{"as_of":"2026-08-09T17:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:12b928371eae561b2a727a5e35dde4a1966a72ed834ed78d0fee04a251c90a98","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":27,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T14:47:40.399031Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T19:30:07.293501Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-08-09T14:47:40.399031Z","title":"and Newhouse, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01763","last_updated":"2025-02-03T19:08:32Z","snapshot_observed_at":"2026-08-09T14:30:38.276963Z","submitted_at":"2025-02-03T19:08:32Z","title":"On The Concurrence of Layer-wise Preconditioning Methods and Provable Feature Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T14:47:40.399031Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2502.01763"},"observation_digest":"sha256:bd9956dafb2c97e3cb11e73b66c7af8873549b23125d7ba39605e867465223d6","observation_id":"e104b005-4fdb-4942-9cd6-7ff6a9ed5fc9","resolution":{"observed_at":"2026-08-09T14:47:40.399031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2502.07529","last_updated":"2025-06-06T13:42:19Z","snapshot_observed_at":"2026-08-03T03:50:14.086851Z","submitted_at":"2025-02-11T13:10:34Z","title":"Training Deep Learning Models with Norm-Constrained LMOs","version":2},"reference_index":159,"source":"arxiv_source","source_observed_at":"2026-05-21T21:22:36.870292Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2502.07529"},"observation_digest":"sha256:e28e572eeac073b5db150110194d027a2f80df8b0536429c2a77c976b56f537e","observation_id":"a2a3852c-5027-443b-9386-3ce4e941ed6d","resolution":{"observed_at":"2026-05-21T21:22:37.015602Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-08-06T18:35:40.098289Z","title":"Modular duality in deep learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08091","last_updated":"2025-07-10T18:04:52Z","snapshot_observed_at":"2026-08-08T23:54:01.601611Z","submitted_at":"2025-07-10T18:04:52Z","title":"Low-rank Momentum Factorization for Memory Efficient Training","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T18:35:40.098289Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2507.08091"},"observation_digest":"sha256:2f99f05a0b245edf3151993b99359e1ca3567a91d22dce9be3f42b93629c999b","observation_id":"3fe12a6e-83c1-43dd-9681-700cffe0ce6e","resolution":{"observed_at":"2026-08-06T18:35:40.098289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2510.10777","last_updated":"2026-05-16T11:31:52Z","snapshot_observed_at":"2026-07-06T22:32:27.698678Z","submitted_at":"2025-10-12T19:39:41Z","title":"Preconditioned Norms: A Unified Framework for Steepest Descent, Quasi-Newton and Adaptive Methods","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T21:05:49.844436Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2510.10777"},"observation_digest":"sha256:710ed5afae667325bc861cfd37ff79afa1d3158b5a979c24960ab2db7afdf5ca","observation_id":"e00d30f1-c896-45e8-ba9c-a7ccd1f43fe1","resolution":{"observed_at":"2026-05-21T21:10:38.704244Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-08-03T03:56:38.947343Z","title":"and Newhouse, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.06880","last_updated":"2026-05-26T21:42:43Z","snapshot_observed_at":"2026-08-08T13:17:56.363673Z","submitted_at":"2026-02-06T17:06:42Z","title":"Decoupling Variance and Scale-Invariant Updates in Adaptive Gradient Descent for Unified Vector and Matrix Optimization","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-03T03:56:38.947343Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2602.06880"},"observation_digest":"sha256:d758c864cec3a3cb563f2a4069241b1593c3d1f819b39091b0428d92daa1e5d9","observation_id":"930d441e-fe2f-4a3c-987e-6ee6a1291d18","resolution":{"observed_at":"2026-08-03T03:56:38.947343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2603.10067","last_updated":"2026-05-21T20:35:00Z","snapshot_observed_at":"2026-07-06T22:48:35.345421Z","submitted_at":"2026-03-10T02:12:24Z","title":"HTMuon: Improving Muon via Heavy-Tailed Spectral Correction","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-25T06:50:29.893126Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2603.10067"},"observation_digest":"sha256:81cf76863a1f7e44ed97f7be110d5e049fe7b847686ab1f484a446666dbe454c","observation_id":"f9c45aab-3c14-4310-8aea-872a5b89da6f","resolution":{"observed_at":"2026-05-25T06:55:26.275684Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-13T17:23:44.758186Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.26661","last_updated":"2026-07-01T17:46:52Z","snapshot_observed_at":"2026-07-13T17:23:44.301154Z","submitted_at":"2026-03-27T17:58:05Z","title":"GaussianGPT: Towards Autoregressive 3D Gaussian Scene Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T17:23:44.758186Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2603.26661"},"observation_digest":"sha256:94a7c54c3f0e589e2707a86b2512644081ceb1fb93d357e926c80e006f49ce49","observation_id":"c0116fc5-4d2e-4979-9593-d089c92fb0c3","resolution":{"observed_at":"2026-07-13T17:23:44.758186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2604.17423","last_updated":"2026-05-01T14:46:49Z","snapshot_observed_at":"2026-08-02T20:20:49.115675Z","submitted_at":"2026-04-19T13:07:51Z","title":"A unified convergence theory for adaptive first-order methods in the nonconvex case, including AdaNorm, full and diagonal AdaGrad, Shampoo and Muo","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T07:19:59.335184Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2604.17423"},"observation_digest":"sha256:0302c9eba5ec61365e3f16918203bcf1719299e5f3966887203f6ed986622d01","observation_id":"db426e5b-2fb2-4d34-bd53-a983ca87e1ae","resolution":{"observed_at":"2026-05-10T07:26:59.843993Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2605.06316","last_updated":"2026-05-07T14:16:16Z","snapshot_observed_at":"2026-08-03T22:01:24.808214Z","submitted_at":"2026-05-07T14:16:16Z","title":"Pro-KLShampoo: Projected KL-Shampoo with Whitening Recovered by Orthogonalization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T13:06:05.234216Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2605.06316"},"observation_digest":"sha256:c9a12bfa0951800b806928bb79314e76c4bb7febcd7607a001d8ce576675b14d","observation_id":"2d37797a-e03f-4428-9578-ca93e927fb41","resolution":{"observed_at":"2026-05-11T19:01:13.028343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2605.07815","last_updated":"2026-05-08T14:47:56Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:47:56Z","title":"OrScale: Orthogonalised Optimization with Layer-Wise Trust-Ratio Scaling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T02:47:08.766380Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2605.07815"},"observation_digest":"sha256:eac8b4addb9bded60a144ea02178ae716584217468d067c79e2a276c3bea5c8f","observation_id":"05939d19-8bed-4420-aa10-1108901a159c","resolution":{"observed_at":"2026-05-11T03:05:55.574343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2605.08949","last_updated":"2026-05-14T22:50:46Z","snapshot_observed_at":"2026-07-06T23:21:06.773761Z","submitted_at":"2026-05-09T13:42:08Z","title":"Muon-OGD: Muon-based Spectral Orthogonal Gradient Projection for LLM Continual Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-12T02:12:25.713592Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2605.08949"},"observation_digest":"sha256:814d4458fa11a25a6f709de76c1f5951932fc103ac003a21feb6f579354ec575","observation_id":"5032579b-e852-48fe-b4d2-32b3f299236a","resolution":{"observed_at":"2026-05-12T02:16:16.351281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2605.08949","last_updated":"2026-05-14T22:50:46Z","snapshot_observed_at":"2026-07-06T23:21:06.773761Z","submitted_at":"2026-05-09T13:42:08Z","title":"Muon-OGD: Muon-based Spectral Orthogonal Gradient Projection for LLM Continual Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-19T15:11:43.827012Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2605.08949"},"observation_digest":"sha256:5d79f5c6361c1acd285879d466c38b85412f1ed94bd3edcc62ac7dd86d91346f","observation_id":"cea3ec6e-975a-4a7d-9a9f-0cd67e452abc","resolution":{"observed_at":"2026-05-19T15:12:37.509271Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2605.08980","last_updated":"2026-05-09T14:47:59Z","snapshot_observed_at":"2026-08-02T05:42:35.044950Z","submitted_at":"2026-05-09T14:47:59Z","title":"Muon Does Not Converge on Convex Lipschitz Functions","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-12T02:22:01.364777Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2605.08980"},"observation_digest":"sha256:a13642fbd1aefd7cc99c8d635db26b16bff87aedeb80708306ce3ccde9628361","observation_id":"0c75b1d6-b680-493e-a7c3-8db89b406a4d","resolution":{"observed_at":"2026-05-12T07:41:39.538565Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2605.09238","last_updated":"2026-05-10T00:39:13Z","snapshot_observed_at":"2026-08-02T15:17:04.657553Z","submitted_at":"2026-05-10T00:39:13Z","title":"Intrinsic Muon: Spectral Optimization on Riemannian Matrix Manifolds","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T05:07:39.558349Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2605.09238"},"observation_digest":"sha256:e859b7d818896ae83410f42b48017bf6059aac8e1c17337298cb28ce85f23784","observation_id":"f0a92b1b-bc02-4461-a8d5-d8205ee71d44","resolution":{"observed_at":"2026-05-12T05:36:26.332930Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2605.12492","last_updated":"2026-05-12T17:59:34Z","snapshot_observed_at":"2026-07-31T18:31:37.222688Z","submitted_at":"2026-05-12T17:59:34Z","title":"Pion: A Spectrum-Preserving Optimizer via Orthogonal Equivalence Transformation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T04:53:52.898843Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2605.12492"},"observation_digest":"sha256:b81418b644f1e87eb07ef9bec03fdf52f1541115f40692a8f9ef9981b567c922","observation_id":"22b56f48-9114-4ecb-82bc-b4684cbbd276","resolution":{"observed_at":"2026-05-13T04:57:17.587986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2605.14200","last_updated":"2026-05-13T23:32:00Z","snapshot_observed_at":"2026-07-06T23:25:39.415637Z","submitted_at":"2026-05-13T23:32:00Z","title":"How to Scale Mixture-of-Experts: From muP to the Maximally Scale-Stable Parameterization","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-15T04:45:20.091598Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2605.14200"},"observation_digest":"sha256:a88e95ffeee54156a5832d152e7f6298ca3aeafb8fdd16e2d9fc5b1e194528ae","observation_id":"6af8c644-af95-4eac-be6f-c0dd6148f0e0","resolution":{"observed_at":"2026-05-15T04:49:44.879652Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2605.16341","last_updated":"2026-05-07T23:37:37Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-07T23:37:37Z","title":"Orth-Dion: Eliminating Geometric Mismatch in Distributed Low-Rank Spectral Optimization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-20T22:23:04.489609Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2605.16341"},"observation_digest":"sha256:10855a6e8b741c55e265df33732c51feef80c7dd436e2e11d8dea0ce234eafc1","observation_id":"1f35a431-1ba4-40b5-bb84-723b7c000f67","resolution":{"observed_at":"2026-05-20T22:23:47.614326Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2606.01787","last_updated":"2026-06-01T07:08:32Z","snapshot_observed_at":"2026-08-02T19:16:44.439836Z","submitted_at":"2026-06-01T07:08:32Z","title":"Stochastic convergence of parallel asynchronous adaptive first-order methods","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T14:27:48.433313Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2606.01787"},"observation_digest":"sha256:0bb9ff2d92bea9654a03c7f785c5f2a6ea0a4685938049b3028f3f220fc5c803","observation_id":"d94318c5-ba2a-41b8-84c9-77de146f909a","resolution":{"observed_at":"2026-07-01T23:16:24.970235Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2606.04662","last_updated":"2026-06-03T09:40:30Z","snapshot_observed_at":"2026-07-06T23:44:42.700120Z","submitted_at":"2026-06-03T09:40:30Z","title":"Why Muon Outperforms Adam: A Curvature Perspective","version":1},"reference_index":125,"source":"arxiv_source","source_observed_at":"2026-06-28T07:04:21.012269Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2606.04662"},"observation_digest":"sha256:e89dde85b2f6b594ec63ce11810a3771cc5dc2c0231d57a6a9f818a4f47fdcfa","observation_id":"74080cf3-bf21-4c9d-98ac-f0a235cdc9ee","resolution":{"observed_at":"2026-07-02T07:06:44.919762Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2606.25342","last_updated":"2026-06-24T03:14:20Z","snapshot_observed_at":"2026-07-06T23:59:47.542695Z","submitted_at":"2026-06-24T03:14:20Z","title":"Lifelong In-Context Learning with Transformers Requires Parametric Forms of Attention","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-25T21:19:30.138022Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2606.25342"},"observation_digest":"sha256:a582168ad21cd22bc851df2627c4660173216e56e03bc7ba6c5aa192dffc839a","observation_id":"e51a6a11-9b07-4631-9ac8-f32a7f4c1236","resolution":{"observed_at":"2026-07-04T19:30:07.295201Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2606.29176","last_updated":"2026-06-28T03:44:59Z","snapshot_observed_at":"2026-08-06T07:39:35.931864Z","submitted_at":"2026-06-28T03:44:59Z","title":"Dead-Direction Conditioners: Gauge-Equivariant Preconditioning for Deep Networks","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-30T07:58:57.890346Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2606.29176"},"observation_digest":"sha256:b89d483251bf84b88cbc4c557432eec6d1f684ea9d0f8026d9d8c7e481d40c95","observation_id":"c0f5a01f-11f3-4852-b61f-a9c78ecb7727","resolution":{"observed_at":"2026-06-30T08:04:28.174134Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":"2410.21265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-04T19:30:07.293501Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265","venue":null,"work_id":"69974f70-20f2-4705-a359-53fe8093a2f3","year":2024},"citing_paper":{"arxiv_id":"2607.01455","last_updated":"2026-07-15T02:52:22Z","snapshot_observed_at":"2026-08-06T17:57:36.341425Z","submitted_at":"2026-07-01T20:21:03Z","title":"Token Geometry","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-03T21:08:26.712950Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2607.01455"},"observation_digest":"sha256:081edc1c4e3ecf4b236472b459c9a5fe11b85d335ca21437b82349804a14c5f2","observation_id":"8566f835-0bb8-4445-bcd8-5b67c161c980","resolution":{"observed_at":"2026-07-03T21:08:57.423707Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-07-12T08:48:22.161005Z","title":"Modular duality in deep learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.01455","last_updated":"2026-07-15T02:52:22Z","snapshot_observed_at":"2026-08-06T17:57:36.341425Z","submitted_at":"2026-07-01T20:21:03Z","title":"Token Geometry","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T08:48:22.161005Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2607.01455"},"observation_digest":"sha256:ffdb052868a4d59027147d6e2790e61dcfd6ee135a44917b95a119d8aa329577","observation_id":"9730bbcb-219e-4d03-bd52-e9e427275bec","resolution":{"observed_at":"2026-07-12T08:48:22.161005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-08-02T05:49:24.942195Z","title":"arXiv preprint arXiv:2410.21265 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13246","last_updated":"2026-08-01T19:18:42Z","snapshot_observed_at":"2026-08-07T16:33:22.195520Z","submitted_at":"2026-07-14T20:21:38Z","title":"Reassessing Muon for Matrix Factorization","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-02T05:49:24.942195Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2607.13246"},"observation_digest":"sha256:e9c98b3d03a48f1b0a541dc86012c86e848b71ab3e616ea60b30e741361ccdb3","observation_id":"130d9530-7a86-475b-8cf2-b4a381aa0fd3","resolution":{"observed_at":"2026-08-02T05:49:24.942195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-08-04T04:23:00.756777Z","title":"arXiv preprint arXiv:2410.21265 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13246","last_updated":"2026-08-01T19:18:42Z","snapshot_observed_at":"2026-08-07T16:33:22.195520Z","submitted_at":"2026-07-14T20:21:38Z","title":"Reassessing Muon for Matrix Factorization","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-04T04:23:00.756777Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2607.13246"},"observation_digest":"sha256:f3458ff74ca4db30184be4ebc0a7eb6e7772f0eb39786ef786863416573c7436","observation_id":"3773977a-28d1-4cee-b341-83bd46971ade","resolution":{"observed_at":"2026-08-04T04:23:00.756777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-08-02T06:45:13.333343Z","title":"Modular duality in deep learning.arXiv preprint arXiv:2410.21265, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20548","last_updated":"2026-07-13T21:47:08Z","snapshot_observed_at":"2026-08-06T06:09:03.498548Z","submitted_at":"2026-07-13T21:47:08Z","title":"SOAP, Muon, and Beyond: Pushing LLM Pretraining Scales","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T06:45:13.333343Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2607.20548"},"observation_digest":"sha256:3313b77da612757c30e315b2cf8c52e9edb0dcf9ec56abd65b4997671d8e159b","observation_id":"9344d4b5-482f-4669-bde0-23ea357f164f","resolution":{"observed_at":"2026-08-02T06:45:13.333343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21265","snapshot_observed_at":"2026-08-05T05:27:17.610179Z","title":"Modular duality in deep learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03941","last_updated":"2026-08-04T17:10:47Z","snapshot_observed_at":"2026-08-09T03:11:52.905541Z","submitted_at":"2026-08-04T17:10:47Z","title":"Muon Meets Mamba: Spectral Optimization for State Space Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T05:27:17.610179Z"},"links":{"cited_paper":"/paper/2410.21265","citing_paper":"/paper/2608.03941"},"observation_digest":"sha256:9a94d7a26bf5a0bd7e3f8ecb7410dde373bfaaccff532c906bfd4f76461ed07b","observation_id":"6e03d072-2279-4b47-86ce-f4814c5d1017","resolution":{"observed_at":"2026-08-05T05:27:17.610179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.21265/citation-record","integrity":"/paper/2410.21265/integrity","json":"/paper/2410.21265/citation-record.json","paper":"/paper/2410.21265"},"outbound":[],"paper":{"arxiv_id":"2410.21265","last_updated":"2024-12-06T17:02:28Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T03:37:14.378232Z","submitted_at":"2024-10-28T17:57:31Z","title":"Modular Duality in Deep Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 27 inbound Pith citation observations for arXiv:2410.21265."}