{"as_of":"2026-08-17T07:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1b6a836aed7b4ef8e992631fea9adbfbe4fb947a6fa51b587d801c1ceab27133","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T18:10:46.063200Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:34:22.315764Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T18:57:17.149799Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"cited_work":{"arxiv_id":"2501.11587","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.11587","snapshot_observed_at":"2026-07-02T18:57:17.149799Z","title":"Recurrent diffusion for large-scale parameter generation.arXiv preprint arXiv:2501.11587","venue":null,"work_id":"4c7e44ca-6eef-4bd4-b8d7-e59c56b20d0f","year":2025},"citing_paper":{"arxiv_id":"2505.13919","last_updated":"2026-05-04T15:52:50Z","snapshot_observed_at":"2026-08-12T08:29:05.844116Z","submitted_at":"2025-05-20T04:29:14Z","title":"Generative Adaptation of Dynamics to Environmental Shifts via Weight-space Diffusion","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T14:59:37.970053Z"},"links":{"cited_paper":"/paper/2501.11587","citing_paper":"/paper/2505.13919"},"observation_digest":"sha256:0d02fba1e73441f65b6ff5e4943c0b5342fd537406a898a3e49841a12a51ff1a","observation_id":"3b0af484-ee74-4fe7-bfe3-f9204a6da6e0","resolution":{"observed_at":"2026-05-22T15:01:42.508148Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11587","snapshot_observed_at":"2026-08-15T19:34:22.315764Z","title":"Recurrent diffusion for large-scale parameter generation.arXiv preprint arXiv:2501.11587, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16406","last_updated":"2025-06-19T15:38:21Z","snapshot_observed_at":"2026-08-16T04:39:21.535380Z","submitted_at":"2025-06-19T15:38:21Z","title":"Drag-and-Drop LLMs: Zero-Shot Prompt-to-Weights","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T19:34:22.315764Z"},"links":{"cited_paper":"/paper/2501.11587","citing_paper":"/paper/2506.16406"},"observation_digest":"sha256:057886d9f09d688e18b81e65f68fba13f3f1d28a1add92737e5bff4c22b71026","observation_id":"424c1453-6c6f-48aa-9a1f-9bbcb57d07f0","resolution":{"observed_at":"2026-08-15T19:34:22.315764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11587","snapshot_observed_at":"2026-08-03T05:57:12.015687Z","title":"Recurrent diffusion for large-scale parameter generation.arXiv preprint arXiv:2501.11587, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.01083","last_updated":"2026-06-03T11:39:37Z","snapshot_observed_at":"2026-08-11T11:17:53.876108Z","submitted_at":"2026-02-01T08:00:51Z","title":"On the Expressive Power of Permutation-Equivariant Weight-Space Networks","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-03T05:57:12.015687Z"},"links":{"cited_paper":"/paper/2501.11587","citing_paper":"/paper/2602.01083"},"observation_digest":"sha256:e2edc96804de1edfd42188f91f0243cb5fdc3a7e61f689c187bed804f63aea74","observation_id":"7b57b6c1-6433-4c0f-852e-623631f5dcd4","resolution":{"observed_at":"2026-08-03T05:57:12.015687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"cited_work":{"arxiv_id":"2501.11587","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.11587","snapshot_observed_at":"2026-07-02T18:57:17.149799Z","title":"Recurrent diffusion for large-scale parameter generation.arXiv preprint arXiv:2501.11587","venue":null,"work_id":"4c7e44ca-6eef-4bd4-b8d7-e59c56b20d0f","year":2025},"citing_paper":{"arxiv_id":"2605.18474","last_updated":"2026-05-19T08:19:47Z","snapshot_observed_at":"2026-08-15T13:10:15.060389Z","submitted_at":"2026-05-18T14:30:32Z","title":"Prompt2Fingerprint: Plug-and-Play LLM Fingerprinting via Text-to-Weight Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T09:34:59.995475Z"},"links":{"cited_paper":"/paper/2501.11587","citing_paper":"/paper/2605.18474"},"observation_digest":"sha256:33f696b361b41fc7517c24809b7117ea58cddac4d753c58cf10fe47afd52be54","observation_id":"bdc36a1c-0d81-46ca-9386-1913d12c5138","resolution":{"observed_at":"2026-05-20T09:38:10.912046Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"cited_work":{"arxiv_id":"2501.11587","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.11587","snapshot_observed_at":"2026-07-02T18:57:17.149799Z","title":"Recurrent diffusion for large-scale parameter generation.arXiv preprint arXiv:2501.11587","venue":null,"work_id":"4c7e44ca-6eef-4bd4-b8d7-e59c56b20d0f","year":2025},"citing_paper":{"arxiv_id":"2605.20189","last_updated":"2026-03-23T07:18:02Z","snapshot_observed_at":"2026-08-16T16:24:07.331889Z","submitted_at":"2026-03-23T07:18:02Z","title":"SOLAR: A Self-Optimizing Open-Ended Autonomous Agent for Lifelong Learning and Continual Adaptation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-21T11:21:30.867480Z"},"links":{"cited_paper":"/paper/2501.11587","citing_paper":"/paper/2605.20189"},"observation_digest":"sha256:65a982487b2ff75a86b484856d17759ae7a2f42f9e38fbc9cad9c2e012f6945e","observation_id":"36ec3123-263e-43db-b1ff-4723e790f556","resolution":{"observed_at":"2026-05-21T11:24:08.623973Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"cited_work":{"arxiv_id":"2501.11587","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.11587","snapshot_observed_at":"2026-07-02T18:57:17.149799Z","title":"Recurrent diffusion for large-scale parameter generation.arXiv preprint arXiv:2501.11587","venue":null,"work_id":"4c7e44ca-6eef-4bd4-b8d7-e59c56b20d0f","year":2025},"citing_paper":{"arxiv_id":"2606.07217","last_updated":"2026-06-05T12:29:28Z","snapshot_observed_at":"2026-08-13T05:12:46.090907Z","submitted_at":"2026-06-05T12:29:28Z","title":"Robotic Policy Adaptation via Weight-Space Meta-Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-27T21:43:30.625293Z"},"links":{"cited_paper":"/paper/2501.11587","citing_paper":"/paper/2606.07217"},"observation_digest":"sha256:56487e3c4f95b90e4bc9f309f61d5ce6f9ef23281082c77b80510077142d24d0","observation_id":"c84cb6e5-5b97-4772-982d-88600a303b38","resolution":{"observed_at":"2026-07-02T18:57:17.151604Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.11587/citation-record","integrity":"/paper/2501.11587/integrity","json":"/paper/2501.11587/citation-record.json","paper":"/paper/2501.11587"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:45.724585Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.724585Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:6f609d77da7b0f217e118bae6c327355675e0fba6a06dbf12a5d9be8666fbb04","observation_id":"910ecff2-848a-449f-a7f4-ee315f00f595","resolution":{"observed_at":"2026-08-10T18:10:45.724585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04517","last_updated":"2024-12-06T15:42:07Z","snapshot_observed_at":"2026-08-16T13:54:34.627474Z","submitted_at":"2024-05-07T17:50:21Z","title":"xLSTM: Extended Long Short-Term Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04517","snapshot_observed_at":"2026-08-10T18:10:45.731585Z","title":"xlstm: Extended long short-term memory","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.731585Z"},"links":{"cited_paper":"/paper/2405.04517","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:d2894f33bfec479455f4ab6548cbd9480a81b23eb1b6993315bc0c3a0e934130","observation_id":"9170e252-3982-4ec0-984a-642b4b3df8db","resolution":{"observed_at":"2026-08-10T18:10:45.731585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:47.186202Z","title":"Piqa: Reasoning about physical commonsense in natural language","venue":null,"work_id":"94add25f-9688-48ff-a855-0666de103260","year":2020},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.737595Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:051ba1c2427eab7b6186d232a7646186dc99008787228d623f24fe6662aae639","observation_id":"e5377a12-3c40-44d5-9340-a4cdcc8b3431","resolution":{"observed_at":"2026-08-10T18:10:47.190476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:47.172914Z","title":null,"venue":null,"work_id":"17b7ed69-1b8d-41af-81fd-afed996ddb05","year":1991},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.742435Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:bfe644f8b29a891b1bb19c0311ba3398c9743b5171900a7334709038c88d1ffa","observation_id":"b5cd1317-1cfc-45b4-a755-10e50cee4142","resolution":{"observed_at":"2026-08-10T18:10:47.177050Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:47.158270Z","title":"SMASH : One-shot model architecture search through hypernetworks","venue":null,"work_id":"69c9d045-a0d2-4856-8b31-a408a2193a7f","year":2018},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.747420Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:046b93183c8db01be4197550b509830544791d91fb84d11b32e11197b99735e2","observation_id":"da34d80d-2888-4672-a9e7-2e09a3618dfe","resolution":{"observed_at":"2026-08-10T18:10:47.162747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14794","last_updated":"2022-11-19T12:45:21Z","snapshot_observed_at":"2026-08-12T04:58:34.201421Z","submitted_at":"2020-09-30T17:09:09Z","title":"Rethinking Attention with Performers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14794","snapshot_observed_at":"2026-08-10T18:10:45.752348Z","title":"Rethinking attention with performers","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.752348Z"},"links":{"cited_paper":"/paper/2009.14794","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:be23f93e961635ccd73e0b49b10197505ffc27b2857865b2ea9e1d57771713b8","observation_id":"ab4a2800-c363-4c81-9ad4-b2d23858edc3","resolution":{"observed_at":"2026-08-10T18:10:45.752348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:47.145279Z","title":"Diffusion-sdf: Conditional generative modeling of signed distance functions","venue":null,"work_id":"1c88197d-0766-489c-9c74-609969706a64","year":2023},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.757370Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:eeeaf6e25f49d73046281f47538dcb56f7df0f5243e2a43f943fcf78e418613c","observation_id":"ef609800-621b-42e0-a830-78175e52a74c","resolution":{"observed_at":"2026-08-10T18:10:47.149245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-08-14T15:52:43.138964Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-10T18:10:45.762514Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.762514Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:44df6a6280e04dfcf4a355b51e86641e7da4e47fbba0e7379d8194e1b475467d","observation_id":"f78d5cd1-2b1b-45bd-9bb7-221533d6ebba","resolution":{"observed_at":"2026-08-10T18:10:45.762514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-10T18:10:45.767417Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.767417Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:2b99f7b8156db92fdc6abad1a5079aac98eb7ed88510ad8f0e197a453ec71363","observation_id":"d9a963bd-0bb8-4179-8063-41f069bb0a90","resolution":{"observed_at":"2026-08-10T18:10:45.767417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-10T18:10:45.772600Z","title":"and Gu, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.772600Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:9f9121066719a5c27ccc67cc4984464c053fcb9fbe88ba431c52bb349ee37110","observation_id":"13fff50c-0dc2-4440-90b5-7b5e3d94ea91","resolution":{"observed_at":"2026-08-10T18:10:45.772600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:47.132023Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"f6f183f5-e4f3-42a9-9ecf-19271af94472","year":2009},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.777433Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:7fd8fd60b98fa71adec341eb83f6df14c93e65ba40471229514bc36914bc83f0","observation_id":"406ecc7d-be21-43f2-ab17-945806fc9049","resolution":{"observed_at":"2026-08-10T18:10:47.136295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:47.119074Z","title":"and Nichol, A","venue":null,"work_id":"6abdd7f0-4606-439b-bdfd-cdb2d09e76a4","year":2021},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.781949Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:a29bc582bc1ee57802284370201e3f64627d7c98033502ef9610a84e85f067d3","observation_id":"bb1e96aa-59a4-40a0-8139-1d46d4436ff2","resolution":{"observed_at":"2026-08-10T18:10:47.122969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:47.103911Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"a720080d-3c9d-4e0d-9aad-196dee9942f4","year":2021},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.786488Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:61817289c63c42606be37f12483bedefc0578cbf7d6f5f3497348fae533452d0","observation_id":"bdd99b5f-f2ff-4e14-81ed-c135d332646d","resolution":{"observed_at":"2026-08-10T18:10:47.109232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:47.089096Z","title":"Hyperdiffusion: Generating implicit neural fields with weight-space diffusion","venue":null,"work_id":"95105e86-76ac-4051-bed5-b7b0e9710e97","year":2023},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.791258Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:bf7dd950abf014067f677e18fbf92ee1d09f0763f2dd9302b66790793601f548","observation_id":"8cf2dd1f-53fa-4574-9d3e-1eb47fa1347f","resolution":{"observed_at":"2026-08-10T18:10:47.093539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:47.074354Z","title":"Structural pruning for diffusion models","venue":null,"work_id":"2a3ad7cf-6bee-405c-804a-54b85904f549","year":2023},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.796331Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:66d892042996ed3830b48f0ec5ecc9a5e49fdd0c63a1b3dd53b6d8c1ba7aa437","observation_id":"e6169f90-b66c-41a0-9791-b16b775c9b56","resolution":{"observed_at":"2026-08-10T18:10:47.079130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:47.058097Z","title":"and Ghahramani, Z","venue":null,"work_id":"5f0e5606-fa80-413d-a75c-b43d3e6b18b4","year":2016},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.800747Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:0e30f3fdc3b37f33e1de12adb2a4d78de4ec238e15bef69bfaadcac3529ec675","observation_id":"8b5f2f44-3b43-48ae-a37a-6828d627635a","resolution":{"observed_at":"2026-08-10T18:10:47.063210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:47.043485Z","title":"Practical variational inference for neural networks","venue":null,"work_id":"b9a5e355-3d92-43cf-a5f3-e1e6b9450210","year":2011},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.805272Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:a7210de31582edcfe6cbc708b04ca9d7cc2ea08508be6d673ab4ee944e084d4d","observation_id":"fe043628-cf60-46ba-8b4b-e2692786f7ce","resolution":{"observed_at":"2026-08-10T18:10:47.048279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-10T18:10:45.815217Z","title":"and Dao, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.815217Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:0f1e6f8153cd54e5cd866bc670bbe7298720f08a98ce5acbb719267f3211b6b8","observation_id":"cc484008-5574-43a9-a1b4-ec62b77269db","resolution":{"observed_at":"2026-08-10T18:10:45.815217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:47.029420Z","title":"M., and Le, Q","venue":null,"work_id":"a590fafb-d92b-47f2-b1e5-54fa62e51b2b","year":2017},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.819692Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:2a00a21af1c9b11d695862d63edfd21220ace63015cb3ea3f33b7331d490d999","observation_id":"afcdd4b9-05cc-4886-8904-8f4345c4b8aa","resolution":{"observed_at":"2026-08-10T18:10:47.033498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:45.824432Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.824432Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:4d8b9e2fb7055e79ff1d6d9c36ccfe71322bf5d402fcc083685a3d8a16f32b45","observation_id":"95f74525-963e-4b5d-9889-c6a49361b67f","resolution":{"observed_at":"2026-08-10T18:10:45.824432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.888776Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"bdb2e9f4-fed1-4b7e-8863-56b1bf32cef6","year":2020},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.829024Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:4a27cb7a78edce8fac8ed445e8c4f8803647be2e6e25e5e40ca0803938b86bf6","observation_id":"21fbdaba-d18e-49f5-8d4f-1a3ff2755311","resolution":{"observed_at":"2026-08-10T18:10:47.009370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.872871Z","title":"Untersuchungen zu dynamischen neuronalen netzen","venue":null,"work_id":"6857025b-6dcc-4afe-8bee-4bcf209230af","year":1991},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.833616Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:c07af500d9d203cfaaac35c06d3afc59a86d12973bfe909c97878c04ebaed73c","observation_id":"cadf170c-d10f-4b8d-9042-1e14129a1623","resolution":{"observed_at":"2026-08-10T18:10:46.878763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:45.839066Z","title":"Long short-term memory","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.839066Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:c704e19675bf912b28053fc4efa4a3ca19173236448a5a386e94aa53c13f3e79","observation_id":"deb62b1f-ea62-412e-9d1a-3838ab3b82ed","resolution":{"observed_at":"2026-08-10T18:10:45.839066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:45.843575Z","title":"Long short-term memory","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.843575Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:44712b5ce91bc293c50fddb9517d22106778f426b87b60492c439d2774ec18fa","observation_id":"9aa0779d-c055-4e59-9552-0160d912dbb6","resolution":{"observed_at":"2026-08-10T18:10:45.843575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.848733Z","title":"J., yelong shen, Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":"143fc0f3-e4b7-436a-ac41-b522f538b3ca","year":2022},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.849516Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:76875836f14099f52b7133ecad8f0006b62363307797f893267e2e3d71a6c972","observation_id":"edfc0638-72cb-4518-95a6-e19b19c4a597","resolution":{"observed_at":"2026-08-10T18:10:46.853519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01415","last_updated":"2024-08-02T17:43:34Z","snapshot_observed_at":"2026-08-16T13:28:54.063245Z","submitted_at":"2024-08-02T17:43:34Z","title":"Conditional LoRA Parameter Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01415","snapshot_observed_at":"2026-08-10T18:10:45.854009Z","title":"Conditional lora parameter generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.854009Z"},"links":{"cited_paper":"/paper/2408.01415","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:362aaeeb334e63412a5e12f491ecc2da65ec80ba108dcfa060d9f2bfc11ea054","observation_id":"05f43baf-909a-4fc6-b154-060c56607772","resolution":{"observed_at":"2026-08-10T18:10:45.854009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-10T18:10:45.858963Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.858963Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:76411b614298ce6fce52405c7740c8a9e01072790c4fc2c57aed84559a9a615d","observation_id":"853dcbbc-2a56-4a36-8742-e1a601da9ec5","resolution":{"observed_at":"2026-08-10T18:10:45.858963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:45.863673Z","title":"and Hinton, G","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.863673Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:39aadf749375fea17509ed86dbb532b4fc0a4cce2749078046c1483d12d1ceb6","observation_id":"accd3adc-b7df-4450-954b-ae3b007cb9d9","resolution":{"observed_at":"2026-08-10T18:10:45.863673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.824800Z","title":null,"venue":null,"work_id":"dbcd4270-f864-411e-846f-ad88b5b7325c","year":2012},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.868316Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:a984add72b014f6c6e86c0af86caafeefecc67c4bf6f5c6d6740e1e749586a38","observation_id":"ecf8eedd-7943-4f35-89d4-1c4505583dd2","resolution":{"observed_at":"2026-08-10T18:10:46.829449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.809969Z","title":"L., and Tanaka, H","venue":null,"work_id":"4a458d8d-bafc-41ca-a174-4d8c65c5142b","year":2021},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.872921Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:f9173f450c59a55008c8558b8cd9e3900bd785f0788e94de0f108bdabb8fcfae","observation_id":"09047cbb-49cd-48a1-b23d-a91a78ba62cf","resolution":{"observed_at":"2026-08-10T18:10:46.814826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11838","last_updated":"2024-11-01T14:45:36Z","snapshot_observed_at":"2026-08-16T13:42:07.461220Z","submitted_at":"2024-06-17T17:59:58Z","title":"Autoregressive Image Generation without Vector Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11838","snapshot_observed_at":"2026-08-10T18:10:45.877458Z","title":"Autoregressive image generation without vector quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.877458Z"},"links":{"cited_paper":"/paper/2406.11838","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:52329ba77a1b7642278b80ab225c4eab44f9c8d6600b1855995e01f4683ab3d4","observation_id":"01373d3c-d1ab-4ef2-a6a2-9eefc4454a43","resolution":{"observed_at":"2026-08-10T18:10:45.877458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.795031Z","title":"Exploring plain vision transformer backbones for object detection","venue":null,"work_id":"993ac5f6-9d1c-4048-bf7e-4351c012bf5c","year":2022},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.882392Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:ea6edda9e1c6641b13f17f07b7fcb3c3b1b4fc054067dd40960628ff784bf597","observation_id":"4bbff2af-d10e-4992-b0ab-738359d98ef4","resolution":{"observed_at":"2026-08-10T18:10:46.799604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14132","last_updated":"2025-03-26T16:33:17Z","snapshot_observed_at":"2026-08-16T13:50:24.240721Z","submitted_at":"2024-05-23T03:11:18Z","title":"Text-to-Model: Text-Conditioned Neural Network Diffusion for Train-Once-for-All Personalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14132","snapshot_observed_at":"2026-08-10T18:10:45.887100Z","title":"Text-to-model: Text-conditioned neural network diffusion for train-once-for-all personalization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.887100Z"},"links":{"cited_paper":"/paper/2405.14132","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:4e631724576db8f62b8a8373cf989d3a51c9f24483200f73c0a8f57e24ed527c","observation_id":"fe89de76-7c6c-4b6c-a778-71ee2a39bb70","resolution":{"observed_at":"2026-08-10T18:10:45.887100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12521","last_updated":"2024-05-21T06:23:47Z","snapshot_observed_at":"2026-08-16T13:51:06.010664Z","submitted_at":"2024-05-21T06:23:47Z","title":"Unleash Graph Neural Networks from Heavy Tuning","version":1},"cited_work":{"arxiv_id":"2405.12521","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.12521","snapshot_observed_at":"2026-08-10T18:10:46.364859Z","title":"Unleash Graph Neural Networks from Heavy Tuning","venue":"cs.LG","work_id":"2a4caef8-068e-489d-9b42-24dde209fc66","year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.892086Z"},"links":{"cited_paper":"/paper/2405.12521","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:26b442f505f1e1cfe51a80d64f3321e6b868a01d552292a60bb3659d63edf9cf","observation_id":"95bfef16-664f-4703-bff2-a574802dcf6e","resolution":{"observed_at":"2026-08-10T18:10:46.369856Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:45.897631Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.897631Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:8e4899e107b7670df06ca841b8695dc9262171a8fb5a8ff11eae8d88b13fbf8a","observation_id":"96c2f3aa-cce0-43f7-8701-49e858c966e2","resolution":{"observed_at":"2026-08-10T18:10:45.897631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09353","last_updated":"2024-07-09T05:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-14T17:59:34Z","title":"DoRA: Weight-Decomposed Low-Rank Adaptation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09353","snapshot_observed_at":"2026-08-10T18:10:45.902633Z","title":"F., Cheng, K.-T., and Chen, M.-H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.902633Z"},"links":{"cited_paper":"/paper/2402.09353","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:4c1df0a4b47321fd9bff4dc04b78a3f7e8dc65923f01221dbbd4ca0586cb31cb","observation_id":"a1470795-391a-4d1a-8c93-e6185e37ba5c","resolution":{"observed_at":"2026-08-10T18:10:45.902633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.770565Z","title":"Dpm-solver: A fast ode solver for diffusion probabilistic model sampling in around 10 steps","venue":null,"work_id":"c1664410-7bed-43c8-acc6-2fe24044d5b3","year":2022},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.907491Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:d29685f35fe097edbfc433f49dc716209f76dea671a58439b9a4ae35cd49b044","observation_id":"5e85a662-8952-4e51-8011-7a1781c603eb","resolution":{"observed_at":"2026-08-10T18:10:46.775550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.755366Z","title":"Deepcache: Accelerating diffusion models for free","venue":null,"work_id":"d480db38-8c16-42d3-a4e2-fa08e7a08b77","year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.911999Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:282668f0d92150d33e063dab3f224f1e02bd4cc768b836c8074e4a2ca8467f86","observation_id":"f6d5f1e7-ab44-4c42-ad24-49b0d1c7c7db","resolution":{"observed_at":"2026-08-10T18:10:46.760275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.740578Z","title":"Introducing meta llama 3: The most capable openly available llm to date","venue":null,"work_id":"9f3b3a53-50ff-487e-9bbc-4a2ad81b97f4","year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.916511Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:0c1c872998104a2e80e908316c1e2520c326750a5b603986e6b7ca73c6247b63","observation_id":"5784bb63-eccb-44ad-849d-f753b0f18b2a","resolution":{"observed_at":"2026-08-10T18:10:46.745294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:45.921045Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.921045Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:3f3199b6463be475beefd1e947d4fc97b6642e620551a37e8692b52e4b866fd0","observation_id":"dfaf3156-819d-4fd8-bd71-4424a3c62b22","resolution":{"observed_at":"2026-08-10T18:10:45.921045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:45.925549Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.925549Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:413ab9fc11fd14d71c3d0e900da5b2545f0c46daa58e880b2c2c99d64debb307","observation_id":"af4b24a7-288d-4ff3-9cec-08a2c2495909","resolution":{"observed_at":"2026-08-10T18:10:45.925549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.706853Z","title":null,"venue":null,"work_id":"51684673-3106-4392-aee2-19df60e1fe32","year":2021},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.930186Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:d400de0d308a7ccf216d476d1f9a78d2cf2b172e3aedfd22929371f96ac482cc","observation_id":"e897a0b8-4f6a-410b-a3cd-fea6283db231","resolution":{"observed_at":"2026-08-10T18:10:46.711459Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14167","last_updated":"2024-02-21T23:08:54Z","snapshot_observed_at":"2026-08-16T14:16:26.401317Z","submitted_at":"2024-02-21T23:08:54Z","title":"T-Stitch: Accelerating Sampling in Pre-Trained Diffusion Models with Trajectory Stitching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14167","snapshot_observed_at":"2026-08-10T18:10:45.934824Z","title":"T-stitch: Accelerating sampling in pre-trained diffusion models with trajectory stitching","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.934824Z"},"links":{"cited_paper":"/paper/2402.14167","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:7eab61b965b97f6a74e7c465ee4f0a05ada37958c2e76ab53f8de0f77b8f209c","observation_id":"1329a040-d01e-4088-9e34-ae5328a54e8e","resolution":{"observed_at":"2026-08-10T18:10:45.934824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.692015Z","title":"and Xie, S","venue":null,"work_id":"fe97da9f-0ac7-4d6b-b650-8079b0254f2c","year":2023},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.939455Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:a9546fdd21b13694f8bc1ddb2bc557a40fb8951e03cdefdc5f0bdcbd2cbe1268","observation_id":"94c7572b-297f-410a-be7b-a7a06baeb2cd","resolution":{"observed_at":"2026-08-10T18:10:46.696703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.12892","last_updated":"2022-09-26T17:59:58Z","snapshot_observed_at":"2026-08-16T17:50:32.125991Z","submitted_at":"2022-09-26T17:59:58Z","title":"Learning to Learn with Generative Models of Neural Network Checkpoints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.12892","snapshot_observed_at":"2026-08-10T18:10:45.944003Z","title":"A., and Malik, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.944003Z"},"links":{"cited_paper":"/paper/2209.12892","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:ae229df161eda0af425f8a34bb123a761be2156510b954caf6d41011a03d3100","observation_id":"bad3cae8-8696-4790-b04e-d44ddb85c4c1","resolution":{"observed_at":"2026-08-10T18:10:45.944003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13048","last_updated":"2023-12-11T03:58:56Z","snapshot_observed_at":"2026-08-16T20:58:18.860294Z","submitted_at":"2023-05-22T13:57:41Z","title":"RWKV: Reinventing RNNs for the Transformer Era","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13048","snapshot_observed_at":"2026-08-10T18:10:45.949025Z","title":"Rwkv: Reinventing rnns for the transformer era","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.949025Z"},"links":{"cited_paper":"/paper/2305.13048","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:9677d624004a0af8c01960863f6437d44ffa23dfb1baadddcdcf1b607d3c5b98","observation_id":"d38413c0-eb94-4348-941d-9483079473e3","resolution":{"observed_at":"2026-08-10T18:10:45.949025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.677035Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"090235d0-89d3-4e66-8e10-79a41b380411","year":2022},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.953793Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:6d49cde8151d74a3e2fb89edf07072eb9ce42f8f52a01dc9dfda527dbee9b975","observation_id":"5ac39ab0-b7be-44ae-bdf7-e7b231cec383","resolution":{"observed_at":"2026-08-10T18:10:46.681800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09728","last_updated":"2019-09-09T17:29:55Z","snapshot_observed_at":"2026-08-12T21:45:41.485479Z","submitted_at":"2019-04-22T05:36:37Z","title":"SocialIQA: Commonsense Reasoning about Social Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09728","snapshot_observed_at":"2026-08-10T18:10:45.958248Z","title":"Socialiqa: Commonsense reasoning about social interactions","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.958248Z"},"links":{"cited_paper":"/paper/1904.09728","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:dbb3a4db615a048aeddc3ff88506333c44e5bd9822da91e8da2ed8573ace927b","observation_id":"1437dfe3-164b-44a9-9e06-00dedd4ea2d7","resolution":{"observed_at":"2026-08-10T18:10:45.958248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.661169Z","title":"Hyper-representations as generative models: Sampling unseen neural network weights","venue":null,"work_id":"85ec4554-23ea-4b38-aef7-5d9c82f6da19","year":2022},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.964218Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:2faa04d5bb2c15469f2148c2ec2ed121816117ec1d6c3d8c6f9eaca8421b1837","observation_id":"13beb514-5f3a-4ac8-8d67-2d851798ee73","resolution":{"observed_at":"2026-08-10T18:10:46.666286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.10951","last_updated":"2022-07-22T09:01:21Z","snapshot_observed_at":"2026-08-17T02:50:32.727077Z","submitted_at":"2022-07-22T09:01:21Z","title":"Hyper-Representations for Pre-Training and Transfer Learning","version":1},"cited_work":{"arxiv_id":"2207.10951","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.10951","snapshot_observed_at":"2026-08-10T18:10:46.264896Z","title":"Hyper-Representations for Pre-Training and Transfer Learning","venue":"cs.LG","work_id":"02c2d2a9-35e4-4479-8bcc-dd284446ef5a","year":2022},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.968818Z"},"links":{"cited_paper":"/paper/2207.10951","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:a2fbbbd6fcb5dc9323e78d793c5128864e9ff5c504503a77d428a6547f4078c0","observation_id":"db9be8d3-493d-4ef3-bf82-a6f6042c3d7a","resolution":{"observed_at":"2026-08-10T18:10:46.272044Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.646548Z","title":"Model zoos: A dataset of diverse populations of neural network models","venue":null,"work_id":"b92c2660-7626-436d-96d2-f6c8824b34f7","year":2022},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.974744Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:942f105d66067055d9b46449e1b2161eab0dee70a8030c2adaf9bebc6109d5b7","observation_id":"a58b0714-e815-43e1-b798-38f2610583a8","resolution":{"observed_at":"2026-08-10T18:10:46.651309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09997","last_updated":"2024-06-14T13:12:07Z","snapshot_observed_at":"2026-08-16T13:42:58.260251Z","submitted_at":"2024-06-14T13:12:07Z","title":"Towards Scalable and Versatile Weight Space Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09997","snapshot_observed_at":"2026-08-10T18:10:45.979197Z","title":"W., and Borth, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.979197Z"},"links":{"cited_paper":"/paper/2406.09997","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:58312f259c73f32efe9060bac4ea0d93a70c6294a840dec169ad3e0f2bde97fb","observation_id":"c518d80d-8cab-4ab2-a7e2-fad68ae356b1","resolution":{"observed_at":"2026-08-10T18:10:45.979197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.630920Z","title":"Temporal dynamic quantization for diffusion models","venue":null,"work_id":"8da39588-3881-4132-ba0a-c586692fdb85","year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.983920Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:4aa26c557835068eef13a655f82c61f73576f6838b428b877874cfb2f7fbd2ad","observation_id":"282c9a25-926d-49b2-9ed7-f18af09af4d9","resolution":{"observed_at":"2026-08-10T18:10:46.636258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.614941Z","title":"Chaos in random neural networks","venue":null,"work_id":"3ce3f7ea-b8e1-451f-8aea-c072530b8b31","year":1988},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.989361Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:00c8a516e6507f7c4269b60a8f8c79c12d0ac6da5b0ebfa1bc2f535f995172c8","observation_id":"1781370d-abc7-4696-a3d2-6365a7bf0a2f","resolution":{"observed_at":"2026-08-10T18:10:46.619954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-10T18:10:45.993923Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.993923Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:647d9c041e2ddadd80cd6809f7d3ce413c6dad1fdfdc47544baf37c8d72c3313","observation_id":"cbb7ab7f-3b84-40aa-9633-ac38bd7c5789","resolution":{"observed_at":"2026-08-10T18:10:45.993923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01469","last_updated":"2023-05-31T06:17:10Z","snapshot_observed_at":"2026-08-15T07:00:23.337991Z","submitted_at":"2023-03-02T18:30:16Z","title":"Consistency Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01469","snapshot_observed_at":"2026-08-10T18:10:45.998965Z","title":"Consistency models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:45.998965Z"},"links":{"cited_paper":"/paper/2303.01469","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:4a7e7fc43074d3ca63ce59eb7b5425b0ff606fcc80f3b415e61a2c0028ead358","observation_id":"b252014e-fcc2-49a0-8528-c9474a520a71","resolution":{"observed_at":"2026-08-10T18:10:45.998965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18153","last_updated":"2024-10-25T08:47:06Z","snapshot_observed_at":"2026-08-16T14:14:37.398325Z","submitted_at":"2024-02-28T08:34:23Z","title":"Diffusion-Based Neural Network Weights Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18153","snapshot_observed_at":"2026-08-10T18:10:46.004882Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:46.004882Z"},"links":{"cited_paper":"/paper/2402.18153","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:b91e461fc2f1fc6fd9f0c7a156ad630780e3aa0fb79697e9d244c71a2ddec3b4","observation_id":"472e6ae2-257a-4b2f-92c1-d7a22bcfd528","resolution":{"observed_at":"2026-08-10T18:10:46.004882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-10T18:10:46.009672Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:46.009672Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:67389028af14ba9cb07c4aa7bd36bcd54b972a32a2cb532ff97f362608cc2025","observation_id":"613c44cd-9dfb-4508-97b9-42cd1d4cec7f","resolution":{"observed_at":"2026-08-10T18:10:46.009672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.599558Z","title":"Attention is all you need","venue":null,"work_id":"0c02cacd-c1ad-4b01-b068-1f1038cb7ff3","year":2017},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:46.014648Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:08fa7e9523150c38478cfa3a48a9e61902bd1cd14894ba632916817ceea51eca","observation_id":"94f5fb5d-3c3a-423d-aef8-2fd1340cf22d","resolution":{"observed_at":"2026-08-10T18:10:46.604184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13144","last_updated":"2024-12-30T19:13:37Z","snapshot_observed_at":"2026-08-16T14:16:53.774738Z","submitted_at":"2024-02-20T16:59:03Z","title":"Neural Network Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13144","snapshot_observed_at":"2026-08-10T18:10:46.019121Z","title":"Neural network diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:46.019121Z"},"links":{"cited_paper":"/paper/2402.13144","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:b1531601dfb205b3d5f14fd7bf71196e0dec05f06102bf9f1f1d5bce308f280a","observation_id":"4177e8ed-f70d-478b-b3fc-d3786351bf89","resolution":{"observed_at":"2026-08-10T18:10:46.019121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-10T18:10:46.023954Z","title":"Z., Khabsa, M., Fang, H., and Ma, H","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:46.023954Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:4474e425a62fb595fd227619fa9664894df9840df4e180452e0ab73f856bbe62","observation_id":"e18e35fa-b2ed-4acd-93a9-806939bb09fb","resolution":{"observed_at":"2026-08-10T18:10:46.023954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.583910Z","title":"GitHub repository: Pytorch image models","venue":null,"work_id":"b6d75a37-7e93-488f-89fc-1e049c377216","year":2019},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:46.028763Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:7af8857c453591445a32e6ae254ffb8e3b5829356cb5feaf5fa119a3f464c29c","observation_id":"78ef22f7-cbb4-49d6-a20d-60a5789bd0fa","resolution":{"observed_at":"2026-08-10T18:10:46.588836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.567196Z","title":"Unified perceptual parsing for scene understanding","venue":null,"work_id":"66e8b02e-59a3-4312-87b7-6dd93e318772","year":2018},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:46.033280Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:6ebbbb10e7c10f4442643ee388aeb62e2f18c452a07e815901033ba522e849d5","observation_id":"15e9acb8-34e3-40a5-99a3-746805af198e","resolution":{"observed_at":"2026-08-10T18:10:46.573042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-16T18:57:50.930866Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-10T18:10:46.038567Z","title":"Qwen2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:46.038567Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:6b57da71db5a0d3b07a2447c7d345d5c411f49729352930d510ba1033f39ac3c","observation_id":"941cf489-fcec-4438-99eb-26ef31389b11","resolution":{"observed_at":"2026-08-10T18:10:46.038567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.550636Z","title":"Diffusion probabilistic model made slim","venue":null,"work_id":"321a3bfc-9d8c-4706-acd4-5236c2812346","year":2023},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:46.044378Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:4d4821d60bf93403d72bb524d931dbe091ba9cde1f054884aafdef24a52bb8ad","observation_id":"073ad95b-356e-40d3-8e23-48bddd1b7a17","resolution":{"observed_at":"2026-08-10T18:10:46.556324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-15T09:37:44.321271Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-10T18:10:46.048948Z","title":"Hellaswag: Can a machine really finish your sentence? arXiv preprint arXiv:1905.07830, 2019","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:46.048948Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:30d4d96bd823bd7333c56bb155f05a765fc6c6803ed89e39cb1269bf1b2b9d76","observation_id":"1fad7eab-8fca-4042-bb05-9f1eb9cece5e","resolution":{"observed_at":"2026-08-10T18:10:46.048948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11808","last_updated":"2024-10-16T14:18:53Z","snapshot_observed_at":"2026-08-16T14:08:47.320696Z","submitted_at":"2024-03-18T14:05:52Z","title":"Dynamic Tuning Towards Parameter and Inference Efficiency for ViT Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11808","snapshot_observed_at":"2026-08-10T18:10:46.053742Z","title":"Dynamic tuning towards parameter and inference efficiency for vit adaptation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:46.053742Z"},"links":{"cited_paper":"/paper/2403.11808","citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:c77bad69c3a3a2594a1d50674b347174799c56cadfcaa71da16606addc932cad","observation_id":"4bb7ae23-1465-41df-81ad-395359f33edb","resolution":{"observed_at":"2026-08-10T18:10:46.053742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.058548Z","title":"Scene parsing through ade20k dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:46.058548Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:6445cf83ae552ff8869f36efbf29e3986afe42df7a50d9ff811485b99b436821","observation_id":"b45fe60c-ceca-4a42-abb6-4ded6296955d","resolution":{"observed_at":"2026-08-10T18:10:46.058548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T18:10:46.063200Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-10T18:10:46.063200Z"},"links":{"citing_paper":"/paper/2501.11587"},"observation_digest":"sha256:fe8412655916ad48b5a4d5fa11ec724acb154a9d2d56abf31e6f83d7454a714a","observation_id":"22796c9e-239f-425b-8106-b6182cafa201","resolution":{"observed_at":"2026-08-10T18:10:46.063200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.11587","last_updated":"2025-02-11T03:29:30Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T12:14:15.896014Z","submitted_at":"2025-01-20T16:46:26Z","title":"Recurrent Diffusion for Large-Scale Parameter Generation"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":2,"verified_fuzzy":29},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 6 inbound Pith citation observations for arXiv:2501.11587."}