{"as_of":"2026-08-11T01:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2e2574c81baea7e2dfdb249db21003f9f76751dee422594deb50a1bc3a7ff571","coverage":[{"denominator":97,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":97,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T17:16:43.832714Z","state":"measured"},{"denominator":97,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":97,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.12381/citation-record","integrity":"/paper/2501.12381/integrity","json":"/paper/2501.12381/citation-record.json","paper":"/paper/2501.12381"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.403227Z","title":"Xcit: Cross-covariance image transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.403227Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:6071bca226ce269404e74a45e03f677960a742a91a60820ccec153a215a5d7a7","observation_id":"b088bae9-501c-48de-ad41-731e975c2933","resolution":{"observed_at":"2026-08-10T17:16:43.403227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04303","last_updated":"2025-02-20T23:20:40Z","snapshot_observed_at":"2026-08-09T18:25:27.318125Z","submitted_at":"2024-06-06T17:49:21Z","title":"Vision-LSTM: xLSTM as Generic Vision Backbone","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04303","snapshot_observed_at":"2026-08-10T17:16:43.408751Z","title":"Vision-lstm: xlstm as generic vision backbone","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.408751Z"},"links":{"cited_paper":"/paper/2406.04303","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:8a74f0829e2cd0dfb174b09debcd0302b2e10afbb68995a25048d76c76047300","observation_id":"e1570967-0bba-43d0-a4c0-d86618a9f826","resolution":{"observed_at":"2026-08-10T17:16:43.408751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-10T17:16:43.413757Z","title":"Layer normalization","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.413757Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:7cc79a7ca4f0f6d398e9f212b0c029dcee07402cbeb3155184a34e811ac9c191","observation_id":"776eae95-1168-4f45-afd7-77c3422e2e57","resolution":{"observed_at":"2026-08-10T17:16:43.413757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.11538","last_updated":"2020-11-23T16:50:18Z","snapshot_observed_at":"2026-07-06T10:17:03.632937Z","submitted_at":"2020-11-23T16:50:18Z","title":"Exploring Alternatives to Softmax Function","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.11538","snapshot_observed_at":"2026-08-10T17:16:43.418691Z","title":"Exploring alternatives to softmax function","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.418691Z"},"links":{"cited_paper":"/paper/2011.11538","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:d973165eade5eb4c8d79b1df79e7c931f36febca7283ac1f95df74a8d3c1929a","observation_id":"003e71e0-1baf-45fc-a99a-b74b7dbbe399","resolution":{"observed_at":"2026-08-10T17:16:43.418691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.423751Z","title":"All are worth words: A vit backbone for diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.423751Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:4503248fa2d48c30a0ca3e40ec778fa188f389619b275e99488f0c839f869b4f","observation_id":"408e7868-ae4f-4727-bf5c-f77e009ba776","resolution":{"observed_at":"2026-08-10T17:16:43.423751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.428664Z","title":"Multidiffusion: Fusing diffusion paths for controlled image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.428664Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:09d416ad405cb0d798325af9df69375649e0ccf74091a00ba933d65265736698","observation_id":"a8b3df54-5a3b-4bab-aa43-3fcfda7a1bd9","resolution":{"observed_at":"2026-08-10T17:16:43.428664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06635","last_updated":"2023-06-11T09:41:37Z","snapshot_observed_at":"2026-08-04T01:23:23.304778Z","submitted_at":"2023-06-11T09:41:37Z","title":"2-D SSM: A General Spatial Layer for Visual Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06635","snapshot_observed_at":"2026-08-10T17:16:43.433466Z","title":"2-d ssm: A general spatial layer for visual transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.433466Z"},"links":{"cited_paper":"/paper/2306.06635","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:bcabbdbcad5934167c700ae5e03fe372a4758ab5c299a8311f2b39f3d29c77ec","observation_id":"7447f20c-3482-4111-afa5-2274fd86a205","resolution":{"observed_at":"2026-08-10T17:16:43.433466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-10T17:16:43.438354Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.438354Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:4ee863b409ac2735fc1649d09a3d083d92fdf0c9e8ba654c1844257df43fa10c","observation_id":"c012fced-07fa-471a-98a4-90b841c7b220","resolution":{"observed_at":"2026-08-10T17:16:43.438354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.443330Z","title":"Scene labeling with lstm recurrent neural net- works","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.443330Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:0a7d58684fb21f847f16f0f0f3d88fcd445dcf48f97f04145f6802fa00e26322","observation_id":"eb6d1e13-20bd-4f41-812b-24ad45aa3a74","resolution":{"observed_at":"2026-08-10T17:16:43.443330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.447658Z","title":"End-to- end object detection with transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.447658Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:725e1d07775c2bd067512ada69150210bec27056d68d76474c7417297d112612","observation_id":"00c13f63-93ad-48cc-ba8c-cd33fe934e7a","resolution":{"observed_at":"2026-08-10T17:16:43.447658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.451575Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.451575Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:a434765bc1c0ae9231ecaddd1b77e0c86719e143563077a6e6a8e3a728e41bb3","observation_id":"22374cd1-60bc-41eb-956a-fb4751a3b3cd","resolution":{"observed_at":"2026-08-10T17:16:43.451575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-10T17:16:43.455464Z","title":"Pixart- \\α: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.455464Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:eb4e5356fd7187c12e9198d5bcfa5ffc65ce47dd56e1c86f13bc0ef4df956f46","observation_id":"82a61733-453b-4ade-9fb7-5b57c9f07cc5","resolution":{"observed_at":"2026-08-10T17:16:43.455464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-09T19:46:04.857927Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-10T17:16:43.459853Z","title":"Generating long sequences with sparse transformers","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.459853Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:fbfa0fce1237e365f60b604208aa0da656ee1b400afe087b8deccd0b9d722373","observation_id":"1bbc7e8a-0bed-4768-84cc-aff03844afd6","resolution":{"observed_at":"2026-08-10T17:16:43.459853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.464431Z","title":"Xception: Deep learning with depthwise separable convolutions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.464431Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:d4af9e6d3b5940c1f49996208f22c713f6521235ece7de48b559deebf3dcfbb3","observation_id":"adf7c6f3-bc96-4b04-99d1-b61d23a7ffe4","resolution":{"observed_at":"2026-08-10T17:16:43.464431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.469583Z","title":"Rethink- ing attention with performers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.469583Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:5a78ac3d804cce83371c08af95a8714954d783a6eedd58ec738c86a2eeaf593c","observation_id":"52c73da9-743c-4495-958e-61ed6d0d6af8","resolution":{"observed_at":"2026-08-10T17:16:43.469583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.473649Z","title":"Twins: Re- visiting the design of spatial attention in vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.473649Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:4a62a665ce9479d00fa0eb1d6fd1eafd01f327dd750a3b9911ebe92b5e8c07a9","observation_id":"09ed2203-1ad2-4df2-a4ad-64bb4e303916","resolution":{"observed_at":"2026-08-10T17:16:43.473649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.477557Z","title":"Empirical evaluation of gated recurrent neural networks on sequence modeling","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.477557Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:f26ee85c4ea9ea4665e2b8e9eaf02309264c5ae70f3bd18783a89b78089077aa","observation_id":"c8128895-ac38-44ea-9c69-b68d82b3c7d5","resolution":{"observed_at":"2026-08-10T17:16:43.477557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.481812Z","title":"Coatnet: Marrying convolution and attention for all data sizes","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.481812Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:20b473f65ca94ac37339499b566de4fc37317c99deabe6641f1bd0f1712062f1","observation_id":"9e0b21af-c068-4e7d-bc14-560e4825043c","resolution":{"observed_at":"2026-08-10T17:16:43.481812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.485884Z","title":"Transformers are ssms: Generalized models and efficient algorithms through structured state space duality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.485884Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:98b437aad71f253bb9455ab34a721b7e86247291de6fd711813a4ecb82a55a24","observation_id":"eb4ef015-4b5e-49dd-afe9-4d903d838fea","resolution":{"observed_at":"2026-08-10T17:16:43.485884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.489879Z","title":"Vision transformers need registers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.489879Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:a0fd8ec2a259733fd13c942f0f856203e30223fca24fa2cdfe743726bc5b0507","observation_id":"e45473d1-9acd-4b8a-a207-77b80c17a11d","resolution":{"observed_at":"2026-08-10T17:16:43.489879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.494067Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.494067Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:79900792c6d4b85a9903af08f48e8ff12e84204b40a42e12f96655cf532c2798","observation_id":"8e154304-9ae5-4629-9027-442f5c93740d","resolution":{"observed_at":"2026-08-10T17:16:43.494067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.497856Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.497856Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:b2a052cf33e9868bcd1b5a9f7213230e3d219282c4d37d5e91775949a87ffa99","observation_id":"90b6dfb7-a641-4811-b63b-6a938ce1f84d","resolution":{"observed_at":"2026-08-10T17:16:43.497856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.501649Z","title":"Cswin transformer: A general vision transformer backbone with cross-shaped windows","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.501649Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:03fefaaa24699815ce67d890eb7fffe17e1a3f8da03218b45f67f7b10e4a28a2","observation_id":"80bc5911-ed16-4db0-8262-1668ef7c77c4","resolution":{"observed_at":"2026-08-10T17:16:43.501649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.505531Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.505531Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:3571f1bb5d30ea4e4c235ba468efff3308e2463013be2e7afa608e71b46448a2","observation_id":"4cd70c49-a69e-44bb-9fca-9a3969042e80","resolution":{"observed_at":"2026-08-10T17:16:43.505531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:45.082025Z","title":"Demofusion: Democratising high- resolution image generation with no $$$","venue":null,"work_id":"a9099e7e-dc94-423b-ba3f-06502639f3cc","year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.509548Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:99652c19c5e516bfe33cfcbf9016a1a250b1afdfdf60e17ad03b659a5d53cdeb","observation_id":"45557290-3a38-4231-a320-7890c81c7596","resolution":{"observed_at":"2026-08-10T17:16:45.086324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02308","last_updated":"2025-03-31T06:14:48Z","snapshot_observed_at":"2026-08-10T09:03:08.430176Z","submitted_at":"2024-03-04T18:46:20Z","title":"Vision-RWKV: Efficient and Scalable Visual Perception with RWKV-Like Architectures","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02308","snapshot_observed_at":"2026-08-10T17:16:43.513780Z","title":"Vision-rwkv: Efficient and scalable visual per- ception with rwkv-like architectures","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.513780Z"},"links":{"cited_paper":"/paper/2403.02308","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:1bd929c08e573d1b651ba8e1bb2ec58ea1ec1d358c49a5a524180a8cef637149","observation_id":"6b21cd99-d6c2-4932-8126-7e606c217929","resolution":{"observed_at":"2026-08-10T17:16:43.513780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:45.067183Z","title":"Sigmoid- weighted linear units for neural network function approxi- mation in reinforcement learning","venue":null,"work_id":"6a8903a3-a498-4f26-9557-858178a2ffab","year":2018},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.517987Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:61126b7c62125b98b8b2eef5f99971bf20a26386753d3ceb970e8d798042c590","observation_id":"cf8f735f-8c61-490a-8a96-abc4a2b9f67d","resolution":{"observed_at":"2026-08-10T17:16:45.071672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:45.049349Z","title":"Hungry hungry hippos: Towards language modeling with state space models","venue":null,"work_id":"dfedbe3a-cc09-4383-ab0f-23f2883b26b8","year":2023},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.521776Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:dcf68a783db19bbbb04a331b7ac467ab6e1e41b57a431579e413ec9d44108284","observation_id":"ce65f3c7-211a-4d8b-871e-c168f3cd0389","resolution":{"observed_at":"2026-08-10T17:16:45.058637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:45.028570Z","title":"Levit: a vision transformer in convnet’s clothing for faster inference","venue":null,"work_id":"8dcf7c1b-911a-4f54-8167-3853332e4e8b","year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.525657Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:e414f310ab1ae7070a47bd6a9b95c79aa15b67b1d27307d96ddb5bc67ed79505","observation_id":"a5745010-9f0a-45c8-a38d-7dfdbd6cecb6","resolution":{"observed_at":"2026-08-10T17:16:45.037918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:45.012045Z","title":"Multi-dimensional recurrent neural networks","venue":null,"work_id":"8634acf8-a949-435e-93ec-fb23d25d0ea0","year":2007},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.530052Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:ae6bcba4223e3ee86bf896d9454a2f86dd116117357fdcbec0c169a2be6452ea","observation_id":"13c7257c-0f23-4cf1-b3db-b21d5fe2de72","resolution":{"observed_at":"2026-08-10T17:16:45.018461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-10T17:16:43.534164Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.534164Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:ed1c0a85143b9620e630486b7a4c25a5b20dded03e6e2179f351df2ffadd625b","observation_id":"e06d9a61-92eb-4acd-a2bf-a428cf0a8449","resolution":{"observed_at":"2026-08-10T17:16:43.534164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.996358Z","title":"Elasticdiffusion: Training-free arbitrary size image generation through global-local content separation","venue":null,"work_id":"d3d27d84-83e7-4481-829a-59e0df374c36","year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.538256Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:223f914da8066262ebb0b1d39b1c2b9399484aed007bb4383a14ceec0ab9588b","observation_id":"77c37199-f950-4322-8a63-63f30cec4221","resolution":{"observed_at":"2026-08-10T17:16:45.001859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.982751Z","title":"Flatten transformer: Vision transformer using focused linear attention","venue":null,"work_id":"0123a26f-0095-405c-a9ed-729f1930fd22","year":2023},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.542548Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:90c74d202ca3bdcddf88e2f1ba385a2c1c62018d55995135be5d8a62ad25af87","observation_id":"5a13a5c6-a7d9-4146-a3b0-259be74ab62c","resolution":{"observed_at":"2026-08-10T17:16:44.988311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08083","last_updated":"2025-03-25T17:54:37Z","snapshot_observed_at":"2026-08-06T23:38:21.068023Z","submitted_at":"2024-07-10T23:02:45Z","title":"MambaVision: A Hybrid Mamba-Transformer Vision Backbone","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08083","snapshot_observed_at":"2026-08-10T17:16:43.546949Z","title":"Mambavision: A hybrid mamba-transformer vision backbone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.546949Z"},"links":{"cited_paper":"/paper/2407.08083","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:0db2199fbd08fd4c3c22ecc25e009a91a46ac734f285f0c11e2597358888634d","observation_id":"87326f92-72b2-4b8f-98f2-1c92fae584fb","resolution":{"observed_at":"2026-08-10T17:16:43.546949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.970873Z","title":"Zhang, Shaoqing Ren, and Jian Sun","venue":null,"work_id":"9a45118e-d60f-499d-b628-f1d87ec1f9d0","year":2016},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.550995Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:85d833e6af80e3106a0dc3da2d620cca6c7a3eab2a8dda2737a616216c798119","observation_id":"7a08da87-4605-4f38-9290-ab41cb5ee82d","resolution":{"observed_at":"2026-08-10T17:16:44.974962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.958820Z","title":"Scalecrafter: Tuning-free higher- resolution visual generation with diffusion models","venue":null,"work_id":"1f68d34f-3d0d-41a3-ab9c-a41bae275b3d","year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.555280Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:666916ec263c5f9a6b7a311114e29169b100acad4bdb1ee8762618f6637cc484","observation_id":"6b8af26e-922c-448c-ac67-f5886ebfe364","resolution":{"observed_at":"2026-08-10T17:16:44.963198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-10T17:16:43.560687Z","title":"Gaussian error linear units (gelus)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.560687Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:c66f0a55f193191db097e9b122fe00e61a9312498de70fe3a4b16a2231fe5411","observation_id":"79777a7c-1fdc-4dab-91c8-aa9f078f638b","resolution":{"observed_at":"2026-08-10T17:16:43.560687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.947227Z","title":"Tenenbaum, Kfir Aberman, Y","venue":null,"work_id":"3a277388-c66e-48b2-bb31-c5f48ef4a560","year":2022},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.565041Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:66b409ebbbf5631ed0627965b5739576a4c03da375b000ec016b9d339344fb72","observation_id":"897ef724-3483-4322-89cf-255dcad4be4a","resolution":{"observed_at":"2026-08-10T17:16:44.951301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.935420Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"50b4fcd4-b815-4a6d-a618-3b9d6efe9f4d","year":2017},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.569850Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:46f6e9e6ccd5a281c54b061106fd524a58c8d34e2ce19b019113e8d7966baa94","observation_id":"0974efd4-ca55-4341-b997-8ade7ab0012f","resolution":{"observed_at":"2026-08-10T17:16:44.939851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.923597Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":"0bc8497a-b2b6-4f39-ad38-e5b150b34952","year":2022},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.573893Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:7dea94a3865a76f10d43328ae946c367bbaaac545c1d9a567a598c8fc2a28809","observation_id":"09ed3a0e-126a-427a-bbad-e79c63106236","resolution":{"observed_at":"2026-08-10T17:16:44.927898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.12180","last_updated":"2019-12-20T13:27:27Z","snapshot_observed_at":"2026-08-06T23:06:09.224235Z","submitted_at":"2019-12-20T13:27:27Z","title":"Axial Attention in Multidimensional Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.12180","snapshot_observed_at":"2026-08-10T17:16:43.577661Z","title":"Axial attention in multidimensional transformers","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.577661Z"},"links":{"cited_paper":"/paper/1912.12180","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:63cb806f2cf2556ed5783443fcd30635fc4861da9f681f746034ebbe85502101","observation_id":"d6284e6d-6289-4c6d-ae0f-568c9c9b5079","resolution":{"observed_at":"2026-08-10T17:16:43.577661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.911545Z","title":"Untersuchungen zu dynamischen neu- ronalen netzen","venue":null,"work_id":"c94f405a-6afd-41b8-bee8-65d0aece30f5","year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.582822Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:e88a1ac61e03026af79c5fe55af8bd14b4aab37cc30ab714a0b3fc562d90d1bf","observation_id":"c20fd6d6-d65c-413b-a793-1216c3018a81","resolution":{"observed_at":"2026-08-10T17:16:44.916234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.899006Z","title":"Long short-term memory","venue":null,"work_id":"ecbb72b7-ec19-4459-9d69-23f66878c9aa","year":1997},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.587750Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:5a0f4a7de57269c781e13bd5c935bb974c9c6e326bd066a891d7ced2ee44e8b7","observation_id":"6ad41833-80aa-45cd-95f9-35490315aeb8","resolution":{"observed_at":"2026-08-10T17:16:44.903300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.887122Z","title":"Trans- former quality in linear time","venue":null,"work_id":"341da9c7-7f84-41e2-9b1c-13e45785ff94","year":2022},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.591897Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:79c62c23562c9b70df18c3504c71e49b537c2de25f574c264068cbf8caa4c961","observation_id":"5663af35-946c-4388-a3fa-2fc268e713c6","resolution":{"observed_at":"2026-08-10T17:16:44.891409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12963","last_updated":"2024-03-19T17:59:33Z","snapshot_observed_at":"2026-07-06T17:47:13.814205Z","submitted_at":"2024-03-19T17:59:33Z","title":"FouriScale: A Frequency Perspective on Training-Free High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12963","snapshot_observed_at":"2026-08-10T17:16:43.596261Z","title":"Fouriscale: A frequency perspective on training-free high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.596261Z"},"links":{"cited_paper":"/paper/2403.12963","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:825094f98e64a48cc027debcee7c3fb36782988a72a1f714fcf273984b987fa5","observation_id":"89c5aa19-5d14-4021-acb8-34845ecc3c87","resolution":{"observed_at":"2026-08-10T17:16:43.596261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09338","last_updated":"2024-03-14T12:32:40Z","snapshot_observed_at":"2026-08-06T04:08:34.950441Z","submitted_at":"2024-03-14T12:32:40Z","title":"LocalMamba: Visual State Space Model with Windowed Selective Scan","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09338","snapshot_observed_at":"2026-08-10T17:16:43.600372Z","title":"Localmamba: Visual state space model with windowed selective scan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.600372Z"},"links":{"cited_paper":"/paper/2403.09338","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:7e71fcfdf53181fb1177ac6ef224ade55d3febe8212ec0043ccdf1d422a859ce","observation_id":"0a42e1ef-56d5-4882-aae1-b4420737a82e","resolution":{"observed_at":"2026-08-10T17:16:43.600372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.875188Z","title":"Transformers are rnns: Fast autoregressive transformers with linear attention","venue":null,"work_id":"7f80f162-aad1-477a-b717-88a8fbf5ed54","year":2020},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.604545Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:abe0f7dff58eb331271c8bc9ee205f6e06b12eebce06abdab22d7b56c8011ab4","observation_id":"0a3d13ef-5fb0-4b85-aa15-1a04462be04a","resolution":{"observed_at":"2026-08-10T17:16:44.879048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.863245Z","title":"Bk-sdm: Architecturally compressed stable diffusion for efficient text-to-image generation","venue":null,"work_id":"50dec5a5-319c-4dca-8419-69473f329150","year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.608348Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:e750827cb13a7dc63d15bcd54d4eb28c127437ec168c3a33abe24e20c2999505","observation_id":"fae2b8a8-d803-460e-8f62-c8d44c0d5568","resolution":{"observed_at":"2026-08-10T17:16:44.867508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.851117Z","title":"Re- former: The efficient transformer","venue":null,"work_id":"7362c231-95a2-43b5-b635-22d9de9e35b3","year":2020},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.612373Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:74600bed919ca33e7cad798b295f4234f76248612991646012484fdbd939b432","observation_id":"c54178ff-869d-49e5-9c9e-8d7c76f02769","resolution":{"observed_at":"2026-08-10T17:16:44.855137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.838388Z","title":"Chatgpt: Jack of all trades, master of none","venue":null,"work_id":"27271658-f0fe-44ad-b235-6eec5d4a4092","year":2023},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.616552Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:09c1c2c9fcd6a0ab868da865840f0496a920365ae89eab793bbf1a4b75f43c0f","observation_id":"ae3bc44d-e900-43a9-8af3-030010ad23cf","resolution":{"observed_at":"2026-08-10T17:16:44.843098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.826119Z","title":"Im- agenet classification with deep convolutional neural networks","venue":null,"work_id":"959aa184-3f40-428b-97e8-d049285cf5af","year":2012},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.620343Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:d781ef54e6a5f1ef64d71b05a765f0a1e3d5fcb0320d04f66fcc1ecb8f721cd7","observation_id":"b6dfa10c-7908-4266-b442-5959c0d7f9a7","resolution":{"observed_at":"2026-08-10T17:16:44.830813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.810723Z","title":"Improved precision and recall metric for assessing generative models","venue":null,"work_id":"a80b5f08-df3e-4aef-96e7-b7df5a06be20","year":2019},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.625432Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:1b2c2e7ba5a00e1dc3c073716e0ba8e4d6473eb52d83688a9112721848abea11","observation_id":"2a4671a3-4514-4685-84db-4cc7867829ed","resolution":{"observed_at":"2026-08-10T17:16:44.816107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05501","last_updated":"2022-08-16T10:16:20Z","snapshot_observed_at":"2026-07-06T13:30:21.406367Z","submitted_at":"2022-07-12T12:50:34Z","title":"Next-ViT: Next Generation Vision Transformer for Efficient Deployment in Realistic Industrial Scenarios","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05501","snapshot_observed_at":"2026-08-10T17:16:43.629784Z","title":"Next-vit: Next generation vision transformer for efficient deployment in real- istic industrial scenarios","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.629784Z"},"links":{"cited_paper":"/paper/2207.05501","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:69edacb133da6adc7ab3cadb6848651a352ccf1452e49b571ee95c1ce37c5ffe","observation_id":"5fdaa095-ca5e-4259-a662-9a9aba734c93","resolution":{"observed_at":"2026-08-10T17:16:43.629784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.796087Z","title":"Savarese, and Steven C","venue":null,"work_id":"d6698e21-9a03-4e4c-b856-4c4101beb63a","year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.633867Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:5a46419ef31518bd7f7f75d7857157e215e9eba6b3c2e3247ad2e0e88aa8b022","observation_id":"79ec935c-8623-4ff4-b340-00ad69bfc36a","resolution":{"observed_at":"2026-08-10T17:16:44.800516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.783154Z","title":"Uniformer: Unified transformer for efficient spatiotemporal representation learning","venue":null,"work_id":"28e75a7a-3a78-4566-948b-3b46dc4c92c6","year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.637888Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:bcbe7a7e8c6e84010eef0fd1c4f9509aa0268f01c835e4fc023a4bf720df8b80","observation_id":"b88dec22-7342-4054-9d75-43651ae2beb1","resolution":{"observed_at":"2026-08-10T17:16:44.787677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.771020Z","title":"Distrifusion: Distributed parallel inference for high-resolution diffusion models","venue":null,"work_id":"43931201-ef06-4c7a-a08a-d774b444548d","year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.641588Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:8178cbbe36a924571c156d2276f7aaa50c85be118195ca6d4ff269ad3c6a9233","observation_id":"79b0a1f3-c0fc-44b1-bc50-95e7f8598699","resolution":{"observed_at":"2026-08-10T17:16:44.775288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05892","last_updated":"2024-07-13T17:37:00Z","snapshot_observed_at":"2026-08-09T18:30:57.894416Z","submitted_at":"2024-02-08T18:30:50Z","title":"Mamba-ND: Selective State Space Modeling for Multi-Dimensional Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05892","snapshot_observed_at":"2026-08-10T17:16:43.645614Z","title":"Mamba-nd: Selective state space modeling for multi-dimensional data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.645614Z"},"links":{"cited_paper":"/paper/2402.05892","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:f24265dd6f3254652c506a41ebc6aa2ee79ac7cf63cd686822976efece96e030","observation_id":"c1729834-8a03-4407-aed4-4c02cec13f16","resolution":{"observed_at":"2026-08-10T17:16:43.645614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15141","last_updated":"2024-04-23T15:47:58Z","snapshot_observed_at":"2026-07-06T18:04:26.177088Z","submitted_at":"2024-04-23T15:47:58Z","title":"CutDiffusion: A Simple, Fast, Cheap, and Strong Diffusion Extrapolation Method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15141","snapshot_observed_at":"2026-08-10T17:16:43.650370Z","title":"Cutdiffusion: A simple, fast, cheap, and strong diffusion extrapolation method","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.650370Z"},"links":{"cited_paper":"/paper/2404.15141","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:cb140c5af624e38f75391daf95ba8d702c875042d0e0167ac7f95cc5016f2366","observation_id":"ac6bb3e4-c90e-4bdc-945a-5fcdaeb5e227","resolution":{"observed_at":"2026-08-10T17:16:43.650370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.756609Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"45eb3494-6ae9-4ae8-98f8-9ca2fa4d662b","year":2014},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.654524Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:063514e60446964d4645dcf7e52e6d2ce784b6f0966e2b0c302bcdeea60f4159","observation_id":"508598c8-baa1-4db2-be63-2ae47580764c","resolution":{"observed_at":"2026-08-10T17:16:44.761573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10738","last_updated":"2024-07-18T04:19:53Z","snapshot_observed_at":"2026-08-03T14:35:46.664688Z","submitted_at":"2024-07-15T14:06:29Z","title":"AccDiffusion: An Accurate Method for Higher-Resolution Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10738","snapshot_observed_at":"2026-08-10T17:16:43.658432Z","title":"Ac- cdiffusion: An accurate method for higher-resolution image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.658432Z"},"links":{"cited_paper":"/paper/2407.10738","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:f99289ec77370f7372fb491aa7ea3c5a622f8d07c6968d0ac58eafe84c880e4a","observation_id":"180fabdb-f7ce-4ab5-9a53-085ad9e4fcaf","resolution":{"observed_at":"2026-08-10T17:16:43.658432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.741139Z","title":"Transformer-vq: Linear-time transformers via vector quantization","venue":null,"work_id":"122980e8-75bb-4d92-b234-d949a5b27fe3","year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.662949Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:3d86cd6c1fe422b3be31a23e1ac61db1632ce449d792c1b1659060a49d54db43","observation_id":"e90126f3-2f0f-44e5-91c4-bbf363bf01e1","resolution":{"observed_at":"2026-08-10T17:16:44.747037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.724348Z","title":"Learning affinity via spatial propagation networks","venue":null,"work_id":"65a0ac81-ee71-42bc-82ce-cbf7a9d1d1ab","year":2017},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.667894Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:e0e7320b98dcec9210a565ddbf54150435d2b0c718f7218c7834d070fbcad42f","observation_id":"fc16ac80-879f-47f1-baa3-18e63a3d816c","resolution":{"observed_at":"2026-08-10T17:16:44.730049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-08-10T17:16:43.672571Z","title":"Linfusion: 1 gpu, 1 minute, 16k image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.672571Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:46c98e9e2fac6c2148950a19f1eaedb6d0bcca2340aa4b7dd16209609d933f4a","observation_id":"fa2c8bcd-df98-43d8-a1c8-066f1b21ff69","resolution":{"observed_at":"2026-08-10T17:16:43.672571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10166","last_updated":"2024-12-29T14:57:13Z","snapshot_observed_at":"2026-07-06T17:17:31.008185Z","submitted_at":"2024-01-18T17:55:39Z","title":"VMamba: Visual State Space Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10166","snapshot_observed_at":"2026-08-10T17:16:43.677642Z","title":"Vmamba: Visual state space model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.677642Z"},"links":{"cited_paper":"/paper/2401.10166","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:c263d62d5fdad42db5572e5244c45f997010f5b7b1ecf8027566abccd885e574","observation_id":"2703d1fd-5d76-42b0-b006-5fc40c2c5991","resolution":{"observed_at":"2026-08-10T17:16:43.677642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.708105Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"4a9d0046-aaee-4249-a3b7-7b85929fd24e","year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.683211Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:2e73a79fc42c616fe5c4e9a31af64f980a2db0f9133cf4ecbb485693d0ce3d4b","observation_id":"79aeff2d-a600-48eb-891a-b6fadfa10e32","resolution":{"observed_at":"2026-08-10T17:16:44.713443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.695005Z","title":"A convnet for the 2020s","venue":null,"work_id":"194787fd-1ccd-4bc6-b32f-64afbaa34a76","year":2022},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.688473Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:0f148b5f62f7241360ad09a0c617019f8fc7fd41ef906456bcef3438195cf8fd","observation_id":"bddf03a3-44a2-4428-a8d4-e58399270c23","resolution":{"observed_at":"2026-08-10T17:16:44.699452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.679154Z","title":"Soft: Softmax-free transformer with linear complexity","venue":null,"work_id":"89c481fb-de93-4f8c-95d2-ea3bf6c8e252","year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.693002Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:b95d831964d3012a2fc64390acfe4cf018f7948fd4c31071a28da4f773311653","observation_id":"7d959d22-f33f-41c5-a84f-36f027d02069","resolution":{"observed_at":"2026-08-10T17:16:44.684210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.664143Z","title":"Sit: Exploring flow and diffusion-based generative models with scalable interpolant transformers","venue":null,"work_id":"f058948e-e9db-48d0-a001-151d33f271ee","year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.697981Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:ae1577934a483ae95ccc736ba1d3c7935e6ab98f6ee7f4b2a6c4ceba41b6ca4a","observation_id":"df0b005d-5a93-4e7b-9c63-cc66a683b850","resolution":{"observed_at":"2026-08-10T17:16:44.668329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-08T06:35:17.078531Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-10T17:16:43.701779Z","title":"Sdedit: Guided image synthesis and editing with stochastic differential equations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.701779Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:a6595c071fad0c15639871c95502702fdfa40e9758d9acad498e8bc298540b64","observation_id":"7522fff4-531d-4f65-9623-b11658fd6bbf","resolution":{"observed_at":"2026-08-10T17:16:43.701779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03841","last_updated":"2021-03-05T17:56:03Z","snapshot_observed_at":"2026-08-10T12:14:10.719052Z","submitted_at":"2021-03-05T17:56:03Z","title":"Generating Images with Sparse Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03841","snapshot_observed_at":"2026-08-10T17:16:43.706301Z","title":"Generating images with sparse representations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.706301Z"},"links":{"cited_paper":"/paper/2103.03841","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:5249e42773625a14b68f72a675688e2d7372361474e0a7edbc0d77a08c53eab2","observation_id":"736f728d-acef-4d38-b110-d6fd854235a1","resolution":{"observed_at":"2026-08-10T17:16:43.706301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.651647Z","title":"S4nd: Modeling images and videos as multidimensional signals with state spaces","venue":null,"work_id":"8f9367bd-95d7-4870-ac83-d2c45af57812","year":2022},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.710550Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:23e0d163d9875d9d4b83a33aada19f52ca9a3d3504b7ef590b0b690d322c6b5d","observation_id":"67e87668-5f5c-4127-97af-51fd0b90ecf2","resolution":{"observed_at":"2026-08-10T17:16:44.656079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:43.714866Z","title":"On aliased resizing and surprising subtleties in gan evaluation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.714866Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:9b000339bbe3ddc0ecb545fdc9a84226fcfd616c93cf1f1e5147dd892f7caa51","observation_id":"3f8bfb4e-0524-4973-8aef-38d520591d3b","resolution":{"observed_at":"2026-08-10T17:16:43.714866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.628738Z","title":"On the difficulty of training recurrent neural networks","venue":null,"work_id":"fc2450eb-d8d9-4a6b-bdd9-3829c27566bb","year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.719148Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:2fa519b8404ae540e57e204b89cff153ad7108f8b10f5b9285200a5d6c78c452","observation_id":"87a91003-5e8c-4af0-b616-e09cd4f9342c","resolution":{"observed_at":"2026-08-10T17:16:44.634362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.606060Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"835a5605-13a2-4f03-9ee8-7409701a4440","year":2023},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.724278Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:f4f0eb00ab31a264090ff038c86691045357ca7468115134fa75110bec39c292","observation_id":"25ac1bce-a612-46a3-9b80-23019bf1fa42","resolution":{"observed_at":"2026-08-10T17:16:44.614810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.02143","last_updated":"2021-03-19T21:24:06Z","snapshot_observed_at":"2026-08-04T23:37:38.910806Z","submitted_at":"2021-03-03T02:48:56Z","title":"Random Feature Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.02143","snapshot_observed_at":"2026-08-10T17:16:43.729920Z","title":"Random feature attention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.729920Z"},"links":{"cited_paper":"/paper/2103.02143","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:6b0be90f14a71eabcf4f2b1b21b04809cad8140fc13ddee36e11c98b3f10dded","observation_id":"717539f0-589f-4ea6-98f4-2dd066956698","resolution":{"observed_at":"2026-08-10T17:16:43.729920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.05682","last_updated":"2022-10-10T16:36:47Z","snapshot_observed_at":"2026-08-06T17:49:01.053607Z","submitted_at":"2021-12-10T17:25:07Z","title":"Self-attention Does Not Need $O(n^2)$ Memory","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.05682","snapshot_observed_at":"2026-08-10T17:16:43.734351Z","title":"Self-attention does not need o(n2) memory","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.734351Z"},"links":{"cited_paper":"/paper/2112.05682","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:4beecbc08c794ad17a474b353a15d71aa0b781e3cd47344fbadfc2606d7ec6d6","observation_id":"79186a72-a78c-49b8-8cae-430b299ca895","resolution":{"observed_at":"2026-08-10T17:16:43.734351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.590196Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"edd66541-d9eb-4417-9300-1485b7ed3772","year":2022},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.738724Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:1922ca3dc330a76f92e740af0232c6e9bbdd6294037ffe9690423dec08c6ad1d","observation_id":"dc98df41-7156-4be2-9cda-b1aab9544504","resolution":{"observed_at":"2026-08-10T17:16:44.595712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.577981Z","title":"Improved techniques for training gans","venue":null,"work_id":"c3b7986f-e15f-4d23-a03b-80e6ce967493","year":2016},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.744503Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:1578afa2958985e8960322b28fd20dd0e2bb934bd4f0f16bdf78f7cb825135d0","observation_id":"e7a9828d-51fd-477d-b476-eab62c7c5272","resolution":{"observed_at":"2026-08-10T17:16:44.582278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.565219Z","title":"Laion-5b: An open large-scale dataset for training next gener- ation image-text models","venue":null,"work_id":"72b0b6f6-9196-4326-9113-a5cfef4ee7e2","year":2022},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.749185Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:9269723d8d12ed75ab48dab4a16fc4abd5a5fd95ebb4aba5d399e6c522f96f95","observation_id":"29170875-8ba1-4fff-b880-8cd5e2541d07","resolution":{"observed_at":"2026-08-10T17:16:44.569362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.552230Z","title":"Efficient attention: Attention with linear complexities","venue":null,"work_id":"3a4dd116-c93a-47e3-9146-4ade295188e5","year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.754455Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:3b8192747c0cc65a5a43f8cc4aa5ccb003c30b239fc6e918b4ea578b9bf6d548","observation_id":"300eca2b-2a13-45bd-8fb1-2eadea8ec433","resolution":{"observed_at":"2026-08-10T17:16:44.557159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.538259Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":"05cb7a98-b34d-4545-bdc9-53239339df9c","year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.759296Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:2cc3239e083f24875fee244e9bdfba2eb6ec1a244b8e2cf6439c688ec00e87c8","observation_id":"e2a58164-275a-4b7c-b06e-7c5957ba5c27","resolution":{"observed_at":"2026-08-10T17:16:44.543409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.525047Z","title":"Training data-efficient image transformers & distillation through atten- tion","venue":null,"work_id":"1e7afe3a-9092-4c5a-888d-c82d657f9596","year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.763799Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:bef4cea35c14499fcebf18d3c6dd88946530943eb95be0cca66cafe83b4a2439","observation_id":"4b4d91ec-b6f1-4fad-827a-da43fb5dcaec","resolution":{"observed_at":"2026-08-10T17:16:44.529674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-10T17:16:43.769076Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.769076Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:4003b56833391da6882f26b9518763196b737f95e3591fe0e37c1299e98a79a0","observation_id":"a5e75e7b-9ba4-4165-9333-aff4e8dfc56e","resolution":{"observed_at":"2026-08-10T17:16:43.769076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.511931Z","title":"Pixel recurrent neural networks","venue":null,"work_id":"7224a2de-2d79-4517-a3b0-5bb0169c9270","year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.773444Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:252e6dd250ede88e554696cfae3a6df3d240a9b86fd7d1b141bbe42c2dbce7ad","observation_id":"8dd0284e-9487-4e62-9890-65ee891a69f4","resolution":{"observed_at":"2026-08-10T17:16:44.516291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.497708Z","title":"Attention is all you need","venue":null,"work_id":"469b53cb-4176-4791-b12a-ffb1f935f3a2","year":2017},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.777447Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:649fdffe14b81095626b4b6ca1ec9f223ca6f6a7ae7be28b34d8c4267c4dac54","observation_id":"6d5f372e-046c-4613-8814-80bd5892cf74","resolution":{"observed_at":"2026-08-10T17:16:44.503039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-10T17:16:43.783072Z","title":"Linformer: Self-attention with linear complexity","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.783072Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:d8ac6c8eefaff66d2e312cf513f51bc643ff7c0c8683759a08735071976589a9","observation_id":"14fdecaa-5232-4ae4-ab59-f7908e4383a4","resolution":{"observed_at":"2026-08-10T17:16:43.783072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.482164Z","title":"Pyra- mid vision transformer: A versatile backbone for dense pre- diction without convolutions","venue":null,"work_id":"60b990f9-fd7e-40d4-a5b4-79221ddfe779","year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.788498Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:e00f9336068df06043a3d33a6f13d1d21f0a2f04f75db7af881b57621fbb7601","observation_id":"8fce0389-79bc-4820-89ce-364a01f335d0","resolution":{"observed_at":"2026-08-10T17:16:44.487466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.468271Z","title":"Con- vnext v2: Co-designing and scaling convnets with masked autoencoders","venue":null,"work_id":"f6bef869-ece9-4b6d-9085-a4cdf420e069","year":2023},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.792615Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:2cfc51b2bcfb8389b7d9e4dfaf521a32ba65ae82f9610ace92453c986799fab8","observation_id":"fc5ce58e-9ef8-44ef-8d40-67612d96781b","resolution":{"observed_at":"2026-08-10T17:16:44.473738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.450125Z","title":"Cvt: Introducing convolutions to vision transformers","venue":null,"work_id":"b90e5887-0639-42d7-9532-36eab0def75d","year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.796760Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:7932306b76b006bf337e52368c3ab7bdec5a6a88df80fca0f6d9da45dec84240","observation_id":"38dedc91-c6a1-429c-95b4-89e2d1d24ab7","resolution":{"observed_at":"2026-08-10T17:16:44.455870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.433828Z","title":"Lite transformer with long-short range attention","venue":null,"work_id":"e781cfec-6a8d-45e6-bc99-569ca8e48406","year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.801245Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:727c9cfc72bcbfe8e2eace59dccd24554767b716b2e2e22a7ca77ff3f80c6be9","observation_id":"34bbded4-682f-49a3-bc23-7602f0512c47","resolution":{"observed_at":"2026-08-10T17:16:44.438584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.418518Z","title":"Nystr¨omformer: A nystr ¨om-based algorithm for approximat- ing self-attention","venue":null,"work_id":"7dca2559-66aa-4cfe-b6d2-76d7c1f51b62","year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.805026Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:7cc8c1844fe0e8625a7917c9b67c82333df69db2dc6b05352ba26277b78be52f","observation_id":"f7faab3f-9db5-467f-90af-bc976ffecf6d","resolution":{"observed_at":"2026-08-10T17:16:44.423792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.401837Z","title":"Focal modulation networks","venue":null,"work_id":"4bc5af0b-5c8a-4d32-a2f3-7327073a5794","year":2022},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.809198Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:d548481b19f33a8b82e0137c5f8e18058b77ee3e0ec6d7ff53080a342fb7790c","observation_id":"cf17c6d4-76b9-4ccd-bb92-a2f270e9ec41","resolution":{"observed_at":"2026-08-10T17:16:44.406754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.02077","last_updated":"2023-11-03T17:59:55Z","snapshot_observed_at":"2026-08-08T00:21:57.482694Z","submitted_at":"2023-11-03T17:59:55Z","title":"EmerNeRF: Emergent Spatial-Temporal Scene Decomposition via Self-Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.02077","snapshot_observed_at":"2026-08-10T17:16:43.813426Z","title":"Emernerf: Emergent spatial- temporal scene decomposition via self-supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.813426Z"},"links":{"cited_paper":"/paper/2311.02077","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:ec88caf5d878df4abb1b3936afc90a7f35104a1a432eab7f47036002e6cb12c2","observation_id":"b4099f2e-ff85-4067-b79a-386526391afd","resolution":{"observed_at":"2026-08-10T17:16:43.813426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07992","last_updated":"2024-05-20T16:36:21Z","snapshot_observed_at":"2026-08-09T20:13:32.035904Z","submitted_at":"2024-05-13T17:59:56Z","title":"MambaOut: Do We Really Need Mamba for Vision?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07992","snapshot_observed_at":"2026-08-10T17:16:43.818342Z","title":"Mambaout: Do we really need mamba for vision? arXiv preprint arXiv:2405.07992,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.818342Z"},"links":{"cited_paper":"/paper/2405.07992","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:3c55039aaf9d479a32a35f6d3f1eed8724168d71f359a003fade859a6dd94989","observation_id":"d8f900cf-bd27-4e95-a328-be46ced3f060","resolution":{"observed_at":"2026-08-10T17:16:43.818342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.386696Z","title":"Tay, Jiashi Feng, and Shuicheng Yan","venue":null,"work_id":"bef9b302-51bb-4e8c-9e24-c093da00ed31","year":2021},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.822682Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:c55f0812909e6b5412bec2281259760974bcf37627b322557baff5fffc75e408","observation_id":"a3f51b9f-4ffb-4740-89df-ca1e35e5007f","resolution":{"observed_at":"2026-08-10T17:16:44.391213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:44.370020Z","title":"Biformer: Vision transformer with bi-level routing attention","venue":null,"work_id":"ff3d02bd-ec7f-4aef-9652-064ccb44976a","year":2023},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.826992Z"},"links":{"citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:6d9915067d03ce0cb53928de68c97bb50e281084e0e47dc4fe5601f3a1990f32","observation_id":"2ec2ae04-0149-4365-8595-26e247db2c20","resolution":{"observed_at":"2026-08-10T17:16:44.376567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09417","last_updated":"2024-11-14T02:00:33Z","snapshot_observed_at":"2026-07-06T17:16:59.193820Z","submitted_at":"2024-01-17T18:56:18Z","title":"Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09417","snapshot_observed_at":"2026-08-10T17:16:43.832714Z","title":"Vision mamba: Efficient visual representation learning with bidirectional state space model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:43.832714Z"},"links":{"cited_paper":"/paper/2401.09417","citing_paper":"/paper/2501.12381"},"observation_digest":"sha256:57c898151d86ad86d2ede3dbb0c8d3dba0da247fdd1b11ec3d71de8a3e6a66ad","observation_id":"3338b945-a4f9-4a25-9223-85f82432f7fa","resolution":{"observed_at":"2026-08-10T17:16:43.832714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.12381","last_updated":"2025-01-21T18:56:19Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T17:10:27.835396Z","submitted_at":"2025-01-21T18:56:19Z","title":"Parallel Sequence Modeling via Generalized Spatial Propagation Network"},"reference_resolution":{"displayed":97,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":0,"verified_fuzzy":50},"total_outbound_references":97},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 97 of 97 outbound references and 0 inbound Pith citation observations for arXiv:2501.12381."}