{"as_of":"2026-08-17T00:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7f4b92582c7ccd81db21a46c088ae18e7b095a80034426f038ed4c25d61f7a84","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:21:37.303004Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T01:25:52.762836Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T07:17:29.550333Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"cited_work":{"arxiv_id":"2506.08297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08297","snapshot_observed_at":"2026-07-17T01:20:35.902956Z","title":"arXiv:2506.08297, to appear in Intern","venue":null,"work_id":"45ef6f13-acb1-4130-b443-3496eabdaa44","year":2026},"citing_paper":{"arxiv_id":"2605.11131","last_updated":"2026-05-11T18:40:13Z","snapshot_observed_at":"2026-08-11T14:28:11.004588Z","submitted_at":"2026-05-11T18:40:13Z","title":"USEMA: a Scalable Efficient Mamba Like Attention for Medical Image Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T07:13:37.134769Z"},"links":{"cited_paper":"/paper/2506.08297","citing_paper":"/paper/2605.11131"},"observation_digest":"sha256:605847fb3156d653d6e36052cf3511d652ab97235b9e1b028ffac9f45e3f707a","observation_id":"23b7e9c4-8eda-424e-8658-2c99eec65b92","resolution":{"observed_at":"2026-07-17T01:20:35.902956Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08297","snapshot_observed_at":"2026-08-02T01:25:52.762836Z","title":"SEMA: a scalable and efﬁcient mamba like attent ion via token localization and averaging","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14711","last_updated":"2026-07-17T20:57:29Z","snapshot_observed_at":"2026-08-14T10:42:14.306331Z","submitted_at":"2026-07-16T08:22:08Z","title":"VideoSEMA: a scalable and efficient Mamba-like attention for video understanding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T01:25:52.762836Z"},"links":{"cited_paper":"/paper/2506.08297","citing_paper":"/paper/2607.14711"},"observation_digest":"sha256:201c45f466d4578ba2d5aefa563faed5a63c9017fef683849395d7ecc7e811ee","observation_id":"d450261e-6653-4083-8fbe-c18cfce826a2","resolution":{"observed_at":"2026-08-02T01:25:52.762836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.08297/citation-record","integrity":"/paper/2506.08297/integrity","json":"/paper/2506.08297/citation-record.json","paper":"/paper/2506.08297"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-07T05:21:37.177006Z","title":"Peters, and Arman Cohan","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.177006Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:777b37dca6b73189f453e3db986242623ac351144eb4351c279a5519cde29556","observation_id":"17eec38e-970e-4841-86b9-4a4260f6edae","resolution":{"observed_at":"2026-08-07T05:21:37.177006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.685721Z","title":"Mixformer: Mixing features across windows and dimensions.CVPR, 2022","venue":null,"work_id":"de390aaf-18cd-486d-8697-f6c4b957d8f0","year":2022},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.181529Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:623896af119aa54cd81ee8829d2f444444e71689b48100b6e380bf8f71d0523b","observation_id":"028da89c-ac47-47fe-8c62-1c8bd009f584","resolution":{"observed_at":"2026-08-07T05:21:37.689519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.674629Z","title":"Conditional positional encodings for vision transformers.ICLR, 2023","venue":null,"work_id":"9b2d3449-3005-43a5-9d45-406928a43f9e","year":2023},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.185167Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:6f7dd3dd2d549f5a698f563c647738345c5c408a7db37b45d9b2aed6bb9e5dec","observation_id":"1e87e9eb-9736-463b-ad54-d0110feccec6","resolution":{"observed_at":"2026-08-07T05:21:37.678492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.663199Z","title":"Randaugment: Practical automated data augmentation with a reduced search space","venue":null,"work_id":"b858545e-19ed-4ce6-a942-34fb85e91e3d","year":2020},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.188856Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:a77de97f76bcb6e1f6fe2d788a9582362e27f56979c3573286c0469994a822d3","observation_id":"326e51c8-4c24-4323-ae38-3fb11ad92c1e","resolution":{"observed_at":"2026-08-07T05:21:37.666937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.192332Z","title":"Imagenet: A large- scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.192332Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:cb821a4c9d54c3606e530f8e0093299a92e95faf6f466a0139383741992a0f68","observation_id":"9b7f7022-8213-404e-89a5-1a0f44227130","resolution":{"observed_at":"2026-08-07T05:21:37.192332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.645590Z","title":"Cswin transformer: A general vision transformer backbone with cross-shaped windows.CVPR, 2022","venue":null,"work_id":"827bdb93-f1c6-4918-8e09-fe1f69cac554","year":2022},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.197511Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:c7b69e8ef2209839197ce0881f623259a1a8e81a9abfc2575cb89f186e8a0b06","observation_id":"75ce774c-c806-4713-83db-669966a8bd83","resolution":{"observed_at":"2026-08-07T05:21:37.648836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.201226Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.201226Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:dbadc0391578bd1726d056ecfac344be36c8839654742562f31fa21206486bf6","observation_id":"769f58d7-3b85-45c9-8a67-c08a523d2e17","resolution":{"observed_at":"2026-08-07T05:21:37.201226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.204961Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.204961Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:ffee7cef0914b206b7a5ef7e65f3ca67a240fa0940462fb8021d9ad555fdfee5","observation_id":"e2f4d272-16da-4a81-b30f-57b939427d4f","resolution":{"observed_at":"2026-08-07T05:21:37.204961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.621843Z","title":"Hippo: Recurrent memory with optimal polynomial projections.NeurIPS, 2020","venue":null,"work_id":"90ad92a5-3862-4906-9a5e-c50d58769267","year":2020},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.208667Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:a313aa881da4c24643913cc2c659ebbf7c4e1cd46bc19ac0e6c55921a682ea3f","observation_id":"d1dcecac-1f1e-4cf5-9e20-c1c3c6fa2bb7","resolution":{"observed_at":"2026-08-07T05:21:37.625199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.611584Z","title":null,"venue":null,"work_id":"54aa826a-5c5b-468c-ad3d-3c552cddeb79","year":2023},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.211934Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:ed088fe5bcb9bdfacb3cb82a2e4b8e09d1236741ecfa3b79563b3e11dc3d3138","observation_id":"449eeeb3-eb32-4b13-a4fe-69c308cc5e62","resolution":{"observed_at":"2026-08-07T05:21:37.614868Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.600076Z","title":"Flatten transformer: Vision transformer using focused linear attention.ICCV, 2023","venue":null,"work_id":"0f0fda74-e897-432b-8808-6b593f2212e7","year":2023},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.215105Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:56a1ee4729551a280b211231cdd121b475f876da4e29910358a0833a32f220e3","observation_id":"c5f13aab-e2dd-4af2-9d94-196aeb842777","resolution":{"observed_at":"2026-08-07T05:21:37.603975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.588547Z","title":"Bridging the divide: Reconsidering softmax and linear attention","venue":null,"work_id":"c9a15fe9-bce4-419f-b0e1-2625e71394e3","year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.218655Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:c279845910a49e7f37c6e30830e4f8d860cf46a7f1d69b8c32a9a69ce061e905","observation_id":"afff5472-db83-4516-acba-6f2c2dd7a5f4","resolution":{"observed_at":"2026-08-07T05:21:37.592306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.577510Z","title":"Demystify Mamba in Vision: A Linear Attention Perspective","venue":null,"work_id":"0b1b2725-21d0-4198-b632-e6020e8d3227","year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.222142Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:ffd9a82ff7a0bfb89990442ab1f6c9e96b696891d99eb3cc298bf41ed2239f96","observation_id":"b2449e63-aa77-450c-9f9b-cda0edbed132","resolution":{"observed_at":"2026-08-07T05:21:37.581261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.566689Z","title":"Neighborhood attention transformer","venue":null,"work_id":"e47c33bc-797b-4438-a8a8-d93823189a21","year":2023},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.225894Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:c03d9f08fcbc8830b8df513afcab217822bfdb276742a7b0b9951be6731b28bf","observation_id":"e2df83a4-6a23-4a88-8a8a-91d2a7d31b2b","resolution":{"observed_at":"2026-08-07T05:21:37.570131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09338","last_updated":"2024-03-14T12:32:40Z","snapshot_observed_at":"2026-08-16T14:09:51.045365Z","submitted_at":"2024-03-14T12:32:40Z","title":"LocalMamba: Visual State Space Model with Windowed Selective Scan","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09338","snapshot_observed_at":"2026-08-07T05:21:37.230687Z","title":"Localmamba: Visual state space model with windowed selective scan.arXiv:2403.09338, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.230687Z"},"links":{"cited_paper":"/paper/2403.09338","citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:32d7f111ffd304ee6450d060b48f45d0aacbe34c854ff13584d68d1370e33b00","observation_id":"8eaa44d6-77d3-43c4-8d4f-c9721408cbcd","resolution":{"observed_at":"2026-08-07T05:21:37.230687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.556678Z","title":"Katharopoulos, A","venue":null,"work_id":"01259228-d786-40a7-8229-4e7f5f6a9b43","year":2020},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.234331Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:a369405d35ce9e813e22991cc1dcc733cd79400b2b3550e7d6999c04629b3490","observation_id":"5688884a-c318-48db-b8d5-fa120a1bd0c6","resolution":{"observed_at":"2026-08-07T05:21:37.560149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.14902","last_updated":"2020-08-20T05:43:22Z","snapshot_observed_at":"2026-08-11T02:59:59.701652Z","submitted_at":"2020-07-29T15:18:46Z","title":"Linear Attention Mechanism: An Efficient Attention for Semantic Segmentation","version":3},"cited_work":{"arxiv_id":"2007.14902","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.14902","snapshot_observed_at":"2026-08-07T05:21:37.385319Z","title":"Linear Attention Mechanism: An Efficient Attention for Semantic Segmentation","venue":"cs.CV","work_id":"56dc6316-add6-4ef1-960c-a076d95bacd7","year":2020},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.238100Z"},"links":{"cited_paper":"/paper/2007.14902","citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:f61a6c909640c76fe1f694015548b8c19416cc186408d670e8b98ac0102845c9","observation_id":"0ac28da9-62f4-44db-b904-ca9b569171bb","resolution":{"observed_at":"2026-08-07T05:21:37.389145Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.546516Z","title":"Rethinking vision transformers for MobileNet size and speed.ICCV, 2023","venue":null,"work_id":"177b73d7-5245-40b2-b938-ff7b09a9c8a1","year":2023},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.241622Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:367011c4c9703afa15d2edae2880251876bf97d90fcfe59d1d02b0326037ae84","observation_id":"628aed8e-e36d-4422-92e4-b1f54f324239","resolution":{"observed_at":"2026-08-07T05:21:37.549811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.244862Z","title":"Lawrence Zitnick","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.244862Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:66a4cd9365604c3fadddae626aa6d1a1bdbce568526e69e0670a7675ae710aa2","observation_id":"970b95eb-ad57-40b6-ae6d-d3a236a3f754","resolution":{"observed_at":"2026-08-07T05:21:37.244862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05794","last_updated":"2025-04-08T08:22:54Z","snapshot_observed_at":"2026-08-16T12:43:06.220515Z","submitted_at":"2025-04-08T08:22:54Z","title":"DefMamba: Deformable Visual State Space Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05794","snapshot_observed_at":"2026-08-07T05:21:37.248020Z","title":"Def- Mamba: Deformable visual state space model.arXiv:2504.05794, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.248020Z"},"links":{"cited_paper":"/paper/2504.05794","citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:51d7d5cd52ede4fecb7440005fb20bebe3b6be061020274678546a11da35d5df","observation_id":"34def07f-1070-4096-b482-f6673a87550b","resolution":{"observed_at":"2026-08-07T05:21:37.248020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.530106Z","title":"VMamba: Visual State Space Model.NeurIPS, 2024","venue":null,"work_id":"b0c2d4d6-a4a4-4753-b22b-7f5efcd9065b","year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.251516Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:3480cd4fc8b8f55e7709f3e0a2534e732ab1311ff68ccb05963a0da27e8e6396","observation_id":"f2b6eb66-10ce-4df8-9149-3972c38f971c","resolution":{"observed_at":"2026-08-07T05:21:37.533726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.520514Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"4379f6e6-3c18-43f7-bb2c-e94aa054ae69","year":2021},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.254722Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:17004b58ebf9b0f1063bb4b4cea5fb4fbec0365db5f8f376b79e789a81963d66","observation_id":"0b5da0a6-c366-47f3-a41b-df4791035a89","resolution":{"observed_at":"2026-08-07T05:21:37.523646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.511000Z","title":"A ConvNet for the 2020s","venue":null,"work_id":"13ad0aaa-d920-4afa-a7ad-4c9e89dc5146","year":2022},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.257984Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:dbf8c841e07fdadcfc1a5215a46759867526870ff09289c42cf4dcf6f3d43031","observation_id":"c969419d-0594-45d1-8fa1-a9e44e1ea066","resolution":{"observed_at":"2026-08-07T05:21:37.514030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.261469Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.261469Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:71feecacf7772da952168b6c412e23b9522087c8e9eee2c8b72e1fdacdc763ed","observation_id":"d36abdc7-aafc-4fdb-bc7a-9948e0a163c8","resolution":{"observed_at":"2026-08-07T05:21:37.261469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.494288Z","title":null,"venue":null,"work_id":"31293eee-8aa2-4c14-9105-738bb803f411","year":2015},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.264794Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:037543deb546fe09551a31af74b99688b38dcc1c6916135c0b85ea3e5cdb4a2e","observation_id":"3160762b-4e03-4274-b040-06cd21b9839b","resolution":{"observed_at":"2026-08-07T05:21:37.497473Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.484510Z","title":null,"venue":null,"work_id":"8a77d5b5-1077-4557-84d0-8349413b71d0","year":2019},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.267758Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:1e0c24e28e52a947a7b57e2051af0523e9c258a0514c5de6902876e9af9a2fe6","observation_id":"550f8bdc-60de-4c53-9679-f5fa3973efb1","resolution":{"observed_at":"2026-08-07T05:21:37.487795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.473699Z","title":"Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 2024","venue":null,"work_id":"b7adba8c-e43a-4d87-8d69-006f8f912c99","year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.270936Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:848abe589070b7261689dc872d322fa9070410c91a005786383d44b88a88946d","observation_id":"7754fbea-310d-4bbf-b10b-172eef1fbd89","resolution":{"observed_at":"2026-08-07T05:21:37.477163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.463432Z","title":"Vaswani, N","venue":null,"work_id":"eee84717-2d60-4422-9f9d-fbd7e0087c48","year":2017},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.274626Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:d5de2ed7d03f66d6eaa1a7e0963cc8ae5f3f65fe57e571920cade8ca7030af67","observation_id":"37608d6b-0855-4eaa-8cf7-363ecf9b5e56","resolution":{"observed_at":"2026-08-07T05:21:37.466786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01104","last_updated":"2025-05-30T23:46:05Z","snapshot_observed_at":"2026-08-16T13:13:34.381105Z","submitted_at":"2024-10-01T22:22:35Z","title":"Softmax is not Enough (for Sharp Size Generalisation)","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01104","snapshot_observed_at":"2026-08-07T05:21:37.278432Z","title":"softmax is not enough (for sharp out-of-distribution).arXiv:2410.01104, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.278432Z"},"links":{"cited_paper":"/paper/2410.01104","citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:799643ae8504e33d244b87f5f68642f93d04020af67218ee421e19b4e84a24ba","observation_id":"91d006b8-d3e3-4789-b1d6-b19fb5fe7d0a","resolution":{"observed_at":"2026-08-07T05:21:37.278432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.282042Z","title":"Pvt v2: Improved baselines with pyramid vision transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.282042Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:c4f338a1e31d2ab415ee9f790d25d0cfc5b6d075463088d14f7daa969d984f7d","observation_id":"5b19aba5-9c12-4583-a343-b6d4f58970cc","resolution":{"observed_at":"2026-08-07T05:21:37.282042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05026","last_updated":"2025-06-03T08:39:28Z","snapshot_observed_at":"2026-08-16T14:54:09.309996Z","submitted_at":"2023-10-08T06:10:09Z","title":"Low-Resolution Self-Attention for Semantic Segmentation","version":3},"cited_work":{"arxiv_id":"2310.05026","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05026","snapshot_observed_at":"2026-08-07T05:21:37.345766Z","title":"Low-Resolution Self-Attention for Semantic Segmentation","venue":"cs.CV","work_id":"32a3d966-fda0-4d1d-aecf-3d8f5ab8e52d","year":2023},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.285548Z"},"links":{"cited_paper":"/paper/2310.05026","citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:cee357add92e4e66b2529d28aa945f71b97b5c373182394dc78c663c00600fb2","observation_id":"e39e43ae-5d97-45aa-b055-0bd67f66f035","resolution":{"observed_at":"2026-08-07T05:21:37.351539Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05258","last_updated":"2025-04-07T12:04:28Z","snapshot_observed_at":"2026-08-16T13:11:48.518180Z","submitted_at":"2024-10-07T17:57:38Z","title":"Differential Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05258","snapshot_observed_at":"2026-08-07T05:21:37.289088Z","title":"Differential transformer.arXiv:2410.05258, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.289088Z"},"links":{"cited_paper":"/paper/2410.05258","citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:7808f79bb88b7abeaa36f038027b37f12444c0b499a56a8a8688c8a0598006e8","observation_id":"bba0ff3f-6533-4a6d-ade0-88923297aa26","resolution":{"observed_at":"2026-08-07T05:21:37.289088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.445390Z","title":"Mambaout: Do We Really Need Mamba for Vision?CVPR, 2025","venue":null,"work_id":"a81ad292-1a66-4406-b10b-f428a69bdf10","year":2025},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.292716Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:fd5d10bbb42b6d1bc84e9b124d51ece2bfd0d097886c141e8683fc9355f01a85","observation_id":"929a87d8-6f75-45fb-8f23-c1cdd8fab411","resolution":{"observed_at":"2026-08-07T05:21:37.449035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.435265Z","title":"Cutmix: Regularization strategy to train strong classifiers with localizable features","venue":null,"work_id":"49746c73-79dc-4363-a21e-94444272abfd","year":2019},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.295984Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:4c01c5ec8a4d9707a09287126ef883544032980e23554062a7206759bc885c96","observation_id":"032dfc7a-7f09-4bc9-a878-b04b6fa0885b","resolution":{"observed_at":"2026-08-07T05:21:37.438544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.299441Z","title":"Dauphin, and David Lopez-Paz","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.299441Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:5053f8c9f26ea2306b333264b087d2f288caa4373ff4797bdcbe8fb9c6ec8d93","observation_id":"2b816775-70c4-4c33-9274-670a57a9ef69","resolution":{"observed_at":"2026-08-07T05:21:37.299441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.417599Z","title":"dim64 head2 window size7 # ×2 2 28×28 downsampling, 128","venue":null,"work_id":"dd5d8370-7936-4f00-a242-065fef24d306","year":2020},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.303004Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:c602a184af6a065d03b1faf36dc6f4492d54f461bf685b99787a84f4d112b1d0","observation_id":"d46073f1-c934-4e35-a544-4105251465d1","resolution":{"observed_at":"2026-08-07T05:21:37.421138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T21:05:10.360798Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":2,"verified_fuzzy":19},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 2 inbound Pith citation observations for arXiv:2506.08297."}