{"as_of":"2026-08-19T10:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8c448f636ecc54e16ab506e9467509b5df6ed827e77b742748ae401b1ba02b9f","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:59:25.515340Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.19409/citation-record","integrity":"/paper/2507.19409/integrity","json":"/paper/2507.19409/citation-record.json","paper":"/paper/2507.19409"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.499815Z","title":"GQA: Training gener- alized multi-query transformer models from multi-head checkpoints","venue":null,"work_id":"8dcde80e-8412-443d-90ec-0e111d05f507","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.215137Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:0e6c33d4e557937811feeed9a1fa27bb78c36efc520a9cabeb34f5e1e0fd8ee7","observation_id":"40c324da-9dd3-4fb6-a6e1-339eec8d53bd","resolution":{"observed_at":"2026-08-15T17:59:26.504863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.485722Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":"c37dfe08-590b-4640-8bb2-df497842b0f4","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.220029Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:edaff4d7ccef88dc5b6d11b690926c3586a799e7a9d73f7138373f19b9d219f8","observation_id":"d637edb3-9b63-4b0e-b8ee-fb77545f0f22","resolution":{"observed_at":"2026-08-15T17:59:26.490859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-15T17:59:25.224593Z","title":"Longformer: The long-document transformer","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.224593Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:4fc747ce3941136ccc651181817a5e1603056684bbff1dad5b6d12034bcd1c8b","observation_id":"2ebd3bc5-ce57-4ab1-a20c-71e9b69b887a","resolution":{"observed_at":"2026-08-15T17:59:25.224593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09461","last_updated":"2023-03-01T19:45:11Z","snapshot_observed_at":"2026-08-13T04:00:22.647615Z","submitted_at":"2022-10-17T22:23:40Z","title":"Token Merging: Your ViT But Faster","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09461","snapshot_observed_at":"2026-08-15T17:59:25.229873Z","title":"Token merging: Your vit but faster","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.229873Z"},"links":{"cited_paper":"/paper/2210.09461","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:16c9651df0ce3b20ad4cd69a822604e7ebb1fd10e36ef507d602573769dfc977","observation_id":"98a3b113-6bca-41bf-b8dd-b33dc0e8ff24","resolution":{"observed_at":"2026-08-15T17:59:25.229873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11062","last_updated":"2024-02-06T10:16:54Z","snapshot_observed_at":"2026-08-18T06:13:07.728363Z","submitted_at":"2023-04-19T16:18:54Z","title":"Scaling Transformer to 1M tokens and beyond with RMT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11062","snapshot_observed_at":"2026-08-15T17:59:25.234525Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.234525Z"},"links":{"cited_paper":"/paper/2304.11062","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:7d3fee9d94bf2215f01f46958f74a538e76a4de34a10108781e371d83898d5b4","observation_id":"1383d3df-aadf-4b0f-8eb1-7afe67b8464e","resolution":{"observed_at":"2026-08-15T17:59:25.234525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.471900Z","title":"Vggsound: A large-scale audio-visual dataset","venue":null,"work_id":"7bac10fe-cb79-406e-a2a6-5236df0cc576","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.239060Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:b558ac19a4bad356fba93053f6e042230740800676ec2501ad8c3397414c2f83","observation_id":"e2ea8a0c-c9a0-4e14-ad68-0f5fd9b360b9","resolution":{"observed_at":"2026-08-15T17:59:26.476645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.458157Z","title":"Classification of long sequential data using circular dilated convolutional neural networks","venue":null,"work_id":"6e28b6cb-1293-40ef-8268-0f6a7119215d","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.244652Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:599309bd4093a536d20f8d39edc3ce4b2c36aacec2ef1c0382fa24d344708ab6","observation_id":"ce372dc8-eff8-473a-81cb-b13e67c1066e","resolution":{"observed_at":"2026-08-15T17:59:26.462757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-16T10:03:03.268538Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-15T17:59:25.248806Z","title":"Gen- erating long sequences with sparse transformers","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.248806Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:1bbddc334fb863017ffdc74644047ae347496aa74faf624afa7980bd51ea36fa","observation_id":"3a3eded5-c146-4be6-b11e-5a5788db84ae","resolution":{"observed_at":"2026-08-15T17:59:25.248806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.444851Z","title":"Rethinking attention with performers","venue":null,"work_id":"7f23991f-91fb-4011-903e-3d9decb66e51","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.253515Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:7b5d4e80891ae8c53576f44764389b9410f3a0fdedcc1d6ff2caf9b6e86f74e9","observation_id":"74a40dab-c92e-4313-884e-350194cfaae4","resolution":{"observed_at":"2026-08-15T17:59:26.449170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.431153Z","title":"Ran- daugment: Practical automated data augmentation with a reduced search space","venue":null,"work_id":"9475e606-f084-47bc-9b4b-07c6eab94fab","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.258004Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:a6c4627617f206d8904674267cc5ec7d049fae405de88949289cdecfd46f6c6f","observation_id":"6fc60df1-913f-441c-ac32-a11e3238eccb","resolution":{"observed_at":"2026-08-15T17:59:26.435665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.417706Z","title":null,"venue":null,"work_id":"0fedf8a0-94b7-4d8e-80b9-d394f7863269","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.263129Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:be4997a82f6cdefd13cab1099618f9f80fd5572389fd65395f767de95c2d0ebe","observation_id":"472b63c3-65ce-451d-b6bf-37fd00998efa","resolution":{"observed_at":"2026-08-15T17:59:26.422263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.403331Z","title":"FlashAttention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":"e49a2cd3-86b0-4d72-a810-10f1ab20e86e","year":2024},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.267331Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:778b0d36550d15c7d657033ebb5c25270f853b060e84df095997ac75737cdc86","observation_id":"17a97211-7920-42c0-b8bd-8b9d13558edf","resolution":{"observed_at":"2026-08-15T17:59:26.408224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.389823Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher R´e","venue":null,"work_id":"c61a68f5-0b3c-4d4d-b089-a7fb523b395e","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.271441Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:e5ae1ec96aa701d1cab699072706a4f2d905ebe20ded9862d3f215412beaffad","observation_id":"7f27df0e-d055-413b-b62c-5d5f15659eab","resolution":{"observed_at":"2026-08-15T17:59:26.394228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.376165Z","title":"The ucr time series classifica- tion archive, 2019","venue":null,"work_id":"9b3728dc-77f0-4e0d-ba24-5102a3c66143","year":2019},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.276528Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:91e9b66654ee4b3ea9cd51df31acc75a5dbcef9920f10ffe15c067a8ae5bc961","observation_id":"1df443de-fc46-4f88-82e7-b5a1c91349ce","resolution":{"observed_at":"2026-08-15T17:59:26.380830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-15T17:59:25.280766Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.280766Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:d29fc65fef1ebe2011c769e4302b90699e73d6147786a25dd50b435c9f599116","observation_id":"70b88857-625a-4ccc-a378-f427f406048f","resolution":{"observed_at":"2026-08-15T17:59:25.280766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.362628Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"077857e2-c59e-4603-bff7-7e74cbf27d06","year":2009},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.285702Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:e677fbfa9cee2e3deb1bf46d1e0a9dfbb721b4d5d37f03ec9dd129a2b020ea96","observation_id":"9812f137-9952-4b9d-b4cb-9ff28c92b788","resolution":{"observed_at":"2026-08-15T17:59:26.367324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.348745Z","title":"fvcore: A collection of core libraries for com- puter vision","venue":null,"work_id":"3095468e-84d8-4eb5-84d6-26009d32f914","year":2019},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.290213Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:5814e42fbc4a3347e1fed26cacdbd64eef1ec08e58b5249244a494979cf66f84","observation_id":"a36df706-28d2-411a-9e10-fe7894b98148","resolution":{"observed_at":"2026-08-15T17:59:26.353386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.335638Z","title":"Multiscale vision transformers","venue":null,"work_id":"c3d3e417-1278-45f2-a246-2d9e8743e06a","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.294296Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:544a0f904915196909f402051bbb17011fbf92060e682badd3aaaf9232428b70","observation_id":"e9652e75-ee4d-4152-9a9b-e8763c39efae","resolution":{"observed_at":"2026-08-15T17:59:26.339847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.14052","last_updated":"2023-04-29T03:18:40Z","snapshot_observed_at":"2026-08-18T19:17:21.619873Z","submitted_at":"2022-12-28T17:56:03Z","title":"Hungry Hungry Hippos: Towards Language Modeling with State Space Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.14052","snapshot_observed_at":"2026-08-15T17:59:25.298833Z","title":"Fu, Tri Dao, Khaled K","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.298833Z"},"links":{"cited_paper":"/paper/2212.14052","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:243013774edd6e408d11fd3230d095bf6aacb1a5be8b50cd3cd53b64762ee31e","observation_id":"2b5b81ca-432e-4d31-b44e-3f67d8965325","resolution":{"observed_at":"2026-08-15T17:59:25.298833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14767","last_updated":"2023-10-13T19:01:20Z","snapshot_observed_at":"2026-08-16T15:37:00.428813Z","submitted_at":"2023-04-28T11:26:17Z","title":"Dissecting Recall of Factual Associations in Auto-Regressive Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14767","snapshot_observed_at":"2026-08-15T17:59:25.303243Z","title":"Dissecting recall of factual associations in auto-regressive language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.303243Z"},"links":{"cited_paper":"/paper/2304.14767","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:3262f2470619109dfc9a0b491ecf11886cae01d24cbc9da10e05d19d10cd4319","observation_id":"76069de1-ba93-41d0-8855-dc3cca94f696","resolution":{"observed_at":"2026-08-15T17:59:25.303243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.322750Z","title":"Liu, David Har- wath, Leonid Karlinsky, Hilde Kuehne, and James R","venue":null,"work_id":"476bd8ce-52c8-40e1-954d-f1b40adf9f52","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.307614Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:4d327589b7983ff093ec174a4fe53de3abeb3890a18e363d0c9ab599182aa5da","observation_id":"6a1df863-2b17-47de-9a55-b342cc01a06b","resolution":{"observed_at":"2026-08-15T17:59:26.326851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.309068Z","title":"Choudhury, Saurabh M","venue":null,"work_id":"833e51c4-2b02-4352-8f3a-bf0168a75442","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.311632Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:15e8cf07f85ccb694693047b75e6e2e3473c1cab1238c9168db7fb8b0717d6c8","observation_id":"832d6e1b-4a4b-44ba-9953-49dd3ec803f7","resolution":{"observed_at":"2026-08-15T17:59:26.313722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.296111Z","title":"Levit: a vision transformer in convnet’s clothing for faster inference","venue":null,"work_id":"5fac329a-65bc-449e-bf82-7f91abd2f7a1","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.315688Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:39954e494a030cd2bb58a5f61c0e105066c16cbea96e71f6cfbd480ea5344a13","observation_id":"eca2bdb5-abcb-42e0-b621-7cea2e99dad0","resolution":{"observed_at":"2026-08-15T17:59:26.300518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-08-17T20:47:46.242385Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-15T17:59:25.319687Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.319687Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:4dcd08ca179313880171afc8ea8135e5df5bbb070115061df0755af01e83a000","observation_id":"3598c43a-b2cc-4556-a459-144cd849f4f0","resolution":{"observed_at":"2026-08-15T17:59:25.319687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.282829Z","title":"Longt5: Efficient text-to-text transformer for long sequences","venue":null,"work_id":"f80a9b26-98a8-485f-9d43-f108fcda962c","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.323970Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:78789818aa6b4b4e5d43bd6477440a4a45052a0e8bf5207b59c37312185c47da","observation_id":"f192dcbc-ca27-40f6-8fa0-9b4667330089","resolution":{"observed_at":"2026-08-15T17:59:26.287274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.268990Z","title":"Flatten transformer: Vision transformer using focused linear atten- tion","venue":null,"work_id":"28b82441-51cd-4525-941d-317877893400","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.327908Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:e3520afeb9bfc1556f264cfa7bbe038e01912d3a7c75e43a5fad68eee12fa983","observation_id":"b4763ef0-e95b-4a4e-b44d-067276310a14","resolution":{"observed_at":"2026-08-15T17:59:26.273407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.256166Z","title":"Masked autoencoders are scalable vision learn- ers","venue":null,"work_id":"d762582d-ab8d-46e5-8f31-2df636828b49","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.332340Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:303c6a8d1cd630a8662d5672ba43d40e1045b722d65ac62b97fe61bb5fbb4ac5","observation_id":"6709e51d-7c88-4e42-be09-80c2fc9eafba","resolution":{"observed_at":"2026-08-15T17:59:26.260553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.243124Z","title":"Rethinking spatial dimensions of vision transformers","venue":null,"work_id":"399579fd-1bb0-4662-8775-771d9e7f7ab5","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.336473Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:32e34f97fcaf3b5f1749680761b8e6f04f09a361c214d829ac4bd242e83f9e97","observation_id":"f215666b-23e2-43db-b069-4e43ac9dcf0f","resolution":{"observed_at":"2026-08-15T17:59:26.247518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.228609Z","title":null,"venue":null,"work_id":"8b1a8f7e-346d-4dc1-9239-d3874bce933b","year":2008},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.340570Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:c37a19c794bfe123142da74b8ef8b07322230e8a1c4ad2b7a919616ba78072fd","observation_id":"a773974a-63ca-4161-be25-957645d5e75d","resolution":{"observed_at":"2026-08-15T17:59:26.233896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.214842Z","title":"Deep networks with stochastic depth","venue":null,"work_id":"59461bee-00dc-4e15-82f2-8b62840b4569","year":2016},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.344819Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:6c57a5c868b59096d8747aab09d51aaa4c9c90fbdf55e497a89648f91cff7751","observation_id":"38e4425a-a289-466f-888a-9a71f47c3090","resolution":{"observed_at":"2026-08-15T17:59:26.219846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.200683Z","title":"Transformers: State-of-the-art machine learning for pytorch, tensorflow, and jax","venue":null,"work_id":"41ee3567-d415-4c94-8907-da678287315e","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.348878Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:7e43a299fe10f8fc2fdebd2b2cf70df75e210120ad9f3f65cff54a79a9fbee0f","observation_id":"b35ca5c3-3979-435c-8e28-49b8e3f78cfc","resolution":{"observed_at":"2026-08-15T17:59:26.205532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.186643Z","title":"An empirical survey of data augmentation for time series classification with neural networks","venue":null,"work_id":"5bd8cbec-802e-4ae1-bb6b-dc22e946bb0e","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.352830Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:319be2f011a047353c222db6f99662a2ad2c153feab911b75ad4a3a37fd0e15b","observation_id":"a8d10155-e7e8-4edf-b305-c51f4b269ddc","resolution":{"observed_at":"2026-08-15T17:59:26.191554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.173214Z","title":"Katharopoulos, A","venue":null,"work_id":"7106be14-9327-4aec-b75b-9f469b2a1b81","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.357165Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:544ce21cd9ad2ff7a327f0934c544a0fa25bbd299246b53a048cde27c1f1b955","observation_id":"2e913e1d-44f5-4c50-98d0-0ec554898e92","resolution":{"observed_at":"2026-08-15T17:59:26.177627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.159963Z","title":"Reformer: The efficient transformer","venue":null,"work_id":"051634d7-aa44-4b28-9441-b509c61bcb2a","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.361347Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:54dac053a68e4bca7f5910018d9b9570cafaa5753842b51e14e4bc93ef1f0936","observation_id":"09c1b765-c89c-42dc-8aba-31811d20d31c","resolution":{"observed_at":"2026-08-15T17:59:26.164371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.146092Z","title":"Sequence parallelism: Long sequence training from sys- tem perspective","venue":null,"work_id":"371e00db-ca7a-4d65-bfd8-41716e534fc3","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.365969Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:0ab7b6d5be7a1d97c0ba4784dc7f59554e02d7a161d3c5ded76fe342c53efbef","observation_id":"f2a17ed6-74b4-4c32-97ab-2dc84f820da3","resolution":{"observed_at":"2026-08-15T17:59:26.151210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.132325Z","title":"Mvitv2: Im- proved multiscale vision transformers for classification and detec- tion","venue":null,"work_id":"068f3eb3-87f0-46a2-9d10-ecf683b7b1d4","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.370122Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:4815580501f23a7a3f5a6bd9c6ab1baf920c3fb8d1f0c51e081355ae9af903b6","observation_id":"8b3e01ac-e52f-415a-a6f3-2454d57caa58","resolution":{"observed_at":"2026-08-15T17:59:26.137162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.119677Z","title":"Efficientformer: Vi- sion transformers at mobilenet speed","venue":null,"work_id":"46690385-87ea-4836-9ccf-4665a790c786","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.374058Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:6b48242005a3d4fdec689e4f20474e92c4a8b49b1f6d71925dea191a73e0a17e","observation_id":"bb17e37d-ac4b-43f8-8176-fa7524e45327","resolution":{"observed_at":"2026-08-15T17:59:26.123873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01889","last_updated":"2023-11-27T06:38:47Z","snapshot_observed_at":"2026-08-14T10:14:18.862721Z","submitted_at":"2023-10-03T08:44:50Z","title":"Ring Attention with Blockwise Transformers for Near-Infinite Context","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01889","snapshot_observed_at":"2026-08-15T17:59:25.378070Z","title":"Ring attention with blockwise transformers for near-infinite context","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.378070Z"},"links":{"cited_paper":"/paper/2310.01889","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:34146ed30da71ddec72a705df822746c8c99c49a45da17ea9458effa6a7f0925","observation_id":"f6ee13b4-36fc-43fa-b932-88a4db6f26c0","resolution":{"observed_at":"2026-08-15T17:59:25.378070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-15T17:59:25.382444Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.382444Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:f9fa6a28cce22d397c7f8c8f6e67e835fa7b12aa6918fc9ca65bfe86edc00ecf","observation_id":"7b8adc2b-ecdf-4c52-8683-59e0fadc48ae","resolution":{"observed_at":"2026-08-15T17:59:25.382444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.106895Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"2646573c-de02-4e1a-ae15-9e1821dca06d","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.386674Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:48b6f6c76381d342b418397212df612eb0c9c8af293d5337332038ef9c04656c","observation_id":"918ca2aa-219e-424f-8732-02491fe6a18d","resolution":{"observed_at":"2026-08-15T17:59:26.111004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.093198Z","title":"Sgdr: Stochastic gradient descent with warm restarts","venue":null,"work_id":"4a132273-e124-47ac-8c01-adb3c5bef4d7","year":2017},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.390792Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:d5da7b1804630cc9aca8acdd993f82d397da87aab29ce11e59b21c97cc6223e7","observation_id":"23d30d51-e82c-401f-9cf4-4f67d03a0e5d","resolution":{"observed_at":"2026-08-15T17:59:26.097838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.078857Z","title":"Decoupled weight decay regular- ization","venue":null,"work_id":"58e60a81-f0a7-4913-87ed-29798eeda1f8","year":null},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.394907Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:cad1e9d4c917aa818d9d3b59a7e1a611e02655c809588840fd18d30bd847daa4","observation_id":"afaefcc2-3ff1-45a9-85a1-e3a223656ba1","resolution":{"observed_at":"2026-08-15T17:59:26.083666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.064544Z","title":"Token pooling in vi- sion transformers for image classification","venue":null,"work_id":"5ca04c0c-cc17-42f1-ba4d-5b970d87f544","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.399303Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:8b48d5bc275da67d79f446985a527eff5f387afce7905bce2a88b2c9b96b9385","observation_id":"d6781f67-41c5-4bf6-b199-d4e5fac58704","resolution":{"observed_at":"2026-08-15T17:59:26.069938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.051506Z","title":"Lo- cating and editing factual associations in gpt","venue":null,"work_id":"362762ef-da59-4959-95a3-a1cfd1ea0703","year":null},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.403328Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:6f77ebfe43b65db556be052974c10eb11835b3c795c326459ea42cfdc976af9a","observation_id":"ded4bb0b-b8c5-43c3-ad37-3e8c7564c964","resolution":{"observed_at":"2026-08-15T17:59:26.055908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.038486Z","title":"Scalable vision transformers with hierarchical pooling","venue":null,"work_id":"696958c3-d505-4c88-8b20-0c801a30eed8","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.407321Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:ee4571dc81ab507d311d19c3bdc69fd8b2893dd3406e3f2419e7fb673302faa2","observation_id":"de3fd62f-775f-42dc-bcbe-5e061e48957c","resolution":{"observed_at":"2026-08-15T17:59:26.042794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.024386Z","title":"Investigating efficiently ex- tending transformers for long input summarization","venue":null,"work_id":"f681cb2b-2525-4e90-b4c4-50bd3b3ff714","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.411439Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:99fdab7b15191d3f8ae115c35652f505484f8d7e20308805cb77dc860e86a1d5","observation_id":"e5223b9e-3647-40da-982b-cb780d597be6","resolution":{"observed_at":"2026-08-15T17:59:26.029374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.05682","last_updated":"2022-10-10T16:36:47Z","snapshot_observed_at":"2026-08-18T08:33:42.893303Z","submitted_at":"2021-12-10T17:25:07Z","title":"Self-attention Does Not Need $O(n^2)$ Memory","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.05682","snapshot_observed_at":"2026-08-15T17:59:25.415528Z","title":"Rabe and Charles Staats","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.415528Z"},"links":{"cited_paper":"/paper/2112.05682","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:9635e7028287942aead0feafe4ac66696f07009579d7c5b4cdcdb8cc1815441d","observation_id":"43ac81ea-8578-4a32-91fe-38ac259db8fc","resolution":{"observed_at":"2026-08-15T17:59:25.415528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-15T17:59:25.419888Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.419888Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:9784458f375f4ea42d0c68a9efc93a4ce27966d37ffd77bd296922b4dc62693c","observation_id":"ea68c8ca-08bd-443e-9ac4-bcea0df233a0","resolution":{"observed_at":"2026-08-15T17:59:25.419888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-15T17:59:25.424102Z","title":"Fast transformer decoding: One write-head is all you need","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.424102Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:09e6007a63e938875bf0cf5a4d726a8630168a3c6b500f74e45ef990ac5b0b9b","observation_id":"cf490f3b-ba2d-4c84-bc08-b07d41e60581","resolution":{"observed_at":"2026-08-15T17:59:25.424102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.011047Z","title":"Dropout: A simple way to prevent neural networks from overfitting","venue":null,"work_id":"c4dcbe9d-7c75-49f0-97de-61047c7a94b9","year":1929},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.428525Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:eb10a00882cb795f59557057745d1dec8917bddd7fd0d8d4abd44224092d02ab","observation_id":"8e568b0c-f1df-468c-a9e3-1b02f0a5ae8c","resolution":{"observed_at":"2026-08-15T17:59:26.015343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13739","last_updated":"2024-07-18T17:46:02Z","snapshot_observed_at":"2026-08-16T13:32:57.459072Z","submitted_at":"2024-07-18T17:46:02Z","title":"Scaling Granite Code Models to 128K Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13739","snapshot_observed_at":"2026-08-15T17:59:25.433055Z","title":"Cox, Ruchir Puri, and Rameswar Panda","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.433055Z"},"links":{"cited_paper":"/paper/2407.13739","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:e738943054019878e796600d8eb108e338e73a5c1707c103b421b2567a76bec2","observation_id":"d6b1d789-7f89-4778-bc55-3f9a920933e9","resolution":{"observed_at":"2026-08-15T17:59:25.433055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.997670Z","title":"Rethinking the inception architecture for computer vision","venue":null,"work_id":"bba9af7f-55dc-4b8e-808b-151c12ed4a9b","year":2016},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.438136Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:63ce95fd798d79157bbc9115ab6235dc0ff55c8d34f0bd1b7af60f87412cebb5","observation_id":"8b34aa8f-5245-4abd-bf37-e9ac6d438833","resolution":{"observed_at":"2026-08-15T17:59:26.002442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.984518Z","title":"Sparse sinkhorn attention","venue":null,"work_id":"9762e5b3-0b29-4ed6-908e-8563f65acf5a","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.442255Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:afb5526a53f4549d3f2d8f83c36bf6744adc1f2e54480473aff57758b9a2f551","observation_id":"27c25218-4a4c-4e58-b892-c55857594733","resolution":{"observed_at":"2026-08-15T17:59:25.988808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.971461Z","title":"Long range arena: A benchmark for efficient transformers","venue":null,"work_id":"eb1c7ca7-16a0-4b6b-8b8e-90536641d6a4","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.446268Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:e2ebc35eff3d33c709f3cc141fae54c63b6349e172d19ee08f9ef2b002b6a45e","observation_id":"c568d9a2-a81d-4380-97b2-11a0af045455","resolution":{"observed_at":"2026-08-15T17:59:25.975646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.957888Z","title":"Atten- tion is all you need","venue":null,"work_id":"5ca82842-b9af-4647-a62e-d292006a9fab","year":2017},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.450471Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:221cb89fe15979368897172c1b3ffa7f536be16f8f78ff22f2bb94a0d73e41e5","observation_id":"9b3e551d-34f2-4704-b71c-0c858959ce64","resolution":{"observed_at":"2026-08-15T17:59:25.962476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-15T17:59:25.454731Z","title":"Interpretability in the wild: a circuit for indirect object identification in gpt-2 small","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.454731Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:3bc588bc2c6a4e8fbf000f043d5b92d2ee58fcf10552275739e036f4bddf73e9","observation_id":"27f9710a-aefa-4135-8eab-6c0349fa9bd2","resolution":{"observed_at":"2026-08-15T17:59:25.454731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.943443Z","title":"Huang, Krzysztof Choromanski, Valerii Likhosherstov, and Adrian Weller","venue":null,"work_id":"b7ef39c3-e34c-42e0-9f6a-ba7beaf5287d","year":null},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.459274Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:9048dbfd7ae0176a7ff77fb2322497044dad71b4b843de10169f09a0eb150709","observation_id":"d3cefd6b-9bfa-48fd-bdbe-9f1891eb5021","resolution":{"observed_at":"2026-08-15T17:59:25.948665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.13604","last_updated":"2022-04-28T16:04:20Z","snapshot_observed_at":"2026-08-19T01:59:28.888414Z","submitted_at":"2022-04-28T16:04:20Z","title":"MeSHup: A Corpus for Full Text Biomedical Document Indexing","version":1},"cited_work":{"arxiv_id":"2204.13604","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.13604","snapshot_observed_at":"2026-08-15T17:59:25.600814Z","title":"MeSHup: A Corpus for Full Text Biomedical Document Indexing","venue":"cs.CL","work_id":"f430634b-8318-4290-84e5-aa543c228a24","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.464664Z"},"links":{"cited_paper":"/paper/2204.13604","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:96c2e4f259a0e2b2427ae15251f7d0a21ba1d82e17c9da30ae7a11cab7485a47","observation_id":"205864dc-13d0-4511-9f0b-658740b3868d","resolution":{"observed_at":"2026-08-15T17:59:25.605672Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.929566Z","title":"Pytorch image models","venue":null,"work_id":"e00f22db-3b13-4caf-9f23-bbbc4d63d2f0","year":2019},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.469293Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:d2b3f4cb93a81b227eca2efe5659af497d478c0ebb4854a1faf4b9b3efb1332a","observation_id":"aed7673b-bfe3-4ea9-8b30-3d74e96e3ed5","resolution":{"observed_at":"2026-08-15T17:59:25.934518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.915805Z","title":"Ef- fective long-context scaling of foundation models","venue":null,"work_id":"40a13d5b-7825-4e2f-87da-fa83d0d0a689","year":2024},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.473274Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:28a2a07fccfe7f8701d6fe1c62dd318d4d583de65c8002685c006856d1624a74","observation_id":"e5fe8155-0781-420d-a003-e7eaaacebf1c","resolution":{"observed_at":"2026-08-15T17:59:25.920457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.902417Z","title":"A-vit: Adaptive tokens for efficient vision transformer","venue":null,"work_id":"aa126dc7-263d-4613-836d-2dade4cbaa5a","year":null},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.477372Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:ff2541f9f8efceb52019b6bf1f1d4981187e000d2ca3154625202d4817781798","observation_id":"1da600db-4868-46d7-ac0d-f7ffa5f80bf4","resolution":{"observed_at":"2026-08-15T17:59:25.906773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07185","last_updated":"2023-05-19T21:09:11Z","snapshot_observed_at":"2026-08-16T15:33:42.352919Z","submitted_at":"2023-05-12T00:55:41Z","title":"MEGABYTE: Predicting Million-byte Sequences with Multiscale Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07185","snapshot_observed_at":"2026-08-15T17:59:25.481718Z","title":"Megabyte: Predicting million- byte sequences with multiscale transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.481718Z"},"links":{"cited_paper":"/paper/2305.07185","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:bd9372271f75ebae991b95c36772a4cfe6fc4f487e2c2ea988eaf32586e72edc","observation_id":"65337461-5d63-4e10-b756-0c38205a0dbe","resolution":{"observed_at":"2026-08-15T17:59:25.481718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.887865Z","title":"Metaformer is actually what you need for vision","venue":null,"work_id":"d5ae0355-da5f-4a37-8b00-b66934ab9020","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.486110Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:37b994c6e4f20a1fb88d454831ce49485cc058990296de83989053f8ac36a361","observation_id":"b1a65efb-5ebd-44f3-bf4f-7a6b80d8256e","resolution":{"observed_at":"2026-08-15T17:59:25.892725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.872067Z","title":"Cutmix: Regularization strategy to train strong classifiers with localizable features","venue":null,"work_id":"4f7ffca0-39f8-4992-bc0f-fc5b2f0e9cec","year":2019},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.490295Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:3eadebce93b944ab67eed4aa74e2bdfd5d642ff52de3abd676e68bb98df4cec7","observation_id":"c4b9783c-bed3-400d-8f7c-dd4510e5d740","resolution":{"observed_at":"2026-08-15T17:59:25.877463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.858693Z","title":"Big bird: Trans- formers for longer sequences","venue":null,"work_id":"87b93f15-4c8a-4acb-973b-a40a5133e23b","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.494565Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:1672e42c9daae973224f6ad96c1c972699c72cebb7d81cd874dc2e71bd364fe5","observation_id":"1768df0d-4863-4051-8548-0f4155c2aea5","resolution":{"observed_at":"2026-08-15T17:59:25.863098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.845015Z","title":"mixup: Beyond empirical risk minimization","venue":null,"work_id":"ba233df3-d23b-422d-9654-62c63a80d6e6","year":2018},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.498610Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:f45db00c46e9d1db1a4037cf1511d729bdd9909ae90f160cb939cb347fd7e513","observation_id":"c6651615-4d64-4f29-b1cc-0edb604dc96f","resolution":{"observed_at":"2026-08-15T17:59:25.849604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-15T17:59:25.502868Z","title":"Opt: Open pre-trained transformer language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.502868Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:f484f3f0851a7437e92b6ae8d1ccb8797554b7ba67e0804779b8ee6363e0922a","observation_id":"39cd3b71-1fcd-483c-8f13-9eaaa2c1e444","resolution":{"observed_at":"2026-08-15T17:59:25.502868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.831369Z","title":"Adavit: Adaptive vision transformers for efficient image recognition","venue":null,"work_id":"5a265575-c64d-4618-8219-cbfcd25ea0bc","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.507154Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:6f6fb7087734ef57d0383c0fa9dc31bbd28de86cf5c0be00db83ce9b0bbe2ca1","observation_id":"9db88336-7389-4943-966a-6d4c20ab901c","resolution":{"observed_at":"2026-08-15T17:59:25.835846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.817599Z","title":"Long-short transformer: Efficient transformers for language and vision","venue":null,"work_id":"a4d7038e-9e6c-4e90-928d-6e5c3c351664","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.511224Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:a7c0c7c55e9db4219e5fa392052cb2358d6a2ea1f3e4a38d97d790938138dc02","observation_id":"27b8126e-4ca5-4088-86e3-ad1eaa430b5f","resolution":{"observed_at":"2026-08-15T17:59:25.822039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10757","last_updated":"2023-03-19T20:21:29Z","snapshot_observed_at":"2026-08-19T05:41:53.994037Z","submitted_at":"2023-03-19T20:21:29Z","title":"Multiscale Audio Spectrogram Transformer for Efficient Audio Classification","version":1},"cited_work":{"arxiv_id":"2303.10757","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.10757","snapshot_observed_at":"2026-08-15T17:59:25.550292Z","title":"Multiscale Audio Spectrogram Transformer for Efficient Audio Classification","venue":"cs.SD","work_id":"052a83a4-f709-48f8-b97d-d598116f47e6","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.515340Z"},"links":{"cited_paper":"/paper/2303.10757","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:32fdaa0dee38ad7694f765d9b68835a253be96b8df4006a60d5f02be6f97a11b","observation_id":"feabdaa6-8dd1-42ba-857f-21e471ac9c98","resolution":{"observed_at":"2026-08-15T17:59:25.556777Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T06:35:41.074632Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":2,"verified_fuzzy":49},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 0 inbound Pith citation observations for arXiv:2507.19409."}