{"as_of":"2026-08-22T21:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e82078f96e1221e45a046f9d9c218c99b6f3e3db02dd6fdbd82b2bf4d93d24f4","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:59:21.733748Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.17245/citation-record","integrity":"/paper/2507.17245/integrity","json":"/paper/2507.17245/citation-record.json","paper":"/paper/2507.17245"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T14:59:15.809601Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:15.809601Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:c00d35b0c27a3ca4959cc42e7d3ef991f337606de128b9c238f113d9c3ea639f","observation_id":"232ab8e8-0c6f-42a3-bbd3-6da9baa9f452","resolution":{"observed_at":"2026-08-06T14:59:15.809601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-06T14:59:15.947288Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:15.947288Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:a6f972bf38c59df15515aff9fab1f03dae4da404cc916ea60fd15d61ca161565","observation_id":"c8d32dea-6d28-4bcd-8844-b4ce2b678eaa","resolution":{"observed_at":"2026-08-06T14:59:15.947288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:25.298055Z","title":null,"venue":null,"work_id":"eb7e5b6f-9bd4-48db-9afe-b494cf94bb47","year":2022},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:16.091060Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:9b85f2d8086887b995a9ee86b28d35c4939f35c30af983456b9a24659d9c9d50","observation_id":"cb186c9f-1eb2-42f1-941b-54f9dbe4372c","resolution":{"observed_at":"2026-08-06T14:59:25.356724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:16.200592Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:16.200592Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:b2bc7a7257e336a6ac0c806d93169fdc570a4eaddb8fc4c0509e443a04fa4c2e","observation_id":"853f1073-d9ec-4e71-bf89-46292efa64a0","resolution":{"observed_at":"2026-08-06T14:59:16.200592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:16.367152Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:16.367152Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:5cb832fa401625bb6dfa94b7bbedebb42c5fd019104fabb1c1f91e26a0ddf4e4","observation_id":"25b20105-c41f-4db3-8e6b-d410cc1381d1","resolution":{"observed_at":"2026-08-06T14:59:16.367152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:25.123555Z","title":null,"venue":null,"work_id":"58a16d3c-cf97-48ea-b7fd-80ecf1f32b17","year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:16.512501Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:aa2ec97b131da247947882f42af31fb1b1dff4f839e45c392036a3140bb1cb8b","observation_id":"2a50d29c-4eba-4b2b-9098-a6bf20a04d9a","resolution":{"observed_at":"2026-08-06T14:59:25.186070Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.999840Z","title":null,"venue":null,"work_id":"ad0e80a0-1c82-44c3-bb26-74dd28dfe643","year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:16.655409Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:c77d1bcd77d3540114265aa7d0df3c7eab7e2f2ee7bc5601ea43040b086377fd","observation_id":"9800c2b5-e3ea-4004-a220-09196fc83f1f","resolution":{"observed_at":"2026-08-06T14:59:25.058743Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:16.778790Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:16.778790Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:e71b928e22db2fecc92e6b8a5594b70e5290c6223885345814ba7f879a65a0a8","observation_id":"b64bbc2b-056e-4911-82bd-b795f2ec4943","resolution":{"observed_at":"2026-08-06T14:59:16.778790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.885942Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher Ré","venue":null,"work_id":"627b213a-52de-4bfd-94fe-1a26a4add54c","year":2022},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:16.904359Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:68c510f9bf9b652dc8ef9da1dee5605872f63e1587bf163f32ae586aa6423fb4","observation_id":"27652ce9-950f-4c16-8c7d-868084b14f85","resolution":{"observed_at":"2026-08-06T14:59:24.932126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:17.064513Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:17.064513Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:79d4184d09c261bc3d76c1eb4aea0bb3bb452cb07095ee70bc81e498ac62dbcd","observation_id":"f6823301-2c45-42cc-8a6c-65bc1a0c4098","resolution":{"observed_at":"2026-08-06T14:59:17.064513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T14:59:17.196470Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:17.196470Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:75152e78510ddf549ce1c6bf5a8ef11c6fcccf9eb14d6a4929c09f196532fdb5","observation_id":"9bed0c7a-70e5-48f3-a498-ec09ccf6b0b1","resolution":{"observed_at":"2026-08-06T14:59:17.196470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00314","last_updated":"2024-05-01T04:32:07Z","snapshot_observed_at":"2026-08-16T13:56:23.963769Z","submitted_at":"2024-05-01T04:32:07Z","title":"Model Quantization and Hardware Acceleration for Vision Transformers: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":"2405.00314","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.00314","snapshot_observed_at":"2026-08-06T14:59:22.023639Z","title":"Model Quantization and Hardware Acceleration for Vision Transformers: A Comprehensive Survey","venue":"cs.LG","work_id":"20c0f764-a763-48c2-8e31-947bf290f961","year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:17.399880Z"},"links":{"cited_paper":"/paper/2405.00314","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:268f83e0171d184c3cec4428ac535e328b814b5176565d47fe40dd6aaf4ca94d","observation_id":"20a646ab-cabe-49c6-bfa5-fac000e01ef2","resolution":{"observed_at":"2026-08-06T14:59:22.117502Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.741356Z","title":null,"venue":null,"work_id":"a992ad97-58b2-40ce-b824-c5f9d2c5c68a","year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:17.576673Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:deb111c5a5bb7d5f4431960410573105c9d71113d64355b3a29bb571667b3b8f","observation_id":"d057d2da-0cb7-45f2-884d-3476c81015e5","resolution":{"observed_at":"2026-08-06T14:59:24.798586Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11582","last_updated":"2024-06-17T05:59:24Z","snapshot_observed_at":"2026-08-20T22:45:31.022929Z","submitted_at":"2024-05-19T15:22:25Z","title":"SLAB: Efficient Transformers with Simplified Linear Attention and Progressive Re-parameterized Batch Normalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11582","snapshot_observed_at":"2026-08-06T14:59:17.671731Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:17.671731Z"},"links":{"cited_paper":"/paper/2405.11582","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:f0adbd0064b9034ca77f022e5b735dc2e46ed9d6b4d77f6bdd98711367e16fc2","observation_id":"47933c8a-f709-4c3e-89b0-46ed2084c6a5","resolution":{"observed_at":"2026-08-06T14:59:17.671731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.614281Z","title":null,"venue":null,"work_id":"501dc501-e9e0-4115-8a96-6e7322953799","year":2023},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:17.882438Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:61a7553f296bb622fbd0b394d3777fb88f6e0e0771ef3e74a642910e2c808697","observation_id":"14a700cd-df99-4479-85ef-b87b0fc22d22","resolution":{"observed_at":"2026-08-06T14:59:24.677589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06590","last_updated":"2024-12-09T15:44:22Z","snapshot_observed_at":"2026-08-11T19:27:26.067106Z","submitted_at":"2024-12-09T15:44:22Z","title":"Bridging the Divide: Reconsidering Softmax and Linear Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06590","snapshot_observed_at":"2026-08-06T14:59:18.113221Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:18.113221Z"},"links":{"cited_paper":"/paper/2412.06590","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:33f19f3ee7f74695ea581d4c8c2465ce4c458e488fc04e56ecd97b840cda3b7c","observation_id":"25b65990-dd71-49d6-8079-c1af9ea10c72","resolution":{"observed_at":"2026-08-06T14:59:18.113221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.455214Z","title":null,"venue":null,"work_id":"9de642c2-ad3f-4840-a423-1860902b6fb4","year":2025},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:18.216602Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:d75e98440221ea3b6182ab1c87ad365f9e41acc5033a1d0323aabe8ea4e2ba99","observation_id":"8205a9bf-81b8-4f8f-bc92-534e2b17dfd5","resolution":{"observed_at":"2026-08-06T14:59:24.509718Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05869","last_updated":"2023-12-01T17:43:06Z","snapshot_observed_at":"2026-08-16T14:53:44.947197Z","submitted_at":"2023-10-09T17:05:25Z","title":"HyperAttention: Long-context Attention in Near-Linear Time","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05869","snapshot_observed_at":"2026-08-06T14:59:18.324072Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:18.324072Z"},"links":{"cited_paper":"/paper/2310.05869","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:4fb3029e881d6a62b2405bd0682742a6bfc339ac9b2f07465121e84a5489c199","observation_id":"5214b05d-ff75-468e-be1d-1233b187f920","resolution":{"observed_at":"2026-08-06T14:59:18.324072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.331547Z","title":null,"venue":null,"work_id":"bb4f68bd-0809-4a10-be94-e8e5ddb6b840","year":2019},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:18.505631Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:4d07f4081b98084ed901cd598b7f3c0cced506dbe4122e307ab5ea548fcbb770","observation_id":"ccbc15de-4a5b-422c-a9ff-c493ab6288f6","resolution":{"observed_at":"2026-08-06T14:59:24.388665Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:18.696047Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:18.696047Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:7d0d97f2685e4e57120235d7a4e87dce11e3798b3f24dd041059b08d4fc35075","observation_id":"b22d12ad-d125-42f1-8507-8f76a635d994","resolution":{"observed_at":"2026-08-06T14:59:18.696047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.04451","last_updated":"2020-02-18T16:01:18Z","snapshot_observed_at":"2026-07-06T08:50:12.690900Z","submitted_at":"2020-01-13T18:38:28Z","title":"Reformer: The Efficient Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.04451","snapshot_observed_at":"2026-08-06T14:59:18.845528Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:18.845528Z"},"links":{"cited_paper":"/paper/2001.04451","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:d3a4914a250b889fcfce9396916b7927c04cbedf334644f0b51b71a2a016e11f","observation_id":"dda31b12-52f4-4c02-824b-809c8ae71f65","resolution":{"observed_at":"2026-08-06T14:59:18.845528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.200129Z","title":null,"venue":null,"work_id":"2e29abef-b73c-4bb8-a3d2-5d31d8daea64","year":2009},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:18.941134Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:378f783e2a40c4392cbeea3a294fbe01ebd6eeeb6fdce52b99c4ee8baa6690e2","observation_id":"a50bd99a-e0e6-4fc8-a3a7-e113e27f20d1","resolution":{"observed_at":"2026-08-06T14:59:24.253857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:19.021449Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.021449Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:5043c49ee600820798ab50c095750b06796700e55087fea4741781c0eff511f7","observation_id":"23c8d610-2da9-4c6f-afc0-ae723a30e647","resolution":{"observed_at":"2026-08-06T14:59:19.021449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02530","last_updated":"2024-10-30T04:55:26Z","snapshot_observed_at":"2026-08-17T01:30:14.271006Z","submitted_at":"2024-10-30T04:55:26Z","title":"A Comprehensive Study on Quantization Techniques for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02530","snapshot_observed_at":"2026-08-06T14:59:19.104376Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.104376Z"},"links":{"cited_paper":"/paper/2411.02530","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:6303d3d86b1515dd2e312117f0be7772ad09c06c63275c2b8e4944eced8f5de2","observation_id":"d6f709c2-6e21-423a-a986-1a040325a841","resolution":{"observed_at":"2026-08-06T14:59:19.104376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.012675Z","title":null,"venue":null,"work_id":"7caf5153-47cd-4b39-8432-f9c6f332e70d","year":2016},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.168451Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:00b7b63b6f53c7fb78c8a344fd2a510a3309faf1b326e0adaf69b6a7f2111a81","observation_id":"c0166071-2d08-4c7e-8fc4-fe8dfc0e2836","resolution":{"observed_at":"2026-08-06T14:59:24.092820Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:23.832598Z","title":null,"venue":null,"work_id":"6a31b897-9d47-49a3-926e-1ca35f23072b","year":2023},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.310754Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:1f05a079d9840ceb9c9dea42662e9b42bf006fba6a11bb932cf3d48ccfa95d7d","observation_id":"3a5794f8-8820-4db6-9774-a47ccbd7f82b","resolution":{"observed_at":"2026-08-06T14:59:23.920943Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:23.650007Z","title":null,"venue":null,"work_id":"317c381e-cb9e-457a-b423-207f6f72397a","year":2021},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.501588Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:d822def2eca2d722213477a8fe97ec51bbc7250fad0c7f4d42efde3c03046bbb","observation_id":"0e23106d-e2ed-47b8-8a18-9bad230eeb67","resolution":{"observed_at":"2026-08-06T14:59:23.746641Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:23.489869Z","title":null,"venue":null,"work_id":"f7b67d37-5682-4a86-af74-96554af441d1","year":2022},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.670900Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:4526dc1f4722f2de6f92a69d8d1484f5e70bab3826a11387b884a0ffb68e744f","observation_id":"5ea1efeb-6db7-4dcb-8c82-6ab2ec3cf01b","resolution":{"observed_at":"2026-08-06T14:59:23.575714Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.06139","last_updated":"2017-12-27T20:43:02Z","snapshot_observed_at":"2026-08-14T20:02:52.239357Z","submitted_at":"2017-12-17T16:36:26Z","title":"TensorFlow-Serving: Flexible, High-Performance ML Serving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.06139","snapshot_observed_at":"2026-08-06T14:59:19.840455Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.840455Z"},"links":{"cited_paper":"/paper/1712.06139","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:6f455250b9f6cdbdc51f5c8feb56ce3a50589bea325be4dd8ca46e2150243678","observation_id":"df312a47-caff-40ad-94a3-6d0dc3dd3f8f","resolution":{"observed_at":"2026-08-06T14:59:19.840455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:19.896901Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.896901Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:882a1fa3dbe8b92ce7fa05233f113a19c548bcbaec82f6c2411f78ae5111a4bf","observation_id":"e2a9fbf6-546c-4d99-a0c7-2777f3b680aa","resolution":{"observed_at":"2026-08-06T14:59:19.896901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.14995","last_updated":"2024-01-19T07:47:01Z","snapshot_observed_at":"2026-08-16T15:12:45.594763Z","submitted_at":"2023-07-27T16:45:33Z","title":"TransNormerLLM: A Faster and Better Large Language Model with Improved TransNormer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.14995","snapshot_observed_at":"2026-08-06T14:59:20.061853Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.061853Z"},"links":{"cited_paper":"/paper/2307.14995","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:d98701e7e92380e96ae65739e9f95c9f4384d6d6830fbab5fcaa58ef6e802eca","observation_id":"28c342ae-0647-47e7-a519-eac408e4d8e7","resolution":{"observed_at":"2026-08-06T14:59:20.061853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:23.310570Z","title":null,"venue":null,"work_id":"4d1f6d06-e94e-4a9c-a244-338d55abc299","year":null},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.189854Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:beae0d948cd315677c7eb1e7bc4035e5ae1df1d9c451bea7b6a499e0a0756a95","observation_id":"560a7101-d369-4b59-b209-ab02802a1225","resolution":{"observed_at":"2026-08-06T14:59:23.406700Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:20.348857Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.348857Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:2bcb96786a0a5a33ae31ce86a071d9c3ee31d4ec9ed239d60ce4ca26c87e04ce","observation_id":"8525dec2-83a5-4206-b745-57e1d913c59c","resolution":{"observed_at":"2026-08-06T14:59:20.348857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:23.110540Z","title":null,"venue":null,"work_id":"835cb3ae-b886-42f7-aa96-ec337ea0d31b","year":2021},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.429659Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:a9bf826424e363f47194f18fb031c34dd9685d4c76ebb2c2fbeeb9d5e65a7cd4","observation_id":"dbb424ee-46cc-4566-9a2e-7a50c362952f","resolution":{"observed_at":"2026-08-06T14:59:23.192806Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05964","last_updated":"2024-04-07T13:03:58Z","snapshot_observed_at":"2026-08-18T13:11:45.136886Z","submitted_at":"2024-02-05T12:16:28Z","title":"A Survey on Transformer Compression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05964","snapshot_observed_at":"2026-08-06T14:59:20.593821Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.593821Z"},"links":{"cited_paper":"/paper/2402.05964","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:6fc0280cf86f369b4e5c5347f349d9a5e91eb76627dd8674f064eda8e9ce9dfc","observation_id":"f9663580-685a-44e5-9093-ea1f5b4e7451","resolution":{"observed_at":"2026-08-06T14:59:20.593821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-21T05:15:28.840279Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-06T14:59:20.706090Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.706090Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:b5d5c596fb9cdc6916021c7b9f2d2103bbcd001a3d353c89787b8fd53dd716c4","observation_id":"c509138d-2cdd-4431-910f-d23168e84d80","resolution":{"observed_at":"2026-08-06T14:59:20.706090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:22.958054Z","title":null,"venue":null,"work_id":"0694b762-8bab-4964-8f35-e32cace01ba1","year":2021},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.862710Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:bcbb6f43ee89b4c923908412c532f65b8e19035c77101c3ef4973c44ff3411f6","observation_id":"39df773b-f0d2-4945-b96e-a9d059d5c6ea","resolution":{"observed_at":"2026-08-06T14:59:23.054451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:20.914884Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.914884Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:8c0215aa475e2f5688fcd5530a5831b92b98924d30d9e9fc3f09d8ccc83676cd","observation_id":"4a0b605c-a264-47c1-9dfc-31f9b0173d4b","resolution":{"observed_at":"2026-08-06T14:59:20.914884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:20.972111Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.972111Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:c035f823bca7747b527f437f15a17ecac3d44317119049bd30b1ccd0c0ef2b2a","observation_id":"ecb22aa5-09e3-4e34-b2b3-737ea5f9f037","resolution":{"observed_at":"2026-08-06T14:59:20.972111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-06T14:59:21.049806Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.049806Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:7c628e94a4895fb9983d46693d5cbe522f1a6d7615dc6821949f23cc5ea9bb27","observation_id":"83cc35d0-77fb-4e13-b36d-db750f6faa65","resolution":{"observed_at":"2026-08-06T14:59:21.049806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:22.778400Z","title":null,"venue":null,"work_id":"40b5ae68-2e4e-437e-bc48-41575980391c","year":null},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.156696Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:1d55a935184dfe43dd0be2ae4155760e32761ad41f67ef28d618d044ab247451","observation_id":"35adaee9-69b3-4298-bc5c-0dd14f8d5da5","resolution":{"observed_at":"2026-08-06T14:59:22.858727Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08237","last_updated":"2020-01-02T12:48:08Z","snapshot_observed_at":"2026-07-31T22:49:43.034741Z","submitted_at":"2019-06-19T17:35:48Z","title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08237","snapshot_observed_at":"2026-08-06T14:59:21.331681Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.331681Z"},"links":{"cited_paper":"/paper/1906.08237","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:76cbdefde8a6799d90b6109c782aed83c0189a2c62a7758b548d7d3c6c0f8fb8","observation_id":"20f7b23b-bd89-4346-8287-6bd575492ba7","resolution":{"observed_at":"2026-08-06T14:59:21.331681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","snapshot_observed_at":"2026-08-20T01:25:02.234471Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08413","snapshot_observed_at":"2026-08-06T14:59:21.220570Z","title":"arXiv:2406.08413 [cs.AR] https://arxiv.org/abs/2406.08413 Conference acronym ’XX, June 03–05, 2018, Woodstock, NY Trovato et al","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.220570Z"},"links":{"cited_paper":"/paper/2406.08413","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:95da9e2dd76791309a603de9f2790df33f6b471950488015c02750cff4f41c65","observation_id":"313ba47d-2924-4ce0-8580-18c49df2de96","resolution":{"observed_at":"2026-08-06T14:59:21.220570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:22.592081Z","title":null,"venue":null,"work_id":"9220448d-8012-4c87-a950-17f7648134f3","year":2022},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.467894Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:a6801b45be2ef3b84cc49779179e34785f559cba75074c2441d88674e51a3183","observation_id":"e3175271-c62d-4913-b8aa-8c9d1aff1d47","resolution":{"observed_at":"2026-08-06T14:59:22.672705Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07368","last_updated":"2024-07-25T17:18:01Z","snapshot_observed_at":"2026-08-16T13:44:07.761054Z","submitted_at":"2024-06-11T15:34:43Z","title":"When Linear Attention Meets Autoregressive Decoding: Towards More Effective and Efficient Linearized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07368","snapshot_observed_at":"2026-08-06T14:59:21.394850Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.394850Z"},"links":{"cited_paper":"/paper/2406.07368","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:313e76e0a9bcf1a99b5e038ad08447eaed45c915188acf5e21f3136db312de9b","observation_id":"8b144df7-8c9a-4500-ba33-d383d03d7bc4","resolution":{"observed_at":"2026-08-06T14:59:21.394850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:21.631803Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.631803Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:47551bdaa7df4e64e24661f1a3c7a4080af1fa3591263d773859a0fe2bcba6e7","observation_id":"32a31ad1-a1c8-4d45-be76-6e12284c7cfb","resolution":{"observed_at":"2026-08-06T14:59:21.631803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:22.417628Z","title":null,"venue":null,"work_id":"10462232-b8b7-40d7-93e4-60e2c4e7ce18","year":2023},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.550685Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:154922b5ec1c8a843c13f43cc40e3e3062d464bd0b81f2f76adfd017295655af","observation_id":"1a9a3706-375f-4c58-8f05-5aac9adcb364","resolution":{"observed_at":"2026-08-06T14:59:22.487020Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:22.230347Z","title":null,"venue":null,"work_id":"ce40975f-6829-436b-a83e-fe04b786a74c","year":2021},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.733748Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:5732eebc7a39084656e933e1cb8c44a73d809cb2c30253c35004f3c100d3b92a","observation_id":"efe63d3a-fc0a-4bcb-8d9a-0af527e8ccc9","resolution":{"observed_at":"2026-08-06T14:59:22.302708Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04658","last_updated":"2024-01-15T14:57:29Z","snapshot_observed_at":"2026-08-21T15:05:39.649419Z","submitted_at":"2024-01-09T16:27:28Z","title":"Lightning Attention-2: A Free Lunch for Handling Unlimited Sequence Lengths in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04658","snapshot_observed_at":"2026-08-06T14:59:20.274728Z","title":"arXiv preprint arXiv:2401.04658 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.274728Z"},"links":{"cited_paper":"/paper/2401.04658","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:4b55095976331609d34180734eca89474aa31674a51b8d36f78dbd3c3f367982","observation_id":"4417498f-24f2-49bf-9455-b66670c7696b","resolution":{"observed_at":"2026-08-06T14:59:20.274728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T13:12:24.804116Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2507.17245."}