{"as_of":"2026-08-18T22:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1c3ee99c032fe90f219f262d2e995607c21978aa3888afa6cea1db09a0b760c4","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:06:14.458362Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.18960/citation-record","integrity":"/paper/2508.18960/integrity","json":"/paper/2508.18960/citation-record.json","paper":"/paper/2508.18960"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2104.05704","last_updated":"2022-06-07T19:25:30Z","snapshot_observed_at":"2026-08-18T19:47:27.998235Z","submitted_at":"2021-04-12T17:58:56Z","title":"Escaping the Big Data Paradigm with Compact Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.05704","snapshot_observed_at":"2026-08-05T16:06:14.398738Z","title":"Adi Haviv, Ori Ram, Ofir Press, Peter Izsak, and Omer Levy","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-18T19:48:11.579664Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.398738Z"},"links":{"cited_paper":"/paper/2104.05704","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:12d4f9ef8b522c99815608f48c45af530f17ec55613c138faefee02d14698662","observation_id":"ef8e7f9b-7ebc-4014-a6d5-e324f47afdb4","resolution":{"observed_at":"2026-08-05T16:06:14.398738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:06:14.404401Z","title":"doi: 10.18653/v1/ 2022.findings-emnlp.99","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-18T19:48:11.579664Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.404401Z"},"links":{"citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:39c10f70514a90b17ed915ca59ff1204c431f856acb766ea3113fc0796911235","observation_id":"0fe19501-ef97-4b5d-bdaa-df3de26baa2e","resolution":{"observed_at":"2026-08-05T16:06:14.404401Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01643","last_updated":"2025-02-16T14:14:16Z","snapshot_observed_at":"2026-08-18T19:48:48.047263Z","submitted_at":"2024-03-03T23:40:35Z","title":"Cost-Effective Attention Mechanisms for Low Resource Settings: Necessity & Sufficiency of Linear Transformations","version":3},"cited_work":{"arxiv_id":"2403.01643","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.01643","snapshot_observed_at":"2026-08-05T16:06:14.677876Z","title":"Cost-Effective Attention Mechanisms for Low Resource Settings: Necessity & Sufficiency of Linear Transformations","venue":"cs.LG","work_id":"375f2ca3-ee70-4da9-b8f8-645592be2884","year":2024},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-18T19:48:11.579664Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.416634Z"},"links":{"cited_paper":"/paper/2403.01643","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:d450193cef10dc2e5bf2840ed5bbd5e23b0cfa360ba5831dc42b5484e84dfaf6","observation_id":"64ad2ad0-021c-44ab-a671-194a217a42ed","resolution":{"observed_at":"2026-08-05T16:06:14.685538Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:06:14.436260Z","title":"doi: https://doi.org/10.1016/j.neucom.2023.127063","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-18T19:48:11.579664Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.436260Z"},"links":{"citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:1211de1a1fc013a7bd27edd987a5413c40ffb42930f76db9b9fe3e3d5c67cd68","observation_id":"464ad2bf-1c83-4c53-ae92-5278ebe1acc9","resolution":{"observed_at":"2026-08-05T16:06:14.436260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.15808","last_updated":"2021-03-29T17:58:22Z","snapshot_observed_at":"2026-08-16T18:35:28.619837Z","submitted_at":"2021-03-29T17:58:22Z","title":"CvT: Introducing Convolutions to Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.15808","snapshot_observed_at":"2026-08-05T16:06:14.447164Z","title":"Sangdoo Yun, Dongyoon Han, Seong Joon Oh, Sanghyuk Chun, Junsuk Choe, and Youngjoon Yoo","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-18T19:48:11.579664Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.447164Z"},"links":{"cited_paper":"/paper/2103.15808","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:7265bdfc84cface6f70c9050b63a82c15c88673b28222749506bb9233a1df185","observation_id":"342d9fec-7898-4ea9-95be-6a72925cb26a","resolution":{"observed_at":"2026-08-05T16:06:14.447164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6120","last_updated":"2014-02-19T17:26:57Z","snapshot_observed_at":"2026-08-14T23:50:45.351114Z","submitted_at":"2013-12-20T20:24:00Z","title":"Exact solutions to the nonlinear dynamics of learning in deep linear neural networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6120","snapshot_observed_at":"2026-08-05T16:06:14.422608Z","title":"Jay Shah, Ganesh Bikshandi, Ying Zhang, Vijay Thakkar, Pradeep Ramani, and Tri Dao","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-18T19:48:11.579664Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.422608Z"},"links":{"cited_paper":"/paper/1312.6120","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:26fb094e353d977aaafeaa5be26ddd92589a7960aefad5d131e87f062efcd528","observation_id":"77667219-add1-41bf-ad91-3d62c193366b","resolution":{"observed_at":"2026-08-05T16:06:14.422608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:06:14.767264Z","title":"Haiping Wu, Bin Xiao, Noel Codella, Mengchen Liu, Xiyang Dai, Lu Yuan, and Lei Zhang","venue":null,"work_id":"7f45b157-30b1-4614-88df-05dbbeccd874","year":2017},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-18T19:48:11.579664Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.442398Z"},"links":{"citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:9f4be6e71145801cad64a73f30bacf00c72eae16f40a1987683657b23298ccb6","observation_id":"7016da55-e739-4284-b39f-5450aca25335","resolution":{"observed_at":"2026-08-05T16:06:14.772291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-08-08T10:28:19.597631Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-08-05T16:06:14.458362Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-18T19:48:11.579664Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.458362Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:ca19c31f3c341871ac5a56b041831a4969bad2846b0982fcdb9b874fdd5f79d6","observation_id":"71035cb2-abc0-4f23-a82b-6351aeee45da","resolution":{"observed_at":"2026-08-05T16:06:14.458362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.04899","last_updated":"2019-08-07T07:15:29Z","snapshot_observed_at":"2026-08-14T16:33:23.205222Z","submitted_at":"2019-05-13T08:10:22Z","title":"CutMix: Regularization Strategy to Train Strong Classifiers with Localizable Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.04899","snapshot_observed_at":"2026-08-05T16:06:14.452828Z","title":"Hongyi Zhang, Moustapha Cisse, Yann N","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-18T19:48:11.579664Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.452828Z"},"links":{"cited_paper":"/paper/1905.04899","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:b52f11948d1910b7cbf20606a99103800223998d28051747cba524aee007c244","observation_id":"6a0494e5-daa6-470f-8828-76e349d8abaf","resolution":{"observed_at":"2026-08-05T16:06:14.452828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T16:06:14.393248Z","title":"Ali Hassani, Steven Walton, Nikhil Shah, Abulikemu Abuduweili, Jiachen Li, and Humphrey Shi","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-18T19:48:11.579664Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.393248Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:12ebd3428060f799e4a0c1f3774dafc8b12c6b806550aab5b6e6c36ceaa495f2","observation_id":"044f5c52-6736-4b19-92c1-876c51cb8275","resolution":{"observed_at":"2026-08-05T16:06:14.393248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:06:14.783290Z","title":null,"venue":null,"work_id":"d75d8505-1dde-4fed-9b55-643fad4cc846","year":2022},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-18T19:48:11.579664Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.382302Z"},"links":{"citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:994612df807c096036e1599425698c5fe9c15f3da34aa5e17ed28fe25dd08aca","observation_id":"907e4757-36ba-4359-a650-e6c9f1287ac8","resolution":{"observed_at":"2026-08-05T16:06:14.790009Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-08-13T19:48:28.322536Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-05T16:06:14.410154Z","title":"Peyman Hosseini, Mehran Hosseini, Ignacio Castro, and Matthew Purver","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-18T19:48:11.579664Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.410154Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:aec8b7b5c0f7c80d37b4c59e6b599f77107ba85b8f442b82641c2d3281628b39","observation_id":"81cad6fe-7339-4e3f-bcf8-472a4132a060","resolution":{"observed_at":"2026-08-05T16:06:14.410154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08608","last_updated":"2024-07-12T22:15:02Z","snapshot_observed_at":"2026-08-16T11:15:38.109255Z","submitted_at":"2024-07-11T15:44:48Z","title":"FlashAttention-3: Fast and Accurate Attention with Asynchrony and Low-precision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08608","snapshot_observed_at":"2026-08-05T16:06:14.428458Z","title":"Nitish Srivastava, Geoffrey Hinton, Alex Krizhevsky, Ilya Sutskever, and Ruslan Salakhut- dinov","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-18T19:48:11.579664Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.428458Z"},"links":{"cited_paper":"/paper/2407.08608","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:5e0bf2f675e270cc9051c6ae2fcd808cc2687f0f77f8172f90b6d98c98d0aa2d","observation_id":"ab679388-0a74-4ee0-97ca-0309649c3202","resolution":{"observed_at":"2026-08-05T16:06:14.428458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-05T16:06:14.387738Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-18T19:48:11.579664Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.387738Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:c93d9b852fda7cb5bc994da3497ab2ba20d3a32fec212d38f27284b79df8bc57","observation_id":"d041d17a-9a10-418e-8133-0e08fe6e8f56","resolution":{"observed_at":"2026-08-05T16:06:14.387738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T19:48:11.579664Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2508.18960."}