{"as_of":"2026-08-14T17:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b0b0077e4b54cc16bdf32661b16ab4baf7348758afb6b09fbe20ec1ba6d0ed2f","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T20:02:51.284788Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2511.21513/citation-record","integrity":"/paper/2511.21513/integrity","json":"/paper/2511.21513/citation-record.json","paper":"/paper/2511.21513"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.144056Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.144056Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:b7fe75a30a73e0198fdb9f90db88656bb98bdcf6ac48132e90118e7760931a49","observation_id":"86852760-e6b4-4c0b-83a4-da9595acb95b","resolution":{"observed_at":"2026-08-03T20:02:51.144056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.149256Z","title":"L., Gao, J., and Choi, Y","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.149256Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:35b6bfc43e97ced556ae9a3beb68accb865c7a9d9f9c2bdbda6912b9fd5cf533","observation_id":"c84ccaf8-56b2-449b-9ed2-791b10123512","resolution":{"observed_at":"2026-08-03T20:02:51.149256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-03T20:02:51.153441Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.153441Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:22240dc2ad1691e7b771cb75bc653bc123c42e415f1243b38c5d80b1407e7893","observation_id":"04d8b239-edb1-45a7-93a9-4933487bdb46","resolution":{"observed_at":"2026-08-03T20:02:51.153441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.159821Z","title":"Flashattention: Fast and memory-efficient exact attention with io-awareness","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.159821Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:95be1ca498e068e49494cdb4fd49879cfe67288b4501186c2ede7870e9a56dbd","observation_id":"4ce46f9b-7c26-4653-a9ce-1ead9397e79c","resolution":{"observed_at":"2026-08-03T20:02:51.159821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.164046Z","title":"Y., Ermon, S., Rudra, A., and Re, C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.164046Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:701a4cfcb9887652d3bbb596f62101c289f4a22674c71ad91339e0773c26ff33","observation_id":"be61cde2-7148-43ed-b3f4-e3c9734f2986","resolution":{"observed_at":"2026-08-03T20:02:51.164046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.167968Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.167968Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:01eee37a719740e4619da20e867c6073e1bbe3920ebb9cc0feac75995ad89248","observation_id":"54c859e9-edfa-4d98-a32f-1e93c536ea84","resolution":{"observed_at":"2026-08-03T20:02:51.167968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.171927Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.171927Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:c733d95a641c3c85bc624319d43743ad940c4a73ed32b0b7c213fe1b97c38f9b","observation_id":"cbd33151-75e6-41b0-881a-0028331e0d46","resolution":{"observed_at":"2026-08-03T20:02:51.171927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.176027Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.176027Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:5d0069a303cc22ca04b811c68f1528c2d0d2218ff596f2ee65c8a32ad390492f","observation_id":"11d39b75-9549-4535-8010-80b555a9d741","resolution":{"observed_at":"2026-08-03T20:02:51.176027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-03T20:02:51.179705Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.179705Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:d63eee0ffe761f5f131774c20d2ffc9c4f48db3aaaa58954374b4dd6a0ad6f8f","observation_id":"1217367b-54de-4bc3-b6f2-95bc54fbb18a","resolution":{"observed_at":"2026-08-03T20:02:51.179705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.183865Z","title":"The language model evaluation harness, 07 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.183865Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:f95b33ad2bf50e2e7c702acf5f3cfbb01871a1a6e6ea8a1c02c22d8aa086a8a6","observation_id":"329a9d90-5a8b-47e9-a247-d34504187587","resolution":{"observed_at":"2026-08-03T20:02:51.183865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-14T12:13:04.166386Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-08-03T20:02:51.187405Z","title":"I-llm: Efficient integer-only inference for fully-quantized low-bit large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.187405Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:6387a55e8c6248c7448b09aca8ccc8b746579e3e7a9cbf30bce005993b63c3b5","observation_id":"490beeb3-ca10-49cc-9299-4a0cf099750c","resolution":{"observed_at":"2026-08-03T20:02:51.187405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.191737Z","title":"Quantization and training of neural networks for efficient integer-arithmetic-only inference","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.191737Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:b72fd0901089dc362493bfa02da393c98b16d675056c098615559b24654afe9d","observation_id":"046de272-849a-4d1c-93c4-c85676288ec8","resolution":{"observed_at":"2026-08-03T20:02:51.191737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.195365Z","title":"Turboattention: Efficient attention approximation for high throughputs llm","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.195365Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:17cba4ff59da8a0cd86ee7b701ed1cbd2dfc4cf15834297c9729062bc7cd2682","observation_id":"fee7d037-74f3-49dc-bd2c-2b18d370faeb","resolution":{"observed_at":"2026-08-03T20:02:51.195365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.199071Z","title":"W., and Keutzer, K","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.199071Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:c5773e1e3ac93cff3511d89af79739f2cf10730a379f30644af3d924f47c71a9","observation_id":"9c088b77-6c98-458b-82e0-6f27a42b93aa","resolution":{"observed_at":"2026-08-03T20:02:51.199071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.203450Z","title":"H., Gonzalez, J., Zhang, H., and Stoica, I","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.203450Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:1aba9463bf827d98969ff708b60dd1b6a6a5c48e3aca655a884835a8ea113854","observation_id":"4a2fe4d2-4b8c-4993-b511-f0e0c2983514","resolution":{"observed_at":"2026-08-03T20:02:51.203450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.207028Z","title":"Questa: Expanding reasoning capacity in llms via question augmentation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.207028Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:b30ec43256909aa3372fb91446a4e3c57fae12c62a1e7ac2c2fd891a8fd39eb8","observation_id":"061d8ef5-b739-4585-9845-5e05d9f8d27f","resolution":{"observed_at":"2026-08-03T20:02:51.207028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.210703Z","title":"and Gu, Q","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.210703Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:2291af6ad8b2edd2e8696ed516e5f3e3547981ebe05047ac8ad3c40a7534c324","observation_id":"e7e1fb80-df5c-40a3-855c-12c2083e7513","resolution":{"observed_at":"2026-08-03T20:02:51.210703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.214398Z","title":"Consmax: Hardware-friendly alternative softmax with learnable parameters","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.214398Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:55fa3d169c24c4d7e8083b45b65d428fc52bf8972a48ae52058f18071becc662","observation_id":"dc5c4fc5-b139-4946-9b6a-4fc184816359","resolution":{"observed_at":"2026-08-03T20:02:51.214398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.218008Z","title":"Pointer sentinel mixture models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.218008Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:e86365ae00fd4b16b7bc92a6aa4bee7dad85103e7a2e3cfeedf202a0e63fa252","observation_id":"1154984f-4196-4ba9-b3c5-99a46332378e","resolution":{"observed_at":"2026-08-03T20:02:51.218008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.05433","last_updated":"2022-09-29T20:47:07Z","snapshot_observed_at":"2026-08-14T05:39:52.416140Z","submitted_at":"2022-09-12T17:39:55Z","title":"FP8 Formats for Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.05433","snapshot_observed_at":"2026-08-03T20:02:51.221841Z","title":"Fp8 formats for deep learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.221841Z"},"links":{"cited_paper":"/paper/2209.05433","citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:d7ef722e3dbffed76628f9a71f27995dcce171770cbe41066ac484d9f82ef36b","observation_id":"b8073b15-6f0c-4c36-9673-a62c7e0c72b1","resolution":{"observed_at":"2026-08-03T20:02:51.221841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.226114Z","title":"The lambada dataset: Word prediction requiring a broad discourse context","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.226114Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:37b6d86d40ce5bcfc248a98d413a569b90ab608f50b382483c6c5a924935a3fe","observation_id":"37879aaf-3a60-4857-83f5-e0033daa9c60","resolution":{"observed_at":"2026-08-03T20:02:51.226114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.229689Z","title":"W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., Askell, A., Mishkin, P., Clark, J., et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.229689Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:8d4ed7048426689b0c21286f60c1051b4f108e97fc6db8434ae1c5c2e9fe6a46","observation_id":"7b40a9c0-21b8-4794-bf82-33e59adf9d98","resolution":{"observed_at":"2026-08-03T20:02:51.229689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.233270Z","title":"L., Bhagavatula, C., and Choi, Y","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.233270Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:42724f19f0802af473664482632e69c63ba2d5b771351f399ac4122aeb5b7216","observation_id":"d39db26a-dfb7-47b5-8dac-aa3cb966c3d9","resolution":{"observed_at":"2026-08-03T20:02:51.233270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.237209Z","title":"Flashattention-3: Fast and accurate attention with asynchrony and low-precision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.237209Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:9050dfe99a386a82a1ab83f906188f4fef9f58d944d4142b1b85aca2832d8544","observation_id":"bc988903-3d45-44cc-b5ef-ff315387ccb5","resolution":{"observed_at":"2026-08-03T20:02:51.237209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.241048Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.241048Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:3b89596ecaae8c42495184f5d218be41aa80386946934ce5f3185b878767015a","observation_id":"c155ce13-584e-4da4-99f6-0bd270080904","resolution":{"observed_at":"2026-08-03T20:02:51.241048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.244758Z","title":"R., Venkatesan, R., Dai, S., Khailany, B., and Raghunathan, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.244758Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:b55f29f19d5f63e0fdc0d10ce351f876088898a99565340eaafb2458f85ccee4","observation_id":"52522623-20b6-4e82-a730-dc9ec9db5af8","resolution":{"observed_at":"2026-08-03T20:02:51.244758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-03T20:02:51.248806Z","title":"Gemma 3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.248806Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:efce3cf98ba5cda561a19bc878c764aed45aea82e920d5bca498a6ae51a0040f","observation_id":"f6d2b996-cdaf-44f6-9074-c3b7feb18445","resolution":{"observed_at":"2026-08-03T20:02:51.248806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.253229Z","title":"Training data-efficient image transformers & distillation through attention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.253229Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:a1176732a59dc1768f0c42ca147303e1405ff64a56bbbaff5666bfe385863101","observation_id":"f4d503c4-8374-47d4-940a-4519a3de6204","resolution":{"observed_at":"2026-08-03T20:02:51.253229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.257110Z","title":"Going deeper with image transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.257110Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:b0dbd7af88a27209270058ef1baf859aad914fe12470eeeb6feb6dd76cb06aad","observation_id":"2aabb028-e852-421f-8605-c1ce97d34e8c","resolution":{"observed_at":"2026-08-03T20:02:51.257110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.260861Z","title":"N., Kaiser, ., and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.260861Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:dc89806524b06c3b073fa9dfd52edce1cc896d7d329d503a45553a87ee14c10d","observation_id":"29b32b43-b3ec-469e-ad7d-c65424e52ed8","resolution":{"observed_at":"2026-08-03T20:02:51.260861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-03T20:02:51.264837Z","title":"Qwen3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.264837Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:da45caace1036014d5a12b8c9353e2ce9e050b7858e8635758ba90070fedc599","observation_id":"41b793be-d5ad-41c0-9a70-154b598a8100","resolution":{"observed_at":"2026-08-03T20:02:51.264837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.268840Z","title":"Hellaswag: Can a machine really finish your sentence? In Proceedings of the 57th Annual Meeting of the Association for Computational Linguistics, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.268840Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:48080bba71e98d52f2609d3a8f04e0df85e6768e3a423ba82214a9aff4026edf","observation_id":"5e58f2ae-53eb-455e-8da7-0c092b5a2c8c","resolution":{"observed_at":"2026-08-03T20:02:51.268840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.272636Z","title":"Sageattention2: Efficient attention with thorough outlier smoothing and per-thread int4 quantization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.272636Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:ae5a7f72a608307286b646ad98b0c0813fbe0c45caa57bebe358211d619c0827","observation_id":"5afe1b56-e159-4104-9da2-3a16cfa21c26","resolution":{"observed_at":"2026-08-03T20:02:51.272636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.276270Z","title":"Sageattention3: Microscaling FP 4 attention for inference and an exploration of 8-bit training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.276270Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:0839c4d2c891e58779d532675992e0de0973a82d0d47f6575a3a5dd3c1d85001","observation_id":"025b1bed-e5e5-43fb-9bd6-1303e4503a2f","resolution":{"observed_at":"2026-08-03T20:02:51.276270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:02:51.280162Z","title":"Sageattention: Accurate 8-bit attention for plug-and-play inference acceleration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.280162Z"},"links":{"citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:9d48947312997a3d51d70ed8a976b0978617e40f037337f2a405f37e141be339","observation_id":"c5759337-4c36-486b-b963-7d639996dd2e","resolution":{"observed_at":"2026-08-03T20:02:51.280162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-03T20:02:51.284788Z","title":"V., Mihaylov, T., Ott, M., Shleifer, S., Shuster, K., Simig, D., Koura, P","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.284788Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:f180a8246083b503651a06f4f1b56efe407fc7d55ad3036f7e77e0761d92c220","observation_id":"f0058924-423b-40c9-a6e8-8e7fcb9c5e2d","resolution":{"observed_at":"2026-08-03T20:02:51.284788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2511.21513."}