{"as_of":"2026-08-17T23:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:eba1fe1e259224b920a8434182005440ab0f5ead42c651e56bf09eff155a06d0","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:15:38.038041Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.16269/citation-record","integrity":"/paper/2504.16269/integrity","json":"/paper/2504.16269/citation-record.json","paper":"/paper/2504.16269"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:38.374481Z","title":"BERT: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":"3d9a4dd7-53d4-42da-aa4a-c8559a0809bd","year":2019},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:37.955391Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:418709ffe3292721f4d4f128b3a640a357826a5d98024b96940e0f49b4a548e3","observation_id":"d3121046-86bf-4293-be99-cd5f53378fed","resolution":{"observed_at":"2026-08-16T11:15:38.377906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-16T11:15:37.959940Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:37.959940Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:f01c86f30673d7ee69e49c643517c8c444ff6f1c82e20117c7788512065b80ec","observation_id":"bfbb6682-018a-43a0-8cdd-faa249ba2126","resolution":{"observed_at":"2026-08-16T11:15:37.959940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14368","last_updated":"2023-05-18T03:26:39Z","snapshot_observed_at":"2026-08-17T18:15:11.089318Z","submitted_at":"2023-05-18T03:26:39Z","title":"Support for Stock Trend Prediction Using Transformers and Sentiment Analysis","version":1},"cited_work":{"arxiv_id":"2305.14368","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.14368","snapshot_observed_at":"2026-08-16T11:15:38.244407Z","title":"Support for Stock Trend Prediction Using Transformers and Sentiment Analysis","venue":"q-fin.ST","work_id":"7242ec58-a243-49a1-8e9c-becc8e8afd13","year":2023},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:37.963603Z"},"links":{"cited_paper":"/paper/2305.14368","citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:5f4656fb0ca62ca29f6e5100467cf93dce0e709ecd9b2173f54210db84bc046d","observation_id":"0ceca926-fa07-43fc-93f5-0d8e91576f6e","resolution":{"observed_at":"2026-08-16T11:15:38.248437Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:37.967766Z","title":"Progprompt: Generating situated robot task plans using large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:37.967766Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:095f5ce034ebe262ea69e8641299df4afec8c7f6c58bd94b072f4628ed9a0ff6","observation_id":"9f2482bb-6b2f-400d-bc82-91a309800706","resolution":{"observed_at":"2026-08-16T11:15:37.967766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:38.359155Z","title":"Q8bert: Quantized 8bit bert,","venue":null,"work_id":"e8d6ae2e-181f-427c-a38b-c3825847eb78","year":2019},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:37.971312Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:7480cbc2b9725566b7df121f9d2e8e990daf0e64af1848cd670cefe77171ea4a","observation_id":"2f71a144-c15a-45b4-bfcc-bea16f91836e","resolution":{"observed_at":"2026-08-16T11:15:38.362613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:38.350090Z","title":"A fast post-training pruning framework for transform- ers,","venue":null,"work_id":"1eb3179c-b1c2-4a78-97b1-8e9d489874c3","year":2022},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:37.975215Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:61425a7e7fdcc74668656f451c6f084e723fc081adc85b86df71b829e3dd9811","observation_id":"0dfd2e6f-58b4-435d-86c5-a9f59e4b406f","resolution":{"observed_at":"2026-08-16T11:15:38.353408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:37.978935Z","title":"Accelerating binarized convolutional neural networks with software-programmable fpgas,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:37.978935Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:70b22078d5ccdda237193cf6889c5cea3fed815702e163a071a4dd26e914aed9","observation_id":"eaddfda0-1b22-4abf-81e4-63346d23f220","resolution":{"observed_at":"2026-08-16T11:15:37.978935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:37.982219Z","title":"Fracbnn: Accurate and fpga-efficient binary neural networks with fractional activations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:37.982219Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:274a29bd2a5e97ab4519869248ca0664a4172f9d157648d783972b44b6ee5acb","observation_id":"92d271b3-89ed-4066-84e8-f1175177dbdf","resolution":{"observed_at":"2026-08-16T11:15:37.982219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:37.985542Z","title":"A two-stage efficient 3- d cnn framework for eeg based emotion recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:37.985542Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:dc269686a87eb94752eec2471969437087dd6c151f5e26a87bf5c66775ac990b","observation_id":"3f03938b-9d07-4f74-816c-4fce777618c7","resolution":{"observed_at":"2026-08-16T11:15:37.985542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:37.988793Z","title":"Bnn an ideal architecture for acceleration with resistive in memory computation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:37.988793Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:79fd99b657ebd816a0f6d78c8e74ef42e0b511f3fb2a083d022012dd3315e868","observation_id":"60fc69be-d636-436d-ae2d-de62beb0ace5","resolution":{"observed_at":"2026-08-16T11:15:37.988793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.15701","last_updated":"2021-07-22T13:13:45Z","snapshot_observed_at":"2026-08-16T18:54:56.110272Z","submitted_at":"2020-12-31T16:34:54Z","title":"BinaryBERT: Pushing the Limit of BERT Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.15701","snapshot_observed_at":"2026-08-16T11:15:37.991950Z","title":"BinaryBERT: Pushing the limit of bert quantization,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:37.991950Z"},"links":{"cited_paper":"/paper/2012.15701","citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:a2bec9012cd0bbbced4b86645c53042e734a45f5beb9b692891bc62306c3d188","observation_id":"2113dc6b-6d27-4bac-bb0b-f38d1daa2cbb","resolution":{"observed_at":"2026-08-16T11:15:37.991950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.06390","last_updated":"2022-03-12T09:46:13Z","snapshot_observed_at":"2026-08-16T17:15:08.377369Z","submitted_at":"2022-03-12T09:46:13Z","title":"BiBERT: Accurate Fully Binarized BERT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.06390","snapshot_observed_at":"2026-08-16T11:15:37.995525Z","title":"BiBERT: Accurate fully binarized BERT,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:37.995525Z"},"links":{"cited_paper":"/paper/2203.06390","citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:b4e7cfe8c9616f43cb7f8a8e628f86a2f7d8e231131fb5c45460073caa3a48a4","observation_id":"d7cec287-32b2-433b-a699-eb8a1a2a1c13","resolution":{"observed_at":"2026-08-16T11:15:37.995525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:38.330021Z","title":"BiT: Robustly binarized multi-distilled transformer,","venue":null,"work_id":"d75bd709-9e65-404d-9f35-fa590da6d1cf","year":2022},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:37.998742Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:9bafde2835d69084b0ed12322c104f70b1a5426e123dc7aef7a648e6c9f38601","observation_id":"9a73db1a-3cda-4e81-aa8e-32dc808ef8fe","resolution":{"observed_at":"2026-08-16T11:15:38.333369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.12812","last_updated":"2020-10-10T07:24:54Z","snapshot_observed_at":"2026-08-09T20:46:06.940947Z","submitted_at":"2020-09-27T10:17:28Z","title":"TernaryBERT: Distillation-aware Ultra-low Bit BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.12812","snapshot_observed_at":"2026-08-16T11:15:38.001720Z","title":"TernaryBERT: Distillation-aware ultra-low bit BERT,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:38.001720Z"},"links":{"cited_paper":"/paper/2009.12812","citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:ff5641ba941e595db7ccc4c53dd735332003260063b90bbfe0dccc9f055a940e","observation_id":"70ebbc43-6be7-4460-a8be-25a17ccc92d9","resolution":{"observed_at":"2026-08-16T11:15:38.001720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:38.004880Z","title":"Yodann: An architecture for ultralow power binary-weight cnn acceleration,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:38.004880Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:df08194f30cb47787c25d3a88ca3aaea22e08f0d7f5b26daa24842d541b42caf","observation_id":"826a9d68-6930-4150-a1ad-0b471a5210a8","resolution":{"observed_at":"2026-08-16T11:15:38.004880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:38.314016Z","title":"Xnorbin: A 95 top/s/w hardware accelerator for binary convolutional neural networks,","venue":null,"work_id":"703b35aa-6fb0-4176-98a2-703e6136bef1","year":2018},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:38.008044Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:eb38e35058e3b483ff5c4126a684bb1d067cc5262e5e1bb3f77a18b450f2fda6","observation_id":"365f2947-c1e5-4f50-8915-734555fbb864","resolution":{"observed_at":"2026-08-16T11:15:38.317291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.06618","last_updated":"2022-02-18T18:54:59Z","snapshot_observed_at":"2026-08-16T17:27:47.338130Z","submitted_at":"2022-01-17T20:27:52Z","title":"VAQF: Fully Automatic Software-Hardware Co-Design Framework for Low-Bit Vision Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.06618","snapshot_observed_at":"2026-08-16T11:15:38.010939Z","title":"Vaqf: Fully automatic software-hardware co-design frame- work for low-bit vision transformer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:38.010939Z"},"links":{"cited_paper":"/paper/2201.06618","citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:d5e2d7172ec685d823b99d89ecfce04f7e2fa8bbdc42d9553e5ecfc9a0d6aa94","observation_id":"273c91f7-8a77-4898-8249-178c2dd8d50d","resolution":{"observed_at":"2026-08-16T11:15:38.010939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11851","last_updated":"2024-01-23T04:17:07Z","snapshot_observed_at":"2026-08-16T16:48:54.707867Z","submitted_at":"2024-01-22T11:14:08Z","title":"BETA: Binarized Energy-Efficient Transformer Accelerator at the Edge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11851","snapshot_observed_at":"2026-08-16T11:15:38.015372Z","title":"BETA: Binarized Energy-Efficient Transformer Accelerator at the Edge,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:38.015372Z"},"links":{"cited_paper":"/paper/2401.11851","citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:05967a68c1f822d9fbb3f12facbd143c29237e82bcec1cf7017df0ca170f8691","observation_id":"8395cc99-294e-4518-b907-0289579a650c","resolution":{"observed_at":"2026-08-16T11:15:38.015372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12070","last_updated":"2024-07-16T12:36:10Z","snapshot_observed_at":"2026-08-16T13:33:47.710559Z","submitted_at":"2024-07-16T12:36:10Z","title":"Co-Designing Binarized Transformer and Hardware Accelerator for Efficient End-to-End Edge Deployment","version":1},"cited_work":{"arxiv_id":"2407.12070","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.12070","snapshot_observed_at":"2026-08-16T11:15:38.075273Z","title":"Co-Designing Binarized Transformer and Hardware Accelerator for Efficient End-to-End Edge Deployment","venue":"cs.LG","work_id":"78dfc78e-2e81-4928-9089-55343764f65d","year":2024},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:38.018586Z"},"links":{"cited_paper":"/paper/2407.12070","citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:7d36e0b9b3027e598fa7f128761d68080655a9548fa024b68c09b95cd5312e37","observation_id":"89c044c6-ed3c-4a9b-943d-6913fa8b07d2","resolution":{"observed_at":"2026-08-16T11:15:38.080532Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:38.304199Z","title":"Flashattention: fast and memory-efficient exact attention with io-awareness,","venue":null,"work_id":"710daab9-7726-4a10-900c-c880f6bee5cc","year":2022},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:38.022081Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:01eaff7291cf9d486440f5484214ceddf602a2bbcf056dbfb36485f1dad5aff2","observation_id":"a921cb94-cf50-407e-a30b-76e790374474","resolution":{"observed_at":"2026-08-16T11:15:38.307499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-08-16T09:50:11.319379Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-16T11:15:38.025118Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:38.025118Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:ef62b94ead68cc70d2bf3276a932f24386fe36e2047ea525a2061f2b7aa0987c","observation_id":"3d7437ad-84f9-45b5-859a-c1ad926f7749","resolution":{"observed_at":"2026-08-16T11:15:38.025118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:38.294033Z","title":"Hardware acceleration of fully quan- tized bert for efficient natural language processing,","venue":null,"work_id":"82db1897-be97-4718-9f85-58dc85d7c52d","year":2021},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:38.029038Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:e6cb88d88617e1dfcb1c7db035e6a0e7c4f0abad85a017e35417e184f2a97bd7","observation_id":"84cb9c3a-e2ae-4f4e-8ae2-496a9ab9aec2","resolution":{"observed_at":"2026-08-16T11:15:38.297813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:38.284195Z","title":"Cosa:co-operative systolic arrays for multi-head attention mechanism in neural network using hybrid data reuse and fusion methodologies,","venue":null,"work_id":"14848019-814e-470f-82b4-9e92a7724aec","year":2023},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:38.032126Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:9e00c01894bd9454b25a28060140c3081e8aa8651a7ae22045b1459b73b4acc6","observation_id":"5e48b0fa-b08b-4ddc-b8c7-60bd77d8993d","resolution":{"observed_at":"2026-08-16T11:15:38.287644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:38.273720Z","title":"Transfru: Efficient deployment of transformers on fpga with full resource utilization,","venue":null,"work_id":"0310cc63-d88d-4dda-b5ec-44e06bd14ff0","year":2024},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:38.035153Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:a9f88572c05eced95ca3ebcc597d80c2609c4f42d9e85e44ffdb4f7845427051","observation_id":"bb22804f-3596-4e2c-81c3-6e838bd1dbe7","resolution":{"observed_at":"2026-08-16T11:15:38.277052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:15:38.263734Z","title":"Hamming weight — wikipedia, the free encyclopedia","venue":null,"work_id":"9d50043d-7adc-4b6a-bc3c-1d59736e9459","year":null},"citing_paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T11:15:38.038041Z"},"links":{"citing_paper":"/paper/2504.16269"},"observation_digest":"sha256:f11d3bec3f9a1de246ce25103110216b894b396525264395dcde89b5402ae588","observation_id":"d663d4ea-4b98-4c65-bfa4-5fad37c0a741","resolution":{"observed_at":"2026-08-16T11:15:38.267139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.16269","last_updated":"2025-04-24T18:13:19Z","latest_version":2,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-16T16:48:30.509952Z","submitted_at":"2025-04-22T21:03:43Z","title":"COBRA: Algorithm-Architecture Co-optimized Binary Transformer Accelerator for Edge Inference"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":2,"verified_fuzzy":10},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2504.16269."}