{"as_of":"2026-08-10T20:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1c6d39d8986539df7567e4c1794be840440dfae70f1771bf3ca986a73e8ae745","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:06:30.520235Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.16346/citation-record","integrity":"/paper/2505.16346/integrity","json":"/paper/2505.16346/citation-record.json","paper":"/paper/2505.16346"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:29.398472Z","title":"Visualizing size of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.398472Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:ba406f7df84137910309740557ebe1ac940f1eaf66d85507c616ee5e066e5114","observation_id":"c44066fd-fa82-459e-ac9a-e92d9805bfd9","resolution":{"observed_at":"2026-08-07T15:06:29.398472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:32.133099Z","title":"Trends in deep learning hardware,","venue":null,"work_id":"d1045393-f907-4728-bd05-4eb40bd39f8f","year":2024},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.403476Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:24fe423707fa4000af49afa4090582a2de77399da73758ca5a24e36c9dbab925","observation_id":"14d25844-d249-4f4c-977e-e25c5c79aa5c","resolution":{"observed_at":"2026-08-07T15:06:32.138137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:32.109175Z","title":"Roofline: an insightful visual performance model for multicore architectures,","venue":null,"work_id":"85576604-dc2d-45f8-8ebb-db60f7b42c93","year":2009},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.408467Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:39c4568818475828fa4e397cd0894d347339acc34576c8a081b541bfa2015b55","observation_id":"7086185c-8b13-4bc9-9546-2fd5afc2a679","resolution":{"observed_at":"2026-08-07T15:06:32.113461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:32.091560Z","title":"Eyeriss: A apatial architecture for energy-efficient dataflow for convolutional neural networks,","venue":null,"work_id":"89ba89f3-bc71-42a7-a58e-241a0f766ad9","year":2016},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.412848Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:ed5022d678c5ca89f8778f8452abd1dbaa5165ecd980329e8abb72cebf983b2f","observation_id":"83c26e29-7cd7-4049-b5c9-4c43790a0f65","resolution":{"observed_at":"2026-08-07T15:06:32.096760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:32.072440Z","title":"Roofline performance analysis of dnn architectures on cpu and gpu systems,","venue":null,"work_id":"cee3300d-8405-478b-96b3-a57f02dc1b1b","year":2024},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.419412Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:061c5efde530e04fdc8b54c03e3ca60d73301a9ae849be39682e8bb6b9c3ba44","observation_id":"dba73b76-278c-45fe-8064-49a7104e97cc","resolution":{"observed_at":"2026-08-07T15:06:32.079775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:32.040261Z","title":null,"venue":null,"work_id":"71b893ec-1a9b-4357-90d7-3a53a48693c7","year":2010},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.424820Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:a7976af3fe833126c0df9aaa842d02f0559d054afa5ee4af02697f2c8d659dbc","observation_id":"3bc34efd-f60a-415e-b5a8-0faad797ffe0","resolution":{"observed_at":"2026-08-07T15:06:32.048841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:32.023615Z","title":"Understanding reuse, performance, and hardware cost of dnn dataflow: A data-centric approach,","venue":null,"work_id":"56db4f99-a288-4372-9767-818fe8f05615","year":2019},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.438721Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:152b13a3be96e59bd9cf5ea9974896c63d2c76e26b75efd4ca96335f41b51989","observation_id":"5ebbde3f-f00f-4f35-a464-fe03ea9f0e38","resolution":{"observed_at":"2026-08-07T15:06:32.028318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:32.002273Z","title":"A roofline model of energy,","venue":null,"work_id":"5e3f6132-7bfb-4b95-bea3-47e91e7e6f3a","year":2013},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.443914Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:6c43397713e55d32ddc7df0706bb3eaf8a2556f3a9576038c6a793419ba4722e","observation_id":"191aa578-ee30-4289-a75c-2836b4ec5a45","resolution":{"observed_at":"2026-08-07T15:06:32.008663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.986646Z","title":"Symphony: Orchestrating sparse and dense tensors with hierarchical heterogeneous processing,","venue":null,"work_id":"87eb65ca-e48c-4644-93b4-b663adaa55a7","year":2023},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.449801Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:8ae87073becc10c057f6d43860ab559b19056953e47dda51d0cb7c17b8a8bc90","observation_id":"2db46215-a0bb-4c48-84f7-8a8d5ad0049d","resolution":{"observed_at":"2026-08-07T15:06:31.991855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.970967Z","title":"Lots of questions on Google’s “Trillium","venue":null,"work_id":"70e02035-106e-44f1-886e-1ea03e3a8760","year":2024},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.455217Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:c4330707533bc3cdd01281353c193ceeb5ab77d7b374ac020d71387ceed86d76","observation_id":"79867109-ebbf-4d1d-8b49-b0c9761378ec","resolution":{"observed_at":"2026-08-07T15:06:31.976054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.954391Z","title":"Envi- sion: A 0.26-to-10tops/w subword-parallel dynamic-voltage-accuracy- frequency-scalable convolutional neural network processor in 28nm fdsoi,","venue":null,"work_id":"903fc061-463e-4031-9948-548ab85f0a54","year":2017},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.461094Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:e2c1a771098db418d7382cd35deae835853ac1bb99248ac52b1da1513fa1432d","observation_id":"fcbb83b6-24a5-426b-b612-a27c077aa0f7","resolution":{"observed_at":"2026-08-07T15:06:31.959854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.933535Z","title":"9.5 a 6k-mac feature-map-sparsity-aware neural processing unit in 5nm flagship mobile soc,","venue":null,"work_id":"111c151b-1fbe-47fe-ac7d-f0a3f986c572","year":2021},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.468026Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:252c2a251ef3860cdf24021988deff96ad9340ca117392550796905a25665f3c","observation_id":"03919dc5-ba5d-4c84-a46c-846a3f0ba0cc","resolution":{"observed_at":"2026-08-07T15:06:31.939247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.916665Z","title":"Compute solution for tesla’s full self-driving computer,","venue":null,"work_id":"b8032d20-e006-40f4-a9af-0cbc59778518","year":2020},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.472900Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:c508b28ddf898933e2c925095cd36d68226c6b4bc1061ac8f55a70cc563ddd7b","observation_id":"563c3ace-a04a-40e0-b028-5fc467f91985","resolution":{"observed_at":"2026-08-07T15:06:31.921995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.897477Z","title":"7.2 a 12nm programmable convolution-efficient neural- processing-unit chip achieving 825tops,","venue":null,"work_id":"38e43981-b595-42b3-8c7f-7e5472fbb4cd","year":2020},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.477473Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:9145e1c107ff86819c80a4605c0fb5f279d38e814cc445e9dd30633fe5120930","observation_id":"a7c94c0d-2efb-4268-8c84-19ebc1307c38","resolution":{"observed_at":"2026-08-07T15:06:31.902241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.871981Z","title":"Groq rocks neural networks,","venue":null,"work_id":"d7a6453a-771d-4f5c-af87-7e6dbbaa226f","year":2020},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.484255Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:5eef8d756cf7f2b963f798b007bb18ee282af6db5dc919979bcb42a22b65db1b","observation_id":"d74fe782-4893-4413-82b4-4950a2811a22","resolution":{"observed_at":"2026-08-07T15:06:31.883652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.854499Z","title":"9.1 a 7nm 4-core ai chip with 25.6tflops hybrid fp8 training, 102.4tops int4 inference and workload-aware throttling,","venue":null,"work_id":"446b218c-5962-4632-8b83-e4006f353de6","year":2021},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.491187Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:dd53dc9b4fe98091a9ed7477170b2bc11fbeb7a372cac992ffc45fd8a20dea01","observation_id":"db943f5f-3a0c-4ed3-b6d0-bdf3d7e97261","resolution":{"observed_at":"2026-08-07T15:06:31.859940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.834726Z","title":"16.7 a 40-310tops/w sram-based all-digital up to 4b in-memory computing multi-tiled nn accelerator in fd-soi 18nm for deep-learning edge applications,","venue":null,"work_id":"0391d17e-67a8-4c49-a690-1196e2903b12","year":2023},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.501017Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:d98e221605eda5328fad4cc6496ae6d678e41c6b28de60b282b74b4a7fe24383","observation_id":"21688fde-3472-4885-9133-5e67b0f4bbc7","resolution":{"observed_at":"2026-08-07T15:06:31.841139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:29.512744Z","title":"Charm: Composing heterogeneous accelerators for matrix multiply on versal acap architecture,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.512744Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:055d568452a99adc77f9e07d74cdb8e77e5f69f9242954e5dad488c8b26d2c5f","observation_id":"64e534e9-7d1c-4f72-aba6-e2a83c65919d","resolution":{"observed_at":"2026-08-07T15:06:29.512744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.815928Z","title":"Davinci: A scalable architecture for neural network computing,","venue":null,"work_id":"c9e28205-c424-4f84-b5c8-e7022bbf2355","year":2019},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.523587Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:45f4c7f22b46c10377c1537751e065a511d5511503312aec2f83c4050eece0e0","observation_id":"074e189b-9dd1-4e3d-bd31-b2e6bb4362eb","resolution":{"observed_at":"2026-08-07T15:06:31.821177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:29.538744Z","title":"Nvidia tensor core programmability, performance & precision,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.538744Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:bdc9582384e3fda9f6cac47dd4a7e62a34e08e6067391b445efb9736f3496aa6","observation_id":"70b5df40-95fa-47b8-b99e-193403ae7e95","resolution":{"observed_at":"2026-08-07T15:06:29.538744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:29.557111Z","title":"A charge domain sram compute-in-memory macro with c-2c ladder- based 8-bit mac unit in 22-nm finfet process for edge inference,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.557111Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:f3244d1e6f8f27b55cf095a2a10aa2b2350ccb8645ad58158583000010fbc4b4","observation_id":"a7876e8c-e647-4b9b-b903-617d5ecc35ae","resolution":{"observed_at":"2026-08-07T15:06:29.557111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.767622Z","title":"A 22 nm, 1540 top/s/w, 12.1 top/s/mm 2 in-memory analog matrix-vector-multiplier for dnn acceleration,","venue":null,"work_id":"eb51f8e1-81fc-4949-9767-1cfdccb189d5","year":2021},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.584583Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:bc4c58fea094e39b035cff91dd2f8a3c7ddb254e0f5e7b4061353ec707e40ffb","observation_id":"8aa39835-d1be-4fdd-968a-736471b5bba6","resolution":{"observed_at":"2026-08-07T15:06:31.775674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.746417Z","title":"A 64-tile 2.4- mb in-memory-computing cnn accelerator employing charge-domain compute,","venue":null,"work_id":"87e9056e-9ba0-4a21-bd0a-b0f9cb4568fc","year":2019},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.613354Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:9c9e7c3ae7debe8716b82b2ceba2e9be98049638844f6ba6810ccd0e20dea20f","observation_id":"060dfa3f-6df2-41e0-8d36-efaafad155e2","resolution":{"observed_at":"2026-08-07T15:06:31.752647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.727534Z","title":"Compute Solution for Tesla’s Full Self-Driving Computer,","venue":null,"work_id":"ad14f055-f5a0-4da3-88ed-d079ce6fadc1","year":2020},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.643554Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:4d2ff47d416d01d42f7a685a09f74f64872161aabb59ed46968251dc6840853e","observation_id":"0b0afbc5-c8bf-4721-b4fb-82278323b147","resolution":{"observed_at":"2026-08-07T15:06:31.733368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.711944Z","title":"Hardware for deep learning,","venue":null,"work_id":"f39df72f-99aa-4aad-a142-c4ce67ac4b03","year":2023},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.669402Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:f57ff48e61e1fb467253fcefaf0fd2349004eee94479b65b901605197e479ffa","observation_id":"fae8ddfc-2b2d-4e3a-9f0c-497ee270e85d","resolution":{"observed_at":"2026-08-07T15:06:31.715995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.695889Z","title":"Lincoln ai computing survey (laics) update,","venue":null,"work_id":"eefb6414-44d8-43a6-9f89-86cd35c77982","year":2023},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.691612Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:726ee60d20cd83e6e371a21e4cd7003d9ce3dbc8e3314f4ddefe2b12b7a9473b","observation_id":"da16470b-2d3e-4fe0-84a9-b071dd26d719","resolution":{"observed_at":"2026-08-07T15:06:31.701147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.677417Z","title":"Neural network accelerator comparison","venue":null,"work_id":"7d00c15b-dc64-4389-a17f-69b24d5ba344","year":null},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.702506Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:b329805c5442032cb99103b54e44758253c0a3a6b78a247824a1a14c0986a05e","observation_id":"901acd9a-d4f1-4ea0-ac01-b5ca945a06b6","resolution":{"observed_at":"2026-08-07T15:06:31.682603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16363","last_updated":"2024-05-01T20:42:28Z","snapshot_observed_at":"2026-08-01T22:52:35.092898Z","submitted_at":"2024-02-26T07:33:05Z","title":"LLM Inference Unveiled: Survey and Roofline Model Insights","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16363","snapshot_observed_at":"2026-08-07T15:06:29.707975Z","title":"Llm inference unveiled: Survey and roofline model insights,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.707975Z"},"links":{"cited_paper":"/paper/2402.16363","citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:14849f24e4658f4aaef5fd5aa6d244b5f3d085c7200af07639298dcac99451a3","observation_id":"97d55eaf-e1ea-4233-aa9f-aea58d0b400a","resolution":{"observed_at":"2026-08-07T15:06:29.707975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.662490Z","title":"Minifloats on risc-v cores: Isa extensions with mixed- precision short dot products,","venue":null,"work_id":"78cb8c93-f529-42f6-aada-72ee83e1edf1","year":2024},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.712718Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:5cfb057a23e0f38d28827df73f8df62b431d1176be7bc40132d6a4c6e43d9e4c","observation_id":"08353473-84cd-4cb4-bd49-537fa186db6a","resolution":{"observed_at":"2026-08-07T15:06:31.666883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.645937Z","title":"Cutie: Beyond petaop/s/w ternary dnn inference acceleration with better-than-binary energy efficiency,","venue":null,"work_id":"6295f29e-8332-4758-ac5d-4dbe5b4ac1f5","year":2021},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.719228Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:0ebbd7db714ec9cb6518ddf2fffbef1a74b609e41ae583bcd17bc83fb1d29ebd","observation_id":"8555f8ba-09e2-4b4a-af27-409f6d015b63","resolution":{"observed_at":"2026-08-07T15:06:31.651276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.629906Z","title":"Binareye: An always-on energy-accuracy-scalable binary cnn processor with all memory on chip in 28nm cmos,","venue":null,"work_id":"c403e61f-59ba-46d1-b153-b8e5444ef82e","year":2018},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.727130Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:b4199ae9347ed8488bc805d081a98b815a977cb83266c1aa45e22de6d90de513","observation_id":"0e670c07-2879-40bf-b013-1f9a3a083047","resolution":{"observed_at":"2026-08-07T15:06:31.635016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11453","last_updated":"2023-10-17T17:59:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-17T17:59:15Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11453","snapshot_observed_at":"2026-08-07T15:06:29.752659Z","title":"Bitnet: Scaling 1-bit transformers for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.752659Z"},"links":{"cited_paper":"/paper/2310.11453","citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:f68c8896aa6f014d6deb418487354178309935e48df1a32a906a4af294712c91","observation_id":"0a3287c9-08c5-4d5d-a841-4c814fd7ab59","resolution":{"observed_at":"2026-08-07T15:06:29.752659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.611362Z","title":"A 3 tops/w risc-v parallel cluster for inference of fine-grain mixed-precision quantized neural networks,","venue":null,"work_id":"6cf30ccf-19ab-4220-8fc8-5dc429f2d5e6","year":2023},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:29.907854Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:441c1cb20920ee855cfab17b7ed4811b565cd6e4630118f9238823cf27b0381d","observation_id":"1519180e-97b3-4911-bfc5-9e5d87d183b3","resolution":{"observed_at":"2026-08-07T15:06:31.615689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.596589Z","title":"Marsellus: A heterogeneous risc-v ai-iot end-node soc with 2–8 b dnn acceleration and 30%-boost adaptive body biasing,","venue":null,"work_id":"9a4d1053-0c3f-478f-8614-bb44901a175b","year":2023},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.045702Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:c94a1dac0f85fddfbe3f2876f6dd0a55cbd501aab6c80492780b20a3a50b2915","observation_id":"0ba24f90-6cda-4cec-98bc-13dd8c9fa289","resolution":{"observed_at":"2026-08-07T15:06:31.601169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10537","last_updated":"2023-10-19T16:38:33Z","snapshot_observed_at":"2026-08-08T01:04:32.134805Z","submitted_at":"2023-10-16T16:07:41Z","title":"Microscaling Data Formats for Deep Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10537","snapshot_observed_at":"2026-08-07T15:06:30.167879Z","title":"Microscaling data formats for deep learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.167879Z"},"links":{"cited_paper":"/paper/2310.10537","citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:566f38d761e730277846c491f888707e02bf334a0cdfecdb9652adc23eb47a2c","observation_id":"99a00f12-8207-439c-b6f2-350163c31afb","resolution":{"observed_at":"2026-08-07T15:06:30.167879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.581513Z","title":"Nvidia blackwell platform: Advancing generative ai and accelerated computing,","venue":null,"work_id":"83c8a462-256e-4b8f-b5d0-0001580b04ad","year":2024},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.260534Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:b96777e302151e4b54d18d6c1c4c321811b2969610fbd4cd8a1d9c94600ce809","observation_id":"2cf05c9b-d6e0-4f88-98ba-393fd718c14d","resolution":{"observed_at":"2026-08-07T15:06:31.585901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.566755Z","title":"Siracusa: A 16 nm heterogenous risc-v soc for extended reality with at-mram neural engine,","venue":null,"work_id":"7b7976e5-6b7a-42f8-854c-ce6e5b5a34db","year":2024},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.295340Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:765bd88dc2a14c9953929e4f17af37ebafac882d393dcf966a8e82ffaf5d445c","observation_id":"1680c9ec-81fd-4344-8309-0f0dbff0fc78","resolution":{"observed_at":"2026-08-07T15:06:31.571402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.552604Z","title":"Onyx: A 12nm 756 gops/w coarse-grained reconfigurable array for accelerating dense and sparse applications,","venue":null,"work_id":"0db87afa-a160-4c69-b6f7-402281de7955","year":2024},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.311228Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:f44c913c4766d252842ff6d345bba6d550d185c8866f95f6b5f83fb3746e4129","observation_id":"3fe2bff3-6cba-4d4f-9df5-377dcb967997","resolution":{"observed_at":"2026-08-07T15:06:31.557095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.04010","last_updated":"2021-04-18T10:18:00Z","snapshot_observed_at":"2026-08-04T18:04:45.224844Z","submitted_at":"2021-02-08T05:55:47Z","title":"Learning N:M Fine-grained Structured Sparse Neural Networks From Scratch","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.04010","snapshot_observed_at":"2026-08-07T15:06:30.316475Z","title":"Learning n: m fine-grained structured sparse neural networks from scratch,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.316475Z"},"links":{"cited_paper":"/paper/2102.04010","citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:3dff15d7a03570755a884d24f5ca0af1ddc954a481c594aa24c18eafd5e3232d","observation_id":"811baf5b-cbc8-40a8-b6b8-58e74ad81a01","resolution":{"observed_at":"2026-08-07T15:06:30.316475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.538617Z","title":"3.2 the a100 datacenter gpu and ampere architecture,","venue":null,"work_id":"b94b18cd-d48f-49a3-8168-e57cef4b23f2","year":2021},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.321479Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:f2900cd0153513b55099d5ebbdb9330f9f28e19591e05c39c343ea280bb15f7b","observation_id":"fd4078a9-32f3-41e9-9fcb-d49e353faaa0","resolution":{"observed_at":"2026-08-07T15:06:31.543279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.522188Z","title":"Venom: A vectorized n: M format for unleashing the power of sparse tensor cores,","venue":null,"work_id":"0a87cbb6-f541-481b-9ee1-085706be9494","year":2023},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.327263Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:b8b6065f9b034a418c3b0983f2ad6c0b8f545f724425153b18379992a54c158a","observation_id":"1b9ff632-a182-4763-8a18-bfe3f114406f","resolution":{"observed_at":"2026-08-07T15:06:31.527977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.506919Z","title":"Occamy: A 432-core dual-chiplet dual-hbm2e 768-dp-gflop/s risc-v system for 8- to-64-bit dense and sparse computing in 12-nm finfet,","venue":null,"work_id":"a07343aa-3cfc-4e88-8ca6-e0efbc5ef8f1","year":2025},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.332379Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:87a591cfa11143c35c94da4912587b329230f1d4f145c5d5952a98d3e6c59447","observation_id":"442b8fd4-7f49-4dfd-bff1-240ef09e13e4","resolution":{"observed_at":"2026-08-07T15:06:31.511828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:30.338151Z","title":"Neupims: Npu-pim heterogeneous acceleration for batched llm inferencing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.338151Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:1177a80a52b9b5d38a25cc0f6fe75d1ee5ea42d5cd8f2bf9af1b426044e77b89","observation_id":"a916b1ac-aac4-455c-b223-d85dd214cb28","resolution":{"observed_at":"2026-08-07T15:06:30.338151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07984","last_updated":"2024-01-17T16:00:27Z","snapshot_observed_at":"2026-08-10T14:40:34.550328Z","submitted_at":"2023-09-14T18:42:29Z","title":"Inclusive-PIM: Hardware-Software Co-design for Broad Acceleration on Commercial PIM Architectures","version":3},"cited_work":{"arxiv_id":"2309.07984","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.07984","snapshot_observed_at":"2026-08-07T15:06:30.768225Z","title":"Inclusive-PIM: Hardware-Software Co-design for Broad Acceleration on Commercial PIM Architectures","venue":"cs.AR","work_id":"9b3ec8fc-5a9b-4a20-9553-f0681db36ed8","year":2023},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.344978Z"},"links":{"cited_paper":"/paper/2309.07984","citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:64dabb0333c82ca32eaaa1ac18074680d117f4786625b5b15fcc2b331ad8e5f6","observation_id":"17058cdc-295b-4200-86ac-6371834add2f","resolution":{"observed_at":"2026-08-07T15:06:30.773144Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.490662Z","title":"In-memory computation of a machine-learning classifier in a standard 6t sram array,","venue":null,"work_id":"2c32c6df-7c81-4d80-b767-ce4ffb522d90","year":2017},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.350099Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:18bd1b597926e2fba37e72809da45a0073b7b89a804c05871d77fe625c97cc75","observation_id":"c504234d-02c1-4508-a794-fdaf31d7348c","resolution":{"observed_at":"2026-08-07T15:06:31.496919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.474383Z","title":"An energy-efficient memory-based high-throughput vlsi architecture for convolutional networks,","venue":null,"work_id":"185713ea-d50a-489f-b077-83e731402768","year":2015},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.354542Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:68895ea87fe6829307e20cb33f5d1d86ab6f9277a3cb9cf3ea84d977d83abefc","observation_id":"eabae999-f60c-4fe5-bc52-73e6730bdc6a","resolution":{"observed_at":"2026-08-07T15:06:31.479682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.452145Z","title":"Fast, energy-efficient, robust, and reproducible mixed-signal neuromorphic classifier based on embedded nor flash memory technology,","venue":null,"work_id":"f79bdc82-6316-4515-a13b-08ef5595256a","year":2017},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.359436Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:34f22e1b3d60d8293f91734d9a443f1684b9726f1766599f30468874d80b8926","observation_id":"dc024c9b-6911-468e-a603-4c7ed3dba6b1","resolution":{"observed_at":"2026-08-07T15:06:31.457417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.436387Z","title":"Analog in-memory subthreshold deep neural network accelerator,","venue":null,"work_id":"34538f09-bfed-4505-abc9-16b3d8cedc48","year":2017},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.364825Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:381a950fc32651045d4ae97d5569f6b2097685045ae82848c640670269b6d96b","observation_id":"1983e91c-efc9-4b7e-9918-6b05794fdb74","resolution":{"observed_at":"2026-08-07T15:06:31.441396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.420073Z","title":"A 5-nm 254-tops/w 221-tops/mm2 fully-digital computing-in-memory macro supporting wide-range dynamic-voltage- frequency scaling and simultaneous mac and write operations,","venue":null,"work_id":"2b20b492-751d-4890-bf48-efc3ee9b862d","year":2022},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.369284Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:e9327b27102d4258ea6c57a36a877584d09f192695c78cf989e3e9ed1a9d9b81","observation_id":"a97abc10-7d55-49d8-8883-98a46308033d","resolution":{"observed_at":"2026-08-07T15:06:31.425267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.405423Z","title":"16.4 an 89tops/w and 16.3tops/mm2 all-digital sram-based full-precision compute-in memory macro in 22nm for machine-learning edge applications,","venue":null,"work_id":"e0cc53a5-f23d-4e3d-8098-c3574966938f","year":2021},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.373554Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:73f49cc458949de3808e45f9f3f22b4aaee46f46a5a56897f9cc6d057e8c31b8","observation_id":"dc0712c1-5f9f-4572-8f47-94f1c6f54a44","resolution":{"observed_at":"2026-08-07T15:06:31.410366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.389835Z","title":"A maximally row- parallel mram in-memory-computing macro addressing readout circuit sensitivity and area,","venue":null,"work_id":"21f36dcc-86ef-4b03-b3ca-b231b21a4613","year":2021},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.378539Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:a357fa8061e7d412aed8fc884c70d4525d5f019fd0b319800e1c9fdce5c620af","observation_id":"db9547c9-63ff-48aa-9301-808349548048","resolution":{"observed_at":"2026-08-07T15:06:31.395141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:30.383254Z","title":"A programmable heterogeneous microprocessor based on bit-scalable in-memory comput- ing,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.383254Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:a9eee0e92bf3afdef7d7b360136ddac45fac2b6fb1d343c7bc40a0e45e22e53d","observation_id":"fd9d4dde-1f9e-452b-994a-62a1a717dc71","resolution":{"observed_at":"2026-08-07T15:06:30.383254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:30.387652Z","title":"A crossbar array of magnetoresistive memory devices for in-memory computing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.387652Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:88110fbd84a31d3763bfdb5edee6e86c050e7f1c2af5da5c1eeb118d48217bfb","observation_id":"6393fdbe-e573-4a73-bd6a-fc229cb2005d","resolution":{"observed_at":"2026-08-07T15:06:30.387652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:30.392346Z","title":"In-memory computing: Advances and prospects,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.392346Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:60b6ff052599f252b1b3bee109c02558c8127a10b1c2f69128b12917124b03f5","observation_id":"7cd66dde-bc47-49df-a0eb-f1c9e5eba12e","resolution":{"observed_at":"2026-08-07T15:06:30.392346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.348748Z","title":"14.2 a compute sram with bit-serial integer/floating-point operations for programmable in-memory vector acceleration,","venue":null,"work_id":"3bcf5754-83e7-4915-933e-1bcc86ce4db8","year":2019},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.397269Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:ad9dc3cdd215b3320949debff07a8505aa285bc2490be04d085916c8c9c8f90a","observation_id":"37ddb158-edd6-4020-8d8a-5accaacf7207","resolution":{"observed_at":"2026-08-07T15:06:31.354015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.331705Z","title":"A 40nm 64kb 26.56tops/w 2.37mb/mm2rram binary/compute-in-memory macro with 4.23x im- provement in density and > 75% use of sensing dynamic range,","venue":null,"work_id":"647217d1-76e6-4bb7-bdb8-3f116cba8cd3","year":2022},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.402092Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:1bcb2e8397811a0dc40eb2d8a701d528575f7ecde5766ea12ce03ad4625d0581","observation_id":"c4466db2-cdb4-4a65-b9c0-9ca6dfc39acd","resolution":{"observed_at":"2026-08-07T15:06:31.337684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.313148Z","title":"Funda- mental limits on energy-delay-accuracy of in-memory architectures in inference applications,","venue":null,"work_id":"4605a889-120f-4178-8329-f6fb2c81a7dc","year":2022},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.406524Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:853ca45ba108f2ed5e620600a941b109f60569fe2ba7ef16588f04cf39d77097","observation_id":"04b325b6-8759-454e-9434-474b467266b1","resolution":{"observed_at":"2026-08-07T15:06:31.318288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.298493Z","title":"11.3 metis aipu: A 12nm 15tops/w 209.6tops soc for cost- and energy-efficient inference at the edge,","venue":null,"work_id":"6a726b6b-35d8-4435-958c-02382c93209e","year":2024},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.410836Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:632dd5ea70625573c7f5cb2e145a96555fa4225cf8699bed2e79b930b0e4044e","observation_id":"64a7278b-04c8-4782-a5a6-d54aab5e3df7","resolution":{"observed_at":"2026-08-07T15:06:31.302813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:30.415453Z","title":"Benchmarking in-memory computing architectures,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.415453Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:344a250de358f561e3555509d77f38201d0c0f1a83f903a9c7782e5a8eaf73a9","observation_id":"1f3e82c2-4fd0-45b6-be87-3f584cd7db5a","resolution":{"observed_at":"2026-08-07T15:06:30.415453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.272534Z","title":"A 22nm 128-kb mram row/column-parallel in-memory computing macro with memory- resistance boosting and multi-column adc readout,","venue":null,"work_id":"7b99787e-c789-4e2d-9034-75e477c8c9a0","year":2022},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.420737Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:37e3d8f9a670bab6fd9de1e90c552410ba3d50fece7ffac68c22deca198d0e0c","observation_id":"c2fb4c15-99b8-4560-b5be-7029727d1d2e","resolution":{"observed_at":"2026-08-07T15:06:31.278613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:30.425731Z","title":"A 64-core mixed-signal in-memory compute chip based on phase-change memory for deep neural network inference,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.425731Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:de49de28a3d53a728be5d4c6ded3b5f79798c7db4f2d950b9039f37da7ed51ac","observation_id":"8af9691b-3084-4a53-9b91-dc7aaad9beaf","resolution":{"observed_at":"2026-08-07T15:06:30.425731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.244984Z","title":"An n40 256k×44 embedded rram macro with sl-precharge sa and low-voltage current limiter to improve read and write performance,","venue":null,"work_id":"40390da2-0096-4ed6-b23d-3d5c087097b6","year":2018},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.430911Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:c304f7bd33e0f32c1aecb6f5db852c3c5665d5529f01e3b109ab6ab0f64be819","observation_id":"e721fac0-ee09-4f4e-b3ae-d4b9c7e2f8d7","resolution":{"observed_at":"2026-08-07T15:06:31.250233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.230478Z","title":"Cmos- embedded stt-mram arrays in 2x nm nodes for gp-mcu applications,","venue":null,"work_id":"6c64404a-070d-4101-aa41-7ae3318bdacf","year":2017},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.435960Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:6695e6a1820d849cf029c805e1d448a7ce41fc6d4692f52cb87c3cc8d2ae7bba","observation_id":"57ef3e98-bfbe-45af-9fe0-48b39b3e2f75","resolution":{"observed_at":"2026-08-07T15:06:31.234950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.215631Z","title":"A switched-capacitor sram in-memory computing macro with high-precision, high-efficiency differential archi- tecture,","venue":null,"work_id":"978a6910-72de-4949-a3d8-69399bd198a8","year":2024},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.441328Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:1c56b97b58adb9d1e3cc675065307fefab413235a2fb5217dd170695c0ea822e","observation_id":"847322d6-5d32-4d10-b9f9-6b0dceb45256","resolution":{"observed_at":"2026-08-07T15:06:31.220998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.201911Z","title":"Scalable and Programmable Neural Network Inference Accelerator Based on In-Memory Computing,","venue":null,"work_id":"a76c3ce7-e741-45bc-af06-aa9b1d78ec51","year":2022},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.445701Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:7cf20bebc3616228dd8de0ab9af27944c9e7360cf58b0bde5c89c3f7db9e11ae","observation_id":"499a3c28-1233-4957-b69f-4fa88b284e65","resolution":{"observed_at":"2026-08-07T15:06:31.206563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:30.450465Z","title":"Interstellar: Using Halide’s Scheduling Language to Analyze DNN Accelerators,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.450465Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:b0f602ec382a32094e64bec2780aca6d3914cacb72ca27fca5c506197b6546b7","observation_id":"a78fcd0f-2f3d-4bea-892a-66ee8ff32747","resolution":{"observed_at":"2026-08-07T15:06:30.450465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.188459Z","title":"MAESTRO: A Data-Centric Approach to Understand Reuse, Performance, and Hardware Cost of DNN Mappings,","venue":null,"work_id":"88de8691-d96c-4dcd-9500-dfe06388b318","year":2020},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.454805Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:a417603e2e37d47d685fb13d7a5508bd22769724d093953b3a7a944c346003c5","observation_id":"d5106f5f-7b45-4e8f-8825-d07f2c8fa3a4","resolution":{"observed_at":"2026-08-07T15:06:31.192491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.174162Z","title":"Timeloop: A Systematic Approach to DNN Accelerator Evaluation,","venue":null,"work_id":"af03fa35-4f56-49de-9354-2a5566d0b7a8","year":2019},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.459381Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:4d1cb919b316b94f1a24d849522fd3035504d4aafaaa45535aac2e45c50a343e","observation_id":"abdc799a-4fe5-46f0-9623-1de4d6bb730f","resolution":{"observed_at":"2026-08-07T15:06:31.179380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.158362Z","title":"ZigZag: Enlarging Joint Architecture-Mapping Design Space Exploration for DNN Accelerators,","venue":null,"work_id":"6c5172ee-6863-4bc5-bebb-e61d1b23c54d","year":2021},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.463852Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:57c9f4db870f993abfb248e4e1f52419f33bb20edd7045ff3f833c43e5d8701a","observation_id":"b8576801-923c-4513-acf6-f513d0ae90d5","resolution":{"observed_at":"2026-08-07T15:06:31.163852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.142493Z","title":"CoSA: Scheduling by constrained op- timization for spatial accelerators,","venue":null,"work_id":"3a0ec4de-bd50-4bff-8672-583fdb6244c2","year":2021},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.471518Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:aedfd8cfb00b773e5df16275492d4526298e6cf6f11fe6e85995f96e5675cf35","observation_id":"2cc2e601-e74a-4511-9e51-3ef07c37610c","resolution":{"observed_at":"2026-08-07T15:06:31.147252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:30.476277Z","title":"Mind Mappings: Enabling Efficient Algorithm-Accelerator Mapping Space Search,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.476277Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:eca54b694de95336530c02c6655cd6e8548721460acef76a55c1be2043618328","observation_id":"b6ac7aae-c0da-4d9c-a770-63efc2c79417","resolution":{"observed_at":"2026-08-07T15:06:30.476277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3400302","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"GAMMA: Automating the HW Mapping of DNN Models on Accelerators via Genetic Algorithm,","venue":null,"work_id":"633c9725-544b-4fb5-8fb5-d692e3aeefc0","year":2020},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.480952Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:5ecc8db0fc41c6c6fc31700bad1a1b1fd391b6d218bcd86a7260ad39b432bf00","observation_id":"8ce0af98-da9c-489c-9b97-929ae3a283eb","resolution":{"observed_at":"2026-08-07T15:06:30.566889Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.127388Z","title":"Stream: Design space exploration of layer-fused dnns on hetero- geneous dataflow accelerators,","venue":null,"work_id":"314e3aaf-c6a6-42f3-a07b-4873858a8786","year":2024},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.485112Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:806749396714b0882f218dbc323c0745da62cb3cb63c41ffea22213ca01cd5a1","observation_id":"2c87e16f-c313-489e-91ac-527b88f5fe22","resolution":{"observed_at":"2026-08-07T15:06:31.131537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.112922Z","title":"The groq software-defined scale-out tensor streaming multiprocessor : From chips-to-systems architectural overview,","venue":null,"work_id":"75edca07-7922-4d78-8ad7-c9834e702712","year":2022},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.488902Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:6f6be6cce583fc64c4ccc6ecdbc5dad79334d296a9ae32ec2587e8a612ecc77d","observation_id":"8a588eea-947f-4fc9-90b8-ecc9ac56877d","resolution":{"observed_at":"2026-08-07T15:06:31.117852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.099203Z","title":"Application specific instruction processor based implementation of a gnss receiver on an fpga,","venue":null,"work_id":"d99a85f6-cbd3-409d-b44f-929b0e265e05","year":2006},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.492972Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:684d251076338e2669530fe2c9aec166e2289eff469760bd24113dae88d64e08","observation_id":"17a54891-ec19-44ba-bd33-97e9311fa29c","resolution":{"observed_at":"2026-08-07T15:06:31.103230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.084003Z","title":"How flexible is your com- puting system?","venue":null,"work_id":"b051c7da-c699-42b9-a00e-44597915040f","year":2022},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.497613Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:efbfeb8d416c8ca28b3b0a47173ad967611fa517d4f990d964aa1485da1e7760","observation_id":"1d680a15-8dd8-4544-a543-a003d2402db8","resolution":{"observed_at":"2026-08-07T15:06:31.088800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:30.501738Z","title":"Tandem processor: Grappling with emerging operators in neural networks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.501738Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:416a28acd107b5e6844dcc7d1775fff022f99f8a20908fbc451b7642ad846145","observation_id":"a9dedbe3-43ab-407c-aeec-1b8d2a4311e5","resolution":{"observed_at":"2026-08-07T15:06:30.501738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.058978Z","title":"Mec: memory-efficient convolution for deep neural network,","venue":null,"work_id":"ed8ccdad-0d5a-4fb3-a1f8-6e5769c3b8a4","year":2017},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.505928Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:fb31f1acd4fd1386c6015802a0ee4cb9f94f19c7ba97f878a1ef3414199af3ed","observation_id":"cc7cdc0a-dd28-4d26-9de6-1a32daf336d9","resolution":{"observed_at":"2026-08-07T15:06:31.063778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.043860Z","title":"A formalism of dnn accelerator flexibility,","venue":null,"work_id":"c5a060cd-dca6-4079-ab95-c6dfa5cfa9d0","year":2022},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.510290Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:d2c022669f362b04d40d524a68c8f300f0dbc0533574a7183628d5d7b0abb90e","observation_id":"196c9181-8b97-4077-97e0-4ae7c239699b","resolution":{"observed_at":"2026-08-07T15:06:31.048331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:30.515891Z","title":"Mlir: Scaling compiler infrastructure for domain specific computation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.515891Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:38aabcbca641b65bf60e6c8bce220651095d7add02e396875367137d01998a71","observation_id":"84c6dd27-560d-4be8-a390-6d1be9a0e729","resolution":{"observed_at":"2026-08-07T15:06:30.515891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:06:31.018753Z","title":"The hardware lottery,","venue":null,"work_id":"e1780fd1-bf85-4e88-8f91-d753ce5de127","year":2021},"citing_paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T15:06:30.520235Z"},"links":{"citing_paper":"/paper/2505.16346"},"observation_digest":"sha256:79393364455e6ca852c5b56c1ecf811f671d71abffd9a4eb66d69d90765105fb","observation_id":"d484f9f9-f15a-4eb2-988f-a8ac376c7f42","resolution":{"observed_at":"2026-08-07T15:06:31.023084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16346","last_updated":"2025-05-23T07:21:27Z","latest_version":2,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-09T04:28:51.014509Z","submitted_at":"2025-05-22T07:59:26Z","title":"How to keep pushing ML accelerator performance? Know your rooflines!"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":2,"verified_fuzzy":60},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 0 inbound Pith citation observations for arXiv:2505.16346."}