{"as_of":"2026-08-10T00:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7d3e70979eba8893a1dfd27a636e14332254daf68162d6dd7882ba78d6e12bce","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:57:33.640328Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.12205/citation-record","integrity":"/paper/2507.12205/integrity","json":"/paper/2507.12205/citation-record.json","paper":"/paper/2507.12205"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:37.205875Z","title":"https://docs.nvidia.com/cuda/cublas/index","venue":null,"work_id":"9735f825-c4a7-4230-a727-a1b306c7340d","year":2024},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:28.542169Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:2ccf6e59a0d3f3ea44e243bcee5f4a28f92bfe2cf5b590fce800e81f0d5d656d","observation_id":"48a63018-7cf9-4643-95a2-162f8bdf7e07","resolution":{"observed_at":"2026-08-06T16:57:37.211118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:37.191494Z","title":"M., Buluç, A., Williams, S., and Y ang, C.Optimizing sparse matrix- multiple vectors multiplication for nuclear configuration interaction calculations","venue":null,"work_id":"2ac918a7-ceb8-4346-847d-5c98d7c48f31","year":2014},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:28.646996Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:a55494e6da9cba1da1e7a95323d83b3f826c8e055df08668714a02fa5246fce4","observation_id":"e74c6229-dcd0-44da-bda5-5477f16a7be9","resolution":{"observed_at":"2026-08-06T16:57:37.196281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:37.176189Z","title":"Fast sparse matrix-vector multiplication on gpus for graph applications","venue":null,"work_id":"1b0ed1b1-8f5a-4283-a6f5-1e06fd8ea602","year":2014},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:28.754124Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:be15d7d6a52bb5794bb08c59b231862479c30d9015cddb05d1eda104e563d84c","observation_id":"c97a557a-fac1-401c-aa9a-0df47fb8909c","resolution":{"observed_at":"2026-08-06T16:57:37.181182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:37.162080Z","title":"Efficient sparse matrix-vector multiplication on cuda","venue":null,"work_id":"5471b523-0fda-4521-93cc-a860e26a7b43","year":2008},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:28.828409Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:0a53ea26f3879d6b609ab06688f19bedfc74bd354e2d356ebb6e61d033a89bb6","observation_id":"490c7c82-b1d0-472b-95b2-eeab2e50fd88","resolution":{"observed_at":"2026-08-06T16:57:37.166702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:37.147320Z","title":"On the relations between ilus and factored approx- imate inverses","venue":null,"work_id":"53f6ccbf-07ff-4051-b659-e90089d31d15","year":2002},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:28.901761Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:991f7355d2576bc26a15858510432a493d36d3e800cf53d86e39b66393d5b190","observation_id":"3464eca1-787c-4aea-a21d-876979d64e4f","resolution":{"observed_at":"2026-08-06T16:57:37.151931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:37.133475Z","title":"In SC22: International Conference for High Performance Computing, Networking, Storage and Analysis (2022), IEEE, pp","venue":null,"work_id":"7c772533-a19d-4ef3-b71a-28aee3d5606e","year":2022},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:28.999888Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:d57bcd2cffc85237ad3c523caa7d65ce184cc7d74d53d93369e46627ef9c36aa","observation_id":"cde669b4-9605-4140-bbfd-e8e2ff075da4","resolution":{"observed_at":"2026-08-06T16:57:37.137985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:37.118375Z","title":"Scaling algorithms for weighted matching in general graphs","venue":null,"work_id":"7f2e99a9-49b7-4dec-bb93-8a8190093047","year":2018},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:29.073778Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:8cb8a6d0b049a640c4b5d82661173f8791cbf239a776eb566a498d98a963d40a","observation_id":"603493ed-e13f-4a82-9779-850e44bf4070","resolution":{"observed_at":"2026-08-06T16:57:37.123188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:37.103058Z","title":"Spinfer: Leveraging low-level sparsity for efficient large language model inference on gpus","venue":null,"work_id":"c604b1ff-e45b-44fb-98aa-8acc42eb78f9","year":2025},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:29.142189Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:4e2261145d8d16cea7a2e343f74463dc3bb9c962b97a1d13ff3e1b2040d50796","observation_id":"ba33c097-54d3-4f54-97a3-a3bb9d37a992","resolution":{"observed_at":"2026-08-06T16:57:37.108219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:37.087188Z","title":"Sparsegpt: Massive language models can be accurately pruned in one-shot","venue":null,"work_id":"eeab4667-6274-4c13-92ca-747bf1f6fdd4","year":2023},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:29.214424Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:3e8ce6c438d64d0d344e695ce90f1500437bba8d51110d579c1523056839de2c","observation_id":"02d83cfa-cdc3-4bb5-b99a-fb6a4782ba62","resolution":{"observed_at":"2026-08-06T16:57:37.091869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:37.072892Z","title":"Leveraging index compression techniques to optimize the use of co-processors","venue":null,"work_id":"2e44b75b-7d12-4bb7-a9a5-50d883a945e3","year":2024},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:29.292206Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:5d34eef152fac673686bc7a955320627515a666c7ec097383113152f957413dd","observation_id":"4bdbb461-922d-4b48-9ef7-e9429071805c","resolution":{"observed_at":"2026-08-06T16:57:37.077629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:37.057599Z","title":"Sparse GPU kernels for deep learning","venue":null,"work_id":"f368d4e4-4ef4-4707-a1b8-14205538df73","year":2020},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:29.372395Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:1d00204dcef6765d435774ccbb1c60a351693fe5b0f7860da669f3af4cb1f9a6","observation_id":"f04e6b05-ae1f-4b3c-b175-a542ff16c034","resolution":{"observed_at":"2026-08-06T16:57:37.062242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:37.043629Z","title":"ggerganov/llama","venue":null,"work_id":"cd8cc466-2a1a-4fdd-a156-430871973bb1","year":2023},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:29.505170Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:51e1576272d5da9d161c69c972defcd701f763f0bb565d7d9ecbe2f58ca810ea","observation_id":"ced03fe2-8687-4b8a-beb0-a7f9fcee5273","resolution":{"observed_at":"2026-08-06T16:57:37.048160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:37.029243Z","title":"L., and Daga, M","venue":null,"work_id":"4b848cb5-b1ab-4e6c-ab1e-eb6a2795ee39","year":2014},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:29.588403Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:f473d7bed55ca53dd21faac00fd010c58899f20243e8097fe611fbbf0b02b058","observation_id":"57e6c840-e4e6-4e2b-a172-e08de5a78e03","resolution":{"observed_at":"2026-08-06T16:57:37.033721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:37.013786Z","title":"Y., Leng, J., Qiu, Y., Guan, Y., W ang, Z., Jia, X., Li, X., Guo, M., and Zhu, Y","venue":null,"work_id":"48dc95cc-2a85-4c4c-ac20-d1a7d4467077","year":2020},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:29.688320Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:89a45d71525893f4459db195255ecd302454190dd8cd74e09f39987491cc680a","observation_id":"8b4ff62c-ddbe-4048-ba7d-d7c0d0eab7c5","resolution":{"observed_at":"2026-08-06T16:57:37.018716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:36.998817Z","title":"In Proceedings of the 24th ACM SIGPLAN Symposium on Principles and Practice of Parallel Programming, PPoPP 2019, Washington, DC, USA, February 16-20, 2019 (2019), ACM, pp","venue":null,"work_id":"f28da063-a7e5-4449-b6e6-6cbae0941445","year":2019},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:29.789797Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:6585476a6a319d46b060be37ebe22d24beb4cb21bae1d7351b04d9702d98b347","observation_id":"6f701053-2b7c-44d3-849d-4b4e92d299a4","resolution":{"observed_at":"2026-08-06T16:57:37.003567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:36.984965Z","title":"Flashdecoding++: Faster large language model inference with asynchronization, flat gemm optimization, and heuristics","venue":null,"work_id":"fd6822ec-828d-4cc4-a31c-5118e82c00a6","year":2024},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:29.890563Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:4415b5982dee8595f9b34ad19f2084e645c473e4c2c83637ed618cc9aaaf6341","observation_id":"241a9bab-12fb-49a2-a192-1c1353043314","resolution":{"observed_at":"2026-08-06T16:57:36.989336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:36.971444Z","title":"In Proceedings of the 25th ACM SIGPLAN symposium on principles and practice of parallel program- ming (2020), pp","venue":null,"work_id":"5e35b35a-e6e2-4740-9f78-261bc5c553b1","year":2020},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:29.971335Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:e2086b72d41f41614a1419cdb326ba33a47cbd601cf1ccab6c4db5e22d28d0ae","observation_id":"66d04aa1-90c5-4445-b1c0-22621663ff4f","resolution":{"observed_at":"2026-08-06T16:57:36.975601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:36.957576Z","title":"Maximum bounded 3-dimensional matching is max snp-complete","venue":null,"work_id":"ea31bba0-f919-4ef7-93ba-2163187126b7","year":1991},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:30.042219Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:03291df70428c174d4b32cdb4f62324bb35f615df6d8ecb7fbf9de34f3598054","observation_id":"ba390c32-a1f8-4c43-b859-fd9fa46e476a","resolution":{"observed_at":"2026-08-06T16:57:36.961843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:36.943789Z","title":"Computational complexity of the perfect matching problem in hypergraphs with subcritical density","venue":null,"work_id":"58550a82-8cec-4ab7-b49f-12381937d6f1","year":2010},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:30.110288Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:170ca94829db7aea1bbc86e4f624cb728a1108a2ee6ce5ea51610c9cdfb91f11","observation_id":"c2a7b3a5-33ed-44cb-b088-a48c1f71cee7","resolution":{"observed_at":"2026-08-06T16:57:36.948405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:36.930261Z","title":"Optimizing sparse matrix-vector multiplication using index and value compression","venue":null,"work_id":"d6ed7b29-883b-4075-b18e-3f9b0d1be274","year":2008},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:30.192910Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:28126ed1fe6d0aa9be00f0adce4e8dcb50edf7a2d0b7f942eafd0151914bc81d","observation_id":"3c631827-6d0e-499c-a6ff-359e5020e677","resolution":{"observed_at":"2026-08-06T16:57:36.934657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:36.916536Z","title":"ACM Transactions on Architecture and Code Optimization (2024)","venue":null,"work_id":"9decf830-7e5a-4526-8849-2f762c78173d","year":2024},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:30.292321Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:5c4e1b43aadc760e1f0e8c264aebca92aefa00c2db5af850cbca744434b377b3","observation_id":"80d4e512-f945-4554-ac46-978fa9d1234f","resolution":{"observed_at":"2026-08-06T16:57:36.921002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:36.902542Z","title":"Csr5: An efficient storage format for cross-platform sparse matrix-vector multiplication","venue":null,"work_id":"85aa893c-c657-42c5-baf5-0935c1448169","year":2015},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:30.369287Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:19bea898b18e34ade0e7851d579145733dcc3be97758b76f22dc77fb24db7bd1","observation_id":"0204ba87-e55d-4302-a816-413f1822313f","resolution":{"observed_at":"2026-08-06T16:57:36.907128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:36.889353Z","title":"Spp: Sparsity-preserved parameter-efficient fine-tuning for large language models, 2024","venue":null,"work_id":"749945a8-3dfa-409e-8fc8-910a1cad81d6","year":2024},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:30.445136Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:cbbe20c67b7c7800c2cc733b6b23bc6a61f135f2bf281f29fb2d5ac6767c565c","observation_id":"9653f73c-a23b-4de5-9b01-490916a57d2e","resolution":{"observed_at":"2026-08-06T16:57:36.893724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:36.875808Z","title":"Dasp: Specific dense matrix multiply-accumulate units accelerated general sparse matrix-vector multiplication","venue":null,"work_id":"d845bdb6-0a1b-4e72-9706-640455db755c","year":2023},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:30.519844Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:85ecbc4b7f395e159f2e5e7895c7e6f890c53d156b41e8ca45c896006c614c0b","observation_id":"7222110e-eb3a-4c27-96e4-c5d2073cebdb","resolution":{"observed_at":"2026-08-06T16:57:36.880069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:36.862280Z","title":"Llm-rec: Personalized recommendation via prompting large language models","venue":null,"work_id":"9fd4071e-3bfc-4ab7-8b47-759aeab93be2","year":2024},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:30.592794Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:d0707cbd060b73bf1a0b668fc756eb150e12124c6103299cb09d67702108d6ea","observation_id":"74dd5b41-ec91-4b1a-94c8-35bb361fd81f","resolution":{"observed_at":"2026-08-06T16:57:36.866773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:36.676991Z","title":"Advances in neural information processing systems 36 (2023), 21702–21720","venue":null,"work_id":"e7b5dfe8-4761-4868-a9f1-e809d6826b39","year":2023},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:30.652135Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:c323ede2c275601796d4f155d3937199d326d4b425d40b3cdc002831c4b4fb7a","observation_id":"147c739a-f584-4fc4-a0ae-2abc12432e22","resolution":{"observed_at":"2026-08-06T16:57:36.853099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:36.293716Z","title":"Adell: An adaptive warp-balancing ell format for efficient sparse matrix-vector multiplication on gpus","venue":null,"work_id":"803eee37-9267-4e6d-a52b-3eb6fca71d64","year":2013},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:30.792890Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:a7f20be07c15be8820f9180490d23de9ad45f19cb99bd5f8985c276483b928c3","observation_id":"1fef18ad-bb73-4c57-bd46-bfc9e3d79c97","resolution":{"observed_at":"2026-08-06T16:57:36.493590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:35.897636Z","title":"Merge-based parallel sparse matrix-vector multi- plication","venue":null,"work_id":"0b171b4f-6b7d-4edf-989e-e82803e1f77f","year":2016},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:30.912617Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:ecc1aee093b1566d3601c33ae202097a6ee27804cec7e7ae7ad4abc898497f20","observation_id":"bfa0a9c9-41af-44e9-bd41-56fcef23a7cb","resolution":{"observed_at":"2026-08-06T16:57:36.113989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:35.676451Z","title":"In GPU Technology Conference (2010), vol","venue":null,"work_id":"9754d663-ace5-4bea-b0aa-d7e75a5e9f6e","year":2010},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:31.046779Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:a0972137c3a5cfc70a136652fc80a8d43fe8bb9a6a35546246375423613a8bc5","observation_id":"a7886ae0-cc7d-4f5f-928c-98078b721c07","resolution":{"observed_at":"2026-08-06T16:57:35.740541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:35.546824Z","title":"In2021 IEEE International Parallel and Distributed Processing Symposium (IPDPS) (2021), IEEE, pp","venue":null,"work_id":"99d0e901-f86d-456b-8dee-061271477975","year":2021},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:31.233990Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:c15d28265c6171fc35917f80235e89211008fa26061a9e252f72c4c4f6f71bc9","observation_id":"a13808ca-0101-4bb2-9ddf-06cddf59714b","resolution":{"observed_at":"2026-08-06T16:57:35.597180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12456","last_updated":"2024-12-12T12:38:12Z","snapshot_observed_at":"2026-08-07T20:41:48.188566Z","submitted_at":"2023-12-16T02:27:00Z","title":"PowerInfer: Fast Large Language Model Serving with a Consumer-grade GPU","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12456","snapshot_observed_at":"2026-08-06T16:57:31.381924Z","title":"Powerinfer: Fast large language model serving with a consumer-grade gpu","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:31.381924Z"},"links":{"cited_paper":"/paper/2312.12456","citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:63285b51ea290c845288952a3cf28f458b975d94e6e2892c14ddaa58614fde6e","observation_id":"5e860b4a-708f-43e3-aad1-8ed942bdf3a0","resolution":{"observed_at":"2026-08-06T16:57:31.381924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-06T16:57:31.512871Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:31.512871Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:8ad3fb064e274144de4eb668ce7b6f9a28f81881e40e01a5e4fcf2abb3852790","observation_id":"c498357d-ccaf-46b9-a17f-a4e0c07a3377","resolution":{"observed_at":"2026-08-06T16:57:31.512871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:35.448617Z","title":"In 2011 International conference on parallel processing (2011), IEEE, pp","venue":null,"work_id":"20419fa6-67df-4c0b-a200-402603c3cc79","year":2011},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:31.678902Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:11723bf97d41ebdf0a32dd29c5d40b390a2161e0a79c3c35cc46f68182a75722","observation_id":"31b7b88b-7f35-485f-a93d-e0f572a4a012","resolution":{"observed_at":"2026-08-06T16:57:35.498328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T16:57:31.830414Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:31.830414Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:3cb4fcfff39b8adfb34be63abc827501c3a343abd0295a15a1b667dc62172a18","observation_id":"ebc2f897-3a61-4a56-b034-62f6b6b6b329","resolution":{"observed_at":"2026-08-06T16:57:31.830414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:35.339288Z","title":null,"venue":null,"work_id":"d261a026-dd86-435e-afe2-0d066881e084","year":2011},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:31.939265Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:cdab38a6f21474fa942a7afc3f8db7a4b81c1d9d84f39a6eef7b4c15aafd582a","observation_id":"c648bf5c-9f23-4d22-ba94-2a440a2ef3c5","resolution":{"observed_at":"2026-08-06T16:57:35.387900Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:35.207382Z","title":"W., and Yelick, K","venue":null,"work_id":"72c55b9f-0d0d-42e2-89a8-aacdf94c9f61","year":2005},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:32.064464Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:c9919696e48f851b6d23d02f93ded5844d0e9c1c5ca7e293cc73e1ac936ddc5d","observation_id":"af78bfaf-f28a-4812-a87d-d0c97c12f52a","resolution":{"observed_at":"2026-08-06T16:57:35.259125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.14030","last_updated":"2023-11-23T14:36:30Z","snapshot_observed_at":"2026-07-06T16:51:36.124532Z","submitted_at":"2023-11-23T14:36:30Z","title":"PrivateLoRA For Efficient Privacy Preserving LLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.14030","snapshot_observed_at":"2026-08-06T16:57:32.216391Z","title":"Privatelora for efficient privacy preserving llm","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:32.216391Z"},"links":{"cited_paper":"/paper/2311.14030","citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:96e09116256e80a2d672e81f029e27c324db133a1b6cddf72c1b4ddc7fa8520e","observation_id":"fd9bd963-9ffc-4a45-9cbc-5c49340c05fb","resolution":{"observed_at":"2026-08-06T16:57:32.216391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:35.049668Z","title":"M.Register tiling for unstructured sparsity in neural network inference","venue":null,"work_id":"ceae2285-d7cf-4be0-a81a-e3faf7046eb2","year":2023},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:32.364100Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:60b715f1be32eb03274aa8fc5892ab7181ff9c105095912fa33e120cd8e054f7","observation_id":"18427a5f-1fb6-4a2a-b5cf-eacdb605087a","resolution":{"observed_at":"2026-08-06T16:57:35.146848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:34.818669Z","title":"Accelerating sparse matrix computations via data compression","venue":null,"work_id":"da3de162-cc63-4c56-a5f6-19f25660cd71","year":2006},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:32.498733Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:53520fefd82e6571bd08ef0936abccd617e2bf9ca14e26c3f765100d533e91be","observation_id":"bc708c7e-9cb0-43fa-8382-8f44deeb7737","resolution":{"observed_at":"2026-08-06T16:57:34.946084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:34.617266Z","title":null,"venue":null,"work_id":"f62f811d-bb25-43b5-ba21-963be7afc5a8","year":2023},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:32.675617Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:b93499d0405becc19353c00e7179aaf1d11db26746a6dff2972b526008175fce","observation_id":"d8036e1d-99f5-4bce-a1b8-5ebb9735bdf1","resolution":{"observed_at":"2026-08-06T16:57:34.723427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06694","last_updated":"2024-04-11T01:18:06Z","snapshot_observed_at":"2026-08-08T20:21:38.269492Z","submitted_at":"2023-10-10T15:13:30Z","title":"Sheared LLaMA: Accelerating Language Model Pre-training via Structured Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06694","snapshot_observed_at":"2026-08-06T16:57:32.791550Z","title":"Sheared llama: Accelerating language model pre-training via structured pruning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:32.791550Z"},"links":{"cited_paper":"/paper/2310.06694","citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:794e36025b7fbb968e59974d9bf92caf99f54c700ef2d69315ac2ec76307b71f","observation_id":"ae5af087-a1b0-45e5-83f0-b0aa3f0d4416","resolution":{"observed_at":"2026-08-06T16:57:32.791550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:34.371461Z","title":"Besa: Pruning large language models with blockwise parameter- efficient sparsity allocation","venue":null,"work_id":"5b44fe5d-3200-478a-88d5-64f29a80e635","year":null},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:32.917819Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:842487f1b1300caea947e43527d2f5dcde1e4273e90fcd424469b9cde532519b","observation_id":"f03df9fe-b017-417c-b89e-ea99fa139406","resolution":{"observed_at":"2026-08-06T16:57:34.503129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:34.112800Z","title":"A survey on large language model (llm) security and privacy: The good, the bad, and the ugly","venue":null,"work_id":"547135d8-87e4-480c-aa44-ce9e99ee85d6","year":2024},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:33.073534Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:7f866cc0c4356c223780946539fb82e836f17f9ef263173008cb18dd3849042d","observation_id":"3a3f4dea-9ab7-4c07-9a9d-97e23b7c3b0c","resolution":{"observed_at":"2026-08-06T16:57:34.233921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-06T16:57:33.217115Z","title":"V., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:33.217115Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:9d2894e5d4f89c4c2627a649d4f1035ec94c262654ca3bc4192321e8d2649bbe","observation_id":"0438e405-d73c-4f6d-a8f8-526e234a7762","resolution":{"observed_at":"2026-08-06T16:57:33.217115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08915","last_updated":"2024-02-26T02:51:30Z","snapshot_observed_at":"2026-07-06T16:32:23.448967Z","submitted_at":"2023-10-13T07:38:52Z","title":"Dynamic Sparse No Training: Training-Free Fine-tuning for Sparse LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08915","snapshot_observed_at":"2026-08-06T16:57:33.377605Z","title":"Dynamic sparse no training: Training-free fine-tuning for sparse llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:33.377605Z"},"links":{"cited_paper":"/paper/2310.08915","citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:1a99edfffa4c437927ce1f612ec6c191bcbfe62d65cabecd6f94f7ced0368876","observation_id":"839236d8-5228-4f8f-9019-a9802689158d","resolution":{"observed_at":"2026-08-06T16:57:33.377605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:57:33.914609Z","title":"Acc-spmm: Accelerating general-purpose sparse matrix-matrix multiplication with gpu tensor cores","venue":null,"work_id":"96e299c4-5088-4686-befc-c480a56237f4","year":2025},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:33.512161Z"},"links":{"citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:ce30cf5d3b54e8e13041fcaecf833a83a1005b8942d19a925844417ea0e3cbc6","observation_id":"e4a225ad-ab69-455a-b4a7-18e8b33ccf67","resolution":{"observed_at":"2026-08-06T16:57:34.025375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-06T16:57:33.640328Z","title":"X., Zhou, K., Li, J., Tang, T., Wang, X., Hou, Y., Min, Y., Zhang, B., Zhang, J., Dong, Z., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T16:57:33.640328Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2507.12205"},"observation_digest":"sha256:f8125086a6e42322a932f27dbbc25a405d00465f33f3f4be0ed8cf511f0ecec7","observation_id":"2e83db51-a3e4-45a8-b62b-8ff6ef5584e5","resolution":{"observed_at":"2026-08-06T16:57:33.640328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.12205","last_updated":"2025-07-16T13:04:06Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-07T12:21:15.238746Z","submitted_at":"2025-07-16T13:04:06Z","title":"Toward Efficient SpMV in Sparse LLMs via Block Extraction and Compressed Storage"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":37},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2507.12205."}