{"as_of":"2026-08-10T03:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:33d108101218c017cb1e6d5c314c35e44078c2c0d06b0b41d45e52973200c12e","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:09:29.472155Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01536/citation-record","integrity":"/paper/2608.01536/integrity","json":"/paper/2608.01536/citation-record.json","paper":"/paper/2608.01536"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-01T16:27:35.664983Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-08-06T00:09:25.460411Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:25.460411Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:dea8e039be29c0e4e4350b2b840de7018e7219effe10f45b52ca7b9c9bb594e0","observation_id":"90ba9164-23c6-4e8e-aa8b-16e6c04ae8a9","resolution":{"observed_at":"2026-08-06T00:09:25.460411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:34.688876Z","title":null,"venue":null,"work_id":"e2194781-5a76-4ff5-9603-7eb9d4e0d5bb","year":2016},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:25.540124Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:c9238bb7ea6b05d1e15720b5fa5b03c4368984ebe03b4964aa04b468d98bcdb5","observation_id":"8f1a3059-cf80-4e3b-a5dd-df936e485b4f","resolution":{"observed_at":"2026-08-06T00:09:34.760777Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:34.530198Z","title":null,"venue":null,"work_id":"d575c3f1-db29-4ba4-8008-53fbd3d581da","year":2019},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:25.640712Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:f797153ca9781ae9389dd55e682d73fc4f360c72eb72f2048477f94c3064ac65","observation_id":"5b9af056-542b-4898-8531-8d25c89600bd","resolution":{"observed_at":"2026-08-06T00:09:34.606557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:34.378959Z","title":null,"venue":null,"work_id":"2ef59ad9-d53c-43ab-8ea3-6a77d39511c4","year":2022},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:25.737432Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:a0bdb67953ac50ad48b59c7461bccb72f659e6a808cfddc7fad2915137e709b3","observation_id":"09b0186b-9fc7-44c1-aead-cb42939868b5","resolution":{"observed_at":"2026-08-06T00:09:34.461160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:34.230121Z","title":null,"venue":null,"work_id":"c06e3d94-24bd-41d1-b160-5f90dd24ab8c","year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:25.909781Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:42a7660e68a288528baa12d51d02756371a37e98de7181855cd1a12b55f188fb","observation_id":"518db606-ea8a-4666-8701-56654afd26c4","resolution":{"observed_at":"2026-08-06T00:09:34.295839Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:34.098011Z","title":null,"venue":null,"work_id":"5b7e7aa6-8a05-464d-8343-9f23c8b76dd2","year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.072768Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:a94a90afc2fabc3b2d668d090a4dc9d02bcefc3715f52f78617c09ceb5bb4be6","observation_id":"d65fed49-ec24-48af-84c5-39d63de3fb21","resolution":{"observed_at":"2026-08-06T00:09:34.165013Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:33.949828Z","title":null,"venue":null,"work_id":"6936023b-f044-4994-9f19-13e2cc1cf3de","year":2020},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.194168Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:341449c9b8d3dc994895ff639afaeecb8914226f7568581ec1f9fe445f6e1a6b","observation_id":"e25114ec-a5b2-4a74-ad0f-85b41d3a8b20","resolution":{"observed_at":"2026-08-06T00:09:34.039474Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:33.818037Z","title":null,"venue":null,"work_id":"83ec1980-810e-42f0-9973-d7ff11537cad","year":2016},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.339314Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:506ef4fa17cdaf135dd4922f207fe3bedb9ed2b5a295b9350f0cc606ecf17073","observation_id":"ccfd753a-087b-424f-a08b-896e51baa068","resolution":{"observed_at":"2026-08-06T00:09:33.883572Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00025","last_updated":"2024-02-22T20:38:47Z","snapshot_observed_at":"2026-07-06T17:23:18.724263Z","submitted_at":"2024-01-05T19:17:55Z","title":"Accelerating a Triton Fused Kernel for W4A16 Quantized Inference with SplitK work decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00025","snapshot_observed_at":"2026-08-06T00:09:26.458557Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.458557Z"},"links":{"cited_paper":"/paper/2402.00025","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:fa480a8219606da270f50e4eee57fdaa769e25f0ac398f3189eefd826a9450be","observation_id":"c52859f4-982f-485a-bb3b-f369db80bb69","resolution":{"observed_at":"2026-08-06T00:09:26.458557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:33.664403Z","title":null,"venue":null,"work_id":"69a6dcdf-1345-474d-b717-b75634ad0ccb","year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.585936Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:626c453112cac49aeb9300d106335a9f948a6ef1a0e424725fd5ae97ee837cd1","observation_id":"9f59e3ce-de8e-4108-b978-484db1da7ba5","resolution":{"observed_at":"2026-08-06T00:09:33.722674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:33.505780Z","title":null,"venue":null,"work_id":"50850594-97d0-4727-80f9-b17a14ebfd4d","year":2015},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.683328Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:ae022ca504f2904028e03a17e781ca511cf76d3004a87cae8d9dd152a07a9e79","observation_id":"06f33b93-039a-4106-9332-64b8cd866179","resolution":{"observed_at":"2026-08-06T00:09:33.581372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:33.374750Z","title":null,"venue":null,"work_id":"83ae119e-c7cf-402e-9063-388b37c6f023","year":2022},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.812192Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:b2ba58ae46f85fe6508f7fa07f20f7af5e676379a550af6643ddb0b9ce255ef6","observation_id":"fdedfe60-b2dd-4111-90df-59fe0da63113","resolution":{"observed_at":"2026-08-06T00:09:33.428784Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:33.220242Z","title":null,"venue":null,"work_id":"90cc3b9a-0b3c-46e5-99a8-cd0832df6e78","year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:26.909656Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:16e1f9c39798988c896a02ca1c4cd4bb297b8f8d73648ff577be90b3aa5e1256","observation_id":"b4f060c8-5bf0-4d6a-b40b-794450d253fa","resolution":{"observed_at":"2026-08-06T00:09:33.281959Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:33.059654Z","title":null,"venue":null,"work_id":"82ef5d33-9558-4cc5-bd19-55460919e6b4","year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.018368Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:017faf1002ccac60684e5ed8116af545b60cbce4e0eabe195521821a7dff03a7","observation_id":"63e97ef6-1f2f-4019-ae54-73e2ebc2ea63","resolution":{"observed_at":"2026-08-06T00:09:33.142263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:32.901029Z","title":null,"venue":null,"work_id":"5265449b-886f-4770-a996-a307bb165749","year":2020},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.134374Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:0aef9b092cfede5bfc67e7102bd4f7918d46496710bb9bc8b5b22d54d39d166a","observation_id":"991a5dba-6ec8-4ac7-bb73-f7138907e9db","resolution":{"observed_at":"2026-08-06T00:09:32.971883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05459","last_updated":"2024-05-08T06:16:23Z","snapshot_observed_at":"2026-08-02T13:57:57.119489Z","submitted_at":"2024-01-10T09:25:45Z","title":"Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05459","snapshot_observed_at":"2026-08-06T00:09:27.255209Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.255209Z"},"links":{"cited_paper":"/paper/2401.05459","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:2422b9ceb784f5dc206f51988b0a96ca278f94ef5fc15061f8f24bc08735da0c","observation_id":"998bed04-e576-46d0-b9bf-15059eb36691","resolution":{"observed_at":"2026-08-06T00:09:27.255209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:32.741089Z","title":null,"venue":null,"work_id":"492982e6-8531-4c2a-860c-471cc61b6f9e","year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.364607Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:7808561b628091b29b61177a80bec7adbe035170cd5e3c00f6a0ce683b3b301d","observation_id":"8fe30705-e9bb-422d-b783-48e16e03a83e","resolution":{"observed_at":"2026-08-06T00:09:32.815385Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:32.581362Z","title":null,"venue":null,"work_id":"64f21588-2323-4e1b-bfd0-71b52dccd07c","year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.439093Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:d29b03d76785264e3525b0b42fd52326c7b55b3d19dcfba8b845f572e3415fa6","observation_id":"cc621830-3a20-4bb0-a2fb-9da4d1339508","resolution":{"observed_at":"2026-08-06T00:09:32.657437Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:32.425224Z","title":"2025.CUDA Pro Tip: Increase Per- formance with Vectorized Memory Access","venue":null,"work_id":"942e308d-6638-4627-ae3e-2ddb9910f3da","year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.539068Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:f802e06469475b64c6b1e3f443fb8e30f9ad04b0a3c9ffc17bcde26bcad71981","observation_id":"1f8abdde-f27d-41dd-a902-9cb095c5daa6","resolution":{"observed_at":"2026-08-06T00:09:32.498383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:27.631155Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.631155Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:e2efc5d4bfee6bbb2713595d7d1f3378d4ba4bc3f5de3115c93a8a9ebde4c5e1","observation_id":"bcaf8b32-8100-45c5-bc31-4c8ac214b4a4","resolution":{"observed_at":"2026-08-06T00:09:27.631155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-03T01:48:18.654934Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-06T00:09:27.751477Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.751477Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:74e10c752ead0b0eefbb71ffd00788b8b0aa306547e5891543b24e241245db11","observation_id":"abaf76ac-d623-4d99-b48a-121c41e5317b","resolution":{"observed_at":"2026-08-06T00:09:27.751477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-06T00:09:27.834304Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.834304Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:8a4e4c6d3db181ec0016bc363aeb5df9382e118cd71e9efb96e8b89c4a32950f","observation_id":"cce07656-58c6-4f4a-94b4-7599c754c919","resolution":{"observed_at":"2026-08-06T00:09:27.834304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:32.231696Z","title":null,"venue":null,"work_id":"2e08c45f-95db-4eab-96f2-54552282c3d6","year":2021},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:27.958092Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:d9387132e3f036162e7891740f9ac5670b2c08fc9ea7045cb882bbb3acc5313c","observation_id":"eb3d8de3-1a87-47c5-8dc7-8a9734ffbb67","resolution":{"observed_at":"2026-08-06T00:09:32.307534Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:32.081009Z","title":null,"venue":null,"work_id":"1b4bfe00-fc88-407b-9903-b35cd86762c6","year":2020},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.035913Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:42c71bb34acb7e0a349644946f374b7f9dd2f713a9a40a895234405403625ab4","observation_id":"7b57217b-de99-48c6-95ef-dd8d91f693eb","resolution":{"observed_at":"2026-08-06T00:09:32.153451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17771","last_updated":"2025-08-17T16:56:30Z","snapshot_observed_at":"2026-08-05T02:49:13.264759Z","submitted_at":"2025-01-29T17:05:33Z","title":"2SSP: A Two-Stage Framework for Structured Pruning of LLMs","version":2},"cited_work":{"arxiv_id":"2501.17771","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.17771","snapshot_observed_at":"2026-08-06T00:09:29.854181Z","title":"2SSP: A Two-Stage Framework for Structured Pruning of LLMs","venue":"cs.CL","work_id":"f2189d74-0f12-4f1f-89dd-3c21ab213a0e","year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.186603Z"},"links":{"cited_paper":"/paper/2501.17771","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:b0962016c6ae403ce73dffb26943758f5724e959432df8e7535f1e4e5e4af2f6","observation_id":"cb4a149c-bff4-4ad0-a8b2-6282ce3c7e40","resolution":{"observed_at":"2026-08-06T00:09:29.908872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:31.914422Z","title":null,"venue":null,"work_id":"0002b962-514c-44b2-857e-382cac73178e","year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.268501Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:a05b1375ffafce91378fb7f482cd38d460f39f04e015ea934307a6bf9e92d168","observation_id":"85c156e0-f35f-4210-afeb-5bb1e6942a17","resolution":{"observed_at":"2026-08-06T00:09:32.010398Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:31.607988Z","title":null,"venue":null,"work_id":"9edf61ae-7585-4f5e-bafc-bdf7a62f3f53","year":2017},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.349277Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:e5d45a53c89d332e8daa228489e13e960561220cfd0c398db7679ab879abe729","observation_id":"09a9ac09-0d70-45ad-b359-09e4075cff59","resolution":{"observed_at":"2026-08-06T00:09:31.775108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-06T00:09:28.408073Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.408073Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:c9d4ac9e15b04b3cb385b00117b94ffb1144b4b65b9fce67e1a283c54d878393","observation_id":"9b2922f6-7837-4f7c-a652-b5696f317df0","resolution":{"observed_at":"2026-08-06T00:09:28.408073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T00:09:28.494137Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.494137Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:4beecfe79d67d3aa9c7950dc560436d580f021586c660ad9bc7ee3422b435f4d","observation_id":"22a12d2b-b491-4ef7-b66e-b0fe35ab357d","resolution":{"observed_at":"2026-08-06T00:09:28.494137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:31.371030Z","title":null,"venue":null,"work_id":"7100f7b4-575e-495a-b812-b784f48ade5c","year":2021},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.609596Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:fa66c9e2fc95ba09dcf056bfe3c06818ad9457b4f4f25433a6efe2f0268abd95","observation_id":"3a455e09-76e5-4004-bc0d-48311b2ed5a9","resolution":{"observed_at":"2026-08-06T00:09:31.484732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10285","last_updated":"2023-09-19T03:20:02Z","snapshot_observed_at":"2026-08-01T16:15:23.171765Z","submitted_at":"2023-09-19T03:20:02Z","title":"Flash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10285","snapshot_observed_at":"2026-08-06T00:09:28.755271Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.755271Z"},"links":{"cited_paper":"/paper/2309.10285","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:2d3551995e49914b4403c06cdc8c61789d15f8cb4617a21c33ec2870a54cd178","observation_id":"3b184a85-9f3c-4509-a578-95e4ef8985b9","resolution":{"observed_at":"2026-08-06T00:09:28.755271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:31.054657Z","title":null,"venue":null,"work_id":"6eef13af-f0e7-49d1-afb7-37429dc73b9f","year":2024},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.832699Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:ee6ea698fe648974156b03c24f784c24c52978ec63964e59dcd689ed310dc881","observation_id":"c4ea8b7f-a3e3-4bd3-8c41-673785a545bb","resolution":{"observed_at":"2026-08-06T00:09:31.230643Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:30.804019Z","title":null,"venue":null,"work_id":"05be5af8-1fd1-4019-9605-0984468dbca6","year":2015},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:28.938982Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:3962e19827383fad7ae73b7ccb4dd468d758745b096ce23df1f203a560443688","observation_id":"4964a459-efbc-4f63-bd09-d2701ab4a430","resolution":{"observed_at":"2026-08-06T00:09:30.941108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.20194","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:29.671614Z","title":null,"venue":null,"work_id":"d9a65773-8af1-4bb6-bd77-33e96a75e533","year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:29.058718Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:f25aba3aa140fb3ce083ba7889cef3deab545185c66b2ce352f35de24e29645a","observation_id":"e36c7279-bba0-4acd-9992-3dc374a73064","resolution":{"observed_at":"2026-08-06T00:09:29.728433Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-06T00:09:29.156883Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:29.156883Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:5b37ff692879629550a89f63e54acff3ba3c7d60a069b10e8fee0dfb1627df44","observation_id":"0d67357a-368f-4125-8633-4370b11fa352","resolution":{"observed_at":"2026-08-06T00:09:29.156883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:30.489414Z","title":null,"venue":null,"work_id":"4d25cdad-2cfb-4695-9242-1dc607548afe","year":2025},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:29.267647Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:3603c0ee9fe84957b0fb6b5da0b71b7aa9ed763544b7622ab91f6b8b686d5c06","observation_id":"ec737639-aee7-439a-956b-5bd8d9519247","resolution":{"observed_at":"2026-08-06T00:09:30.629179Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:30.306448Z","title":"2022.{SparTA}:{Deep-Learning} Model Sparsity via{Tensor-with-Sparsity-Attribute}","venue":null,"work_id":"b6353fca-2e03-48aa-af20-a51122d9e755","year":2022},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:29.336047Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:b8d6c97c31138fc593c53a827342f909396dbef20865d4598dbfc43f00a021a3","observation_id":"3d213abd-06ad-48ac-9938-5a333520d90d","resolution":{"observed_at":"2026-08-06T00:09:30.382427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10594","last_updated":"2025-05-22T04:58:06Z","snapshot_observed_at":"2026-07-06T18:31:27.512384Z","submitted_at":"2024-06-15T11:03:33Z","title":"BlockPruner: Fine-grained Pruning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10594","snapshot_observed_at":"2026-08-06T00:09:29.407949Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:29.407949Z"},"links":{"cited_paper":"/paper/2406.10594","citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:00dd39097415a25305f7992f28f8a17b5b01fca7b292c01796d081f8c9477656","observation_id":"eae9f883-b582-45c3-a052-d1e00201dc5e","resolution":{"observed_at":"2026-08-06T00:09:29.407949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:30.179176Z","title":null,"venue":null,"work_id":"b4eb4677-af22-42e3-9fd6-8d117efc4342","year":2019},"citing_paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:29.472155Z"},"links":{"citing_paper":"/paper/2608.01536"},"observation_digest":"sha256:f70d52a3a0ebef1dd1cd47adc6fff6ab1535cd26c6db66a515a49576745cdafa","observation_id":"3c91bb2c-fc32-4948-848c-964556848b74","resolution":{"observed_at":"2026-08-06T00:09:30.230893Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.01536","last_updated":"2026-08-02T23:10:04Z","latest_version":1,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-09T11:50:23.411535Z","submitted_at":"2026-08-02T23:10:04Z","title":"Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2608.01536."}