Pith. sign in

Paper Citation Record · LEDGER

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference

As of 9 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2608.01536.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2608.01536 v1

Coverage vector

measured 39 of 39 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T00:09:29.472155Z

measured 39 of 39 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

39 of 39 outbound references displayed

  • verified exact2
  • verified fuzzy2
  • unresolved35
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 90ba9164-23c6-4e8e-aa8b-16e6c04ae8a9 · outbound

This paper cites gpt-oss-120b & gpt-oss-20b Model Card.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference gpt-oss-120b & gpt-oss-20b Model Card

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:25.460411Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:25.460411Z digest=sha256:dea8e039be29c0e4e4350b2b840de7018e7219effe10f45b52ca7b9c9bb594e0

Observation 8f1a3059-cf80-4e3b-a5dd-df936e485b4f · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.760777Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:25.540124Z digest=sha256:c9238bb7ea6b05d1e15720b5fa5b03c4368984ebe03b4964aa04b468d98bcdb5

Observation 5b9af056-542b-4898-8531-8d25c89600bd · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.606557Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:25.640712Z digest=sha256:f797153ca9781ae9389dd55e682d73fc4f360c72eb72f2048477f94c3064ac65

Observation 09b0186b-9fc7-44c1-aead-cb42939868b5 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 4

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.461160Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:25.737432Z digest=sha256:a0bdb67953ac50ad48b59c7461bccb72f659e6a808cfddc7fad2915137e709b3

Observation 518db606-ea8a-4666-8701-56654afd26c4 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.295839Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:25.909781Z digest=sha256:42a7660e68a288528baa12d51d02756371a37e98de7181855cd1a12b55f188fb

Observation d65fed49-ec24-48af-84c5-39d63de3fb21 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.165013Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:26.072768Z digest=sha256:a94a90afc2fabc3b2d668d090a4dc9d02bcefc3715f52f78617c09ceb5bb4be6

Observation e25114ec-a5b2-4a74-ad0f-85b41d3a8b20 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 7

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.039474Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:26.194168Z digest=sha256:341449c9b8d3dc994895ff639afaeecb8914226f7568581ec1f9fe445f6e1a6b

Observation ccfd753a-087b-424f-a08b-896e51baa068 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 8

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.883572Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:26.339314Z digest=sha256:506ef4fa17cdaf135dd4922f207fe3bedb9ed2b5a295b9350f0cc606ecf17073

Observation c52859f4-982f-485a-bb3b-f369db80bb69 · outbound

This paper cites Accelerating a Triton Fused Kernel for W4A16 Quantized Inference with SplitK work decomposition.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Accelerating a Triton Fused Kernel for W4A16 Quantized Inference with SplitK work decomposition

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:26.458557Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:26.458557Z digest=sha256:fa480a8219606da270f50e4eee57fdaa769e25f0ac398f3189eefd826a9450be

Observation 9f59e3ce-de8e-4108-b978-484db1da7ba5 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.722674Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:26.585936Z digest=sha256:626c453112cac49aeb9300d106335a9f948a6ef1a0e424725fd5ae97ee837cd1

Observation 06f33b93-039a-4106-9332-64b8cd866179 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.581372Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:26.683328Z digest=sha256:ae022ca504f2904028e03a17e781ca511cf76d3004a87cae8d9dd152a07a9e79

Observation fdedfe60-b2dd-4111-90df-59fe0da63113 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.428784Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:26.812192Z digest=sha256:b2ba58ae46f85fe6508f7fa07f20f7af5e676379a550af6643ddb0b9ce255ef6

Observation b4f060c8-5bf0-4d6a-b40b-794450d253fa · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.281959Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:26.909656Z digest=sha256:16e1f9c39798988c896a02ca1c4cd4bb297b8f8d73648ff577be90b3aa5e1256

Observation 63e97ef6-1f2f-4019-ae54-73e2ebc2ea63 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.142263Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:27.018368Z digest=sha256:017faf1002ccac60684e5ed8116af545b60cbce4e0eabe195521821a7dff03a7

Observation 991a5dba-6ec8-4ac7-bb73-f7138907e9db · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.971883Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:27.134374Z digest=sha256:0aef9b092cfede5bfc67e7102bd4f7918d46496710bb9bc8b5b22d54d39d166a

Observation 998bed04-e576-46d0-b9bf-15059eb36691 · outbound

This paper cites Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.255209Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.255209Z digest=sha256:2422b9ceb784f5dc206f51988b0a96ca278f94ef5fc15061f8f24bc08735da0c

Observation 8fe30705-e9bb-422d-b783-48e16e03a83e · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.815385Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:27.364607Z digest=sha256:7808561b628091b29b61177a80bec7adbe035170cd5e3c00f6a0ce683b3b301d

Observation cc621830-3a20-4bb0-a2fb-9da4d1339508 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.657437Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:27.439093Z digest=sha256:d29b03d76785264e3525b0b42fd52326c7b55b3d19dcfba8b845f572e3415fa6

Observation 1f8abdde-f27d-41dd-a902-9cb095c5daa6 · outbound

This paper cites 2025.CUDA Pro Tip: Increase Per- formance with Vectorized Memory Access.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference 2025.CUDA Pro Tip: Increase Per- formance with Vectorized Memory Access

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:09:32.498383Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:27.539068Z digest=sha256:f802e06469475b64c6b1e3f443fb8e30f9ad04b0a3c9ffc17bcde26bcad71981

Observation bcaf8b32-8100-45c5-bc31-4c8ac214b4a4 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.631155Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.631155Z digest=sha256:e2efc5d4bfee6bbb2713595d7d1f3378d4ba4bc3f5de3115c93a8a9ebde4c5e1

Observation abaf76ac-d623-4d99-b48a-121c41e5317b · outbound

This paper cites ShortGPT: Layers in Large Language Models are More Redundant Than You Expect.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference ShortGPT: Layers in Large Language Models are More Redundant Than You Expect

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.751477Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.751477Z digest=sha256:74e10c752ead0b0eefbb71ffd00788b8b0aa306547e5891543b24e241245db11

Observation cce07656-58c6-4f4a-94b4-7599c754c919 · outbound

This paper cites Pointer Sentinel Mixture Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Pointer Sentinel Mixture Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.834304Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.834304Z digest=sha256:8a4e4c6d3db181ec0016bc363aeb5df9382e118cd71e9efb96e8b89c4a32950f

Observation eb3d8de3-1a87-47c5-8dc7-8a9734ffbb67 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.307534Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:27.958092Z digest=sha256:d9387132e3f036162e7891740f9ac5670b2c08fc9ea7045cb882bbb3acc5313c

Observation 7b57217b-de99-48c6-95ef-dd8d91f693eb · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.153451Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:28.035913Z digest=sha256:42c71bb34acb7e0a349644946f374b7f9dd2f713a9a40a895234405403625ab4

Observation cb4a149c-bff4-4ad0-a8b2-6282ce3c7e40 · outbound

This paper cites 2SSP: A Two-Stage Framework for Structured Pruning of LLMs.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference 2SSP: A Two-Stage Framework for Structured Pruning of LLMs

Reference 25

Resolution
verified exact
local_arxiv, observed 2026-08-06T00:09:29.908872Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:28.186603Z digest=sha256:b0962016c6ae403ce73dffb26943758f5724e959432df8e7535f1e4e5e4af2f6

Observation 85c156e0-f35f-4210-afeb-5bb1e6942a17 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 26

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.010398Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:28.268501Z digest=sha256:a05b1375ffafce91378fb7f482cd38d460f39f04e015ea934307a6bf9e92d168

Observation 09a9ac09-0d70-45ad-b359-09e4075cff59 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:31.775108Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:28.349277Z digest=sha256:e5d45a53c89d332e8daa228489e13e960561220cfd0c398db7679ab879abe729

Observation 9b2922f6-7837-4f7c-a652-b5696f317df0 · outbound

This paper cites A Simple and Effective Pruning Approach for Large Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference A Simple and Effective Pruning Approach for Large Language Models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:28.408073Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:28.408073Z digest=sha256:c9d4ac9e15b04b3cb385b00117b94ffb1144b4b65b9fce67e1a283c54d878393

Observation 22a12d2b-b491-4ef7-b66e-b0fe35ab357d · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference LLaMA: Open and Efficient Foundation Language Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:28.494137Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:28.494137Z digest=sha256:4beecfe79d67d3aa9c7950dc560436d580f021586c660ad9bc7ee3422b435f4d

Observation 3a455e09-76e5-4004-bc0d-48311b2ed5a9 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:31.484732Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:28.609596Z digest=sha256:fa66c9e2fc95ba09dcf056bfe3c06818ad9457b4f4f25433a6efe2f0268abd95

Observation 3b184a85-9f3c-4509-a578-95e4ef8985b9 · outbound

This paper cites Flash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Flash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:28.755271Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:28.755271Z digest=sha256:2d3551995e49914b4403c06cdc8c61789d15f8cb4617a21c33ec2870a54cd178

Observation c4ea8b7f-a3e3-4bd3-8c41-673785a545bb · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:31.230643Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:28.832699Z digest=sha256:ee6ea698fe648974156b03c24f784c24c52978ec63964e59dcd689ed310dc881

Observation 4964a459-efbc-4f63-bd09-d2701ab4a430 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:30.941108Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:28.938982Z digest=sha256:3962e19827383fad7ae73b7ccb4dd468d758745b096ce23df1f203a560443688

Observation e36c7279-bba0-4acd-9992-3dc374a73064 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 34

Resolution
verified exact
raw_fallback, observed 2026-08-06T00:09:29.728433Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:29.058718Z digest=sha256:f25aba3aa140fb3ce083ba7889cef3deab545185c66b2ce352f35de24e29645a

Observation 0d67357a-368f-4125-8633-4370b11fa352 · outbound

This paper cites OPT: Open Pre-trained Transformer Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference OPT: Open Pre-trained Transformer Language Models

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:29.156883Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:29.156883Z digest=sha256:5b37ff692879629550a89f63e54acff3ba3c7d60a069b10e8fee0dfb1627df44

Observation ec737639-aee7-439a-956b-5bd8d9519247 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 36

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:30.629179Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:29.267647Z digest=sha256:3603c0ee9fe84957b0fb6b5da0b71b7aa9ed763544b7622ab91f6b8b686d5c06

Observation 3d213abd-06ad-48ac-9938-5a333520d90d · outbound

This paper cites 2022.{SparTA}:{Deep-Learning} Model Sparsity via{Tensor-with-Sparsity-Attribute}.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference 2022.{SparTA}:{Deep-Learning} Model Sparsity via{Tensor-with-Sparsity-Attribute}

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:09:30.382427Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:29.336047Z digest=sha256:b8d6c97c31138fc593c53a827342f909396dbef20865d4598dbfc43f00a021a3

Observation eae9f883-b582-45c3-a052-d1e00201dc5e · outbound

This paper cites BlockPruner: Fine-grained Pruning for Large Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference BlockPruner: Fine-grained Pruning for Large Language Models

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:29.407949Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:29.407949Z digest=sha256:00dd39097415a25305f7992f28f8a17b5b01fca7b292c01796d081f8c9477656

Observation 3c91bb2c-fc32-4948-848c-964556848b74 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 39

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:30.230893Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T00:09:29.472155Z digest=sha256:f70d52a3a0ebef1dd1cd47adc6fff6ab1535cd26c6db66a515a49576745cdafa

Pith citing papers

No inbound Pith citation observations are available.