Pith. sign in

Paper Citation Record · LEDGER

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference

As of 10 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2608.01536.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2608.01536 v1

Coverage vector

measured 39 of 39 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T00:09:29.472155Z

measured 39 of 39 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

39 of 39 outbound references displayed

  • verified exact2
  • verified fuzzy2
  • unresolved35
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 90ba9164-23c6-4e8e-aa8b-16e6c04ae8a9 · outbound

This paper cites gpt-oss-120b & gpt-oss-20b Model Card.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference gpt-oss-120b & gpt-oss-20b Model Card

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:25.460411Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:25.460411Z digest=sha256:dea8e039be29c0e4e4350b2b840de7018e7219effe10f45b52ca7b9c9bb594e0

Observation 8f1a3059-cf80-4e3b-a5dd-df936e485b4f · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.760777Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:25.540124Z digest=sha256:2dd9d6b79ecfc2a8a4b80e4b9c0c1f0b33b622ba8b40f3d3557eb0d01b6cce22

Observation 5b9af056-542b-4898-8531-8d25c89600bd · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.606557Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:25.640712Z digest=sha256:4ed9d9e7eb80485352d78c8df1178216c3a5864e98a8fd1af8494006f8158c1a

Observation 09b0186b-9fc7-44c1-aead-cb42939868b5 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 4

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.461160Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:25.737432Z digest=sha256:fbc279aac3b72ccfbdb12442c8d64b9d4f2be0479eef812a011bb24c3862c22c

Observation 518db606-ea8a-4666-8701-56654afd26c4 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.295839Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:25.909781Z digest=sha256:1fa26ea00ee04850c10c2903e5c86bf22894abe4a48cbe01934e1bc7830c37da

Observation d65fed49-ec24-48af-84c5-39d63de3fb21 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 6

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.165013Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:26.072768Z digest=sha256:09183caa5f3c354d216c284577d0c2a4e0e455f394e6ec74d516d5b0b5d8fe9f

Observation e25114ec-a5b2-4a74-ad0f-85b41d3a8b20 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 7

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:34.039474Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:26.194168Z digest=sha256:f20f941a6c5e8739d32111ae34e1c498d909bc71b613af8423be4a0dc68e5214

Observation ccfd753a-087b-424f-a08b-896e51baa068 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 8

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.883572Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:26.339314Z digest=sha256:d168c0142118cb66d254dc87ebfbc49ac3644c24a42148a2d2c0139f1815f508

Observation c52859f4-982f-485a-bb3b-f369db80bb69 · outbound

This paper cites Accelerating a Triton Fused Kernel for W4A16 Quantized Inference with SplitK work decomposition.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Accelerating a Triton Fused Kernel for W4A16 Quantized Inference with SplitK work decomposition

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:26.458557Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:26.458557Z digest=sha256:fa480a8219606da270f50e4eee57fdaa769e25f0ac398f3189eefd826a9450be

Observation 9f59e3ce-de8e-4108-b978-484db1da7ba5 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.722674Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:26.585936Z digest=sha256:e9223b7adff0232b064a22e63395421ae7aa4e2ecc1e27c3995daa5280641d59

Observation 06f33b93-039a-4106-9332-64b8cd866179 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.581372Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:26.683328Z digest=sha256:07131d800729971d2af21c789f32665404ca353f4d377c5e8da84666d756091b

Observation fdedfe60-b2dd-4111-90df-59fe0da63113 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.428784Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:26.812192Z digest=sha256:f8b48802e4cc3267a5e2d8337b152eb34428c0767dc6fd03f3bb5a47edac60b6

Observation b4f060c8-5bf0-4d6a-b40b-794450d253fa · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.281959Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:26.909656Z digest=sha256:f20ec42b08671258faabf546d2ecb544eaf0ef4b83ef2b82dedc46d9ff2c509b

Observation 63e97ef6-1f2f-4019-ae54-73e2ebc2ea63 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:33.142263Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:27.018368Z digest=sha256:2a0dc7636e8dd3a65e73759231e455b67e0eb149e0408bf8cb53944d44754bc7

Observation 991a5dba-6ec8-4ac7-bb73-f7138907e9db · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.971883Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:27.134374Z digest=sha256:5860df46f6feb6dbe1f7fc1f376286ddab7c3f7453885237b1d25bed37d8ee25

Observation 998bed04-e576-46d0-b9bf-15059eb36691 · outbound

This paper cites Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.255209Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.255209Z digest=sha256:2422b9ceb784f5dc206f51988b0a96ca278f94ef5fc15061f8f24bc08735da0c

Observation 8fe30705-e9bb-422d-b783-48e16e03a83e · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.815385Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:27.364607Z digest=sha256:62d18ed7c1560e1ceb676e98d619e667094d44f13cb67aa1e8ea076b481d1f29

Observation cc621830-3a20-4bb0-a2fb-9da4d1339508 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.657437Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:27.439093Z digest=sha256:06d63b5155fc7a66671523fafad986a828dc7145b493cf7c81f07cac1fd22bbf

Observation 1f8abdde-f27d-41dd-a902-9cb095c5daa6 · outbound

This paper cites 2025.CUDA Pro Tip: Increase Per- formance with Vectorized Memory Access.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference 2025.CUDA Pro Tip: Increase Per- formance with Vectorized Memory Access

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:09:32.498383Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:27.539068Z digest=sha256:bef4a0b6277a7c15c2b440526309ed4f5155065bce35cd85614191f1895b9b2f

Observation bcaf8b32-8100-45c5-bc31-4c8ac214b4a4 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.631155Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.631155Z digest=sha256:e2efc5d4bfee6bbb2713595d7d1f3378d4ba4bc3f5de3115c93a8a9ebde4c5e1

Observation abaf76ac-d623-4d99-b48a-121c41e5317b · outbound

This paper cites ShortGPT: Layers in Large Language Models are More Redundant Than You Expect.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference ShortGPT: Layers in Large Language Models are More Redundant Than You Expect

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.751477Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.751477Z digest=sha256:74e10c752ead0b0eefbb71ffd00788b8b0aa306547e5891543b24e241245db11

Observation cce07656-58c6-4f4a-94b4-7599c754c919 · outbound

This paper cites Pointer Sentinel Mixture Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Pointer Sentinel Mixture Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:27.834304Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:27.834304Z digest=sha256:8a4e4c6d3db181ec0016bc363aeb5df9382e118cd71e9efb96e8b89c4a32950f

Observation eb3d8de3-1a87-47c5-8dc7-8a9734ffbb67 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.307534Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:27.958092Z digest=sha256:9813132c9a47135834eb722b99549d72760b524def47fdfae682d236189714ff

Observation 7b57217b-de99-48c6-95ef-dd8d91f693eb · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.153451Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:28.035913Z digest=sha256:c1de572cf9a88beb6f7d79eed0bae82105831e47bce3b47ee58eb2def4efd380

Observation cb4a149c-bff4-4ad0-a8b2-6282ce3c7e40 · outbound

This paper cites 2SSP: A Two-Stage Framework for Structured Pruning of LLMs.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference 2SSP: A Two-Stage Framework for Structured Pruning of LLMs

Reference 25

Resolution
verified exact
local_arxiv, observed 2026-08-06T00:09:29.908872Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:28.186603Z digest=sha256:25c217bfccb4d058eec920c47e4287e8f6e27d68adbb428ab69beb1b51aac19f

Observation 85c156e0-f35f-4210-afeb-5bb1e6942a17 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 26

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:32.010398Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:28.268501Z digest=sha256:b0f79d4ce4e268d32ddad9f7cc90bc0d921f1c37658030652c764ef2459f7c8e

Observation 09a9ac09-0d70-45ad-b359-09e4075cff59 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 27

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:31.775108Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:28.349277Z digest=sha256:7db0f68b4841621c398ff04ba3edc23eaa0599cc3360af986ddaa1806a011628

Observation 9b2922f6-7837-4f7c-a652-b5696f317df0 · outbound

This paper cites A Simple and Effective Pruning Approach for Large Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference A Simple and Effective Pruning Approach for Large Language Models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:28.408073Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:28.408073Z digest=sha256:c9d4ac9e15b04b3cb385b00117b94ffb1144b4b65b9fce67e1a283c54d878393

Observation 22a12d2b-b491-4ef7-b66e-b0fe35ab357d · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference LLaMA: Open and Efficient Foundation Language Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:28.494137Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:28.494137Z digest=sha256:4beecfe79d67d3aa9c7950dc560436d580f021586c660ad9bc7ee3422b435f4d

Observation 3a455e09-76e5-4004-bc0d-48311b2ed5a9 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:31.484732Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:28.609596Z digest=sha256:f67aa58e48d8b97cecf8b4f3e6b7a3dc765761bad9dba4d02dee90ee7508ab48

Observation 3b184a85-9f3c-4509-a578-95e4ef8985b9 · outbound

This paper cites Flash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Flash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:28.755271Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:28.755271Z digest=sha256:2d3551995e49914b4403c06cdc8c61789d15f8cb4617a21c33ec2870a54cd178

Observation c4ea8b7f-a3e3-4bd3-8c41-673785a545bb · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:31.230643Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:28.832699Z digest=sha256:59f9e69e86faf5a0afd709ba172408d772569d6ee2e6b091963c6ba0456943ad

Observation 4964a459-efbc-4f63-bd09-d2701ab4a430 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:30.941108Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:28.938982Z digest=sha256:21d5f245c688a9ec0591615034fece4f9feb5c198a8824a6affa8b0ece0e4ed9

Observation e36c7279-bba0-4acd-9992-3dc374a73064 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 34

Resolution
verified exact
raw_fallback, observed 2026-08-06T00:09:29.728433Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:29.058718Z digest=sha256:10866c2fde0b7a7716340dffdf86250f163fc084900db34f9af0f2777e5159d3

Observation 0d67357a-368f-4125-8633-4370b11fa352 · outbound

This paper cites OPT: Open Pre-trained Transformer Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference OPT: Open Pre-trained Transformer Language Models

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:29.156883Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:29.156883Z digest=sha256:5b37ff692879629550a89f63e54acff3ba3c7d60a069b10e8fee0dfb1627df44

Observation ec737639-aee7-439a-956b-5bd8d9519247 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 36

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:30.629179Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:29.267647Z digest=sha256:8befb134e2743a8cf7fdd01f8d68e09b16d8f048adbe852727189fe4b26c881b

Observation 3d213abd-06ad-48ac-9938-5a333520d90d · outbound

This paper cites 2022.{SparTA}:{Deep-Learning} Model Sparsity via{Tensor-with-Sparsity-Attribute}.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference 2022.{SparTA}:{Deep-Learning} Model Sparsity via{Tensor-with-Sparsity-Attribute}

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T00:09:30.382427Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:29.336047Z digest=sha256:ac8a9f7b97bff8ae9808cc496ad579ec6d6aeee67d97b55ffb3e34b7e24d94fc

Observation eae9f883-b582-45c3-a052-d1e00201dc5e · outbound

This paper cites BlockPruner: Fine-grained Pruning for Large Language Models.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference BlockPruner: Fine-grained Pruning for Large Language Models

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-06T00:09:29.407949Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T00:09:29.407949Z digest=sha256:00dd39097415a25305f7992f28f8a17b5b01fca7b292c01796d081f8c9477656

Observation 3c91bb2c-fc32-4948-848c-964556848b74 · outbound

This paper cites an unresolved cited work.

Celty: SpMspV GPU Kernel and SIMT Co-Design for Efficient Dual-Sparse LLM Inference Unresolved cited work

Reference 39

Resolution
unresolved
raw_fallback, observed 2026-08-06T00:09:30.230893Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-08-06T00:09:29.472155Z digest=sha256:61f79437ffa4e673ffc29eb9e9b88ecddbb137027f5ced8c6424818452336574

Pith citing papers

No inbound Pith citation observations are available.