{"as_of":"2026-08-18T00:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f56483b99ea367a753fa039860195c427e4fd0d14e4768827120733a8ba51ecc","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:52:48.879174Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T05:17:05.015451Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T22:29:00.455930Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20258","snapshot_observed_at":"2026-08-03T19:04:28.510867Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.02551","last_updated":"2026-08-05T18:31:31Z","snapshot_observed_at":"2026-08-16T13:58:25.439020Z","submitted_at":"2025-12-02T09:20:15Z","title":"CUDA-L2: Surpassing cuBLAS Performance for Matrix Multiplication through Reinforcement Learning","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T19:04:28.510867Z"},"links":{"cited_paper":"/paper/2508.20258","citing_paper":"/paper/2512.02551"},"observation_digest":"sha256:1dbceb3cfd488af617eea07e1ef1489dffff60f886c4e9eca9ca75c1073210bd","observation_id":"88e47590-849a-4654-858c-22b63208049d","resolution":{"observed_at":"2026-08-03T19:04:28.510867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20258","snapshot_observed_at":"2026-08-03T08:49:50.385438Z","title":"Swizzleperf: Hardware-aware llms for gpu kernel performance optimization.arXiv preprint arXiv:2508.20258,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.15727","last_updated":"2026-06-06T14:44:09Z","snapshot_observed_at":"2026-08-12T20:12:18.838491Z","submitted_at":"2026-01-22T07:53:52Z","title":"Towards Automated Kernel Generation in the Era of LLMs","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T08:49:50.385438Z"},"links":{"cited_paper":"/paper/2508.20258","citing_paper":"/paper/2601.15727"},"observation_digest":"sha256:3b4338fc517d188707b99bd7fcbc58bbf4c7fd12442a805d894d768dc0844f1b","observation_id":"1bcbc9cb-2ef2-4442-ad32-d721ebd61e73","resolution":{"observed_at":"2026-08-03T08:49:50.385438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"cited_work":{"arxiv_id":"2508.20258","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.20258","snapshot_observed_at":"2026-07-03T22:29:00.455930Z","title":"SwizzlePerf: Hardware-aware LLMs for GPU kernel performance optimization","venue":null,"work_id":"da635439-83e2-472b-a7b7-454977ba00a7","year":2025},"citing_paper":{"arxiv_id":"2604.20032","last_updated":"2026-07-15T22:02:45Z","snapshot_observed_at":"2026-08-14T07:44:58.767661Z","submitted_at":"2026-04-21T22:23:55Z","title":"LEO: Tracing GPU Stall Root Causes via Cross-Vendor Backward Slicing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T00:55:09.017037Z"},"links":{"cited_paper":"/paper/2508.20258","citing_paper":"/paper/2604.20032"},"observation_digest":"sha256:ff95b4c9596e8fc131b7806fc45d0c4a5c7c3f5a5a43df7762adb4375f373d6b","observation_id":"86fcc89c-f9cc-45dc-8373-fdd0747458cf","resolution":{"observed_at":"2026-05-10T01:04:50.649360Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20258","snapshot_observed_at":"2026-08-02T15:49:36.610007Z","title":"SwizzlePerf: Hardware-aware LLMs for GPU kernel performance optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.20032","last_updated":"2026-07-15T22:02:45Z","snapshot_observed_at":"2026-08-14T07:44:58.767661Z","submitted_at":"2026-04-21T22:23:55Z","title":"LEO: Tracing GPU Stall Root Causes via Cross-Vendor Backward Slicing","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T15:49:36.610007Z"},"links":{"cited_paper":"/paper/2508.20258","citing_paper":"/paper/2604.20032"},"observation_digest":"sha256:86fa1839ad3f286df5090d78ca09cdf90fe9928825bd68ea5767d4bc3485c0bd","observation_id":"59802901-4e8e-49ce-8369-9e723d36cdee","resolution":{"observed_at":"2026-08-02T15:49:36.610007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"cited_work":{"arxiv_id":"2508.20258","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.20258","snapshot_observed_at":"2026-07-03T22:29:00.455930Z","title":"SwizzlePerf: Hardware-aware LLMs for GPU kernel performance optimization","venue":null,"work_id":"da635439-83e2-472b-a7b7-454977ba00a7","year":2025},"citing_paper":{"arxiv_id":"2605.30359","last_updated":"2026-08-03T01:31:45Z","snapshot_observed_at":"2026-08-16T07:40:01.654164Z","submitted_at":"2026-05-08T03:41:54Z","title":"Kernel Foundry: A Diagnosis-driven Evolutionary Kernel Optimizer with Multi-Experts","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T23:33:47.477482Z"},"links":{"cited_paper":"/paper/2508.20258","citing_paper":"/paper/2605.30359"},"observation_digest":"sha256:2148707aeed93931f2207ddc1d0f0575386838cea779f91324072be145eb0b9b","observation_id":"0670648b-7238-4aa5-936d-26be8e3c7ff1","resolution":{"observed_at":"2026-06-30T23:35:07.141292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20258","snapshot_observed_at":"2026-08-04T05:17:05.015451Z","title":"Swizzleperf: Hardware-aware llms for gpu kernel performance optimization.arXiv preprint arXiv:2508.20258, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30359","last_updated":"2026-08-03T01:31:45Z","snapshot_observed_at":"2026-08-16T07:40:01.654164Z","submitted_at":"2026-05-08T03:41:54Z","title":"Kernel Foundry: A Diagnosis-driven Evolutionary Kernel Optimizer with Multi-Experts","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T05:17:05.015451Z"},"links":{"cited_paper":"/paper/2508.20258","citing_paper":"/paper/2605.30359"},"observation_digest":"sha256:7b07a5079f949eb20ec6ba772adbb265906300fa2af1af6e7c1b0c4e8a416218","observation_id":"460e180a-3037-4469-8328-8c697cb0b7bf","resolution":{"observed_at":"2026-08-04T05:17:05.015451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"cited_work":{"arxiv_id":"2508.20258","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.20258","snapshot_observed_at":"2026-07-03T22:29:00.455930Z","title":"SwizzlePerf: Hardware-aware LLMs for GPU kernel performance optimization","venue":null,"work_id":"da635439-83e2-472b-a7b7-454977ba00a7","year":2025},"citing_paper":{"arxiv_id":"2606.17518","last_updated":"2026-06-16T04:54:23Z","snapshot_observed_at":"2026-08-16T01:52:01.817331Z","submitted_at":"2026-06-16T04:54:23Z","title":"SpecGen: Accelerating Agentic Kernel Optimization with Speculative Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T23:35:32.175768Z"},"links":{"cited_paper":"/paper/2508.20258","citing_paper":"/paper/2606.17518"},"observation_digest":"sha256:33727b8f230e90c081a43b75ad695f82b8f2f654723acc227f5da26ce7a50bbe","observation_id":"4a565637-34fa-4324-8f73-ba9102e76de5","resolution":{"observed_at":"2026-07-03T22:29:00.457665Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20258","snapshot_observed_at":"2026-08-02T13:46:47.513187Z","title":"Swizzleperf: Hardware-aware llms for gpu kernel performance optimization.arXiv preprint arXiv:2508.20258, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20466","last_updated":"2026-05-19T05:38:39Z","snapshot_observed_at":"2026-08-15T00:40:35.450110Z","submitted_at":"2026-05-19T05:38:39Z","title":"JAXBench: Benchmarking Autonomous TPU Kernel Optimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T13:46:47.513187Z"},"links":{"cited_paper":"/paper/2508.20258","citing_paper":"/paper/2607.20466"},"observation_digest":"sha256:22166da75bf953a94e6913d6295e2767d29ef8e1ba9912493386b0ad3800b20c","observation_id":"030a03f7-669e-4e8b-b5a6-e982ee3547f3","resolution":{"observed_at":"2026-08-02T13:46:47.513187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.20258/citation-record","integrity":"/paper/2508.20258/integrity","json":"/paper/2508.20258/citation-record.json","paper":"/paper/2508.20258"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:49.390863Z","title":"Learning to optimize halide with tree search and random programs","venue":null,"work_id":"e10199be-6a2b-4ef2-a074-85f8bb6a239b","year":2019},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.764789Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:bc39eaee830df66ce3f9b2665a6e8f744814461e3dc806f9bc32189c2cdab4b2","observation_id":"e4fa1617-73b4-46dd-b6ea-ab8848447d71","resolution":{"observed_at":"2026-08-15T16:52:49.395532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-08-15T06:28:09.529747Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-08-15T16:52:48.769505Z","title":"Gqa: Training generalized multi-query transformer models from multi-head checkpoints","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.769505Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:99a0de259800cc4f9438ca8aaaa48978e8a3071a217a45de91cae8550f906043","observation_id":"f89de765-a9d3-488f-8d16-760f3e165eae","resolution":{"observed_at":"2026-08-15T16:52:48.769505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:49.376306Z","title":"Heterogeneous-computing interface for portability (HIP)","venue":null,"work_id":"45d56329-138f-435a-84af-a41c51c90d82","year":2025},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.774765Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:abdecd0055322be54ba6b0f6e86cf4bd0b2ff0eb83eb3abb5cd87b1d22cc16ca","observation_id":"31f951f8-3696-4014-9fb8-f68bd63548ff","resolution":{"observed_at":"2026-08-15T16:52:49.382299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:49.362821Z","title":"ROCprofiler-SDK: Application profiling, tracing, and performance analysis","venue":null,"work_id":"94f9e31f-6d46-4962-8e07-085560adbe12","year":2025},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.778592Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:1d51d46d15703e9e521f6eefabb6373611241e5da9ca37efe948aed1b310505c","observation_id":"292641d1-778e-4417-9bdd-35500a258163","resolution":{"observed_at":"2026-08-15T16:52:49.367684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20807","last_updated":"2025-08-22T08:48:16Z","snapshot_observed_at":"2026-08-11T23:09:56.467501Z","submitted_at":"2025-06-25T19:59:34Z","title":"GPU Kernel Scientist: An LLM-Driven Framework for Iterative Kernel Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.20807","snapshot_observed_at":"2026-08-15T16:52:48.782723Z","title":"Gpu kernel scientist: An llm-driven framework for iterative kernel optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.782723Z"},"links":{"cited_paper":"/paper/2506.20807","citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:a875c74c96b154eb5fa30a74819d6ace775b320b7e43648bcfded4dee3915c98","observation_id":"c01fd3fa-c52e-4862-996a-2125ba499365","resolution":{"observed_at":"2026-08-15T16:52:48.782723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:48.787433Z","title":"Opentuner: An extensible framework for program autotuning","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.787433Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:180ad6e18ff80cd7bb73a15ea97a2c1a1243c3e84edf0a4fca62d4a586b514bf","observation_id":"4c3ce8d3-a7b1-4892-adc0-6bd824b8e534","resolution":{"observed_at":"2026-08-15T16:52:48.787433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:49.350043Z","title":"Intelliperf: LLM-powered autonomous GPU performance engineer, July 2025","venue":null,"work_id":"0d32a464-6963-4288-9516-1ae72a097a72","year":2025},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.792055Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:4db6a8e2882f154a26106abf45c568272973a16e4ea451fe6eed75cc3fe9a80a","observation_id":"04a52275-2c27-4c13-ba48-933fee9af7c4","resolution":{"observed_at":"2026-08-15T16:52:49.354652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11948","last_updated":"2025-07-16T06:33:07Z","snapshot_observed_at":"2026-08-09T05:05:38.345869Z","submitted_at":"2025-07-16T06:33:07Z","title":"Kevin: Multi-Turn RL for Generating CUDA Kernels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11948","snapshot_observed_at":"2026-08-15T16:52:48.796751Z","title":"Kevin: Multi-turn rl for generating cuda kernels","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.796751Z"},"links":{"cited_paper":"/paper/2507.11948","citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:f7934fdedd176b6e0d7bf1c7618774f86340288eda2e4c8a455c1202395628c7","observation_id":"b683da53-5549-4f81-b824-1b0157d8bf3c","resolution":{"observed_at":"2026-08-15T16:52:48.796751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.08166","last_updated":"2019-01-08T23:35:15Z","snapshot_observed_at":"2026-08-14T19:12:53.135307Z","submitted_at":"2018-05-21T16:38:12Z","title":"Learning to Optimize Tensor Programs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.08166","snapshot_observed_at":"2026-08-15T16:52:48.801185Z","title":"Yan, Ziheng Jiang, Thierry Moreau, Luis Ceze, Carlos Guestrin, and Arvind Krishnamurthy","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.801185Z"},"links":{"cited_paper":"/paper/1805.08166","citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:e89747becf8badca13f74c21d39bc43e9f14ebbe2833fa6362739b86949ceebe","observation_id":"657f3e46-93ea-4dd0-915e-200af479c25d","resolution":{"observed_at":"2026-08-15T16:52:48.801185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16362","last_updated":"2021-05-20T14:48:30Z","snapshot_observed_at":"2026-08-09T06:13:20.021836Z","submitted_at":"2020-06-29T20:28:52Z","title":"Multi-Head Attention: Collaborate Instead of Concatenate","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.16362","snapshot_observed_at":"2026-08-15T16:52:48.805535Z","title":"Multi-head attention: Collaborate instead of concatenate","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.805535Z"},"links":{"cited_paper":"/paper/2006.16362","citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:4ddfa7c1f749f94d7baf8a4536ec075e31511b9c8d7ccaf7dee059d65d265ce7","observation_id":"e09d121e-42cf-4a1a-8c3e-a243a38349c0","resolution":{"observed_at":"2026-08-15T16:52:48.805535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:48.809913Z","title":"Flashattention: Fast and memory-efficient exact attention with io-awareness","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.809913Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:2df698e3c7884d168c3ee931ddd0711c138db827acf5702e5908d00c91fa953e","observation_id":"7213ee2c-2d07-4ec6-bff6-6769b9ca088a","resolution":{"observed_at":"2026-08-15T16:52:48.809913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05496","last_updated":"2024-12-07T01:46:38Z","snapshot_observed_at":"2026-08-14T20:35:19.337789Z","submitted_at":"2024-12-07T01:46:38Z","title":"Flex Attention: A Programming Model for Generating Optimized Attention Kernels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05496","snapshot_observed_at":"2026-08-15T16:52:48.813709Z","title":"Flex attention: A pro- gramming model for generating optimized attention kernels","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.813709Z"},"links":{"cited_paper":"/paper/2412.05496","citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:d57469879c6c690f9239c21dabe68b919f3d28b3b775b5b820ddc42c975d1267","observation_id":"f0e5c09b-8fae-4560-ba02-65543371751f","resolution":{"observed_at":"2026-08-15T16:52:48.813709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:49.331066Z","title":null,"venue":null,"work_id":"e8f08a9a-b8f1-419d-bd55-0de609737411","year":2005},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.818335Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:a8557b17813661d137ff93550239332496309452267c9a12e78fd5e0d4e63c27","observation_id":"36a59c8e-378c-472c-9ca2-d2b8f488d599","resolution":{"observed_at":"2026-08-15T16:52:49.334947Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:49.317827Z","title":"An integrated gpu power and performance model","venue":null,"work_id":"3624d945-4e7d-47f2-ac2e-5791e60591ee","year":2010},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.821972Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:0976a409b9be9857e08b646c0299360b9271bd68d9560a2fbb85a91a82b4c584","observation_id":"36c229e2-23ef-4c6a-a53b-c3b69a30d2e3","resolution":{"observed_at":"2026-08-15T16:52:49.322336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.14024","last_updated":"2023-01-23T17:00:01Z","snapshot_observed_at":"2026-08-16T16:05:35.248659Z","submitted_at":"2022-12-28T18:52:44Z","title":"Demonstrate-Search-Predict: Composing retrieval and language models for knowledge-intensive NLP","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.14024","snapshot_observed_at":"2026-08-15T16:52:48.825748Z","title":"Demonstrate-search-predict: Composing retrieval and language models for knowledge-intensive NLP","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.825748Z"},"links":{"cited_paper":"/paper/2212.14024","citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:f28f170d0dbdf4b394abb90cd373b6c2787e6b564c457d1fabf453865eb2734c","observation_id":"2b7a7be9-8b5b-4b02-a5d0-a31b7fc2cc6b","resolution":{"observed_at":"2026-08-15T16:52:48.825748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:49.303086Z","title":"Joshi, Hanna Moazam, Heather Miller, Matei Zaharia, and Christopher Potts","venue":null,"work_id":"ace9bd75-c305-443c-a961-6c8482b1aada","year":2024},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.829659Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:902280f43a4cece6647a2bf2fbb56955ace1fa25f144d74fd645de68acaec46c","observation_id":"01ff1895-c04d-4c8b-9061-9db7b4b22854","resolution":{"observed_at":"2026-08-15T16:52:49.308726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.14111","last_updated":"2026-08-05T22:03:49Z","snapshot_observed_at":"2026-08-09T23:09:14.608641Z","submitted_at":"2025-07-18T17:43:56Z","title":"CUDA-L1: Improving CUDA Optimization via Contrastive Reinforcement Learning","version":12},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.14111","snapshot_observed_at":"2026-08-15T16:52:48.833300Z","title":"Cuda-l1: Improving cuda optimization via contrastive reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.833300Z"},"links":{"cited_paper":"/paper/2507.14111","citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:beee99be556f5f67aaf8a6f03adf44f04f014ea7d3eabb40bcc45a9b880f300b","observation_id":"cd925acc-6a93-4223-9eb5-4146574b6d0e","resolution":{"observed_at":"2026-08-15T16:52:48.833300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:48.837373Z","title":"Competition-level code generation with alphacode","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.837373Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:13d810c77706b97bd214888a88e229a470b2e500b9b636d3c689a001301b02dd","observation_id":"3c4d4751-0e71-4a38-821b-cef0392ce7fb","resolution":{"observed_at":"2026-08-15T16:52:48.837373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:49.270096Z","title":"Rigorous evaluation of computer processors with statistical model checking","venue":null,"work_id":"87b80cf3-6cb8-4ec1-9218-81c9329b4d5e","year":2023},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.840961Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:ede2f450a06955b31c1475cbc22d994a0be8afc5b4271492e70b3314fa8a9d53","observation_id":"9da3f234-6622-41cf-8e98-07c8b900f353","resolution":{"observed_at":"2026-08-15T16:52:49.282434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10517","last_updated":"2025-02-14T19:30:53Z","snapshot_observed_at":"2026-08-16T10:36:49.395324Z","submitted_at":"2025-02-14T19:30:53Z","title":"KernelBench: Can LLMs Write Efficient GPU Kernels?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10517","snapshot_observed_at":"2026-08-15T16:52:48.844809Z","title":"Kernelbench: Can llms write efficient gpu kernels? arXiv preprint arXiv:2502.10517, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.844809Z"},"links":{"cited_paper":"/paper/2502.10517","citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:5061f61a24cf7dae9b5b29f156acce0d6cc5057f16ade1156e5966f4ce62ad45","observation_id":"58f2089d-5bf0-4f28-b3a6-5a3b26175670","resolution":{"observed_at":"2026-08-15T16:52:48.844809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:49.252206Z","title":"Quarch: A question-answering dataset for ai agents in computer architecture","venue":null,"work_id":"e7524557-744f-44f0-bcd7-1e32ebe753e8","year":2025},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.848915Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:3023659f05e1169a0bb36e59268ca16e906c7c5a255ab00d00ae3e7732acfec8","observation_id":"6446b73b-9261-4bfb-a52b-e267b74cac26","resolution":{"observed_at":"2026-08-15T16:52:49.256650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10480","last_updated":"2025-01-14T05:00:34Z","snapshot_observed_at":"2026-08-16T13:52:00.486713Z","submitted_at":"2024-05-17T00:52:39Z","title":"Lean Attention: Hardware-Aware Scalable Attention Mechanism for the Decode-Phase of Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10480","snapshot_observed_at":"2026-08-15T16:52:48.852560Z","title":"Lean attention: Hardware-aware scalable attention mechanism for the decode-phase of transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.852560Z"},"links":{"cited_paper":"/paper/2405.10480","citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:b5694fe8c2115b244859ae5b29a95b5e131b082e01dc3cf29b909948aab0d090","observation_id":"6a1a9ed2-b8e6-4477-9869-f92f4785ce49","resolution":{"observed_at":"2026-08-15T16:52:48.852560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07867","last_updated":"2024-04-26T16:41:55Z","snapshot_observed_at":"2026-08-16T15:55:05.167686Z","submitted_at":"2023-02-15T18:59:21Z","title":"Learning Performance-Improving Code Edits","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07867","snapshot_observed_at":"2026-08-15T16:52:48.857043Z","title":"Learning performance-improving code edits","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.857043Z"},"links":{"cited_paper":"/paper/2302.07867","citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:9a008127bec37dea2b79901f8b151a4d359557436725f110bc2a12f04f52e10f","observation_id":"4f06d7f6-6316-44d0-b099-f14a41ba61e9","resolution":{"observed_at":"2026-08-15T16:52:48.857043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:49.238883Z","title":"11.1 amd instincttm mi300 series modular chiplet package–hpc and ai accelerator for exa-class systems","venue":null,"work_id":"e170a6bb-a9e8-4d6f-8c8d-790b324180a8","year":2024},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.861873Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:9530cd3f66cbfa909a05d5f5d67e0914dd013f9d7cac6e4e61631c5d42ad5c55","observation_id":"830203f4-87ea-4b39-a89d-9a4d09ff2d8a","resolution":{"observed_at":"2026-08-15T16:52:49.243144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12032","last_updated":"2025-02-06T04:16:22Z","snapshot_observed_at":"2026-08-16T13:09:02.817802Z","submitted_at":"2024-10-15T20:06:33Z","title":"MLPerf Power: Benchmarking the Energy Efficiency of Machine Learning Systems from Microwatts to Megawatts for Sustainable AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12032","snapshot_observed_at":"2026-08-15T16:52:48.865474Z","title":"Mlperf power: Benchmarking the energy efficiency of machine learning systems from mi- crowatts to megawatts for sustainable ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.865474Z"},"links":{"cited_paper":"/paper/2410.12032","citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:512c56dab5e0ae8f86faa2b17bc2329a94e71b9339e3fecbb699c324ee6b2982","observation_id":"702965d7-d447-42e8-a886-19971e214975","resolution":{"observed_at":"2026-08-15T16:52:48.865474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:49.221929Z","title":"Measuring energy and power with papi","venue":null,"work_id":"c261817f-f9dc-4866-b340-66459f89c4b8","year":2012},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.870250Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:44413e230d0da8b4027848c63ec51d694c56479ddcc872e4d6b8edee7e4ddebb","observation_id":"af9f8efc-6079-4649-8d54-4b1b0d9bc7db","resolution":{"observed_at":"2026-08-15T16:52:49.229627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:49.202320Z","title":"Clint Whaley, Antoine Petitet, and Jack J","venue":null,"work_id":"73a4bc4e-de97-4c4a-9f57-7890c8e75260","year":2001},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.874337Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:a749186f4898cb5514466db0c1569ad5084850b041cdd2b041e7319560f06a56","observation_id":"3ebd13be-26ad-4035-89b2-a6dfffaa1053","resolution":{"observed_at":"2026-08-15T16:52:49.209755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:52:49.186052Z","title":"Gonzalez, Ion Stoica, and Koushik Sen","venue":null,"work_id":"15bff3c7-716c-4647-b2db-9a57b379c2ee","year":2020},"citing_paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T16:52:48.879174Z"},"links":{"citing_paper":"/paper/2508.20258"},"observation_digest":"sha256:ccc4180bc4e6f64f55ad02ed5cc0478b149b72ba7dd01ac5f65f6fde796845f5","observation_id":"8c3b6360-621b-4fdb-bb46-51fe55499cbd","resolution":{"observed_at":"2026-08-15T16:52:49.191567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.20258","last_updated":"2025-08-27T20:30:43Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-15T16:46:02.920934Z","submitted_at":"2025-08-27T20:30:43Z","title":"SwizzlePerf: Hardware-Aware LLMs for GPU Kernel Performance Optimization"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 8 inbound Pith citation observations for arXiv:2508.20258."}