{"as_of":"2026-08-19T00:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:90f404550c804c5b7413028e7b16faa0c706c41e8c3c8a3956d47cfcff9c617d","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:30:25.024913Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T04:49:45.955512Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21661","snapshot_observed_at":"2026-08-01T04:49:45.955512Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22432","last_updated":"2026-07-24T15:50:23Z","snapshot_observed_at":"2026-08-06T21:57:48.528474Z","submitted_at":"2026-07-24T15:50:23Z","title":"TileSight: A First-Principles Tile-Centric Analytical GPU Performance Model from Cores to Clusters","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T04:49:45.955512Z"},"links":{"cited_paper":"/paper/2505.21661","citing_paper":"/paper/2607.22432"},"observation_digest":"sha256:6acbad71db667b1952d29483fc7330fbee86af5ab02081e7da64be1a7fd52e0d","observation_id":"d12f834c-5d30-49cb-94e8-e4e59f0174e5","resolution":{"observed_at":"2026-08-01T04:49:45.955512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21661/citation-record","integrity":"/paper/2505.21661/integrity","json":"/paper/2505.21661/citation-record.json","paper":"/paper/2505.21661"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:34.410136Z","title":"AMD CDNA 3 Architec- ture, 2024","venue":null,"work_id":"2ad45838-eb8e-4394-8e79-2450d632e193","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:19.545522Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:6387387600874a2a6a2e3427003b4664a94b0569086fff92fe60ecf73d387cce","observation_id":"2e344e02-b01f-4ccc-ba02-e4205fe72d85","resolution":{"observed_at":"2026-08-07T13:30:34.500256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:34.224623Z","title":"AMD Instinct MI300","venue":null,"work_id":"89763909-a17f-4f8f-83d9-e86c8570ac43","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:19.671071Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:fead4c1f199124279a16f1d802663ceaa1708e6c7a90f1064538a7ce4cdae840","observation_id":"2eb6d586-4189-48eb-b105-842caf372f90","resolution":{"observed_at":"2026-08-07T13:30:34.344389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.996340Z","title":"Composable kernel (CK) library, 2024","venue":null,"work_id":"a020a6fb-8562-4988-abe7-7bd8d97d7fce","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:19.807153Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:668e716a0d2a91870b917dcdca411f310f10a876d2946860f493a34348c005b8","observation_id":"73eeba50-5079-4895-9db1-e035931c4531","resolution":{"observed_at":"2026-08-07T13:30:34.049128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.819189Z","title":"ROCm ROCProfiler, 2024","venue":null,"work_id":"1f5cc481-4cb3-4b4a-b44a-51b17bb7ba95","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:19.964826Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:64568fc478b40b951c5faf8b118c88d0dea94339da344697bfcee1c1ae476fcd","observation_id":"e39d64f4-f18f-440c-9dfa-b1e9d0d2d5b1","resolution":{"observed_at":"2026-08-07T13:30:33.896032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.661404Z","title":"Version 6.2.4","venue":null,"work_id":"3a874919-578f-4706-9893-c696d6f9d69e","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:20.062588Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:41ce2619d8f15debdf419cfd9185f562f1e3499696db3c98e8427b379f8ad2a5","observation_id":"27487e3b-0f90-4d32-8a29-b566a845e40f","resolution":{"observed_at":"2026-08-07T13:30:33.736971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.463483Z","title":"rocBLAS Library, 2023","venue":null,"work_id":"a9f31f10-fc7c-4eb4-bde9-8bb57ff16bf3","year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:20.161638Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:31b7a064dea48745d35f269c74f323cf644985909bd264d4cc7341f438ad369d","observation_id":"290f3855-9c35-42cf-9d0e-12e558601a81","resolution":{"observed_at":"2026-08-07T13:30:33.571161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.246233Z","title":"Pytorch 2: Faster machine learning through dynamic python bytecode transformation and graph compilation","venue":null,"work_id":"89582db2-6ef4-4b9b-9cc1-26fc328768ab","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:20.365005Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:7276b935d1a67e9a47196fefbea526dc40eb26323f21ee705fe0a657fa15a8e3","observation_id":"57e3bd36-2b97-4be7-a9c8-1f223975e3b9","resolution":{"observed_at":"2026-08-07T13:30:33.368927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.034753Z","title":"Cu- daDMA: optimizing GPU memory bandwidth via warp specialization","venue":null,"work_id":"d9fce6c8-3d18-4733-b695-dddbf17d8d35","year":2011},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:20.495238Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:3f8fd0fb588fc3a4854bd644a1f8237817ed6cee15747dd7e9e0dec6000fa15a","observation_id":"7bfcd8d2-17c6-40eb-8dd6-42d58241f38d","resolution":{"observed_at":"2026-08-07T13:30:33.159266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:32.856671Z","title":"Hatchet: Pruning the overgrowth in parallel profiles","venue":null,"work_id":"a23387e6-29cf-4a5f-a580-ef5eda3666ec","year":2019},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:20.624754Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:8ce900f8de5d7dfcd70b0ee3a7ec9ea371d6ad51504ccc4151190004b3dac524","observation_id":"9d5e68d6-583b-4ea5-ac8b-3fed454b7474","resolution":{"observed_at":"2026-08-07T13:30:32.924612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:20.844831Z","title":"JAX: com- posable transformations of Python+NumPy programs, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:20.844831Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:a9015634bbd940aa76c31b4b72a4181e4dc8fb60fc688765457d80f557a5143d","observation_id":"56db27a6-5958-4258-9476-5d40c9cf77d1","resolution":{"observed_at":"2026-08-07T13:30:20.844831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-07T13:30:20.955014Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:20.955014Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:cbffcec2f51238f23e5b3249c3bf5786e9b96b5e7257a20f8cc69bd9a0c482ef","observation_id":"af6e44c1-3fa5-454f-84a2-9114f38f6aa6","resolution":{"observed_at":"2026-08-07T13:30:20.955014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-08-18T02:47:16.120894Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-07T13:30:21.095644Z","title":"Flux: fast software-based communication overlap on gpus through kernel fusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.095644Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:69bf970ac3affdcbf66fbec4825fd62674ff93a52a84222139e32b1ced161bc7","observation_id":"12e87fc3-18af-4c55-805c-fde39d1251fd","resolution":{"observed_at":"2026-08-07T13:30:21.095644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:21.169914Z","title":"{TVM}: An automated {End-to-End} optimizing compiler for deep learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.169914Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:b93a074a72a5b5bcf6423534800fb09f767510daf7256272e40e9a961d92ca3b","observation_id":"e8ee2ef3-9316-4ea0-9c1e-03a139372fb6","resolution":{"observed_at":"2026-08-07T13:30:21.169914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:32.594537Z","title":"Learning to optimize tensor programs","venue":null,"work_id":"3db42b82-ad66-45ce-8694-287c2abf1459","year":2018},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.285927Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:7efdf2815db677a6067ff02ef9c2b629640add12183c7841688eac645aaad45a","observation_id":"da1d23e9-33a1-403a-a7c4-9197248d0658","resolution":{"observed_at":"2026-08-07T13:30:32.674148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:32.343570Z","title":"Nvidia hopper h100 gpu: Scaling per- formance","venue":null,"work_id":"9d0d7964-e36e-4f7f-9d34-76e1918d2d3e","year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.383216Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:dc4a6d5fbed3fb234970b9ef8ef5f55746da6b078b779903c68014542bebe141","observation_id":"70948b4b-64fa-4f76-b913-09282b3312ca","resolution":{"observed_at":"2026-08-07T13:30:32.471184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:32.174121Z","title":"V olta: Performance and programmability","venue":null,"work_id":"24291681-8017-43a3-bd90-d5ed4f494a90","year":2018},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.491020Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:8553e8e0ad43623a1fcc74b60215386bef58cba89f3b46a59a8fafdc1b41f20b","observation_id":"e515ed3f-c5ed-4351-bed5-824f17cb5415","resolution":{"observed_at":"2026-08-07T13:30:32.276667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:31.979027Z","title":"Crago, Sana Damani, Karthikeyan Sankar- alingam, and Stephen W","venue":null,"work_id":"02d28efd-e4c0-4a58-a2af-bc4d6c862606","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.603517Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:ba956dbae032fa273d382f8cd5df477c75f669f3b382f067cc7e5cb5aa02013f","observation_id":"cd36a80a-8a84-469d-86a2-a8d1bd62fd9a","resolution":{"observed_at":"2026-08-07T13:30:32.056556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:31.715926Z","title":"Davidson and Christopher W","venue":null,"work_id":"23b0740b-8414-40cc-9d04-7c961dae600f","year":1982},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.691141Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:b48a630cae919bf7d1957866169a3b2eb74af48c5fb63e1b8c6bfaf4c361c658","observation_id":"2d5df09b-e791-4c35-9034-b1f53d7aa60e","resolution":{"observed_at":"2026-08-07T13:30:31.869324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:31.469653Z","title":"Chrome trace format, 2023","venue":null,"work_id":"e89ecd5a-02c8-467e-a005-4eed5de8b4ab","year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.790575Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:3100344a1b9d15ea22d32fc1f1b33cbae970f9c32f5bed0eb9cfdebb682c5ccb","observation_id":"8d485b2e-9f76-4a37-907d-48a7880ec5fd","resolution":{"observed_at":"2026-08-07T13:30:31.586912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:31.244180Z","title":"Amanda: Unified instrumentation 14 framework for deep neural networks","venue":null,"work_id":"d90dc5ed-88c8-4b31-a854-cd69d9436772","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.937992Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:8f124752de133c3f820c450fca2cbd6393d0367d0633c4b58ac325f868313968","observation_id":"e8743293-0cba-417c-822f-db090b7c51ba","resolution":{"observed_at":"2026-08-07T13:30:31.347179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:31.072089Z","title":"Profile inference revisited","venue":null,"work_id":"074241fe-cc7e-4412-8e76-728f6995d9a9","year":2022},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.055097Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:b1a26dbc9fec4f3e4d1c665d8d9816d9b562023e3763f4336d78c8afcacef13d","observation_id":"053317d4-7d5c-477a-9b90-252097da8bc3","resolution":{"observed_at":"2026-08-07T13:30:31.171306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16691","last_updated":"2023-05-06T02:26:41Z","snapshot_observed_at":"2026-08-18T10:32:30.848100Z","submitted_at":"2022-10-29T20:47:27Z","title":"ALCOP: Automatic Load-Compute Pipelining in Deep Learning Compiler for AI-GPUs","version":2},"cited_work":{"arxiv_id":"2210.16691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.16691","snapshot_observed_at":"2026-08-07T13:30:26.132247Z","title":"ALCOP: Automatic Load-Compute Pipelining in Deep Learning Compiler for AI-GPUs","venue":"cs.DC","work_id":"17dc330d-58ff-4ce7-92fc-0dc81cc4733f","year":2022},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.165005Z"},"links":{"cited_paper":"/paper/2210.16691","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:5235729a96a1851f4d07355a71ef90bf0c8ad6358f76519baf24acca1525b2aa","observation_id":"29bd1027-93f8-4c83-bb31-db15c772544e","resolution":{"observed_at":"2026-08-07T13:30:26.245325Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:30.921895Z","title":"Alcop: Automatic load- compute pipelining in deep learning compiler for ai- gpus","venue":null,"work_id":"99a5452e-a687-42a2-998d-9e59678d04dc","year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.247836Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:9a3a0e0f277e2b4212be3cda213700398334e0f813c46d888cd1969ade30c019","observation_id":"b05945cf-638c-494d-8c03-0b328d61116f","resolution":{"observed_at":"2026-08-07T13:30:30.958905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:30.726265Z","title":"Multi- physics simulations: Challenges and opportunities","venue":null,"work_id":"b3da74c8-6251-422f-b8ad-5ee22f4d3384","year":2013},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.335538Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:a556363e9231a2594d17efadca0263e4e56b002d84198dc1d0c5ab71d132b414","observation_id":"6b3fb28a-fef5-4fcb-b20c-20866a858629","resolution":{"observed_at":"2026-08-07T13:30:30.809330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:30.574304Z","title":"Llvm: A compilation framework for lifelong program analysis & transforma- tion","venue":null,"work_id":"dbde62dd-3298-4e6f-aa62-f246b3ac34c5","year":2004},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.389283Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:fbf8a5b408a73e7bc9e75770230628ec1aa9137e36f435e3451347feddbe2561","observation_id":"a73110ad-2825-4370-bfb5-f1d1099a928e","resolution":{"observed_at":"2026-08-07T13:30:30.653926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:22.515748Z","title":"Mlir: Scaling compiler infrastructure for do- main specific computation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.515748Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:c5c216212d0ae953402c9bf35994fcf14fcf013ee71fddd56ac656edb8a8f164","observation_id":"54c58660-8eea-4202-b3ad-11c340ed26d5","resolution":{"observed_at":"2026-08-07T13:30:22.515748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:22.645303Z","title":"Deep learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.645303Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:bd6d2fc45418f0b19db67183cc50d5c113ee56b57cfbdadeb5c7c6c51b899e69","observation_id":"8c6437fb-9148-44fb-94f3-3bdf8c6f3095","resolution":{"observed_at":"2026-08-07T13:30:22.645303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:30.395336Z","title":null,"venue":null,"work_id":"30bf1ae6-8673-44fc-bf9e-b338b87952ca","year":1997},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.701028Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:35da4de70ea899e94b41e5d9b986a54f73c8f1d29267d6a01d2d6ea0ba69c56c","observation_id":"13dd4433-06a5-4ef0-abd3-021156b40d2d","resolution":{"observed_at":"2026-08-07T13:30:30.468605Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:30.258991Z","title":"Experimental FlashAttention3 using Triton, 2024","venue":null,"work_id":"2da87b63-94a3-4314-a77c-abc6055da02c","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.794752Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:02935dd52c9c59227044ab5be5fe9aba4dfb67b69a64847a3fda47cc280600bf","observation_id":"e4235d67-0ff5-497d-82b3-0a5addda178c","resolution":{"observed_at":"2026-08-07T13:30:30.297140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:30.054236Z","title":"NVIDIA Turing GPU Architec- ture Whitepaper, 2018","venue":null,"work_id":"cfcc6ed1-739d-41cb-a372-9d831df499f7","year":2018},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.857610Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:a69b334b61c5a71232fdabf9b2a2f96900cd60c019dc8bd1458098faec0aa649","observation_id":"6028930b-df31-4f74-bde3-fe4661c93150","resolution":{"observed_at":"2026-08-07T13:30:30.176968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:29.879908Z","title":"cuBLAS Library, 2023","venue":null,"work_id":"86f0e777-8c52-4f16-bcaf-47871654860f","year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.984913Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:ab4864c0450f87693db7cea013d8f846e29214d1c7ae4a24750bef5672655053","observation_id":"1d72d265-bef9-4ede-a978-766f10be2cac","resolution":{"observed_at":"2026-08-07T13:30:29.941830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:29.717131Z","title":"CUPTI: CUDA Profiling Tools Interface, 2023","venue":null,"work_id":"fe580c21-ae0a-436a-aaf4-547793a227b0","year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.068207Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:bf5cdf5c0c421bfc100e156bea7628079d07f88ebd1c391423961c39c185de42","observation_id":"7fa48589-8726-4e2d-b4ac-468851ed5b65","resolution":{"observed_at":"2026-08-07T13:30:29.782672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:29.579053Z","title":"NVIDIA Nsight Compute, 2024","venue":null,"work_id":"9c67106e-65d8-424c-bf11-69943af5d88d","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.187664Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:48749717a2c9a3acf3c85675d16d12c54f14fdf3e71a41ca85479400eef3d6ee","observation_id":"416fd099-5bf4-47c1-9099-65b41182c32b","resolution":{"observed_at":"2026-08-07T13:30:29.630513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:29.360275Z","title":"NVIDIA Nsight Systems, 2024","venue":null,"work_id":"b895b115-0ba8-4205-b2d1-04966459a5bc","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.281676Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:dd478548fa2381a20633f218ca4da451d1591db0974a576a666bd2dfcb730a05","observation_id":"c2cfa9d0-71d2-477a-a996-c9d8ae0684f6","resolution":{"observed_at":"2026-08-07T13:30:29.448684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:29.180992Z","title":"NVIDIA PTX, 2024","venue":null,"work_id":"45218330-0337-4ac8-a3e7-c61008aad2c3","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.329699Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:201553b736e7403a44161ae6d290d720cc9b8aac6024b57821193461d5555a27","observation_id":"7cbfb932-243c-45f5-9250-329661b90689","resolution":{"observed_at":"2026-08-07T13:30:29.275704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:28.945299Z","title":"Group GEMM in Triton, 2024","venue":null,"work_id":"059944f4-e03f-45f7-b7f5-29c5a5efb27f","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.419679Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:0890bf84439d917987950675b82f3854b2ea5e07d3a9478efe4fa720bdf19ad8","observation_id":"58fa46a6-32fb-41a2-85af-35dc37be549e","resolution":{"observed_at":"2026-08-07T13:30:29.065653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:28.862422Z","title":"Optimizing distributed ml communi- cation with fused computation-collective operations","venue":null,"work_id":"165d31bf-4874-447d-bac8-e3dceefb28b2","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.515110Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:05cc3d507a69bc637f1531679cf4002d40900b6c6661c720bf6f1ad8618a39d2","observation_id":"e41f3c2e-4d9e-486e-8919-ac13e92c36c3","resolution":{"observed_at":"2026-08-07T13:30:28.909368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:28.756617Z","title":"PyTorch Profiler","venue":null,"work_id":"4fce47dd-19b3-4dc7-9654-41820b196ded","year":2021},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.639842Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:32644037ebc7fe37b24e383ce8b4b4e7579a3542008b8f51c0889a774b944a7c","observation_id":"8410f4dd-7f2c-4774-88fb-74a2d3637376","resolution":{"observed_at":"2026-08-07T13:30:28.804814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02544","last_updated":"2022-03-04T19:45:43Z","snapshot_observed_at":"2026-08-18T10:32:31.345839Z","submitted_at":"2022-03-04T19:45:43Z","title":"Reinventing High Performance Computing: Challenges and Opportunities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02544","snapshot_observed_at":"2026-08-07T13:30:23.717161Z","title":"Rein- venting high performance computing: challenges and opportunities","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.717161Z"},"links":{"cited_paper":"/paper/2203.02544","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:7b82a0f6c0a097d7cd255b4c7215c1ced0ad41103aeb756b11f23b073dd6d63e","observation_id":"9e33af1c-37ca-4ab3-a77f-a84c89132027","resolution":{"observed_at":"2026-08-07T13:30:23.717161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:23.775785Z","title":"Learning representations by back-propagating errors","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.775785Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:3a7dda8ddaf480f412ae32c06d83644a47d3728fd7a768987cadddff58e2e5f0","observation_id":"01376597-3a37-4828-babc-6bb0cb7c485f","resolution":{"observed_at":"2026-08-07T13:30:23.775785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:28.585732Z","title":"Flashattention- 3: Fast and accurate attention with asynchrony and low- precision","venue":null,"work_id":"830311ad-25ac-494c-8802-5a577a70f7c4","year":null},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.832865Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:c2bbc95c87bfcd46be898786de46c67e29bb101d00a37450fb219a699c513f89","observation_id":"4fe7920d-610c-4afb-bda8-6fad7fb2be62","resolution":{"observed_at":"2026-08-07T13:30:28.685775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08608","last_updated":"2024-07-12T22:15:02Z","snapshot_observed_at":"2026-08-16T11:15:38.109255Z","submitted_at":"2024-07-11T15:44:48Z","title":"FlashAttention-3: Fast and Accurate Attention with Asynchrony and Low-precision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08608","snapshot_observed_at":"2026-08-07T13:30:23.937127Z","title":"Flashattention- 3: Fast and accurate attention with asynchrony and low- precision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.937127Z"},"links":{"cited_paper":"/paper/2407.08608","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:c3c10f37c3cbb2e1d8a9c4f65e723e7a788b0314a5984630229169688d236aff","observation_id":"c01853a3-027a-4e52-85d3-a2a427ea60cd","resolution":{"observed_at":"2026-08-07T13:30:23.937127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:23.995310Z","title":"Tensor program opti- mization with probabilistic programs","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.995310Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:7eb80778156f791f6915c2e26f0b698ba9e5ce9844b19360f7f7bb214c1316a1","observation_id":"759b5c7d-5f43-4bac-8b38-274054b48cc6","resolution":{"observed_at":"2026-08-07T13:30:23.995310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20399","last_updated":"2024-10-27T10:07:16Z","snapshot_observed_at":"2026-08-18T10:33:45.749823Z","submitted_at":"2024-10-27T10:07:16Z","title":"ThunderKittens: Simple, Fast, and Adorable AI Kernels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20399","snapshot_observed_at":"2026-08-07T13:30:24.085300Z","title":"Thunderkittens: Simple, fast, and adorable ai kernels","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.085300Z"},"links":{"cited_paper":"/paper/2410.20399","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:2410ca3a7a9f6fd05616e01dece1f275ef1e532c616231584fcc15db113ca2ef","observation_id":"feb87269-0c5b-4cd8-ae0f-061a40d6246d","resolution":{"observed_at":"2026-08-07T13:30:24.085300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:28.207239Z","title":"CUTLASS, January 2023","venue":null,"work_id":"f7bab0fc-bf5d-49fb-8979-13ebd86671b5","year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.159738Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:caa196e8a7960218415069023cbb635d3bb2018c9b082ea6a273818fbf200b67","observation_id":"274c38bf-249b-455c-8760-e2c0a40f8074","resolution":{"observed_at":"2026-08-07T13:30:28.475954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:24.215990Z","title":"Large language models in medicine","venue":null,"work_id":null,"year":1930},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.215990Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:b2655e87ffaa6c49cfcefbfac15f0fcfe8a14c93904736315f18169e9ab3c758","observation_id":"ec4c7c0b-4745-4260-b614-767e1e5ad6b5","resolution":{"observed_at":"2026-08-07T13:30:24.215990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:24.270842Z","title":"Triton: an intermediate language and compiler for tiled neural network computations","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.270842Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:130b43bfe02d4ab9c7d50af7683e6cd836c8af6b7cd11861267f8f64222badc1","observation_id":"031bdfdc-2d9f-4c1e-b1d5-3976e281fe8a","resolution":{"observed_at":"2026-08-07T13:30:24.270842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:27.847660Z","title":"Nvbit: A dynamic binary instru- mentation framework for nvidia gpus","venue":null,"work_id":"cdeb3e7d-9e34-40cc-b061-f04453f25103","year":2019},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.342065Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:e1e9a93b3f76ba117727294c0ca2bf7f40b9a35c6790067ff6fa9f87c07b293e","observation_id":"eee372a2-8b78-4873-bf88-f62c4503f10b","resolution":{"observed_at":"2026-08-07T13:30:27.955031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17924","last_updated":"2025-03-23T03:40:45Z","snapshot_observed_at":"2026-08-18T10:33:46.676216Z","submitted_at":"2025-03-23T03:40:45Z","title":"WLB-LLM: Workload-Balanced 4D Parallelism for Large Language Model Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17924","snapshot_observed_at":"2026-08-07T13:30:24.514841Z","title":"Wlb-llm: Workload-balanced 4d paral- lelism for large language model training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.514841Z"},"links":{"cited_paper":"/paper/2503.17924","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:df0f8d27000851e09e364d7945e6fff5139b4da0c03f180a88b460de49081c30","observation_id":"54438187-5bdc-4664-a4c7-a00147aabc7c","resolution":{"observed_at":"2026-08-07T13:30:24.514841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:27.621961Z","title":"Rap: Resource-aware automated gpu sharing for multi-gpu recommendation model training and input preprocessing","venue":null,"work_id":"6243d9b0-f062-4765-8092-edb1e4a46908","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.634751Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:89696c7684946a947bc9eecf899d8f4ddfbdfb0a45eeabac2e5483ca3f6c542d","observation_id":"f47efffa-1cd2-476b-bfb4-9dd2fcabe9bb","resolution":{"observed_at":"2026-08-07T13:30:27.714838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17564","last_updated":"2023-12-21T06:21:11Z","snapshot_observed_at":"2026-08-14T12:54:48.492396Z","submitted_at":"2023-03-30T17:30:36Z","title":"BloombergGPT: A Large Language Model for Finance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17564","snapshot_observed_at":"2026-08-07T13:30:24.734854Z","title":"Bloomberggpt: A large language model for finance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.734854Z"},"links":{"cited_paper":"/paper/2303.17564","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:1df51c12480094f9e1dd3c0f21d1e2ba365ef352055b1df6809d96d6d38aae1d","observation_id":"fcee688e-b778-446a-aaef-556320014db0","resolution":{"observed_at":"2026-08-07T13:30:24.734854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:24.804890Z","title":"Ansor: Generating {High-Performance} tensor programs for deep learn- ing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.804890Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:48ecc760fda329ea45efe9fa8b52a036c1b7e2837cd4a2005752d3aadd59f209","observation_id":"57ec749e-fe5d-4864-8b84-af6860c41538","resolution":{"observed_at":"2026-08-07T13:30:24.804890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:27.198930Z","title":"Gvprof: A value profiler for gpu-based clusters","venue":null,"work_id":"6d543c08-d644-4774-a789-f89709771b9f","year":2020},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.934964Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:26d55756c13772e066b2c5ca81c348787fbaf66ac18355f12b6e2e582d3cd237","observation_id":"9ab0e73d-bc02-4e5a-9de7-75afe7c1d6f3","resolution":{"observed_at":"2026-08-07T13:30:27.405478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:26.824859Z","title":"Valueexpert: Exploring value patterns in gpu-accelerated applications","venue":null,"work_id":"1f67eeaa-4339-4f86-bc60-5df3bd4dbf50","year":2022},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:25.024913Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:4234470e9f87718fb55bb27d35ccd356236c3cceac4f218d2291c33c862e1a8f","observation_id":"70b31a9c-f283-484e-baa0-b258163575ea","resolution":{"observed_at":"2026-08-07T13:30:26.974974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-16T20:50:45.580934Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":1,"verified_fuzzy":36},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 1 inbound Pith citation observation for arXiv:2505.21661."}