{"as_of":"2026-08-16T22:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:adcb2418f796bd7e4e59ec1547056d016f1b05be5121881b1368e011804ece59","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:56:49.328497Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":19,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T12:59:12.728206Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T07:37:44.599691Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":"2504.19442","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-03T07:37:44.599691Z","title":"ISBN 9798331314385","venue":null,"work_id":"f063ecaa-699c-4559-bbba-cd25b4712df7","year":2025},"citing_paper":{"arxiv_id":"2505.11329","last_updated":"2026-05-01T12:16:47Z","snapshot_observed_at":"2026-08-13T12:39:52.600804Z","submitted_at":"2025-05-16T14:53:50Z","title":"TokenWeave: Efficient Compute-Communication Overlap for Distributed LLM Inference","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T14:25:14.150581Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2505.11329"},"observation_digest":"sha256:2743f12be090d8dcf5e5a195fbbed82225abdbacf348cdbb95b69a827af4533c","observation_id":"b82ecf43-30b1-4223-95f0-bf96799fa64f","resolution":{"observed_at":"2026-05-22T14:26:40.426398Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-08-05T12:59:12.728206Z","title":"Triton-distributed: Programming overlapping kernels on distributed ai systems with the triton compiler, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.01106","last_updated":"2025-09-11T12:40:54Z","snapshot_observed_at":"2026-08-12T20:25:08.144001Z","submitted_at":"2025-09-01T03:53:47Z","title":"Robix: A Unified Model for Robot Interaction, Reasoning and Planning","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-05T12:59:12.728206Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2509.01106"},"observation_digest":"sha256:358f438493dabe1fb86a60c0f845292cb4e781cf2b7b9ee8856d3a012baa7f06","observation_id":"22004933-2a11-4577-8921-b843a28ddd72","resolution":{"observed_at":"2026-08-05T12:59:12.728206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":"2504.19442","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-03T07:37:44.599691Z","title":"ISBN 9798331314385","venue":null,"work_id":"f063ecaa-699c-4559-bbba-cd25b4712df7","year":2025},"citing_paper":{"arxiv_id":"2511.06605","last_updated":"2026-04-10T17:41:06Z","snapshot_observed_at":"2026-08-02T17:48:25.735846Z","submitted_at":"2025-11-10T01:28:58Z","title":"DMA-Latte: Expanding the Reach of DMA Offloads to Latency-bound ML Communication","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-18T00:27:43.845408Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2511.06605"},"observation_digest":"sha256:ffab57411e84dd92aacf3a749ce3897b37e114f2027dca96d48c46f9d7ed07ad","observation_id":"6022ff37-35f4-49d2-8ed7-d9d7a4d24545","resolution":{"observed_at":"2026-05-18T00:30:33.083551Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-08-03T17:17:35.012041Z","title":"Triton-distributed: Programming overlapping kernels on distributed ai systems with the triton compiler,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10236","last_updated":"2026-06-03T13:48:53Z","snapshot_observed_at":"2026-08-16T20:45:43.263040Z","submitted_at":"2025-12-11T02:43:27Z","title":"Design Space Exploration of DMA based Finer-Grain Compute Communication Overlap","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-03T17:17:35.012041Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2512.10236"},"observation_digest":"sha256:23ab82763bfc432d98db1cbdec5e66dbf65a5f21fa7b3d893485956addd4814f","observation_id":"5f4c9bf8-c59f-4d2c-819f-3ee88f462063","resolution":{"observed_at":"2026-08-03T17:17:35.012041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":"2504.19442","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-03T07:37:44.599691Z","title":"ISBN 9798331314385","venue":null,"work_id":"f063ecaa-699c-4559-bbba-cd25b4712df7","year":2025},"citing_paper":{"arxiv_id":"2601.20595","last_updated":"2026-07-01T05:30:30Z","snapshot_observed_at":"2026-08-16T22:21:52.289198Z","submitted_at":"2026-01-28T13:29:51Z","title":"Syncopate: Efficient Multi-GPU AI Kernels via Automatic Chunk-Centric Compute-Communication Overlap","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-16T10:06:41.150046Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2601.20595"},"observation_digest":"sha256:5665d30e1541750df2e4f536ce1d3d657c5ae28ab02b2629a3e3d8e77189a5f8","observation_id":"aad259e2-f4d6-4b9d-a755-929a04214a70","resolution":{"observed_at":"2026-05-16T10:07:43.209953Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-08-03T07:21:23.181366Z","title":"Triton-distributed: Programming overlapping kernels on distributed ai systems with the triton compiler","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.20595","last_updated":"2026-07-01T05:30:30Z","snapshot_observed_at":"2026-08-16T22:21:52.289198Z","submitted_at":"2026-01-28T13:29:51Z","title":"Syncopate: Efficient Multi-GPU AI Kernels via Automatic Chunk-Centric Compute-Communication Overlap","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T07:21:23.181366Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2601.20595"},"observation_digest":"sha256:0088f1c516bfd8581c50a128800b3c1052291d3ee8bdfe1848bc70427c971ab0","observation_id":"12a7ce50-5cc3-4baa-9d83-7e4967d02403","resolution":{"observed_at":"2026-08-03T07:21:23.181366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":"2504.19442","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-03T07:37:44.599691Z","title":"ISBN 9798331314385","venue":null,"work_id":"f063ecaa-699c-4559-bbba-cd25b4712df7","year":2025},"citing_paper":{"arxiv_id":"2604.04750","last_updated":"2026-04-09T14:13:19Z","snapshot_observed_at":"2026-08-15T16:24:53.602682Z","submitted_at":"2026-04-06T15:16:35Z","title":"DeepStack: Scalable and Accurate Design Space Exploration for Distributed 3D-Stacked AI Accelerators","version":2},"reference_index":126,"source":"pdf_text","source_observed_at":"2026-05-10T19:04:17.725111Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2604.04750"},"observation_digest":"sha256:ea043879d42a190add2c77cd7f480cf71ed1f3f6e6556dddd855825ba45ccb3c","observation_id":"bb172f6c-e390-4cab-ad04-4f2e76452a46","resolution":{"observed_at":"2026-05-10T23:30:51.981196Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":"2504.19442","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-03T07:37:44.599691Z","title":"ISBN 9798331314385","venue":null,"work_id":"f063ecaa-699c-4559-bbba-cd25b4712df7","year":2025},"citing_paper":{"arxiv_id":"2604.13327","last_updated":"2026-04-21T00:31:44Z","snapshot_observed_at":"2026-08-11T17:12:42.732436Z","submitted_at":"2026-04-14T22:19:51Z","title":"Event Tensor: A Unified Abstraction for Compiling Dynamic Megakernel","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T13:45:53.346024Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2604.13327"},"observation_digest":"sha256:224be2de62378592c46b3d7eed08c63f42d9ee14e010fda8dc797ddaa925718e","observation_id":"f4df9561-beba-4fdf-938e-bef5ded9aed7","resolution":{"observed_at":"2026-05-11T11:36:02.757348Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":"2504.19442","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-03T07:37:44.599691Z","title":"ISBN 9798331314385","venue":null,"work_id":"f063ecaa-699c-4559-bbba-cd25b4712df7","year":2025},"citing_paper":{"arxiv_id":"2604.19241","last_updated":"2026-04-21T08:49:27Z","snapshot_observed_at":"2026-08-15T01:06:53.368787Z","submitted_at":"2026-04-21T08:49:27Z","title":"UniEP: Unified Expert-Parallel MoE MegaKernel for LLM Training","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T02:20:00.625923Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2604.19241"},"observation_digest":"sha256:871a4bc1fc0d6216a2beead6a5229f1cbe34732b545dfd76fba50668f9da12a1","observation_id":"3ad8e02c-cd63-41e6-a347-8849af033675","resolution":{"observed_at":"2026-05-11T13:06:05.137902Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":"2504.19442","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-03T07:37:44.599691Z","title":"ISBN 9798331314385","venue":null,"work_id":"f063ecaa-699c-4559-bbba-cd25b4712df7","year":2025},"citing_paper":{"arxiv_id":"2604.19654","last_updated":"2026-04-21T16:43:59Z","snapshot_observed_at":"2026-08-16T05:34:58.788654Z","submitted_at":"2026-04-21T16:43:59Z","title":"FEPLB: Exploiting Copy Engines for Nearly Free MoE Load Balancing in Distributed Training","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T01:14:18.241481Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2604.19654"},"observation_digest":"sha256:683fb81dcb09c16dfce5a277e1aac1c5022d26a41fde1739ee57f79288e11a49","observation_id":"504f7409-3dba-4dc3-89b8-4e17ce7042d4","resolution":{"observed_at":"2026-05-11T13:41:05.339124Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":"2504.19442","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-03T07:37:44.599691Z","title":"ISBN 9798331314385","venue":null,"work_id":"f063ecaa-699c-4559-bbba-cd25b4712df7","year":2025},"citing_paper":{"arxiv_id":"2605.00686","last_updated":"2026-05-01T14:18:30Z","snapshot_observed_at":"2026-08-11T12:58:33.943302Z","submitted_at":"2026-05-01T14:18:30Z","title":"Eliminating Hidden Serialization in Multi-Node Megakernel Communication","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-09T18:35:12.493334Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2605.00686"},"observation_digest":"sha256:3353a754c3ba4c044b4779dc538d93255d4fe1a67b0276387e65d30110d3c281","observation_id":"2014761c-7057-48e6-950b-90133d74b0ac","resolution":{"observed_at":"2026-05-11T16:11:09.153963Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":"2504.19442","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-03T07:37:44.599691Z","title":"ISBN 9798331314385","venue":null,"work_id":"f063ecaa-699c-4559-bbba-cd25b4712df7","year":2025},"citing_paper":{"arxiv_id":"2605.21100","last_updated":"2026-05-20T12:28:51Z","snapshot_observed_at":"2026-08-15T15:35:40.421490Z","submitted_at":"2026-05-20T12:28:51Z","title":"NanoCP: Request-Level Dynamic Context Parallelism for Data-Expert Parallel Decoding","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-21T01:51:38.671365Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2605.21100"},"observation_digest":"sha256:3b35a15b4bcaf8c5b5e60752c54092c11fa2734922951badf8fb29c573e79166","observation_id":"3cf7948d-804f-48db-afe3-8846d520fcb2","resolution":{"observed_at":"2026-05-21T01:53:54.557117Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":"2504.19442","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-03T07:37:44.599691Z","title":"ISBN 9798331314385","venue":null,"work_id":"f063ecaa-699c-4559-bbba-cd25b4712df7","year":2025},"citing_paper":{"arxiv_id":"2605.21603","last_updated":"2026-05-20T18:09:13Z","snapshot_observed_at":"2026-07-06T23:32:01.202542Z","submitted_at":"2026-05-20T18:09:13Z","title":"DynaFlow: Transparent and Flexible Intra-Device Parallelism via Programmable Operator Scheduling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T08:34:47.923752Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2605.21603"},"observation_digest":"sha256:d53acc57e365bd91dd65ae0615425aed594f5e4ca4e3b288956b576d7ef12ee5","observation_id":"d631532b-9e71-4ecb-b590-2f9b335e9624","resolution":{"observed_at":"2026-05-22T08:36:17.082595Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":"2504.19442","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-03T07:37:44.599691Z","title":"ISBN 9798331314385","venue":null,"work_id":"f063ecaa-699c-4559-bbba-cd25b4712df7","year":2025},"citing_paper":{"arxiv_id":"2605.23764","last_updated":"2026-06-01T05:30:13Z","snapshot_observed_at":"2026-08-02T20:06:32.213238Z","submitted_at":"2026-05-22T15:35:23Z","title":"HyperParallel-MoE: Multi-Core Interleaved Scheduling for Fast MoE Training on Ascend NPUs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-25T02:49:09.109990Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2605.23764"},"observation_digest":"sha256:64701504b104ce23a67781ba319d0750b415e850d473c93af716093a06386199","observation_id":"f7e1ebf8-4eba-42e4-8548-ac37829603ee","resolution":{"observed_at":"2026-05-25T02:55:16.750739Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":"2504.19442","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-03T07:37:44.599691Z","title":"ISBN 9798331314385","venue":null,"work_id":"f063ecaa-699c-4559-bbba-cd25b4712df7","year":2025},"citing_paper":{"arxiv_id":"2605.23764","last_updated":"2026-06-01T05:30:13Z","snapshot_observed_at":"2026-08-02T20:06:32.213238Z","submitted_at":"2026-05-22T15:35:23Z","title":"HyperParallel-MoE: Multi-Core Interleaved Scheduling for Fast MoE Training on Ascend NPUs","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T15:10:25.071087Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2605.23764"},"observation_digest":"sha256:79325e2141a5099c3776c8c413c4e062d189d4539e6e229b90f8e0b52bdad3cb","observation_id":"9b15cc1c-a649-46f9-a1de-332a5b2edf7b","resolution":{"observed_at":"2026-06-30T15:14:46.917726Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":"2504.19442","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-03T07:37:44.599691Z","title":"ISBN 9798331314385","venue":null,"work_id":"f063ecaa-699c-4559-bbba-cd25b4712df7","year":2025},"citing_paper":{"arxiv_id":"2605.31000","last_updated":"2026-05-29T08:34:49Z","snapshot_observed_at":"2026-08-03T23:04:17.115629Z","submitted_at":"2026-05-29T08:34:49Z","title":"HetCCL: Enabling Collective Communication For Mixed-Vendor Heterogeneous Clusters","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T20:16:40.966177Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2605.31000"},"observation_digest":"sha256:072dd1114b766cf5239a6de2d16c7d6946a3e48f33bd24dfd812e44c09dc5b78","observation_id":"6fe09191-b2fe-407e-b7ca-9fd37eccf6a8","resolution":{"observed_at":"2026-06-28T20:22:37.227181Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":"2504.19442","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-03T07:37:44.599691Z","title":"ISBN 9798331314385","venue":null,"work_id":"f063ecaa-699c-4559-bbba-cd25b4712df7","year":2025},"citing_paper":{"arxiv_id":"2607.02335","last_updated":"2026-07-02T15:39:10Z","snapshot_observed_at":"2026-08-16T19:52:28.393588Z","submitted_at":"2026-07-02T15:39:10Z","title":"Coalesced Matrix-Free Finite Elements in Cell-Wise Storage","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-07-03T07:37:40.688370Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2607.02335"},"observation_digest":"sha256:0884e0c3d5d40cd7e5dc836696c035da854e8e9fe0c9316ae472abce66544ccd","observation_id":"f7a96141-20b8-4940-b17d-16c900ec5a1e","resolution":{"observed_at":"2026-07-03T07:37:44.601363Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-12T02:40:50.976808Z","title":"arXiv preprint arXiv:2504.19442 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03413","last_updated":"2026-07-03T15:22:31Z","snapshot_observed_at":"2026-08-15T22:54:04.407222Z","submitted_at":"2026-07-03T15:22:31Z","title":"Coalesced Matrix-Free Geometric Multigrid on Persistent Cell-Wise Storage","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-07-12T02:40:50.976808Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2607.03413"},"observation_digest":"sha256:741ad5dc41a114d2a90054dca4fff1c89291e77743528c3795b110ba958ab45e","observation_id":"a3b2296a-e9f8-4a83-89c6-0fc88688d802","resolution":{"observed_at":"2026-07-12T02:40:50.976808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19442","snapshot_observed_at":"2026-07-13T01:18:48.061500Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08973","last_updated":"2026-07-09T22:34:00Z","snapshot_observed_at":"2026-08-15T15:43:55.565026Z","submitted_at":"2026-07-09T22:34:00Z","title":"SiFAR: Synchronization-Free All-Reduce for Low-Latency LLM Inference","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-13T01:18:48.061500Z"},"links":{"cited_paper":"/paper/2504.19442","citing_paper":"/paper/2607.08973"},"observation_digest":"sha256:42d0488a85ff8e660e83cb4ca4374834dd8a4b4a636ec99f74f5b0a7e302e913","observation_id":"448dfd36-bda8-4f71-b366-2421e9937c5a","resolution":{"observed_at":"2026-07-13T01:18:48.061500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.19442/citation-record","integrity":"/paper/2504.19442/integrity","json":"/paper/2504.19442/citation-record.json","paper":"/paper/2504.19442"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:50.913743Z","title":"Rocm communication collectives library.https://github.com/ROCm/rccl, 2024","venue":null,"work_id":"a1881e4d-7057-4305-8cee-20058d09cc71","year":2024},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.102645Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:ad66bed0a0ca361b0716b647a3d225a08ade22ea0f5f9a958f43420bfd36ca80","observation_id":"280aa325-bb9e-4cdc-8e10-5c6138b0dd2f","resolution":{"observed_at":"2026-08-16T05:56:50.918412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:50.896315Z","title":"Triton-linalg for mlu, 2024","venue":null,"work_id":"10680e58-12d3-4847-a61c-7313c388c5a7","year":2024},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.109503Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:22b30a52a44607a59ba3a321e5e7ee66612f5fcc2969e1dd6660e01be29abdc7","observation_id":"127fb14b-5856-473d-a6ef-61f67030d5bc","resolution":{"observed_at":"2026-08-16T05:56:50.902492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-08-16T13:44:21.737275Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-16T05:56:49.115053Z","title":"FLUX: fast software-based communication overlap on gpus through kernel fusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.115053Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:96b8e141984cb330e1ec26d6bc1e8e1f1e92e399420938f0ed9072a8aaf77980","observation_id":"61a959a8-99c4-4bde-8b1a-b9843fb1a340","resolution":{"observed_at":"2026-08-16T05:56:49.115053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.122499Z","title":"Centauri: Enabling efficient scheduling for communication-computation overlap in large model training via communication partitioning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.122499Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:cc13ac56714461586aa4a2c4ec1e0d51e44ef9ab868053b2caf0524d872b1d08","observation_id":"a4545f50-1458-4902-8758-003982b1e6a0","resolution":{"observed_at":"2026-08-16T05:56:49.122499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.128875Z","title":"Yan, Haichen Shen, Meghan Cowan, Leyuan Wang, Yuwei Hu, Luis Ceze, Carlos Guestrin, and Arvind Krishnamurthy","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.128875Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:94c13a183a0b5831102f5f0c33e02cb48d54d8b33c73dcd8d94e4bba2226f179","observation_id":"95176c07-1386-489d-93ec-982034aa0fa5","resolution":{"observed_at":"2026-08-16T05:56:49.128875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:50.865870Z","title":"Flash-decoding for long-context inference, 2023","venue":null,"work_id":"61796ebf-5e32-4c39-a27e-a17e6dc56685","year":2023},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.135780Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:b8e8698ae120eb400ef708635956d4354df3ce4f5b12ab9ed149a23d6ae7a145","observation_id":"4de3f634-be53-4d82-9227-e8b2c4548141","resolution":{"observed_at":"2026-08-16T05:56:50.871794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-16T05:56:49.142017Z","title":"Zhang, Han Bao, Hanwei Xu, Haocheng Wang, Haowei Zhang, Honghui Ding, Huajian Xin, Huazuo Gao, Hui Li, Hui Qu, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.142017Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:1944dd40da3e3e1bf130894717074c8f5ddde231dc4e6ec906b90ff08ef89942","observation_id":"2d4d291c-61bd-41f8-ac47-f62e212393da","resolution":{"observed_at":"2026-08-16T05:56:49.142017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.148268Z","title":"Amarasinghe","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.148268Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:fd20d0739bbe6dc893d67d5626308b25e586e10e5be2c1fb1b3a374c5e086413","observation_id":"09037f36-59a6-4499-8417-c1878dc4679c","resolution":{"observed_at":"2026-08-16T05:56:49.148268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.153156Z","title":"Tensorir: An abstraction for automatic tensorized program optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.153156Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:77ea62df5f9d1c18f559f77e06d648d1e25f9353aca2ffa52ed427a05a3cb174","observation_id":"570e5e45-e4c6-41e8-8d3d-43d673f4a14a","resolution":{"observed_at":"2026-08-16T05:56:49.153156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.158699Z","title":"Pallas, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.158699Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:b61bb7129dd467f0bab243cfeb9294322941c26186dfa426348591307c5356c7","observation_id":"75b02ffc-8353-4305-9502-653f13eeacbf","resolution":{"observed_at":"2026-08-16T05:56:49.158699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:50.838274Z","title":"Goumas, Aristidis Sotiropoulos, and Nectarios Koziris","venue":null,"work_id":"cd9d6f88-d1a7-465c-ae8c-6d335456f911","year":2001},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.166183Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:dfdce7abe1b903283f85894b2fd18d3263975ec338acf02d9ac4a707369d2e20","observation_id":"88e805f9-b77e-44cb-aeeb-83a1e4283deb","resolution":{"observed_at":"2026-08-16T05:56:50.843104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:50.821693Z","title":"Le, Yonghui Wu, and Zhifeng Chen","venue":null,"work_id":"63266b29-a2ed-43d2-a4f7-78d9cbdee1cb","year":2019},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.179643Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:7f7c1b059feed1a8197ed907111db645cd3f174b5005750805de72155568a24a","observation_id":"bb7b60b1-5bb2-40ad-9fcd-38e227c12600","resolution":{"observed_at":"2026-08-16T05:56:50.826886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.184567Z","title":"Thomas, Todd Warszawski, Matei Zaharia, and Alex Aiken","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.184567Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:c02096742f1a8922d7708f6b47810205ccae3db56d03f0df28fb0ee48958d287","observation_id":"b461d3f4-7c39-42d1-b64b-e3f2b9865071","resolution":{"observed_at":"2026-08-16T05:56:49.184567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.189431Z","title":"Amarasinghe","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.189431Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:33a50a11d06da9d022d37b0a95c6c929d38127531db0c716c702a6b71475d664","observation_id":"a18ef61c-c336-4f2c-99ce-e633e503922e","resolution":{"observed_at":"2026-08-16T05:56:49.189431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.11054","last_updated":"2020-03-01T00:38:46Z","snapshot_observed_at":"2026-08-15T17:18:59.163433Z","submitted_at":"2020-02-25T17:24:50Z","title":"MLIR: A Compiler Infrastructure for the End of Moore's Law","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.11054","snapshot_observed_at":"2026-08-16T05:56:49.195787Z","title":"Pienaar, Mehdi Amini, Uday Bondhugula, River Riddle, Albert Cohen, Tatiana Shpeisman, Andy Davis, Nicolas Vasilache, and Oleksandr Zinenko","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.195787Z"},"links":{"cited_paper":"/paper/2002.11054","citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:c60d2c3ed7491d0066617858ef0da5898f6a26f2c1021204c3d42b3e23a9390b","observation_id":"5a358689-3327-4dd7-8b63-385cb452b9f7","resolution":{"observed_at":"2026-08-16T05:56:49.195787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/hpcc-css-icess.2015.82","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.532584Z","title":"MPI+ULT: overlapping communication and computation with user-level threads","venue":null,"work_id":"2efa4fc5-3f71-49e0-93a2-8ed603d2555b","year":2015},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.201061Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:572515bb4659cfc8e316eda2ae42e8d4261382120fda95337904cf5970120ade","observation_id":"2b92840d-7cbf-4158-81b3-18f21b4f151c","resolution":{"observed_at":"2026-08-16T05:56:49.539932Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.206394Z","title":"Overlapping communication and computation by using a hybrid mpi/smpss approach","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.206394Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:db2f009d3d1fca83f66a2341df318d38c76ff09b63772747892824a1eecb3c60","observation_id":"d13acd64-9b70-4604-9dc8-fa42aa0ff9f6","resolution":{"observed_at":"2026-08-16T05:56:49.206394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.211788Z","title":"Efficient large-scale language model training on GPU clusters using megatron-lm","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.211788Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:a95ccf96397b11257d36bf51b906d7e64674ea9d172c6352d1d565cf87ef8bff","observation_id":"423d82e4-f95a-4c2f-8597-e112f664db17","resolution":{"observed_at":"2026-08-16T05:56:49.211788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.223756Z","title":"cuBLAS, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.223756Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:78337c2004fbd3f92b8ae51d0a0918e52a8fdbea12e2bc9fced5e1f39885342b","observation_id":"1fdd5752-b79d-41cf-9dcb-e4dc1c62d1c1","resolution":{"observed_at":"2026-08-16T05:56:49.223756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.228550Z","title":"Cutlass, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.228550Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:26c328205351b8fe9e68200d20d7e278ea877c0e6a1268ffb2ec3fd55fec880e","observation_id":"11b86c41-65fa-427d-a5d6-5c2c5566f1f7","resolution":{"observed_at":"2026-08-16T05:56:49.228550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.233580Z","title":"Nvidia collective communications library.https://developer.nvidia.com/nccl, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.233580Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:6925f5d98e4edfdb2dca4e3e3d542309b4115a637600be00f1466981fae962ee","observation_id":"c738b87b-77d6-4d51-8734-bd21167d064b","resolution":{"observed_at":"2026-08-16T05:56:49.233580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:50.758824Z","title":"Chatgpt, 2022","venue":null,"work_id":"11dd98ea-ef06-46f2-a3f9-cfdd67e63ef9","year":2022},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.238383Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:f7b98fd4c90ca76f5d4ed5a4ccae943b033c487ec468ed9f577a03d1ea5d3725","observation_id":"6db03254-fdbb-453e-a9da-7a1376eadf86","resolution":{"observed_at":"2026-08-16T05:56:50.764451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:50.735777Z","title":"Sora, 2024","venue":null,"work_id":"e06c7cb4-0370-4525-9129-734e0734f49e","year":2024},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.242972Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:abd243c0826f456dcbc24d589f072cef4f5a1412c2600f46c3d759bb13f87830","observation_id":"3e90ca48-5469-4994-b8dc-1bf55851efab","resolution":{"observed_at":"2026-08-16T05:56:50.741562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:50.718433Z","title":"Addendum to gpt-4o system card: Native image generation","venue":null,"work_id":"891bbf35-ceeb-4f19-8d6f-f6ea25e367a9","year":2025},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.247596Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:254362a045e0f36091cb4b8519ca7093b55c31c68ae920fbf491ded91afe8991","observation_id":"fef45f2d-9a39-4fba-88dc-3cc1f36b3489","resolution":{"observed_at":"2026-08-16T05:56:50.723878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06942","last_updated":"2024-04-23T11:55:01Z","snapshot_observed_at":"2026-08-16T15:33:48.347943Z","submitted_at":"2023-05-11T16:20:51Z","title":"Optimizing Distributed ML Communication with Fused Computation-Collective Operations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06942","snapshot_observed_at":"2026-08-16T05:56:49.252665Z","title":"Optimizing distributed ml communica- tion with fused computation-collective operations.arXiv preprint arXiv:2305.06942, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.252665Z"},"links":{"cited_paper":"/paper/2305.06942","citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:e579a203722d34aecb931170541461de42796f68b164bb13bc54768ec0dacc07","observation_id":"1838869a-a4fb-45c0-a81a-402a506adb29","resolution":{"observed_at":"2026-08-16T05:56:49.252665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.259665Z","title":"Ama- rasinghe","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.259665Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:00148a4d972b5c6d65f2b78bf844110a62fe61b501fa01dc80924f439a36b067","observation_id":"435cc7a7-7fc7-4a06-8113-044342fd4f49","resolution":{"observed_at":"2026-08-16T05:56:49.259665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.264286Z","title":"Deepspeed: System optimizations enable training deep learning models with over 100 billion parameters","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.264286Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:6ecce221c50d5ac0db86a367c373c3adcdf8f35715da7ee8a897c6fac657de3f","observation_id":"0e84b639-e9c2-43b7-adb5-abd50fd34541","resolution":{"observed_at":"2026-08-16T05:56:49.264286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:50.702497Z","title":"Doubao-1.5-pro, 2025","venue":null,"work_id":"4c001f3e-7065-44b8-915c-7ae880750d65","year":2025},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.269604Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:4e56ffe034cbfce997d7b18e738dd1a4f2d54c6aa9faf90ea1806ea17ab7b1b8","observation_id":"c041d9b8-aa40-48b7-b7e7-259ad28ad882","resolution":{"observed_at":"2026-08-16T05:56:50.707581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.274264Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.274264Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:73b4f9fa767c94e3588c3a3c4c692d36f696cfd54f5a4b519841696cd7e86659","observation_id":"0a6d506d-385a-43bd-9477-485012cf5744","resolution":{"observed_at":"2026-08-16T05:56:49.274264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-16T05:56:49.279097Z","title":"Qwen2.5 technical report.arXiv preprint arXiv:2412.15115, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.279097Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:84f68fd77ffa3a9b06ccdbd0ecffefb65e5f9c95be0e270bdf2357575f6e3cb4","observation_id":"b32de1d5-71f4-4db8-94ca-7e2ea2122b0d","resolution":{"observed_at":"2026-08-16T05:56:49.279097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:50.675057Z","title":"Tilelang, 2025","venue":null,"work_id":"ae89e0e9-7419-432a-974f-7ad0333ba846","year":2025},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.284292Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:309f2abb7e2c68341470d33d7340f19072ceff7bc96f8a0fd49f2b13808d18c0","observation_id":"f62dcb12-73db-41cb-ac32-831a4ae792cc","resolution":{"observed_at":"2026-08-16T05:56:50.679881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.289496Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.289496Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:764556d83d959d23955fad52bc51538c963512654d92c653ca2ab5a4b8df4135","observation_id":"bfbca8d8-e425-4c3f-88f5-f2f03994a0b5","resolution":{"observed_at":"2026-08-16T05:56:49.289496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.293976Z","title":"DISTAL: the distributed tensor algebra compiler","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.293976Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:87d8c17f9282095641600a622f16bb6a6dee16424762bb620777b8518e2407d7","observation_id":"57c116ba-7342-4b6d-a9ce-5d028f1d1ccb","resolution":{"observed_at":"2026-08-16T05:56:49.293976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01005","last_updated":"2025-04-21T20:10:11Z","snapshot_observed_at":"2026-07-06T20:15:36.280948Z","submitted_at":"2025-01-02T02:02:20Z","title":"FlashInfer: Efficient and Customizable Attention Engine for LLM Inference Serving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01005","snapshot_observed_at":"2026-08-16T05:56:49.299130Z","title":"Flashinfer: Efficient and customizable attention engine for llm inference serving.arXiv preprint arXiv:2501.01005, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.299130Z"},"links":{"cited_paper":"/paper/2501.01005","citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:3eab0ec84885b1a94179781d78cf889229650b39822d02dd0e72079f97a7026e","observation_id":"9de2bafe-49c9-4bdc-8068-1705086537ab","resolution":{"observed_at":"2026-08-16T05:56:49.299130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19811","last_updated":"2025-03-04T09:54:37Z","snapshot_observed_at":"2026-08-16T12:54:45.793629Z","submitted_at":"2025-02-27T06:36:45Z","title":"Comet: Fine-grained Computation-communication Overlapping for Mixture-of-Experts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19811","snapshot_observed_at":"2026-08-16T05:56:49.304091Z","title":"Comet: Fine-grained computation-communication overlapping for mixture-of-experts","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.304091Z"},"links":{"cited_paper":"/paper/2502.19811","citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:9971e083907e919bc1a71043d95325973dccd54941dd0078e9f2b876d70d9112","observation_id":"119a3061-deba-4248-ba42-f6a0de4bcd83","resolution":{"observed_at":"2026-08-16T05:56:49.304091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.309237Z","title":"Deepep: an efficient expert-parallel communication library.https://github.com/deepseek-ai/ DeepEP, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.309237Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:0695c96bc32d4677871704d881f9bc1e78806d9b9654f3fff5ba30b514683340","observation_id":"4624ed39-1996-4001-919e-8174a131875d","resolution":{"observed_at":"2026-08-16T05:56:49.309237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:50.645910Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":"0e5e8242-72e2-44ce-ad28-e2cfc53dbe3e","year":2020},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.313906Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:83f345954a4c0c3c1a64fb8159e54cacae72a4a7f0232f7c3b2a95ac96ec157a","observation_id":"80ac5655-3770-4591-983e-72b32ce89ddc","resolution":{"observed_at":"2026-08-16T05:56:50.650966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.318601Z","title":"Flextensor: An automatic schedule exploration and optimization framework for tensor computation on heterogeneous system","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.318601Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:72837e39163e044f5d678c009b72fc12d933f5f1d5d54659db221362befa450e","observation_id":"13a322e2-d6fe-4bef-8bfd-1498b8130e82","resolution":{"observed_at":"2026-08-16T05:56:49.318601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.324143Z","title":"AMOS: enabling automatic mapping for tensor computations on spatial accelerators with hardware abstraction","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.324143Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:83c4aaaa58d3e20e6337274946c240f14d27c3a0cff2fe7f0c8b8c28bbbeccb4","observation_id":"e4802ef6-fa99-4088-a61a-48a073fe92bd","resolution":{"observed_at":"2026-08-16T05:56:49.324143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20313","last_updated":"2025-04-03T10:23:19Z","snapshot_observed_at":"2026-08-16T12:46:43.833593Z","submitted_at":"2025-03-26T08:25:12Z","title":"TileLink: Generating Efficient Compute-Communication Overlapping Kernels using Tile-Centric Primitives","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20313","snapshot_observed_at":"2026-08-16T05:56:49.328497Z","title":"Tilelink: Generating efficient compute-communication overlapping kernels using tile-centric primitives, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.328497Z"},"links":{"cited_paper":"/paper/2503.20313","citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:0c301a5233adc18a064e2457b5bf55fcd46c761f4fff987acf42946c5165e95a","observation_id":"01651ee0-471d-4be5-92ba-a611d337b7fb","resolution":{"observed_at":"2026-08-16T05:56:49.328497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2001.92497","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:50.428150Z","title":"URLhttps://doi.org/10.1109/IPDPS.2001.924976","venue":null,"work_id":"b29a9a7b-c169-429a-8339-b17a44c0eb59","year":2001},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.174198Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:0e1ad99fe621e5bb76e2ce478ee50f39abc33977e130406aa76f142f9c7f855a","observation_id":"ec862e63-71b6-490e-8a17-737d3373e240","resolution":{"observed_at":"2026-08-16T05:56:50.441937Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:56:49.218663Z","title":"URLhttps://doi.org/10.1145/3458817.3476209","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T05:56:49.218663Z"},"links":{"citing_paper":"/paper/2504.19442"},"observation_digest":"sha256:bfeda047bfa253d4fc805b24a00a706c3d0257184213a2b07ff6929b30d03567","observation_id":"9278b5ba-0d9a-4f40-8094-f814fbddf8d8","resolution":{"observed_at":"2026-08-16T05:56:49.218663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.19442","last_updated":"2025-06-05T05:48:26Z","latest_version":3,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-16T05:49:57.627723Z","submitted_at":"2025-04-28T03:09:22Z","title":"Triton-distributed: Programming Overlapping Kernels on Distributed AI Systems with the Triton Compiler"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":29,"verified_exact":1,"verified_fuzzy":11},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 19 inbound Pith citation observations for arXiv:2504.19442."}