{"as_of":"2026-08-19T18:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e1fcbbdefdfbc2b025ede59aa18854314e72a59be7f9bf0def2b2ef3bcc3ec50","coverage":[{"denominator":296,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:50:52.423393Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:21:29.510318Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T15:21:30.520212Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"cited_work":{"arxiv_id":"2507.07223","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.07223","snapshot_observed_at":"2026-08-15T15:21:30.520212Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","venue":"cs.DC","work_id":"6d8acf4b-bea8-4ed9-bce7-b3945f6a6d1f","year":2025},"citing_paper":{"arxiv_id":"2608.00867","last_updated":"2026-08-01T21:01:52Z","snapshot_observed_at":"2026-08-17T10:38:11.849133Z","submitted_at":"2026-08-01T21:01:52Z","title":"NUNA: Characterizing and Mitigating Non-Uniform Network Access in Multi-Die GPU Scale-Up Systems","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T15:21:29.510318Z"},"links":{"cited_paper":"/paper/2507.07223","citing_paper":"/paper/2608.00867"},"observation_digest":"sha256:bb9009b7c4b53c5849db0eb1b2be4d79af9af15d7cd8ded4b3e8768fbc783e25","observation_id":"4d5fb4b4-e3ab-4423-91e0-b0b78e115360","resolution":{"observed_at":"2026-08-15T15:21:30.524084Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.07223/citation-record","integrity":"/paper/2507.07223/integrity","json":"/paper/2507.07223/citation-record.json","paper":"/paper/2507.07223"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:44.627502Z","title":"Avoiding another AI winter,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.627502Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:51220d2464960c1aca3911bbed74c0cf5744606e1902f3147f7af2d29e255ed0","observation_id":"959de874-0ed6-4b10-a622-7ab39d29eb88","resolution":{"observed_at":"2026-08-06T18:50:44.627502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:44.717214Z","title":"A Brief History of AI: How to Prevent Another Winter,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.717214Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:28b11d9d5ba2a1e3bd8fac4e9623a648dd568e700e4c1866d7d47f2243678a9d","observation_id":"ce54bb8e-08e7-4648-8652-de5c02771f8e","resolution":{"observed_at":"2026-08-06T18:50:44.717214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:44.810710Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.810710Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:0ef8061111705a6c0916f52e56d6e34714724571a0661c745d8589656dcf08d8","observation_id":"e8c772b2-e5cd-4620-90ae-7a392cdf2523","resolution":{"observed_at":"2026-08-06T18:50:44.810710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:44.888240Z","title":"Annotated History of Modern AI and Deep Learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.888240Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:ca58647f9a691e0b226fd7d78a36d453c104e9740d8569c257f0a2f224138481","observation_id":"207cb565-a9de-4eff-a1aa-95b64c6b5ad5","resolution":{"observed_at":"2026-08-06T18:50:44.888240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:44.990434Z","title":"ImageNet Classification with Deep Convolutional Neural Networks,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.990434Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:c2b0c9d9708138fe414a666ae22cae6a641827229e6cd4d617631466e628b1d0","observation_id":"5c7a5b91-6ee6-44d7-8990-4428913cba25","resolution":{"observed_at":"2026-08-06T18:50:44.990434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:45.083350Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.083350Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:16977b74cbd7859a6d8d20508cc9ac4a588f9f0377d05b688b31511d92417f88","observation_id":"efc7b7dd-0b0d-40f5-824c-5c1d099a5531","resolution":{"observed_at":"2026-08-06T18:50:45.083350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T18:50:45.175041Z","title":"The Llama 3 Herd of Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.175041Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:8532ea785a197ed67a5ae826b69d599cc823677defc409600137c5a54386e6fe","observation_id":"b6e0c890-a0e1-48ac-a03e-279326fb2505","resolution":{"observed_at":"2026-08-06T18:50:45.175041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:45.188306Z","title":"Generative Adversarial Nets,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.188306Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:1f3601cdcd49d99b9da28fe2999aa12c78a99c413cdf068d11b647ecaf2aad0b","observation_id":"13bf8b61-7b83-4743-8764-ec3ce4cbf352","resolution":{"observed_at":"2026-08-06T18:50:45.188306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:45.249588Z","title":"Learning to learn by gradient descent by gradient descent,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.249588Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:5e0728f4ea25830d86772d782ba6875d291e289b22196ab11e20e6025aa8b96d","observation_id":"8d03c592-3f66-4338-9dae-a5080df60f22","resolution":{"observed_at":"2026-08-06T18:50:45.249588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:45.360307Z","title":"Gradient Descent: The Ultimate Optimizer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.360307Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:1eec0d4e3fd8103a1fcbec4a9c7871d30f3417c74a70007c0295d980c7e0127f","observation_id":"c643b260-79ef-4c73-9b22-1d47c1d1100d","resolution":{"observed_at":"2026-08-06T18:50:45.360307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04747","last_updated":"2017-06-15T13:21:04Z","snapshot_observed_at":"2026-08-15T03:49:17.013617Z","submitted_at":"2016-09-15T17:32:34Z","title":"An overview of gradient descent optimization algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.04747","snapshot_observed_at":"2026-08-06T18:50:45.468946Z","title":"An overview of gradient descent optimization algorithms,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.468946Z"},"links":{"cited_paper":"/paper/1609.04747","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:133bf79feb00cc6e3029b5b00561dfe419cc52851e0c3ca54394de06bfbad8b8","observation_id":"4b53a767-b11b-4031-8f05-726cf381178f","resolution":{"observed_at":"2026-08-06T18:50:45.468946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:45.594404Z","title":"Optimization methods for large-scale machine learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.594404Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:6ea69e77f9b51ba1132fae2a58952a8cb95547cdbcfd32c98b15e416b05a9d85","observation_id":"230dcd83-dac4-4422-82a6-054fa3ad0dd1","resolution":{"observed_at":"2026-08-06T18:50:45.594404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:45.774798Z","title":"Practical recommendations for gradient-based training of deep architectures,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.774798Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:6048b59e903e0925ef481e516f63c3db52f2afd96b81a88ac7908f1c21131e91","observation_id":"36e9eb5a-9b22-4de1-a768-9b076e810478","resolution":{"observed_at":"2026-08-06T18:50:45.774798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:46.005976Z","title":"On the Number of Linear Regions of Deep Neural Networks,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:46.005976Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:39b69ea31abb65d41f13d606d7a2b60bec01fecdec6db2a0c3fdd74284207b0b","observation_id":"86498f9e-16f8-4fd0-9321-efb53d7b24b0","resolution":{"observed_at":"2026-08-06T18:50:46.005976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:46.243461Z","title":"Representation learning: A review and new perspectives,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:46.243461Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:e5f150026b4c4711cef3dd1bb205c6b3773a8905c689404b445b6a69d7aaa08c","observation_id":"2a6e391b-8884-42e6-a895-4e20279cfca5","resolution":{"observed_at":"2026-08-06T18:50:46.243461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:46.411121Z","title":"Intrinsic dimension of data representations in deep neural networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:46.411121Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:5fc801c4279a6c2d747d29e7872216689323e7f210a81bb691fd59ab87bcf87d","observation_id":"817ff0a6-3d06-4c31-ada0-b89333443442","resolution":{"observed_at":"2026-08-06T18:50:46.411121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:46.553457Z","title":"High dimensional, tabular deep learning with an auxiliary knowledge graph,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:46.553457Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:42fa4f17862edb9a92bb6c72125da1d327e12d39fcf985f5a8572ec10f6b2390","observation_id":"8bd1f63e-ac89-4826-b89c-8f43c349539c","resolution":{"observed_at":"2026-08-06T18:50:46.553457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:46.684131Z","title":"General-purpose, long-context autoregressive modeling with Perceiver AR,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:46.684131Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:95dec03d04b9913e97963469ad003d72bef0acd37fd065e56d73bdac24932c3e","observation_id":"cb93f79f-2a97-42c1-8597-a5156d2935ab","resolution":{"observed_at":"2026-08-06T18:50:46.684131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:46.788043Z","title":"A survey on hardware accelerators: Taxonomy, trends, challenges, and perspectives,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:46.788043Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a8fb89ed0c94c73d409f6ae430792d63a0d3257e6828fc8ba3fcac2a375f2a20","observation_id":"2cf42575-8cc0-4ea4-9900-a535202646f8","resolution":{"observed_at":"2026-08-06T18:50:46.788043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:46.954360Z","title":"The transformational role of GPU computing and deep learning in drug discovery,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:46.954360Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:1cc76b9d9ffe971d1b94034502bf1f10d2589f88ea452572146acb9631054e4d","observation_id":"31a8081c-30cd-4d7f-9c56-80b53a4dc450","resolution":{"observed_at":"2026-08-06T18:50:46.954360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:47.093029Z","title":"ZeRO: Memory optimizations Toward Training Trillion Parameter Models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:47.093029Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a6d76d79837a150a9fecc8e7c4f60492becc93e91e3374876d0f916ae57a8049","observation_id":"6f31e56b-8ae3-4121-8ef2-2e28ea43073b","resolution":{"observed_at":"2026-08-06T18:50:47.093029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:47.300565Z","title":"DeepSpeed: System Optimizations Enable Training Deep Learning Models with Over 100 Billion Parameters,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:47.300565Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:29c0a53bbe414c0e9a3a5afb96f65f67779e5fd2b42ac8e241860d5df81ab34a","observation_id":"6e48f871-6030-4f03-9662-04c96aa0b323","resolution":{"observed_at":"2026-08-06T18:50:47.300565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:47.455266Z","title":"Gpu graph processing on cxl-based microsecond-latency external memory,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:47.455266Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:ab06851936778d7eb2726536e1e82e854e33e68a8e4f96ba2f7456caeafc6dc4","observation_id":"b9639a43-3504-44fe-8d70-49190af0d5a7","resolution":{"observed_at":"2026-08-06T18:50:47.455266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.06890","last_updated":"2021-01-14T23:04:37Z","snapshot_observed_at":"2026-07-06T09:28:19.550239Z","submitted_at":"2020-06-12T00:37:51Z","title":"EMOGI: Efficient Memory-access for Out-of-memory Graph-traversal In GPUs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.06890","snapshot_observed_at":"2026-08-06T18:50:47.659632Z","title":"Emogi: Efficient memory-access for out-of-memory graph-traversal in gpus,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:47.659632Z"},"links":{"cited_paper":"/paper/2006.06890","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:4043d5094becafd5da631e87a04d85f974c4a64e6769d29fdc32ee0ba388ee14","observation_id":"4532eeee-b5d6-4a51-b978-070f45b6e814","resolution":{"observed_at":"2026-08-06T18:50:47.659632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:48.041272Z","title":"Efficient memory management for large language model serving with pagedattention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:48.041272Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:420809de2512656a44d877f0546c7230f1f55bdccfc7bbf2fe0a4638e8c2a6dc","observation_id":"6ff19642-e4de-4110-9ead-c0d8813baeab","resolution":{"observed_at":"2026-08-06T18:50:48.041272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:48.209373Z","title":"H2O: Heavy-hitter oracle for efficient generative inference of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:48.209373Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:5ab972f5af529fff3d5ab878786009eae657f04faf5cd14fead480ee26957feb","observation_id":"65a9e8be-924a-4f32-a4cd-654c6ff95f35","resolution":{"observed_at":"2026-08-06T18:50:48.209373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:48.378999Z","title":"Keyformer: Kv cache reduction through key tokens selection for efficient generative inference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:48.378999Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:5412546c77ee8891df5292ad854dec44feb208ef45984fa9d1f8a5728f8d6c83","observation_id":"ec03af62-3cd0-4b87-82fb-c947d50952e7","resolution":{"observed_at":"2026-08-06T18:50:48.378999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2198.36737","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:56.851109Z","title":"TCCL: Co-optimizing Collective Communication and Traffic Routing for GPU-centric Clusters,","venue":null,"work_id":"e7cd5845-7f49-490d-88f5-fb1eb970777b","year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:48.493360Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:2c313b949170f4ef6d58aa0f90bae1fe183e4e57b4acb2923e539cb0263ccbfd","observation_id":"dd52f4e3-87c9-48cb-bd38-916e95856bfe","resolution":{"observed_at":"2026-08-06T18:50:56.859861Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:48.717974Z","title":"Sˆ3: Increasing GPU Utilization during Generative Inference for Higher Throughput,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:48.717974Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:6833cbfea3e486a83e20ea8c4017a2b48ee0efe1034a7a203a39527e1b20d8e2","observation_id":"4df1ebe9-bdec-4b05-9be5-cb2efc8b23d6","resolution":{"observed_at":"2026-08-06T18:50:48.717974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:48.869405Z","title":"NVIDIA Grace GPU","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:48.869405Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:5657d5ef088fa57793afed865a346250a9d5777405fbc78be2fd77ec3e773553","observation_id":"5873df17-6e2b-4c7e-9730-45ba117901b1","resolution":{"observed_at":"2026-08-06T18:50:48.869405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:48.929610Z","title":"Characterization and prediction of deep learning workloads in large-scale GPU datacenters,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:48.929610Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:baf5f38fc792d7ed0c340deacd7a8b65bafe6bcc9d82029948d12db0384b7fcf","observation_id":"a7302004-5471-4415-bbfc-672d8c95ee24","resolution":{"observed_at":"2026-08-06T18:50:48.929610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3851.37238","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:56.764203Z","title":"Towards Memory Disaggregation via NVLink C2C: Benchmarking CPU-Requested GPU Memory Access,","venue":null,"work_id":"cc3f5d2e-bac5-4b4b-9b53-1101446a22f2","year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.011951Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:be45d4c9d765818896f23bc7a49fd2c945fda570f90a8944b81c885e66d86b96","observation_id":"52ad905f-5962-4bdf-8664-8935afb33c2f","resolution":{"observed_at":"2026-08-06T18:50:56.774562Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.068169Z","title":"Poseidon: An Efficient Communication Architecture for Distributed Deep Learning on GPU Clusters,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.068169Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:4a6a59e81ef43732379920ee8f60e27322cb912da9bb68da8b07d86433a01b01","observation_id":"c3db7e59-9f25-477b-a3bf-d9e8af32f857","resolution":{"observed_at":"2026-08-06T18:50:49.068169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.161709Z","title":"A memory perspective: The effects of finetuning llms with highbandwidth memory,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.161709Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:356ef222d894c1fadd4ee26bc1f7d4ca0f1a3f9184055b9d1dfa4fed80b9dd65","observation_id":"f178814c-9fc0-44bd-b2a1-dfed9ba92ff0","resolution":{"observed_at":"2026-08-06T18:50:49.161709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.244384Z","title":"Whitepaper: NVDIA GH200 Grace Hopper Superchip Architecture,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.244384Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a668e783e0de06c4b9f6c3acfa17922ee203ad66c1a4187bda558414e07bbac5","observation_id":"41c58c71-2b96-4316-9dda-f8b511a7f751","resolution":{"observed_at":"2026-08-06T18:50:49.244384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.329840Z","title":"Streambox-hbm: Stream analytics on high bandwidth hybrid memory,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.329840Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:2bff8e4f8f9721e9ed1beac4f9d2cf6248989d2101455c2eb74566fadb2740b6","observation_id":"f158507a-488c-4d1c-9ce8-2a1e5656de15","resolution":{"observed_at":"2026-08-06T18:50:49.329840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.400186Z","title":"Performance evaluation and optimization of HBM- enabled GPU for data-intensive applications,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.400186Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:d8f65156d341b09fa55299a13e6671e4356fe60bf81f4003eb1b9507a948ab21","observation_id":"a5aaf8ac-80e0-4118-84af-6ce1e7d42c60","resolution":{"observed_at":"2026-08-06T18:50:49.400186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.473655Z","title":"NVIDIA GB200 NVL72 Delivers Trillion-Parameter LLM Train- ing and Real-Time Inference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.473655Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:08e44cb91a5559d437583ea68996169e3bf006fa530faf833b744a0135db1f1c","observation_id":"d77be27f-0c10-4952-b990-5bcfd6dedef1","resolution":{"observed_at":"2026-08-06T18:50:49.473655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.560002Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.560002Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:b5e0b1059de4f0bcc49f8028677a6ef02a278792c74bcff682e15c1a009d38cd","observation_id":"fcc8e50f-8c18-44fa-974a-e35db944713d","resolution":{"observed_at":"2026-08-06T18:50:49.560002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.633004Z","title":"Retrieval augmented language model pre-training,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.633004Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a88b25584effc67d1f92f73d75fe5722a2d264c9a2a730e4cc96586b8f20731a","observation_id":"f91d6942-3f99-4749-8581-fa9414ec7d1a","resolution":{"observed_at":"2026-08-06T18:50:49.633004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.697847Z","title":"Improving language models by retrieving from trillions of tokens,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.697847Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:12d9553c478538cff3648a336642b8fa830598af5a597622bd67b65950280651","observation_id":"6abaf47c-5112-4a2f-9d2d-4bc41a12d153","resolution":{"observed_at":"2026-08-06T18:50:49.697847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-08-12T10:50:46.357243Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-06T18:50:49.785560Z","title":"Megatron-lm: Training multi-billion parameter language models using model parallelism,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.785560Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:7cac55448e7cbbd4bc2f19f8d519fe89e150f3a95ebabf0659a178eea20419f2","observation_id":"ad1cc1f3-8f4d-4aa9-b791-18906dfe0490","resolution":{"observed_at":"2026-08-06T18:50:49.785560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.08910","last_updated":"2020-10-05T21:26:45Z","snapshot_observed_at":"2026-08-15T17:58:46.639035Z","submitted_at":"2020-02-10T18:55:58Z","title":"How Much Knowledge Can You Pack Into the Parameters of a Language Model?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.08910","snapshot_observed_at":"2026-08-06T18:50:49.872748Z","title":"How much knowledge can you pack into the parameters of a language model?","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.872748Z"},"links":{"cited_paper":"/paper/2002.08910","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:3c54ba81c2f60a5032c62d714dbaebfb4045d1a68a3985f19df1c45d75f872d7","observation_id":"5fd623e4-e2a4-498f-8dd7-f679d22a3529","resolution":{"observed_at":"2026-08-06T18:50:49.872748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.938398Z","title":"Pipedream: generalized pipeline parallelism for dnn training,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.938398Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:30a4fe1320736abc71d86ed39a3f594a2b80001b6d504dbd7a9d7da6b506ba21","observation_id":"cc938e01-2d74-4ec3-84ff-7ed3d3851811","resolution":{"observed_at":"2026-08-06T18:50:49.938398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.005542Z","title":"Number of parameters in gpt-4 (latest data),","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.005542Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:52f3f0172148c196267a9929f3590812e43dea165093293b8efc30f2baf958cf","observation_id":"72163969-a342-4f63-bccd-49060ae35bb6","resolution":{"observed_at":"2026-08-06T18:50:50.005542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.070127Z","title":"NVIDIA GB200 NVL72","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.070127Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:ffdfc85b36e4615c2cf8758c0d34f5d224c031a12fedd7b84ec724a20d8a79f8","observation_id":"fa00673f-bea8-4376-b300-31c63625aabf","resolution":{"observed_at":"2026-08-06T18:50:50.070127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.156769Z","title":"NVIDIA GB300 NVL72","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.156769Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:31c43b6cccc5d9990d3439d196c197515d48a4f4ab70fd86382d98dd2fc9b0eb","observation_id":"b22a1f94-3158-4dcb-a281-edc8b83a7dc3","resolution":{"observed_at":"2026-08-06T18:50:50.156769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.224150Z","title":"NVIDIA DGX GB300","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.224150Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:2095b73517c56ffac3184349426adce7cf06f955d3577758fb739e3c9af611d6","observation_id":"3818b815-baf6-40d4-a591-367491c0162a","resolution":{"observed_at":"2026-08-06T18:50:50.224150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.324135Z","title":"Understanding communication characteristics of distributed training,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.324135Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:b96449fdf09cf0cef5e7f6a8da457834c9844ad540d921f576f274fcfd69e43b","observation_id":"c3f6e128-acb6-4590-929f-faf76ad6794f","resolution":{"observed_at":"2026-08-06T18:50:50.324135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.407491Z","title":"MAD-Max Beyond Single-Node: Enabling Large Machine Learning Model Acceleration on Distributed Systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.407491Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:9761399d1a9de56110c15679aeb02ec879ee7c8b8aa58e54cd81c35a8d5d1dd4","observation_id":"cd589e9a-f548-497f-b789-fbd9755e7b40","resolution":{"observed_at":"2026-08-06T18:50:50.407491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-08-18T02:47:16.120894Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-06T18:50:50.463847Z","title":"Flux: fast software-based communication overlap on gpus through kernel fusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.463847Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:cbcb2c83b8eeed4f3460469a66ec297fbc096ec0ad9e31b79393c4ec32720660","observation_id":"169b84dd-eb35-4d65-8765-b7364f8470bc","resolution":{"observed_at":"2026-08-06T18:50:50.463847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.531679Z","title":"Collective communication library NCCL,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.531679Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:29704c8694c103199216abf1b92ca7194e3e67c088d29a7ba4b402ba5de319b0","observation_id":"46abc68b-1e72-4eaa-98c6-089714962a1d","resolution":{"observed_at":"2026-08-06T18:50:50.531679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.586469Z","title":"Lancet: Accelerating mixture-of-experts training via whole graph computation-communication overlapping,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.586469Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:1a14c9266658ab6ed348c354939c5fe52483ad89cef0ceb67b4001eaeb77b838","observation_id":"aca4cb32-e627-4872-86f0-1456b4214eb4","resolution":{"observed_at":"2026-08-06T18:50:50.586469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5053.37311","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:56.459018Z","title":"Traci: Network acceleration of input-dynamic communication for large-scale deep learning recommendation model,","venue":null,"work_id":"c4c6189c-e351-476c-a384-87368f15291b","year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.686463Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:d8a91cfa5d1bf46bdfc9b7040d30773c01c51e51bb08fe2359c4e71ec96d8961","observation_id":"1c4d3d5b-b99a-44a5-b246-645605945842","resolution":{"observed_at":"2026-08-06T18:50:56.469937Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.771412Z","title":"GPU graph processing on cxl-based microsecond-latency external memory,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.771412Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:2470a1f9bb755c321c3b8c1df5c6e3d70327e620cd6fb6871ca1690d8720caae","observation_id":"471bbb5c-5a05-4a5c-9cf5-fda77f7e335a","resolution":{"observed_at":"2026-08-06T18:50:50.771412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.839408Z","title":"Understanding routable{PCIe} performance for composable infrastructures,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.839408Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:b4ffc53dd532e247b113e77e1e64f634c71a1324ef6148374cf68cc6e5eeda8c","observation_id":"384a5e5c-0585-4f59-816a-35cb297168eb","resolution":{"observed_at":"2026-08-06T18:50:50.839408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.922505Z","title":"Understanding PCIe performance for end host networking,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.922505Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:dc662ddaf840ac0cbaa5e74d20dbe19b796afae3f98f4c783ad061cea66a3257","observation_id":"30621a73-9791-4094-b55c-09cf1298a79e","resolution":{"observed_at":"2026-08-06T18:50:50.922505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.962356Z","title":"CXL 1.0 specification,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.962356Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:9eb436685104cb841de86a71a42e0af87f5bd74d0a42493beb1d8ed334a8aa6a","observation_id":"841d44a9-30e2-43be-8d86-9e77e01648f1","resolution":{"observed_at":"2026-08-06T18:50:50.962356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.007942Z","title":"CXL 2.0 specification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.007942Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:3c8be9a71037355d73ada5ab784a222207d2c4bf333fe259c419c617b2c33551","observation_id":"bb516739-9b5e-49d5-b7bd-c50bda4ccffd","resolution":{"observed_at":"2026-08-06T18:50:51.007942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.145890Z","title":"CXL 3.2 specification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.145890Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:e51d6c656801ca74764cf6f2a3b7998eb0464c53a404a32ce947b508fa05821b","observation_id":"b9ed063f-1f98-4bb9-a208-cfc37af202b0","resolution":{"observed_at":"2026-08-06T18:50:51.145890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.321615Z","title":"Overcoming the memory wall with CXL-Enabled SSDs,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.321615Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:db786014c300999465e0231895990b77473f7853a83c551b9fd3a8346c4575e2","observation_id":"a26f8c62-0d99-410a-b902-9805103c873e","resolution":{"observed_at":"2026-08-06T18:50:51.321615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.497367Z","title":"An introduction to the compute express link (cxl) interconnect,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.497367Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:532501f6ae1b5d33660ab6671d81e717dfb0e465e3f3eb6e6434a388cdfb3e53","observation_id":"24c01a0a-fe55-4b2d-83d5-28555188efb3","resolution":{"observed_at":"2026-08-06T18:50:51.497367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.592359Z","title":"Hello bytes, bye blocks: Pcie storage meets compute express link for memory expansion (cxl- ssd),","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.592359Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:97135f629dc187a3b31e8233b4fa33a42d8b26a41abc6d849c9e8bbc64b33122","observation_id":"f547036c-fa1a-48f2-9ade-afaed31ea7c9","resolution":{"observed_at":"2026-08-06T18:50:51.592359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.698491Z","title":"Pond: CXL-Based Memory Pooling Systems for Cloud Platforms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.698491Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:51a5849c3501117d4bfbdad5d936c76a32393fc7cc653c164c118b76d774cb9e","observation_id":"82da996e-dfcc-425a-924f-599f1447b1f9","resolution":{"observed_at":"2026-08-06T18:50:51.698491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.855162Z","title":"Breaking the Memory Wall with Compute Express Link (CXL),","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.855162Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:fa5d578172fbf972d0565d832a77c8bc1e86c4b44a1f99e5c410994bea154ffc","observation_id":"ff480925-c66a-48f1-90df-47112c03486f","resolution":{"observed_at":"2026-08-06T18:50:51.855162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.978517Z","title":"Direct access,{High-Performance} memory disaggregation with {DirectCXL},","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.978517Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:2cf4185a82b50c7735eaf4437565af8cdb1894fbae4f4c23f75e850704cf83b7","observation_id":"f68a0c7c-ec19-412b-be8f-7ec0cdc963ca","resolution":{"observed_at":"2026-08-06T18:50:51.978517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.098820Z","title":"Retrieval-Augmented Generation for Knowledge- Intensive NLP Tasks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.098820Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:d23bd561adcc6ec915e5b0b2d1287fe61b7b92876883eaa9baed7f384655e8b8","observation_id":"c7687572-0c16-4271-9ff6-d708d5201e6b","resolution":{"observed_at":"2026-08-06T18:50:52.098820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.250936Z","title":"Active retrieval augmented generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.250936Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:cf2d8231793947144e3034533895d0e50495892148f8e24660196fd784279f69","observation_id":"a0e41e77-acd9-42ee-9fb5-3b0c00fbbe77","resolution":{"observed_at":"2026-08-06T18:50:52.250936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.273606Z","title":"Benchmarking large language models in retrieval-augmented generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.273606Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:4286d12e27ca8e817067695cfcdb1dab43f1ceaaccea33a7a74a16e1d96879dd","observation_id":"bc36a144-68c5-4bea-a581-9335f12d6625","resolution":{"observed_at":"2026-08-06T18:50:52.273606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16130","last_updated":"2025-02-19T10:49:41Z","snapshot_observed_at":"2026-08-16T12:38:40.131901Z","submitted_at":"2024-04-24T18:38:11Z","title":"From Local to Global: A Graph RAG Approach to Query-Focused Summarization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16130","snapshot_observed_at":"2026-08-06T18:50:52.278520Z","title":"From local to global: A graph rag approach to query-focused summarization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.278520Z"},"links":{"cited_paper":"/paper/2404.16130","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:5517041abc61389c5c03b4ebfb5625b0105d7c6b5cdc24cbe9021786f0736607","observation_id":"d9633924-eb71-482b-afd5-f45472ed02e3","resolution":{"observed_at":"2026-08-06T18:50:52.278520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.282773Z","title":"KV Cache is 1 Bit Per Channel: Efficient Large Language Model Inference with Coupled Quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.282773Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:cfa55b4a57c738ec7d050ec575cf28f475a0185828dc7df74b2b9ac857676921","observation_id":"06914274-d58b-457b-8d19-abd0f881ab54","resolution":{"observed_at":"2026-08-06T18:50:52.282773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.286774Z","title":"InfiniGen: Efficient Generative Inference of Large Language Models with Dynamic KV Cache Management,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.286774Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:9a9bc5bb007c08e06b83378123ce5d8ed66ab332e65f989cfee9129fb37dfe58","observation_id":"2b512ef9-215c-46e6-8276-0a7e88ee8044","resolution":{"observed_at":"2026-08-06T18:50:52.286774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.295326Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.295326Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:f9f4e33d30e8778133b4e7c4194c96dc8baebe2d3c7d363f824722e5590f6a67","observation_id":"cd5008a8-7a74-49ce-b623-cf7ef4fcb953","resolution":{"observed_at":"2026-08-06T18:50:52.295326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.299507Z","title":"UALink 200G 1.0 Specification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.299507Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:d51ce6d3b46d36279d93d4d8a4cb7070ba383e34ad029334e0ba4288a3c41d34","observation_id":"4e619249-3789-4d1a-b210-d866683c063d","resolution":{"observed_at":"2026-08-06T18:50:52.299507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.304004Z","title":"[Online]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.304004Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:1a69504c3101eb691b8260ff36952296e6f6bb6febdbf521bc497482d58c35dc","observation_id":"0648a33f-7136-4ac6-b069-f1d56f84b3dc","resolution":{"observed_at":"2026-08-06T18:50:52.304004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.307870Z","title":"How Ultra Ethernet and UALink Enable High-Performance, Scalable AI Net- works,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.307870Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:2464ba2eb41ba6512a2223da7031884cb28c2e52b5fd8ff20cb0ece0d7a4dbc2","observation_id":"eb1fa165-8f59-43ed-8ad9-299a250c5d4a","resolution":{"observed_at":"2026-08-06T18:50:52.307870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.312269Z","title":"What is NVLink?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.312269Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:60b6f970f400198b4b4a48cf360ba41d9080f53c794f361a466ccac5b7d72a4a","observation_id":"56a82bf3-06c3-4ccb-b828-cd3aef461c0b","resolution":{"observed_at":"2026-08-06T18:50:52.312269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.316486Z","title":"NVLink NVIDIA","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.316486Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:c044fe7ea31eb93da89b8da0eeab67c6994cf4f3b239a2bd1badca6c42e435fb","observation_id":"7cf12210-d465-4efd-bb1e-0ff26e842dde","resolution":{"observed_at":"2026-08-06T18:50:52.316486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.320597Z","title":"WNVIDIA NVLink and NVLink Switch,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.320597Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:847ebe964292fc811a9fde44e11e3bb1c0456ed8c27f548ea110f7a1659a8b94","observation_id":"46b9b429-6b4d-4d19-ad94-3b5522fb34dd","resolution":{"observed_at":"2026-08-06T18:50:52.320597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.325885Z","title":"NVIDIA Fusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.325885Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a60af18d0091825142fe3a5e541d7dc0168f993bac90ef7b29bc185614e70bcf","observation_id":"934bb20d-f772-4c9b-92df-c6c03597161e","resolution":{"observed_at":"2026-08-06T18:50:52.325885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.330598Z","title":"NVIDIA Unveils NVLink Fusion for Industry to Build Semi-Custom AI Infrastructure With NVIDIA Partner Ecosystem,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.330598Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:93d497d64fe6d257f512575c0742d504d20cb6056f751b6e531673a200e005c5","observation_id":"abe2fbb5-ab79-4646-84d3-f4a186d36bf0","resolution":{"observed_at":"2026-08-06T18:50:52.330598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.335714Z","title":"Design guidelines for high performance RDMA systems,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.335714Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a03842ea0bb90c5e98d2793a3adb25e7be0c37f32a0d26c2ef156fadcbf19d34","observation_id":"2c3d6217-7bca-42b3-b630-3322f6115450","resolution":{"observed_at":"2026-08-06T18:50:52.335714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.340336Z","title":"An optimized rdma qp communication mechanism for hyperscale ai infrastructure,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.340336Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:7636de3c74c9124b5d10701743a787833e4b53c35d7086ec74dcbdbdbe6d9291","observation_id":"00107cb5-d202-45bc-9945-85443b3620ad","resolution":{"observed_at":"2026-08-06T18:50:52.340336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.344945Z","title":"Rdma over commodity ethernet at scale,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.344945Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:d5e51eb14a46f2769b2a54cff2de15f9b4cbafb79de12f169df28ae3ab4c7b8b","observation_id":"8930f5e3-5903-4a69-9dae-15bcfe274ece","resolution":{"observed_at":"2026-08-06T18:50:52.344945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.349414Z","title":"Rdma over ethernet for distributed training at meta scale,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.349414Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:12fc265215f000ed149c95b25db5707e43ab0720a1213573bf0a6ccfb2bb0187","observation_id":"73cf4e6c-14cb-4bf8-b9f0-d9ba13039319","resolution":{"observed_at":"2026-08-06T18:50:52.349414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.354129Z","title":"Graph 500 benchmarks,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.354129Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a27cf15b3b4721a93662946a4b2782ea437d93ec5529ee52376a865a4ba6e05d","observation_id":"c6752674-f8d7-42d1-8955-2a70fdc79b8a","resolution":{"observed_at":"2026-08-06T18:50:52.354129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.358617Z","title":"NASA Parallel Benchmarks,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.358617Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:26589e59ef334da39db9b461fd7b80ef8a23175475e6ad399ff2d796e64d9474","observation_id":"0cbfd1c4-2aa3-4710-97ab-01553aa7803d","resolution":{"observed_at":"2026-08-06T18:50:52.358617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.362917Z","title":"Lattice Boltzmann Method Benchmarks,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.362917Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:c47f3341c6104bf19bda0039eb3cf7e8afa20b4cf492e828f18b3f0fe3b2c348","observation_id":"b079bcc4-4f69-4538-88a1-67e2a3d2a180","resolution":{"observed_at":"2026-08-06T18:50:52.362917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.368008Z","title":"Tealeaf: A mini-application to enable design-space explorations for iter- ative sparse linear solvers,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.368008Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:62b8501165f20654a485186c9d9641bbfa5bc6bedb915c4af204681c409409da","observation_id":"9eadc4c9-ba07-4553-a645-e7379d2df155","resolution":{"observed_at":"2026-08-06T18:50:52.368008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.373255Z","title":"Advances in Numerical Modeling for Heat Transfer and Thermal Management: A Review of Computational Approaches and Environmental Impacts,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.373255Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:20b2c857bd2e4cad9b8b58d77a44c9069ebd2a3718b8044cb2436278f0a99bca","observation_id":"a3c2b24c-ff96-4394-96e0-379e07187362","resolution":{"observed_at":"2026-08-06T18:50:52.373255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.377684Z","title":"Sequence to sequence learning with neural networks,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.377684Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:ccf8f8a7d5815ea136be1af3ca2b7f678830fa78ee1fe2e7862acc0e145f1fa6","observation_id":"28ac1eaa-66f3-4df4-ac04-895eedf55958","resolution":{"observed_at":"2026-08-06T18:50:52.377684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.382589Z","title":"State-of-the-Art Speech Recognition with Sequence-to-Sequence Models,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.382589Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:18ea976bdab2d66e1a372e6854152462c9686b10b63859507813394af16ca7c4","observation_id":"5a373215-d156-48c6-b4a4-efc312586920","resolution":{"observed_at":"2026-08-06T18:50:52.382589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06114","last_updated":"2016-03-01T10:55:58Z","snapshot_observed_at":"2026-08-17T11:04:04.660478Z","submitted_at":"2015-11-19T10:24:14Z","title":"Multi-task Sequence to Sequence Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06114","snapshot_observed_at":"2026-08-06T18:50:52.387160Z","title":"Multi-task Sequence to Sequence Learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.387160Z"},"links":{"cited_paper":"/paper/1511.06114","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:3124e2efe0d50373cf1c4ee2e0f84682e55adac162f76cfee2329ae9d803048b","observation_id":"96a0f40e-6fc5-4f28-9edc-39dac6ccafc8","resolution":{"observed_at":"2026-08-06T18:50:52.387160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.391709Z","title":"Improving language understanding by generative pre-training,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.391709Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:b2812cce422f6b1ab9a0df30c7b23fe3ff377036295be49ad222d2ebe48cb9ae","observation_id":"52159462-23da-4ded-b9ea-d1eb5d68801b","resolution":{"observed_at":"2026-08-06T18:50:52.391709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.396528Z","title":"New models and developer products announced at devday,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.396528Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:91c75e459d3221720b573b61882b7445ab7189784340249849beb5f846637a97","observation_id":"3ad91b25-060f-4df5-b3be-a912d60c31ca","resolution":{"observed_at":"2026-08-06T18:50:52.396528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.401383Z","title":"Models. Llama3.1, 3.2, 3.3, Llama4","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.401383Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:daba9b78d7ff0e44c4e5bc256fda264a3d8163e1e994175f9cb080b9f2d600ba","observation_id":"90d55f46-fc11-435e-b221-471e0fc7b53e","resolution":{"observed_at":"2026-08-06T18:50:52.401383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.406098Z","title":"GPT-4 Turbo,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.406098Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:c9dde7d1aca156eb072a3c66c97effce54b142683b1188ba13aa5ab7cdcac3a1","observation_id":"b0939831-f130-44e4-8f90-42609091dea7","resolution":{"observed_at":"2026-08-06T18:50:52.406098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.410359Z","title":"Gemini 2.5: Our most intelligent AI model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.410359Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:2c49b4b250aa37399dff3f7421b4d3d3d78abb7242b8cce0160fbd748111578c","observation_id":"034394ad-decb-4ee1-b18a-097dd6a12cf2","resolution":{"observed_at":"2026-08-06T18:50:52.410359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.414527Z","title":"Report: Google DeepMind Gemini,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.414527Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:7cd7dcf38666e559daff84f483ab7d94ec313da91c5925350bb8c82832277900","observation_id":"a1b23261-f358-4822-8701-3df548b49dcf","resolution":{"observed_at":"2026-08-06T18:50:52.414527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1406.1078","last_updated":"2014-09-03T00:25:02Z","snapshot_observed_at":"2026-08-15T13:36:27.756066Z","submitted_at":"2014-06-03T17:47:08Z","title":"Learning Phrase Representations using RNN Encoder-Decoder for Statistical Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.1078","snapshot_observed_at":"2026-08-06T18:50:52.423393Z","title":"Learning phrase representations using rnn encoder-decoder for statistical machine translation,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.423393Z"},"links":{"cited_paper":"/paper/1406.1078","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:47c2015f88153998fd21cf9aa3523eed32aaa433f5fed82d465121161ec6a712","observation_id":"e3ebedf8-4822-4a8d-965b-a541e76b50f9","resolution":{"observed_at":"2026-08-06T18:50:52.423393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","latest_version":2,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-09T15:41:13.997855Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":97,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":296},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 100 of 296 outbound references and 1 inbound Pith citation observation for arXiv:2507.07223."}