{"as_of":"2026-08-10T20:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:143d28e88403727009d032bc29873d4b6583337d47989efa212a58498e8e2b66","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T06:00:33.427109Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.06472/citation-record","integrity":"/paper/2506.06472/integrity","json":"/paper/2506.06472/citation-record.json","paper":"/paper/2506.06472"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:38.152137Z","title":"In19th USENIX Conference on File and Storage Technologies (FAST 21), pages 387–401, 2021","venue":null,"work_id":"dfcce3fe-3bf1-4401-a893-9761b31ad704","year":2021},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.204819Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:dfdc4c1c60015150cc543c6791a750c0404e3b76ae6cbdc66812332ada1e1fa4","observation_id":"f2e46f6e-6bdf-45b9-938b-f02312d76d6c","resolution":{"observed_at":"2026-08-07T06:00:38.224953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:37.984425Z","title":"Efficient combination of rematerialization and offloading for training dnns.Advances in Neural Information Processing Systems, 34:23844–23857, 2021","venue":null,"work_id":"cf291712-1fc4-4634-b620-beea58d6e800","year":2021},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.210913Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:14cd05c6ab8aecac30f0e5758616d18231cb6e9f08f6a967227a72a193bc4dc6","observation_id":"8b9ac2a1-8192-4455-a34a-31ae374be6b4","resolution":{"observed_at":"2026-08-07T06:00:38.076966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T06:00:32.219076Z","title":"Bert: Pre-trainingofdeep bidirectional transformers for language understanding.arXiv preprint arXiv:1810.04805, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.219076Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:05781c9cc025a9532e64250570a926f1930b4c7efa153e066e7c1a23dbd2abbe","observation_id":"75a2931f-a17e-40b1-a1bb-47b4253cdbf5","resolution":{"observed_at":"2026-08-07T06:00:32.219076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T06:00:32.223943Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.223943Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:3c7e21b18e1f7dada190e0627d580bd0541691314998121116356c8754dbd6a2","observation_id":"4010036c-c454-4239-ae2b-b2339ce45d89","resolution":{"observed_at":"2026-08-07T06:00:32.223943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:37.766245Z","title":"Exxact.https://www.exxactcorp.com/, 2025","venue":null,"work_id":"0d3cc1ee-c962-4e0a-a97b-d0fa0098236b","year":2025},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.229730Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:bb8b3a0731a69b0cf1e65bdb198616e59880bf957f656d9afc6e44307170535c","observation_id":"157e3f5e-29db-458b-8529-bd6344290d2c","resolution":{"observed_at":"2026-08-07T06:00:37.885091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:37.585510Z","title":"T5 11b.https://huggingface.co/google-t5/t5-11b, 2025","venue":null,"work_id":"fde442bd-6394-4beb-b6c3-79a4f836251e","year":2025},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.234022Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:fd8f864cf0bcac200953ad3dd1357058fbfe80b95f6940a541061baa0f8d7c71","observation_id":"79269ad2-b570-4a8c-a116-40c88095f66c","resolution":{"observed_at":"2026-08-07T06:00:37.668737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:37.409523Z","title":"nvidia.com/blog/gpudirect-storage/","venue":null,"work_id":"d3a925ce-b512-4146-b5ab-c18e2912e308","year":null},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.244791Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:503b4f91d7971753b3136d0af09f2724129493f8031335848372b6e45e751f81","observation_id":"0220b629-eb06-4ca6-af42-eb96375c0285","resolution":{"observed_at":"2026-08-07T06:00:37.498608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:37.270089Z","title":"Swapadvisor: Pushingdeeplearningbeyondthegpu memory limit via smart swapping","venue":null,"work_id":"d1b6f04c-1aeb-4311-8504-a7236600e805","year":2020},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.249225Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:694fd0615677cf960ead4241d1d113614b9529dece660bab9046b6ea1daf4b41","observation_id":"fa229a1c-7736-48aa-901c-63497343213c","resolution":{"observed_at":"2026-08-07T06:00:37.315978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:32.255025Z","title":"Gpipe: Efficient training of giant neural networks using pipeline parallelism.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.255025Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:d0f8be0715b02849a4789490a36216ea9ac6dce052dd155c92760d4933640909","observation_id":"565f4070-ef28-41fb-a56a-b5144f07d578","resolution":{"observed_at":"2026-08-07T06:00:32.255025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:37.041117Z","title":"Ibm granite.https://huggingface.co/ibm-granite, 2025","venue":null,"work_id":"782ca5a3-29a1-42ac-adef-4272183802d6","year":2025},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.262423Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:0a53ea567e67fcfa7c770f368f4d67bde2dc99550a3be37b48561661a4b76495","observation_id":"90eeb0ea-75ae-43c7-9042-18b66e18393f","resolution":{"observed_at":"2026-08-07T06:00:37.132856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:36.870654Z","title":"Checkmate: Breaking the memory wall with optimal tensor rematerialization.Proceedings of Machine Learning and Systems, 2:497–511, 2020","venue":null,"work_id":"ebf2f796-f3a7-411d-9f17-cbf2b2c850be","year":2020},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.271033Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:0ff458601f17f815c0529dcae1439e8b81c378baff35fecd56a107e9fbf3abf6","observation_id":"05d469d2-ce6e-4e5c-8cd2-08bfb9f65c09","resolution":{"observed_at":"2026-08-07T06:00:36.954625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:36.668079Z","title":"Smart-infinity: Fastlargelanguagemodeltrainingusingnear-storageprocessingonarealsystem","venue":null,"work_id":"457ff048-888d-46a7-a795-572e9a83ef14","year":2024},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.281042Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:91834f897fb3b63913fdb973fbcbd07bbcf4a87d22cfa25fc1b9bdd066a2ecb6","observation_id":"66b4a927-a40b-4dd6-84cc-2fc2347ddce8","resolution":{"observed_at":"2026-08-07T06:00:36.734315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:36.414542Z","title":"Deepum: Tensormigrationandprefetchinginunified memory","venue":null,"work_id":"8f09c93d-deba-4d75-b6c3-7a0bc568ef01","year":2023},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.291031Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:c3f525d17fb9c59d14c30e7bc3214e181636ebcb77996aa39fe69ac39e18f2c2","observation_id":"62e93b52-97ee-480b-9a82-f474a889d2ba","resolution":{"observed_at":"2026-08-07T06:00:36.517578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T06:00:32.301738Z","title":"Scaling laws for neural language models.arXiv preprint arXiv:2001.08361, 2020","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.301738Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:d901ff7df4e031a30e1c826eba550a3e06a89f3e44fd04a26f70b92fe2be4b27","observation_id":"9e4d01fd-f963-4c16-aac4-afdd38782399","resolution":{"observed_at":"2026-08-07T06:00:32.301738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:36.211243Z","title":"Beyond the memory wall: A case for memory-centric hpc system for deep learning","venue":null,"work_id":"39bb41ed-d3af-40d6-9410-8fd9d29f57c8","year":2018},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.312924Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:a11e336aaac9e69c9e0b7d77b58e6cd368a352cbfdeb58b7e13a1f8975b91145","observation_id":"1ee83164-88a9-44c8-8c30-d5f8387bc992","resolution":{"observed_at":"2026-08-07T06:00:36.317589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.02037","last_updated":"2019-10-02T06:54:46Z","snapshot_observed_at":"2026-08-10T03:47:30.535443Z","submitted_at":"2018-07-05T14:56:39Z","title":"TFLMS: Large Model Support in TensorFlow by Graph Rewriting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.02037","snapshot_observed_at":"2026-08-07T06:00:32.323175Z","title":"Tflms: Large model support in tensorflow by graph rewriting.arXiv preprint arXiv:1807.02037, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.323175Z"},"links":{"cited_paper":"/paper/1807.02037","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:0ee3412d9b28aa359d0d004c2fa6207d886397613ed77432cc5015a9eab2dc94","observation_id":"25d743ac-8fb4-4732-845d-9763d4d96a9a","resolution":{"observed_at":"2026-08-07T06:00:32.323175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06511","last_updated":"2025-06-07T19:16:22Z","snapshot_observed_at":"2026-08-07T00:12:09.462694Z","submitted_at":"2024-10-09T03:26:11Z","title":"TorchTitan: One-stop PyTorch native solution for production ready LLM pre-training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06511","snapshot_observed_at":"2026-08-07T06:00:32.332267Z","title":"Torchtitan: One-stop pytorch native solution for production ready llm pre-training.arXiv preprint arXiv:2410.06511, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.332267Z"},"links":{"cited_paper":"/paper/2410.06511","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:ae785bbeca5f5c86d904f52d6c64d8dc6e1603a2721cfd8309dd866620543d82","observation_id":"6c2374d8-4fe3-4c22-b633-27febef3d874","resolution":{"observed_at":"2026-08-07T06:00:32.332267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06504","last_updated":"2024-12-24T13:41:08Z","snapshot_observed_at":"2026-08-09T17:24:00.350159Z","submitted_at":"2024-03-11T08:25:53Z","title":"LoHan: Low-Cost High-Performance Framework to Fine-Tune 100B Model on a Consumer GPU","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06504","snapshot_observed_at":"2026-08-07T06:00:32.342788Z","title":"Adding nvme ssds to enable and accelerate 100b model fine-tuning on a single gpu.arXiv preprint arXiv:2403.06504, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.342788Z"},"links":{"cited_paper":"/paper/2403.06504","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:85c8cf006b3d76f2817aa7b5f6fdce0856e3849dc972867bc167576be007502e","observation_id":"9347a12c-dc38-4126-87ec-492546f5dec0","resolution":{"observed_at":"2026-08-07T06:00:32.342788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.06162","last_updated":"2018-12-14T20:49:09Z","snapshot_observed_at":"2026-07-06T07:21:19.842962Z","submitted_at":"2018-12-14T20:49:09Z","title":"An Empirical Model of Large-Batch Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.06162","snapshot_observed_at":"2026-08-07T06:00:32.354308Z","title":"An empirical model of large-batch training.arXiv preprint arXiv:1812.06162, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.354308Z"},"links":{"cited_paper":"/paper/1812.06162","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:c39439ec8c5ff624f7d71e279a2f809c924ae1421b5e0c2fd8832eba1650d1c6","observation_id":"93c3f85c-3e80-4487-aace-506d2cf81670","resolution":{"observed_at":"2026-08-07T06:00:32.354308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.03740","last_updated":"2018-02-15T20:04:02Z","snapshot_observed_at":"2026-07-06T06:03:37.247241Z","submitted_at":"2017-10-10T17:42:04Z","title":"Mixed Precision Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.03740","snapshot_observed_at":"2026-08-07T06:00:32.365297Z","title":"Mixed precision training.arXiv preprint arXiv:1710.03740, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.365297Z"},"links":{"cited_paper":"/paper/1710.03740","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:b3795c9e0bfbd59a69f2ce539c06126824be50c3d9269cbfc08270de0a7b748f","observation_id":"6b5ea083-c2da-4c5a-a012-ecf0710c1997","resolution":{"observed_at":"2026-08-07T06:00:32.365297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:32.377846Z","title":"Pipedream: Generalized pipeline parallelism for dnn training","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.377846Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:e856aa3946828876610347c1fea55b33a609f11315900f2e5077d50784915e4b","observation_id":"c7725067-0716-481a-ba8e-9b15d1ccdbdd","resolution":{"observed_at":"2026-08-07T06:00:32.377846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.02868","last_updated":"2023-03-06T03:36:26Z","snapshot_observed_at":"2026-07-31T13:29:57.932652Z","submitted_at":"2023-03-06T03:36:26Z","title":"Angel-PTM: A Scalable and Economical Large-scale Pre-training System in Tencent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.02868","snapshot_observed_at":"2026-08-07T06:00:32.388782Z","title":"Angel-ptm: A scalable and economical large-scale pre-training system in tencent.arXiv preprint arXiv:2303.02868, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.388782Z"},"links":{"cited_paper":"/paper/2303.02868","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:6058b06f196f4132f5a7b83a6f9ec8aa59b922c0d30b9cff42b0626b23f3f376","observation_id":"4244f784-58d3-4f9b-b7ce-5b136bfbc231","resolution":{"observed_at":"2026-08-07T06:00:32.388782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:32.401389Z","title":"Automatic differentiation in pytorch","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.401389Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:9f5662f2bd7ff602f364d762d1697604d47235e38856a81564e825b2eb212b15","observation_id":"e21e5ca9-0316-495e-81fd-55617bd9174e","resolution":{"observed_at":"2026-08-07T06:00:32.401389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:32.412497Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.412497Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:5762eea667233f4eb0ef0fe5d27c6a77ab69e26473bec303934f274018aaa88a","observation_id":"0f628802-5c38-4ba1-8595-23609fd97d9c","resolution":{"observed_at":"2026-08-07T06:00:32.412497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05645","last_updated":"2020-06-05T03:00:26Z","snapshot_observed_at":"2026-08-10T06:01:21.912084Z","submitted_at":"2020-02-13T17:29:47Z","title":"Training Large Neural Networks with Constant Memory using a New Execution Algorithm","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05645","snapshot_observed_at":"2026-08-07T06:00:32.422749Z","title":"Training large neural networks with constant memory using a new execution algorithm.arXiv preprint arXiv:2002.05645, 2020","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.422749Z"},"links":{"cited_paper":"/paper/2002.05645","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:4607fac072d0c036ebe4915bffb06e857ef6aef74d743009e9c7dd2b6134afe3","observation_id":"14a0829f-bdb2-48d5-916a-ca38b86e1ebd","resolution":{"observed_at":"2026-08-07T06:00:32.422749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:35.945519Z","title":"Gpu-initiated on-demand high-throughput storage access in the bam system architecture","venue":null,"work_id":"a92e17a3-22c9-4f14-9bf9-e9a47085a177","year":2023},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.431974Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:aa0a6c1cd93456d91623e0ceebfea720588048b4797f16ad39996b4272626844","observation_id":"5047daf3-6af8-4ed3-8baa-742822822aaf","resolution":{"observed_at":"2026-08-07T06:00:36.064077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:32.441563Z","title":"Language models are unsupervised multitask learners.OpenAI blog, 1(8):9, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.441563Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:7186f0df78fe3dcec4c1f61dc5d659ca90aad462c06fa4e5bf55078335bbd45d","observation_id":"635b8491-36e0-499a-ae3f-3c6646cb1c40","resolution":{"observed_at":"2026-08-07T06:00:32.441563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:32.485821Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer.Journal of machine learning research, 21(140):1–67, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.485821Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:ea3f6ffa74766b78a4694dfa06c74297195460a9df855453b43319bc549cc094","observation_id":"01ad0130-5142-4528-bb29-3d84f7a75259","resolution":{"observed_at":"2026-08-07T06:00:32.485821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:35.671566Z","title":"Zero- infinity: Breaking the gpu memory wall for extreme scale deep learning","venue":null,"work_id":"59f90e35-0f95-46f3-b2f6-f0e58011c757","year":2021},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.546527Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:46a761675a44ec912ad01a4cf39485e37313fe2fce518c61040106330aa2973a","observation_id":"ea7d54cc-26f5-4bec-8c70-07fc2c4a603c","resolution":{"observed_at":"2026-08-07T06:00:35.776160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:35.474410Z","title":"{Zero-offload}: Democratizing{billion-scale}model training","venue":null,"work_id":"9e1ddcb8-376e-48e6-85f2-81bae9c9e610","year":2021},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.628054Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:e7b97175fa811170641eb2e09927c6e1e044e56ca197e95aacd1d1e5a8c58ee9","observation_id":"60312ea8-13a6-49bd-acc7-eda91f132159","resolution":{"observed_at":"2026-08-07T06:00:35.580069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:35.243006Z","title":"vdnn: Virtualizeddeepneuralnetworksforscalable,memory-efficientneuralnetworkdesign","venue":null,"work_id":"8790344b-a38e-4218-be73-25306fa89605","year":2016},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.723638Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:22238bdd13ecfae6727d22f40cec81c38cd72c1616aa52dd00fcf5d5167851de","observation_id":"612eff07-8439-4277-b73d-1afec967f1e8","resolution":{"observed_at":"2026-08-07T06:00:35.359528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:34.986450Z","title":"Building ai agents for autonomous clouds: Challenges and design principles","venue":null,"work_id":"a16adebc-39a0-4eb6-a394-b8c4017fa499","year":2024},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.812774Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:a14c9827d9c109e7e8d5f2711abda046d789a557f08570fb22fc5098efd9ab9b","observation_id":"fe8d81db-435b-4143-9666-f0460fa68928","resolution":{"observed_at":"2026-08-07T06:00:35.090008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:34.771023Z","title":"Stronghold: fast and affordable billion-scale deep learning model training","venue":null,"work_id":"46716bbd-be1d-4920-9af0-d0cdc88f89ae","year":2022},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.885983Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:632dce1b44805c38cab16fa968cc74c905f0481738eeeec169134ca0a5740da2","observation_id":"4899a902-1259-4f04-a872-4a13a2e6d2b3","resolution":{"observed_at":"2026-08-07T06:00:34.872110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:34.552023Z","title":"Superneurons: Dynamic gpu memory management for training deep neural networks","venue":null,"work_id":"9033cc5a-2321-4d13-9b51-7b3820e05cc8","year":2018},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.986663Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:f33377d258a45b600c8a8a7758a950bffd5a284600c466566c5e8a8bf53b47f7","observation_id":"87b62046-85c8-4127-ae0d-7ee6f187fbb5","resolution":{"observed_at":"2026-08-07T06:00:34.654946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:34.296452Z","title":"Netllm: Adapting large language models for networking","venue":null,"work_id":"44c4b2d0-6a76-447b-9cbc-e2c941c81ae6","year":2024},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:33.078030Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:2bb647a051a8f90591a010da5fd60faeeda5d018da2a70bb924e224699a81291","observation_id":"60397c44-59f8-443c-abe6-5f9a2c279258","resolution":{"observed_at":"2026-08-07T06:00:34.439392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10013","last_updated":"2025-02-15T22:39:05Z","snapshot_observed_at":"2026-08-10T07:33:18.087557Z","submitted_at":"2024-08-19T14:09:48Z","title":"SSDTrain: An Activation Offloading Framework to SSDs for Faster Large Language Model Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10013","snapshot_observed_at":"2026-08-07T06:00:33.164055Z","title":"Tba: Faster large language model training using ssd-based activation offloading.arXiv preprint arXiv:2408.10013, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:33.164055Z"},"links":{"cited_paper":"/paper/2408.10013","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:4af76681d7b8ad4dcbb62132d7afa5e8b26ea7105ebed0bf430820d0efa0973d","observation_id":"108aa304-7f91-4023-931c-365f0d00c4d5","resolution":{"observed_at":"2026-08-07T06:00:33.164055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:34.116754Z","title":"Acceleratingthetrainingoflargelanguagemodelsusingefficientactivation rematerializationandoptimalhybridparallelism","venue":null,"work_id":"6308b6ec-9f03-4a3a-b0ba-e3f42ac2760e","year":2024},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:33.266662Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:1bc68af797622d195fd6cd81a191f681736e2031a42e29d3deb8729a9ac4be12","observation_id":"57779a89-1c9f-4080-9835-0f54f9743c4d","resolution":{"observed_at":"2026-08-07T06:00:34.182335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:33.926398Z","title":"Zng: Architecting gpu multi-processors with new flash for scalable data analysis","venue":null,"work_id":"d3429b88-1450-4a13-979a-60d0f1a33d8a","year":2020},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:33.346043Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:bb831f127f30002602b0fa372c5a0909b35c39e8afd0f7e77285392ecedb990e","observation_id":"ca18bf44-aead-4cb4-bb78-9fb324554960","resolution":{"observed_at":"2026-08-07T06:00:34.008635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:33.724425Z","title":"Flashgpu: Placing new flash next to gpu cores","venue":null,"work_id":"02f76510-4e3b-44dd-ae49-1b61de32f4f5","year":2019},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:33.427109Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:b1040086011c089a73079efdf5150e0e6b50aa1f2f505cb3069fe24b57869dd5","observation_id":"f5f669cb-a2c0-4bdd-b073-8e9a4d7e7030","resolution":{"observed_at":"2026-08-07T06:00:33.797888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-10T04:45:33.225669Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2506.06472."}