{"as_of":"2026-08-24T02:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:905b9f0fdc29b3fbbd88079b2bb1279717cb2293b2e9e7b592aab8a33e210457","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:15:32.349029Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01150/citation-record","integrity":"/paper/2608.01150/integrity","json":"/paper/2608.01150/citation-record.json","paper":"/paper/2608.01150"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.188748Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.188748Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:940964228068b21e910a9bc82d8f26bff2e781fd2356abda6663b09e45b962cd","observation_id":"a5fc8679-088a-485f-8543-ab1afa874f32","resolution":{"observed_at":"2026-08-15T15:15:32.188748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.193111Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.193111Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:7ded8153f44c94bd0af75b364ff30df6178a0118df83a4c805d49346337d47b6","observation_id":"f12dde58-452d-463c-a765-940249e2a33d","resolution":{"observed_at":"2026-08-15T15:15:32.193111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.828183Z","title":"Video diffusion models,","venue":null,"work_id":"c06783d2-40f4-42c5-8484-792dcfc75251","year":2022},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.197182Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:c77ebbcb46f4a012994aac3b7e6dba9dcfd9446672bc90b044a95b329a102e52","observation_id":"f03725ed-5eac-4578-b7ad-24fa15033882","resolution":{"observed_at":"2026-08-15T15:15:32.831799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-15T15:15:32.201788Z","title":"Wan: Open and advanced large-scale video generative models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.201788Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:d7d169df4abc5f1e4df64d730bd293da2589d55e01ffeb3d18f8d04251dc116d","observation_id":"ec9d65f5-0ec1-4184-8190-1260e64cd12c","resolution":{"observed_at":"2026-08-15T15:15:32.201788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-15T15:15:32.206599Z","title":"Hunyuanvideo: A systematic framework for large video generative models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.206599Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:14dd7342bc7ae27dafff5b0e823e434e0f4e33691a241772cbda505828985bf7","observation_id":"cad41a26-92db-48ba-b7b3-a5706f3c1440","resolution":{"observed_at":"2026-08-15T15:15:32.206599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.817204Z","title":"Scalable diffusion models with transformers,","venue":null,"work_id":"fdbe9e8b-5074-44dd-b016-8172ed06168c","year":2023},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.210706Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:904c48e0597b7c29e22fc091f6c2b3de66c7031b0df5b016c6cf475243eaec46","observation_id":"489e89e8-d10e-45fc-94fa-058719397254","resolution":{"observed_at":"2026-08-15T15:15:32.821037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.805255Z","title":"FlashAttention: Fast and memory-efficient exact attention with IO-awareness,","venue":null,"work_id":"82f71c75-f86f-46f7-ae53-598491484849","year":2022},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.215169Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:334dde9bbc83993220f3038eb66b776601b962ee27cc04f11d161e13740fee6a","observation_id":"92a11a3a-192a-485e-9ca9-6e9799b778f4","resolution":{"observed_at":"2026-08-15T15:15:32.809929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.793686Z","title":"Efficient large-scale language model training on gpu clusters using megatron-lm,","venue":null,"work_id":"4397e749-7d74-4589-ad36-ff3708464fce","year":2021},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.219050Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:9452bf851f672aa3391e92f49dfed6084bb0d25fd13e488d5172fbbeb451f30e","observation_id":"c5e6ebba-e61a-4955-8440-e0486bb87467","resolution":{"observed_at":"2026-08-15T15:15:32.797283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18485","last_updated":"2024-06-26T16:51:28Z","snapshot_observed_at":"2026-08-21T09:06:10.859865Z","submitted_at":"2024-06-26T16:51:28Z","title":"LoongTrain: Efficient Training of Long-Sequence LLMs with Head-Context Parallelism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18485","snapshot_observed_at":"2026-08-15T15:15:32.222859Z","title":"LoongTrain: Efficient training of long-sequence LLMs with head-context parallelism,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.222859Z"},"links":{"cited_paper":"/paper/2406.18485","citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:7af58d44d3d49ffda77ae21b869e42fe5d6279f1c31e5de2a4a7b4d0e772ad31","observation_id":"8fe3a543-74a7-4560-951b-4140111e0926","resolution":{"observed_at":"2026-08-15T15:15:32.222859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.781954Z","title":"Hydraulis: Balancing large transformer model training via co-designing parallel strategies and data assignment,","venue":null,"work_id":"b12134a3-7af9-4e5e-94f9-66fb365e3309","year":2025},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.227032Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:ab173c8b14ad45de1dc9bd3f040973486f036b9e9e66d9fd4e3f693c77c05025","observation_id":"65124cf3-9c92-47c0-bfc7-2f529f99737e","resolution":{"observed_at":"2026-08-15T15:15:32.786376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.17923","last_updated":"2026-05-18T06:30:31Z","snapshot_observed_at":"2026-08-17T12:16:48.261937Z","submitted_at":"2026-05-18T06:30:31Z","title":"AdaptiveLoad: Towards Efficient Video Diffusion Transformer Training","version":1},"cited_work":{"arxiv_id":"2605.17923","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.17923","snapshot_observed_at":"2026-08-15T15:15:32.493928Z","title":"AdaptiveLoad: Towards Efficient Video Diffusion Transformer Training","venue":"cs.DC","work_id":"a41834fd-5a73-44cf-af97-43ed2059653e","year":2026},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.230926Z"},"links":{"cited_paper":"/paper/2605.17923","citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:9bf3f4b2fa9fed7161c583068ff036e18e0353571df80c01e3e4d4457f7814c6","observation_id":"08d349de-f6ca-40ab-a2d0-c803838ac21a","resolution":{"observed_at":"2026-08-15T15:15:32.498171Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07719","last_updated":"2024-07-02T09:03:26Z","snapshot_observed_at":"2026-08-16T13:53:11.380164Z","submitted_at":"2024-05-13T13:08:02Z","title":"USP: A Unified Sequence Parallelism Approach for Long Context Generative AI","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07719","snapshot_observed_at":"2026-08-15T15:15:32.235407Z","title":"Usp: A unified sequence parallelism approach for long context generative ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.235407Z"},"links":{"cited_paper":"/paper/2405.07719","citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:8b2e3c4174d84e51225e68d850596e1f2ab221d7854143cc27611f2b254b2fc9","observation_id":"612a43ee-98e6-454b-82cb-6fd9f5d237dd","resolution":{"observed_at":"2026-08-15T15:15:32.235407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06001","last_updated":"2025-08-08T04:06:08Z","snapshot_observed_at":"2026-08-17T05:31:24.267544Z","submitted_at":"2025-08-08T04:06:08Z","title":"KnapFormer: An Online Load Balancer for Efficient Diffusion Transformers Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.06001","snapshot_observed_at":"2026-08-15T15:15:32.239400Z","title":"Knapformer: An online load balancer for efficient diffusion transformers training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.239400Z"},"links":{"cited_paper":"/paper/2508.06001","citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:75abd1c014db764ccffdb561388804ee4266497b42bedaae3c142972fab41855","observation_id":"872be4a6-90d2-421e-81da-e70b65a48074","resolution":{"observed_at":"2026-08-15T15:15:32.239400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.771719Z","title":"Efficient approximation algorithms for schedul- ing moldable tasks,","venue":null,"work_id":"e64b2fa1-0bd8-475c-bb8a-fbf71ab6a866","year":2023},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.243440Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:675f8b2f323d086aeb5ad5b96ddbf08efcb6a51a47590a50bea675d404558dc1","observation_id":"7c46a1cd-8894-41e4-b2e9-bbafd0244e82","resolution":{"observed_at":"2026-08-15T15:15:32.775335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.761164Z","title":"The CP-SAT-LP solver,","venue":null,"work_id":"fb76a017-c5c0-4014-8738-0609a57c0454","year":2023},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.247098Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:1cb23ca47641adc0c8e3d5128b51e92cd5826798ec2fe946b07b0683a9533b48","observation_id":"4de1581d-bdcf-471d-b398-9b266e237084","resolution":{"observed_at":"2026-08-15T15:15:32.764685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.29207","last_updated":"2026-06-28T05:16:17Z","snapshot_observed_at":"2026-08-12T17:05:18.584525Z","submitted_at":"2026-06-28T05:16:17Z","title":"KernelFlume: Elastic Core-Attention Scaling for Agentic Long-Context Decoding","version":1},"cited_work":{"arxiv_id":"2606.29207","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.29207","snapshot_observed_at":"2026-08-15T15:15:32.457802Z","title":"KernelFlume: Elastic Core-Attention Scaling for Agentic Long-Context Decoding","venue":"cs.DC","work_id":"5b7513b3-ceee-4fc2-b699-a8d7707c232d","year":2026},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.250856Z"},"links":{"cited_paper":"/paper/2606.29207","citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:09d9d1a606f7366cac21b2be6ac8e1b823bcdd3d961072d449c0a2e3c7f94fdf","observation_id":"6544083a-6474-4221-a945-1dae82860697","resolution":{"observed_at":"2026-08-15T15:15:32.461915Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T15:15:32.254682Z","title":"The Llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.254682Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:a3f9238518e15f2f66356df26dfc80b1761a51ceb63a70045691d46999ad512b","observation_id":"837b6457-2650-479e-875f-162400866aee","resolution":{"observed_at":"2026-08-15T15:15:32.254682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14509","last_updated":"2023-10-04T16:51:13Z","snapshot_observed_at":"2026-08-20T06:29:44.483696Z","submitted_at":"2023-09-25T20:15:57Z","title":"DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14509","snapshot_observed_at":"2026-08-15T15:15:32.258413Z","title":"Deepspeed ulysses: System optimizations for enabling training of extreme long sequence transformer models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.258413Z"},"links":{"cited_paper":"/paper/2309.14509","citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:3c2a6c11e97af68a21a926ad0807b8e888c35525e8cc6e13622bfd01a49cd84f","observation_id":"076097e9-47ae-49fa-8be1-cae3bdebfb48","resolution":{"observed_at":"2026-08-15T15:15:32.258413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01889","last_updated":"2023-11-27T06:38:47Z","snapshot_observed_at":"2026-08-14T10:14:18.862721Z","submitted_at":"2023-10-03T08:44:50Z","title":"Ring Attention with Blockwise Transformers for Near-Infinite Context","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01889","snapshot_observed_at":"2026-08-15T15:15:32.262288Z","title":"Ring attention with blockwise transformers for near-infinite context,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.262288Z"},"links":{"cited_paper":"/paper/2310.01889","citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:8abb92a33d6cb3aa6e1cad3a8dc8a77d0d833d3f5b4d0f0249461884f98cc834","observation_id":"289ff20d-8ec5-450b-8aa8-ec0993e34715","resolution":{"observed_at":"2026-08-15T15:15:32.262288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.749733Z","title":"FlexSP: Accelerating large language model training via flexible sequence parallelism,","venue":null,"work_id":"d3642de5-9816-46d6-81a3-5732641fe720","year":2025},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.266235Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:a7aa11c4ec7e024ece4aa8e6ddcc32824a686ac464b0936a16da3ee1f2a99b3b","observation_id":"c529f7b5-1689-42c0-b8b6-9dee473393a4","resolution":{"observed_at":"2026-08-15T15:15:32.753748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.738863Z","title":"Performance modeling and evaluation of distributed deep learning frameworks on GPUs,","venue":null,"work_id":"d58213e7-e6d4-4c76-b6d1-c48bd4fe2a6f","year":2018},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.269898Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:da856a36083c144053907f8a656b9e690ad8f3b66c6f945854686c43d0eff630","observation_id":"3e7ab0ca-b352-48fc-922e-084adf3b081d","resolution":{"observed_at":"2026-08-15T15:15:32.743008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.728089Z","title":"FSMoE: A flexible and scalable training system for sparse mixture- of-experts models,","venue":null,"work_id":"1ba05902-4df9-4185-8ba9-ea3e3ac1034b","year":2025},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.273325Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:b26297a2d2e08f604bf97123f9e3aae52ef5a4c3da8117f86bfad6f9580b0039","observation_id":"f5ef6510-2594-4eae-9805-35706bcb9cbb","resolution":{"observed_at":"2026-08-15T15:15:32.731783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.717118Z","title":"Compass: Dissecting communication and computation operators for efficient LLM training,","venue":null,"work_id":"323caa72-0e76-4bb8-b962-90e28179fcd5","year":2026},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.276731Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:abcd7e6a25b465235944810e2f23a92e6510959d2b37083770434160e171d474","observation_id":"cb849d24-4175-414b-be75-a4f42f9c66e4","resolution":{"observed_at":"2026-08-15T15:15:32.721116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.705204Z","title":"MG-WFBP: Merging gradients wisely for ef- ficient communication in distributed deep learning,","venue":null,"work_id":"312b620e-9fe5-4d3a-b8b7-31be9ddc5eab","year":1903},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.280373Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:0f85b07cd7ca65f3b6378220c9a685dce073bf40e32637f6338cfe605b10d47c","observation_id":"c28beb0e-e71d-4852-adfe-ad6c6ee3ca6c","resolution":{"observed_at":"2026-08-15T15:15:32.709548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.693623Z","title":"DeAR: Acceler- ating distributed deep learning with fine-grained all-reduce pipelining,","venue":null,"work_id":"b9e14a8f-7d5e-4165-b622-fa2171e78bc5","year":2023},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.283764Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:98b8b23fc55f108faec4be493fc2fb1d269146e8367eb3e45999807ac7a25ebc","observation_id":"fe393279-63d8-44a3-b0c3-f03ce66a1966","resolution":{"observed_at":"2026-08-15T15:15:32.697906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.11136","last_updated":"2026-07-13T06:12:41Z","snapshot_observed_at":"2026-08-15T06:25:02.556963Z","submitted_at":"2026-07-13T06:12:41Z","title":"Xema: Efficient Diffusion Serving through Fine-Grained Memory Management and Auto-Configuration","version":1},"cited_work":{"arxiv_id":"2607.11136","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.11136","snapshot_observed_at":"2026-08-15T15:15:32.411201Z","title":"Xema: Efficient Diffusion Serving through Fine-Grained Memory Management and Auto-Configuration","venue":"cs.DC","work_id":"353645fa-3474-4ee6-a010-f49f26356329","year":2026},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.287337Z"},"links":{"cited_paper":"/paper/2607.11136","citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:f2f1f90fea350a78b6ef9edc8891bab0c6b094d3e10b3b313d1a6884c03e609a","observation_id":"eece71cd-dbb6-4e7d-9393-93ee73ab8f90","resolution":{"observed_at":"2026-08-15T15:15:32.415651Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.682803Z","title":"Reducing activation recomputation in large transformer models,","venue":null,"work_id":"fc11295d-7eee-4be6-9f84-b255ef41119d","year":2023},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.291096Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:cb57db65138b671eb2a9e3a405c9a6a8e5dcbd2f68915c1f8f0e81c5c795673f","observation_id":"a8d2bfe3-a1b7-4fac-9e9d-6ca2d2e2d32d","resolution":{"observed_at":"2026-08-15T15:15:32.686364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.672142Z","title":"On grouping for maximum homogeneity,","venue":null,"work_id":"b2f6df25-5326-497f-983d-1b8a3c8a687d","year":1958},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.294765Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:09e758f2505493292ed7372ae93ad7894864565afdcbddd30f64d330e213f3f0","observation_id":"21d29c0b-f8fa-4341-866e-5ff0cdd257ce","resolution":{"observed_at":"2026-08-15T15:15:32.675737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.660829Z","title":"On a bicriterion for- mulation of the problems of integrated system identification and system optimization,","venue":null,"work_id":"0a96ac1e-51c2-4c3f-9800-f1be132051f1","year":1971},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.298614Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:181d48406d10bd162ee0272e6535cb57bb7ead32d0f4c62cf7d036a735c8a5e8","observation_id":"bfd16d18-fac2-42ab-a7ba-983162e18c97","resolution":{"observed_at":"2026-08-15T15:15:32.664524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.650079Z","title":"Exploiting orbits in symmetric ILP,","venue":null,"work_id":"821949de-f267-4178-922d-346ca923bb1a","year":2003},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.302334Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:83ee601c870d3d6b952d873d969029fa01fffed31785aa7bde8e9bb558d5f4c1","observation_id":"993e3ffd-e88b-4f86-bbe2-ffe3c9d5936b","resolution":{"observed_at":"2026-08-15T15:15:32.653991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.637973Z","title":"Patch n’ pack: NaViT, a vision transformer for any aspect ratio and resolution,","venue":null,"work_id":"6ac88211-4b3a-4ab6-b7b7-f5e02d937338","year":2023},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.306203Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:1f38a803c2837ce94914b9f83ce10b24e6cefb089e2a98cc4970f0c7dde06357","observation_id":"7bb9c8ec-6407-42f4-b4ab-a1b86a3f7106","resolution":{"observed_at":"2026-08-15T15:15:32.642109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.626964Z","title":"Openvid-1m: A large-scale high-quality dataset for text-to-video generation,","venue":null,"work_id":"fb6b7296-db26-4001-9f68-27e520d18a4e","year":2025},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.310350Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:f0cd5c68acc5f91744398a45b8fd56a842addc6045c495c7a51df7590b75e15d","observation_id":"e5512ce5-a66a-4e8e-9f24-5f2bb18855cc","resolution":{"observed_at":"2026-08-15T15:15:32.630730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.615158Z","title":"Koala-36m: A large- scale video dataset improving consistency between fine-grained condi- tions and video content,","venue":null,"work_id":"85299801-5a57-4a9e-a000-8948e2e19544","year":2025},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.314161Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:e6d4aed158600880eb1942ee17bd57339e38a6304d9eae807aba1db3773ffa40","observation_id":"c3c05d19-9d1d-4e35-80ce-a4c60cbbb1ec","resolution":{"observed_at":"2026-08-15T15:15:32.619253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.604069Z","title":"DiffSynth-Studio,","venue":null,"work_id":"5fbf9f55-459f-477e-ab64-f71f3a50afcf","year":2023},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.318044Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:44772670daa0151280dd0407837b3d5433c288256d21108b55d5f9c15d0e6c34","observation_id":"40696fb4-d184-4527-a9e1-d925f6956c89","resolution":{"observed_at":"2026-08-15T15:15:32.607912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01738","last_updated":"2024-11-04T01:40:38Z","snapshot_observed_at":"2026-08-20T02:41:26.684657Z","submitted_at":"2024-11-04T01:40:38Z","title":"xDiT: an Inference Engine for Diffusion Transformers (DiTs) with Massive Parallelism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01738","snapshot_observed_at":"2026-08-15T15:15:32.321918Z","title":"xDiT: an inference engine for diffusion transformers (DiTs) with massive parallelism,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.321918Z"},"links":{"cited_paper":"/paper/2411.01738","citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:ed2797839412a1f95a75458f1abf7a4bc4d7f3f143820fdd358777c42091355f","observation_id":"118e6037-9b2e-436c-8a55-d3b87196a66f","resolution":{"observed_at":"2026-08-15T15:15:32.321918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.592110Z","title":"DSP: Dynamic sequence parallelism for multi-dimensional transform- ers,","venue":null,"work_id":"63c7897f-f411-4da1-b460-ad1a100717e3","year":2025},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.326241Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:6572b4e89e0d54a19c9da19e27955c2cc995a8c6e08fbba36337f4529d6c07e5","observation_id":"a50f2cf1-9829-4e9b-a603-1f2a2e3051c7","resolution":{"observed_at":"2026-08-15T15:15:32.596347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.580832Z","title":"PipeDiT: Accelerating diffusion trans- formers in video generation with task pipelining and model decoupling,","venue":null,"work_id":"c1f66d20-fb5f-48c4-a33b-1a7e11624a99","year":2026},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.329947Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:9a836fd08832676a923ed49ef59fbd5d08584decb605cd616af56a380524e2a3","observation_id":"820af163-f58f-4c84-ae5e-2628c9242588","resolution":{"observed_at":"2026-08-15T15:15:32.584664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.19163","last_updated":"2026-06-17T15:06:56Z","snapshot_observed_at":"2026-08-12T05:11:28.707675Z","submitted_at":"2026-06-17T15:06:56Z","title":"Pulse: Training Acceleration for Large Diffusion Models with Automatic Pipeline Parallelism","version":1},"cited_work":{"arxiv_id":"2606.19163","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.19163","snapshot_observed_at":"2026-08-15T15:15:32.380641Z","title":"Pulse: Training Acceleration for Large Diffusion Models with Automatic Pipeline Parallelism","venue":"cs.DC","work_id":"7549093b-9ef8-427d-8940-4101760f3f3e","year":2026},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.333926Z"},"links":{"cited_paper":"/paper/2606.19163","citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:190c8f6b3c67d2ed3d2aa59b83301ee20dd541e45089c11f315fe99c96b1b2a7","observation_id":"3d481540-186e-49f8-b96d-d8e190c7e3d1","resolution":{"observed_at":"2026-08-15T15:15:32.387036Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.569647Z","title":"Enabling parallelism hot switching for efficient training of large language models,","venue":null,"work_id":"15c510e6-fb08-4522-ba6d-510676108aec","year":2024},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.337904Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:13dd5b3c0cf12d2dad4477a0b0fbbca69325a23628d92b58c83978cd9c396825","observation_id":"bef61d2d-17c0-444b-915f-b0c29c598ff9","resolution":{"observed_at":"2026-08-15T15:15:32.573530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.558941Z","title":"ByteScale: Communication-efficient scaling of LLM training with a 2048k context length on 16384 GPUs,","venue":null,"work_id":"bf493918-2dea-48e8-bb0a-b5733096f30e","year":2025},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.341692Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:5832363182c2f79f86935f02d24aaefbdbc00ac2668867dd3df4f7937748adb1","observation_id":"27eb7e1e-7c22-4707-bbcc-9d7a4a282d6c","resolution":{"observed_at":"2026-08-15T15:15:32.562721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.547536Z","title":"DCP: Addressing input dynamism in long-context training via dynamic context parallelism,","venue":null,"work_id":"0127548e-2800-4dba-bdde-759bc0c62b68","year":2025},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.345495Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:727cb189981e09b30e5cc690f41fd1fc9ec09f6e7b94b960a91e1fea6a08306b","observation_id":"d368ca5f-55b9-4e87-9fb8-c028b4f667bd","resolution":{"observed_at":"2026-08-15T15:15:32.551726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:15:32.535992Z","title":"High-quality hypergraph partitioning,","venue":null,"work_id":"5a6b197d-e998-4ed9-93b7-a35bb4eb7a5a","year":2022},"citing_paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T15:15:32.349029Z"},"links":{"citing_paper":"/paper/2608.01150"},"observation_digest":"sha256:6e4f3d9b1f93ee67aac2fe4d707426e1d8b7cf3df5b0d60dec5e191bb50a8e2c","observation_id":"560182d7-ad4c-4748-ba6d-985d11f89c10","resolution":{"observed_at":"2026-08-15T15:15:32.539724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.01150","last_updated":"2026-08-02T11:00:33Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-20T07:50:17.356086Z","submitted_at":"2026-08-02T11:00:33Z","title":"Zellige: Moldable Sequence Placement for Mixed Image-Video DiT Training"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":4,"verified_fuzzy":27},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2608.01150."}