{"as_of":"2026-08-18T17:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2418b3a36cc4089dd31410523606f36d9285190264353924af860fbdc9735085","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:05:06.570203Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T05:50:05.685350Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T22:21:18.726162Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13497","snapshot_observed_at":"2026-08-04T12:55:10.421426Z","title":"arXiv:2506.13497 [cs.DC]https://arxiv.org/abs/2506","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.01565","last_updated":"2026-06-18T01:08:24Z","snapshot_observed_at":"2026-08-10T05:37:30.922463Z","submitted_at":"2025-10-02T01:23:32Z","title":"TetriServe: Efficiently Serving Mixed DiT Workloads","version":4},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T12:55:10.421426Z"},"links":{"cited_paper":"/paper/2506.13497","citing_paper":"/paper/2510.01565"},"observation_digest":"sha256:21923d19e6038ecd01d2fe0b36998972c01270b59c88c4bfc137dc94c7b400cc","observation_id":"9a2ef9ec-b0c1-4e4e-a98b-33d034fd302d","resolution":{"observed_at":"2026-08-04T12:55:10.421426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"cited_work":{"arxiv_id":"2506.13497","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13497","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ddit: Dynamic resource allocation for diffusion transformer model serv- ing","venue":null,"work_id":"e4f4664b-f7c5-4b87-a140-44f2d678a86e","year":2025},"citing_paper":{"arxiv_id":"2512.14098","last_updated":"2026-04-15T20:49:22Z","snapshot_observed_at":"2026-08-13T18:47:32.702606Z","submitted_at":"2025-12-16T05:14:41Z","title":"Cornfigurator: Automated Planning for Any-to-Any Multimodal Model Serving","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T22:20:48.239186Z"},"links":{"cited_paper":"/paper/2506.13497","citing_paper":"/paper/2512.14098"},"observation_digest":"sha256:57450f6ce11a457cec1fa06b926368eb9d33879ee52e8d3f8a4779a9b6e82fe3","observation_id":"f6f3628e-fe3b-432f-b7ef-a3c3167ffe19","resolution":{"observed_at":"2026-05-16T22:21:18.728402Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"cited_work":{"arxiv_id":"2506.13497","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13497","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ddit: Dynamic resource allocation for diffusion transformer model serv- ing","venue":null,"work_id":"e4f4664b-f7c5-4b87-a140-44f2d678a86e","year":2025},"citing_paper":{"arxiv_id":"2602.18109","last_updated":"2026-04-14T06:55:12Z","snapshot_observed_at":"2026-08-11T12:15:03.868955Z","submitted_at":"2026-02-20T09:56:23Z","title":"TempoNet: Slack-Quantized Transformer-Guided Reinforcement Scheduler for Adaptive Deadline-Centric Real-Time Dispatchs","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-15T21:11:07.026338Z"},"links":{"cited_paper":"/paper/2506.13497","citing_paper":"/paper/2602.18109"},"observation_digest":"sha256:b78007ca36f26e9a2b339753811c7c1c0984fd6737ef0047258d5d270feed060","observation_id":"1b0d1033-9fa6-4c35-ade5-39a3c39b7347","resolution":{"observed_at":"2026-05-15T21:11:37.593778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"cited_work":{"arxiv_id":"2506.13497","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.13497","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ddit: Dynamic resource allocation for diffusion transformer model serv- ing","venue":null,"work_id":"e4f4664b-f7c5-4b87-a140-44f2d678a86e","year":2025},"citing_paper":{"arxiv_id":"2604.04335","last_updated":"2026-04-08T20:38:36Z","snapshot_observed_at":"2026-08-15T01:15:26.638476Z","submitted_at":"2026-04-06T01:02:02Z","title":"GENSERVE: Efficient Co-Serving of Heterogeneous Diffusion Model Workloads","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T20:22:20.395250Z"},"links":{"cited_paper":"/paper/2506.13497","citing_paper":"/paper/2604.04335"},"observation_digest":"sha256:d2f1dac7e42b1bb0e452ed58713a09211a549cf1596123860d43ad72e4d1b38d","observation_id":"4bbc630b-c53c-4645-aa4b-496032172d23","resolution":{"observed_at":"2026-05-10T22:00:47.892092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13497","snapshot_observed_at":"2026-08-14T05:50:05.685350Z","title":"DDiT: Dynamic resource allocation for diffusion transformer model serving.arXiv preprint arXiv:2506.13497, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13499","last_updated":"2026-08-13T17:28:54Z","snapshot_observed_at":"2026-08-18T05:00:25.393700Z","submitted_at":"2026-08-13T17:28:54Z","title":"OpScale: Operator-level Provisioning and Autoscaling for LLM Serving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T05:50:05.685350Z"},"links":{"cited_paper":"/paper/2506.13497","citing_paper":"/paper/2608.13499"},"observation_digest":"sha256:7ba7589aee5f65d742fb53623cf7e62ef3d9b9c4eeae124ed621d08964cce534","observation_id":"b65cc737-39d8-4e89-85c3-5b3c43cb3795","resolution":{"observed_at":"2026-08-14T05:50:05.685350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.13497/citation-record","integrity":"/paper/2506.13497/integrity","json":"/paper/2506.13497/citation-record.json","paper":"/paper/2506.13497"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.266746Z","title":"Deepspeed-inference: enabling efficient inference of transformer models at unprecedented scale","venue":null,"work_id":"335b7fa5-f43f-4ad7-ac09-907983d46180","year":2022},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.255892Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:fa472121583b994a8043bad8ef68b907036e2c651f12bbf738931e71c16c391f","observation_id":"c09a5e5e-d814-4ed1-ab2f-5e7d317a18d1","resolution":{"observed_at":"2026-08-15T20:05:07.270814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-17T12:45:30.627161Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-15T20:05:06.261017Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.261017Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:b5c54c7893d889ce6f2426090033ed0e98294575a31b5579fa286e6b85a9a716","observation_id":"94aae542-5cd2-4d01-806a-9ebb3ebd61f7","resolution":{"observed_at":"2026-08-15T20:05:06.261017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09431","last_updated":"2023-11-15T23:01:02Z","snapshot_observed_at":"2026-08-17T19:29:18.923800Z","submitted_at":"2023-11-15T23:01:02Z","title":"Striped Attention: Faster Ring Attention for Causal Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09431","snapshot_observed_at":"2026-08-15T20:05:06.265472Z","title":"Striped atten- tion: Faster ring attention for causal transformers.arXiv preprint arXiv:2311.09431, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.265472Z"},"links":{"cited_paper":"/paper/2311.09431","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:581e6d2496f89c48d74f4e2bc6a5b14a541fdcf8c68d11223c02ea512b4861aa","observation_id":"828659ad-2bf4-48ac-892d-6e32b7519cd2","resolution":{"observed_at":"2026-08-15T20:05:06.265472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.253472Z","title":"Pixart- 𝑠𝑖𝑔𝑚𝑎: Weak-to-strong training of diffusion transformer for 4k text- to-image generation","venue":null,"work_id":"865f2e28-81ba-41ab-9b17-a15aaa40258f","year":2025},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.270988Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:aa5bd18e11dd2d62d22e1a5de22d737d4fae75d03524734c3f202c8aee26ec56","observation_id":"b4a73874-3515-4696-8bcb-5fe23b0f43b8","resolution":{"observed_at":"2026-08-15T20:05:07.257922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01125","last_updated":"2024-06-03T09:10:44Z","snapshot_observed_at":"2026-08-16T13:46:50.271264Z","submitted_at":"2024-06-03T09:10:44Z","title":"$\\Delta$-DiT: A Training-Free Acceleration Method Tailored for Diffusion Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01125","snapshot_observed_at":"2026-08-15T20:05:06.275248Z","title":"arXiv preprint arXiv:2406.01125, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.275248Z"},"links":{"cited_paper":"/paper/2406.01125","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:70b605d5bf7813ad4bd09851db50c4f35572d06a0031ab0a032ceca1c16679de","observation_id":"a7ae735a-73f9-4479-b255-dcd01a0bd2da","resolution":{"observed_at":"2026-08-15T20:05:06.275248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.241318Z","title":"Flashattention: Fast and memory-efficient exact attention with io- awareness.Advances in Neural Information Processing Systems, 2022","venue":null,"work_id":"9315ce65-6782-4fe3-a04b-9d0dde9fc177","year":2022},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.279204Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:329715aefeb6d506d1f826736614d76071707640ca9ffd81b148e9a04114f045","observation_id":"7cab8db1-c386-4cdb-b789-a0f4acde07f1","resolution":{"observed_at":"2026-08-15T20:05:07.245832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.228802Z","title":"Addison-Wesley, 2013","venue":null,"work_id":"c50e1e48-2423-42ae-a4f9-2217e970c76f","year":2013},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.283294Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:684411146251069e167dc63e482930b0279b688868d18788dbeac01d03a0a3ed","observation_id":"5e3a6cfc-2a7f-4aa2-b222-41677c3b4395","resolution":{"observed_at":"2026-08-15T20:05:07.232935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01738","last_updated":"2024-11-04T01:40:38Z","snapshot_observed_at":"2026-08-16T13:03:20.618441Z","submitted_at":"2024-11-04T01:40:38Z","title":"xDiT: an Inference Engine for Diffusion Transformers (DiTs) with Massive Parallelism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01738","snapshot_observed_at":"2026-08-15T20:05:06.314626Z","title":"xdit: an inference engine for diffusion transformers (dits) with massive parallelism.arXiv preprint arXiv:2411.01738, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.314626Z"},"links":{"cited_paper":"/paper/2411.01738","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:964dcf4a2d96dd0fd5dfb127376a41fea741f963b6ba3886154d8544ff3a0db4","observation_id":"3bcb97a0-d7f1-4d54-ae57-efeb117cd17d","resolution":{"observed_at":"2026-08-15T20:05:06.314626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.217369Z","title":null,"venue":null,"work_id":"bbe2033f-ce7a-42aa-a797-3a0c8b077dea","year":null},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.373071Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:d57dc44c0144e0375cf6b499530d16d0daa358599197009bc64254ad71c74bdc","observation_id":"86101e07-82d0-46b6-b1c6-95170c33cf35","resolution":{"observed_at":"2026-08-15T20:05:07.221063Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.206451Z","title":"Reevaluating amdahl’s law.Communications of the ACM, 31(5):532–533, 1988","venue":null,"work_id":"7967687b-83ce-491f-afc0-077094d236ed","year":1988},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.383705Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:d062becadbcd5d9914849407f9e39e8a017100d2d2da4f88d423d3ff37f43f56","observation_id":"7e27dc85-5be4-44fe-a8a1-c201f82d6e72","resolution":{"observed_at":"2026-08-15T20:05:07.209870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:06.388256Z","title":"Denoising diffusion prob- abilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.388256Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:23fc5c434c09b78cbb8e140b6ed2b9899d9be2f7cb7912bc31bb9afed16445f6","observation_id":"f3d74ff0-29ce-44d0-b1ef-37740abf3c8b","resolution":{"observed_at":"2026-08-15T20:05:06.388256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01282","last_updated":"2024-01-05T12:41:13Z","snapshot_observed_at":"2026-08-16T14:46:31.226431Z","submitted_at":"2023-11-02T14:57:03Z","title":"FlashDecoding++: Faster Large Language Model Inference on GPUs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01282","snapshot_observed_at":"2026-08-15T20:05:06.391434Z","title":"Flashdecoding++: Faster large language model inference on gpus.arXiv preprint arXiv:2311.01282, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.391434Z"},"links":{"cited_paper":"/paper/2311.01282","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:00c466c2153e3fa2708af62d90ecaf520542e2b4e6db7689de88078781e21d19","observation_id":"1d89c164-e0b3-46e0-992b-f5fc0d686405","resolution":{"observed_at":"2026-08-15T20:05:06.391434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.187196Z","title":null,"venue":null,"work_id":"fd0a2c7d-ac35-48d3-9a31-033965fd6cd7","year":null},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.395037Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:63d3ab179194f6d155b5fed1adc3bca2698f5dffe31aefa11c538b9a14bd0cc5","observation_id":"2e0ac90f-a911-4c1e-95cc-3e0b02964cc2","resolution":{"observed_at":"2026-08-15T20:05:07.191561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.175837Z","title":null,"venue":null,"work_id":"e3891b22-151b-496f-9ea4-239e313c47d6","year":null},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.399663Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:0e518094508f004b0f4c179d486f387464a46618817f4e8bd0e630a0defba765","observation_id":"e05d157c-4b43-483b-9d7f-2d1f0c8fb6e7","resolution":{"observed_at":"2026-08-15T20:05:07.179779Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17565","last_updated":"2024-12-21T13:55:49Z","snapshot_observed_at":"2026-08-18T10:15:29.605221Z","submitted_at":"2024-06-25T14:02:08Z","title":"MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17565","snapshot_observed_at":"2026-08-15T20:05:06.403634Z","title":"Memserve: Context caching for disaggregated llm serving with elastic memory pool.arXiv preprint arXiv:2406.17565, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.403634Z"},"links":{"cited_paper":"/paper/2406.17565","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:a37cdceace576aa961f0e59d07d1a44c74ff4b626dd75b228b5454e14dc0ef98","observation_id":"2b28b665-4e13-4260-b651-c556cecf1b01","resolution":{"observed_at":"2026-08-15T20:05:06.403634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11181","last_updated":"2024-01-20T09:43:36Z","snapshot_observed_at":"2026-08-16T14:25:57.735259Z","submitted_at":"2024-01-20T09:43:36Z","title":"Inference without Interference: Disaggregate LLM Inference for Mixed Downstream Workloads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11181","snapshot_observed_at":"2026-08-15T20:05:06.408108Z","title":"Inference without interference: Disaggregate llm inference for mixed downstream workloads.arXiv preprint arXiv:2401.11181, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.408108Z"},"links":{"cited_paper":"/paper/2401.11181","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:9ff3bf53a814f9e24d5b0510b2494c313486a07d4a3e15a311dc1dc934de99c9","observation_id":"a1981db8-ea96-454b-9268-7f2ef1bc6c00","resolution":{"observed_at":"2026-08-15T20:05:06.408108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:06.412347Z","title":"Reducing activation recomputation in large transformer models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.412347Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:e61f5069585a42374f5d473890193e6499e972facae82823d1cb425eb5943d49","observation_id":"fbe8a1b0-52fe-455c-a9ed-96937d17beb7","resolution":{"observed_at":"2026-08-15T20:05:06.412347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.156966Z","title":null,"venue":null,"work_id":"85ffe368-77ed-47b0-b647-b1135e7f84ee","year":null},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.416218Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:670282966fc9d9f1ea5dc3c2dc5c8929485bdeceff0b4e4090ccb228fdef43fb","observation_id":"a7303ded-12f3-40b5-8960-706a99dd863c","resolution":{"observed_at":"2026-08-15T20:05:07.160710Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:06.420247Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.420247Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:ce2cddb2f8637241e85919fc615b55ebac8bfe22fceda45dfa98fce091da44c1","observation_id":"09665ae3-4dec-4ee0-8318-85a5adf32044","resolution":{"observed_at":"2026-08-15T20:05:06.420247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:06.423782Z","title":"Distrifusion: Distributed parallel inference for high-resolution diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.423782Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:ffd4695f1e735fb144c5ad9540576dc82b826ca7e1a172366038fc167ef14b73","observation_id":"952f23a5-0eba-4af8-bb54-21dd21d43d11","resolution":{"observed_at":"2026-08-15T20:05:06.423782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.13120","last_updated":"2022-05-21T06:03:54Z","snapshot_observed_at":"2026-08-16T18:22:05.145735Z","submitted_at":"2021-05-26T13:40:58Z","title":"Sequence Parallelism: Long Sequence Training from System Perspective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.13120","snapshot_observed_at":"2026-08-15T20:05:06.427406Z","title":"Sequence parallelism: Long sequence training from system per- spective.arXiv preprint arXiv:2105.13120, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.427406Z"},"links":{"cited_paper":"/paper/2105.13120","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:43608615110d22b4f0be58ceb3a67f13a30b8e07f219520aa525c2635d7f2546","observation_id":"a0c45c94-03ed-4298-807c-f99269844f3c","resolution":{"observed_at":"2026-08-15T20:05:06.427406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02031","last_updated":"2024-12-06T11:47:06Z","snapshot_observed_at":"2026-08-16T13:37:50.939365Z","submitted_at":"2024-07-02T07:59:08Z","title":"SwiftDiffusion: Efficient Diffusion Model Serving with Add-on Modules","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02031","snapshot_observed_at":"2026-08-15T20:05:06.431371Z","title":"Swiftdiffusion: Efficient diffusion model serving with add-on modules.arXiv preprint arXiv:2407.02031, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.431371Z"},"links":{"cited_paper":"/paper/2407.02031","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:4d5c9dd43ff07cfecbdf7600f77b29395f074b0e84a3e9168cd7a0bda9c75364","observation_id":"776d4615-57c6-40fd-a9f9-3beffd53da02","resolution":{"observed_at":"2026-08-15T20:05:06.431371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:06.435356Z","title":"A survey of convolutional neural networks: analysis, applications, and prospects.IEEE transactions on neural networks and learning systems, 33(12):6999–7019, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.435356Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:f4c16b701238fcc3c69c009fb4997d137f14f95c707e3a254c2bf2eadaa0b2bd","observation_id":"af10252a-5900-40b1-89c2-42ca4bdd52ce","resolution":{"observed_at":"2026-08-15T20:05:06.435356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.123159Z","title":"Train big, then compress: Rethinking model size for efficient training and inference of transformers","venue":null,"work_id":"12a57a84-8147-4832-ab31-dcb2757d0b0d","year":2020},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.439215Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:caad5d228da4592a77b24d7c32554b13843dbb7e858a92286ca105c7a9046978","observation_id":"0dd30c49-bbdd-4909-b771-32f1353fb0bb","resolution":{"observed_at":"2026-08-15T20:05:07.127227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-08-13T21:19:07.777045Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00131","snapshot_observed_at":"2026-08-15T20:05:06.442913Z","title":"Open- sora plan: Open-source large video generation model.arXiv preprint arXiv:2412.00131, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.442913Z"},"links":{"cited_paper":"/paper/2412.00131","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:ca478d484bf66df2ea897016bf06bf668409fd528d44601cb22b4cae5d881023","observation_id":"a6432ccc-f1db-4715-9c72-16c4fe52b485","resolution":{"observed_at":"2026-08-15T20:05:06.442913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01889","last_updated":"2023-11-27T06:38:47Z","snapshot_observed_at":"2026-08-14T10:14:18.862721Z","submitted_at":"2023-10-03T08:44:50Z","title":"Ring Attention with Blockwise Transformers for Near-Infinite Context","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01889","snapshot_observed_at":"2026-08-15T20:05:06.446955Z","title":"Ring attention with blockwise transformers for near-infinite context.arXiv preprint arXiv:2310.01889, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.446955Z"},"links":{"cited_paper":"/paper/2310.01889","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:100934d139a18cec439f89546c20b5a1076048125da9d4960d50334a427b7c5f","observation_id":"450a7e55-a72c-4049-af69-f0861dc39779","resolution":{"observed_at":"2026-08-15T20:05:06.446955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.111112Z","title":"Deepcache: Accelerat- ing diffusion models for free","venue":null,"work_id":"cde6efcb-b9e0-4947-b3ac-51282a2a5019","year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.451188Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:7969354386344e5dfefabc36833d53edb0b7f2b64616fa8dd324fe1d2d8e3192","observation_id":"8eb1b57e-b2f9-4a53-ace4-a9aca481b5de","resolution":{"observed_at":"2026-08-15T20:05:07.115490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.08877","last_updated":"2021-12-14T06:19:33Z","snapshot_observed_at":"2026-08-16T18:02:11.360736Z","submitted_at":"2021-08-19T18:58:02Z","title":"Sentence-T5: Scalable Sentence Encoders from Pre-trained Text-to-Text Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.08877","snapshot_observed_at":"2026-08-15T20:05:06.454723Z","title":"Sentence-t5: Scalable sen- tence encoders from pre-trained text-to-text models.arXiv preprint arXiv:2108.08877, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.454723Z"},"links":{"cited_paper":"/paper/2108.08877","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:903b5e9be75da5b0769b2ccb90e34bd577af2fdd156db4494059c0d5f016070d","observation_id":"fd8191b9-2d46-4a62-8345-626b778740f3","resolution":{"observed_at":"2026-08-15T20:05:06.454723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.099818Z","title":"The design process for google’s training chips: Tpuv2 and tpuv3.IEEE Micro, 41(2):56–63, 2021","venue":null,"work_id":"4e9a0fa9-d11d-40ed-bf97-7cc526bab54f","year":2021},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.459888Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:fb6422b0958782bbaf29502d202004ae0d467cab0b556bb5a9647cbe6da537ea","observation_id":"ef0325db-7c96-4ea0-9f29-35f78e5c1ded","resolution":{"observed_at":"2026-08-15T20:05:07.103618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.086542Z","title":"NCCL.https://docs.nvidia.com/deeplearning/nccl/user- guide/docs/overview.html","venue":null,"work_id":"bd2bb797-ff74-4723-92b4-ce1cc365effa","year":null},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.464126Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:95d7527c52ff254b20ab81de79e2c80d0b9741133ee13da9a90c950bfed39ff5","observation_id":"7d4bd50a-5f2c-499d-8c1b-33771e994039","resolution":{"observed_at":"2026-08-15T20:05:07.090777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.073353Z","title":null,"venue":null,"work_id":"ae41f734-959e-4b1a-b4da-a64ffb14fe33","year":null},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.468166Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:c02142112e9b8d1862ad7865c25db934f7efdf10cd3a90500bd8c44c5104dae8","observation_id":"9c56a28e-6aa1-4617-a7a0-e656c98e93d8","resolution":{"observed_at":"2026-08-15T20:05:07.077374Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18677","last_updated":"2024-05-20T15:37:36Z","snapshot_observed_at":"2026-08-16T14:38:46.729665Z","submitted_at":"2023-11-30T16:24:42Z","title":"Splitwise: Efficient generative LLM inference using phase splitting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18677","snapshot_observed_at":"2026-08-15T20:05:06.472326Z","title":"Splitwise: Efficient genera- tive llm inference using phase splitting.arXiv preprint arXiv:2311.18677, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.472326Z"},"links":{"cited_paper":"/paper/2311.18677","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:98137b158e62e222097e42a16d6a21cef7662d3b39cdb23bdc7f182612be6f0a","observation_id":"515dfd6f-029b-4467-b878-13b93cd913bc","resolution":{"observed_at":"2026-08-15T20:05:06.472326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:06.476265Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.476265Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:bb820a588ad0e9786728690e90c92842c67a328603f2f451899acbf78ef429fb","observation_id":"f976183c-5317-4335-985d-282c1099f744","resolution":{"observed_at":"2026-08-15T20:05:06.476265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.052526Z","title":"Variational autoencoder","venue":null,"work_id":"fa78c115-622a-47d2-bc3c-bafceba8edde","year":2021},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.480002Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:2e85b79b3001c15da159bf0830a0a74fc549da7afee6fb484d84dc1bf03a4751","observation_id":"42600dd4-2549-455e-96b7-992e377d7a46","resolution":{"observed_at":"2026-08-15T20:05:07.057332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.12922","last_updated":"2020-10-16T19:22:57Z","snapshot_observed_at":"2026-07-06T09:59:10.348334Z","submitted_at":"2020-09-27T18:41:32Z","title":"Seagull: An Infrastructure for Load Prediction and Optimized Resource Allocation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.12922","snapshot_observed_at":"2026-08-15T20:05:06.483437Z","title":"Seagull: An infrastructure for load predic- tion and optimized resource allocation.arXiv preprint arXiv:2009.12922, 2020","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.483437Z"},"links":{"cited_paper":"/paper/2009.12922","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:2b797e98a6eae30f5465f4e9ed2e7df53c93937c447551bfa800e60391431c27","observation_id":"809ed3dd-6705-4ed1-9ba5-c7688ce26c2f","resolution":{"observed_at":"2026-08-15T20:05:06.483437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.040516Z","title":"A remark on stirling’s formula.The American mathematical monthly, 62(1):26–29, 1955","venue":null,"work_id":"4afe4b37-8a4b-4c8a-8dc7-4725dbd1fbb6","year":1955},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.486911Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:5a3c043d77d7f38311537de33c81cf76fcbb283935935d60c485a2b0d4910b44","observation_id":"fc481b10-0b48-4be1-a105-321f9ce13c9c","resolution":{"observed_at":"2026-08-15T20:05:07.044921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.027664Z","title":null,"venue":null,"work_id":"dda675e7-479c-42d0-bc6f-dd6e27fc9258","year":null},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.490338Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:2c13d9eacccb2b0d17a5285252b5620510bb6a4e57458f8f1f67381b13c908e6","observation_id":"ae3ab585-60f0-4e23-aab9-ff770706ee90","resolution":{"observed_at":"2026-08-15T20:05:07.031371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01425","last_updated":"2024-07-01T16:14:37Z","snapshot_observed_at":"2026-08-16T13:38:03.111467Z","submitted_at":"2024-07-01T16:14:37Z","title":"FORA: Fast-Forward Caching in Diffusion Transformer Acceleration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01425","snapshot_observed_at":"2026-08-15T20:05:06.493639Z","title":"Fora: Fast-forward caching in diffusion transformer 13 acceleration.arXiv preprint arXiv:2407.01425, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.493639Z"},"links":{"cited_paper":"/paper/2407.01425","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:2dbdc08549151074e3b57e1312765ee07156b221717c57d82cd3aa1d9a314ce2","observation_id":"d853f804-380e-479a-837c-d3899bdeed23","resolution":{"observed_at":"2026-08-15T20:05:06.493639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-08-12T10:50:46.357243Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-15T20:05:06.496920Z","title":"Megatron-lm: Training multi- billion parameter language models using model parallelism.arXiv preprint arXiv:1909.08053, 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.496920Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:0687a0ed5cfdfecdafb288da36d17b73a696eef8cda33b1d86cd454c07898947","observation_id":"9717fb87-54e7-4425-84f3-b90446bb1b6e","resolution":{"observed_at":"2026-08-15T20:05:06.496920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.014198Z","title":"Fundamentals of queueing theory, volume 399","venue":null,"work_id":"8b35365c-4c7b-430a-972a-3358153a5a73","year":2018},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.500900Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:1cc092d5546ecd31ffb7b3b2b2005e402fb19819b70c375bbe1dd2dd261892ec","observation_id":"99f9ae0c-df2e-46f9-8b48-d7b9731a8442","resolution":{"observed_at":"2026-08-15T20:05:07.019142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:07.000548Z","title":"Rpc: Remote procedure call protocol specification version 2","venue":null,"work_id":"9e251aaf-0a43-45f1-a512-cc45c33739b6","year":1995},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.504641Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:83e212f3e1fa009e6dcea57eb52197c6dc863bccddd68fb3740c0b0fea59d904","observation_id":"5e8346e6-8498-41a0-9e8f-2e61557b7111","resolution":{"observed_at":"2026-08-15T20:05:07.005583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09741","last_updated":"2023-05-30T15:22:50Z","snapshot_observed_at":"2026-08-16T16:07:34.137342Z","submitted_at":"2022-12-19T18:57:05Z","title":"One Embedder, Any Task: Instruction-Finetuned Text Embeddings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09741","snapshot_observed_at":"2026-08-15T20:05:06.508413Z","title":"One embedder, any task: Instruction-finetuned text embeddings","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.508413Z"},"links":{"cited_paper":"/paper/2212.09741","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:b20059b03fa6b5700dbe14ab5d136c26b6e0aee8b09d8a853fc62a5a104840fe","observation_id":"39163bc3-5ad0-4b37-af08-44df92dbeaea","resolution":{"observed_at":"2026-08-15T20:05:06.508413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:06.984070Z","title":"Videosys: An easy and efficient system for video generation, 2024","venue":null,"work_id":"4ebf341d-9684-45a3-9158-8113cdb7faca","year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.512520Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:cad9c384e36f2dd0c1c94f0759918bcd4003cdc8173ff0029d64efa264eca818","observation_id":"1f8c96ef-7309-463a-a795-4d3ed50d2009","resolution":{"observed_at":"2026-08-15T20:05:06.989202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:06.969840Z","title":"New and old results for the m/d/c queue.AEU- International Journal of Electronics and Communications, 60(2):125–130, 2006","venue":null,"work_id":"1a61860b-7ea4-45dc-9690-604fceda2eef","year":2006},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.516173Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:c16cd343a026d61941b6269446020af6029306c0113aa8fc4c0b5f3573ef31ad","observation_id":"f28349fa-4562-4a07-8c44-ed35d4692974","resolution":{"observed_at":"2026-08-15T20:05:06.975467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14430","last_updated":"2025-12-03T10:59:23Z","snapshot_observed_at":"2026-08-16T19:24:02.063445Z","submitted_at":"2024-05-23T11:00:07Z","title":"PipeFusion: Patch-level Pipeline Parallelism for Diffusion Transformers Inference","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14430","snapshot_observed_at":"2026-08-15T20:05:06.519810Z","title":"Pipefu- sion: Displaced patch pipeline parallelism for inference of diffusion transformer models.arXiv preprint arXiv:2405.14430, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.519810Z"},"links":{"cited_paper":"/paper/2405.14430","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:21e5517db45f5c51decdd7762b3520d52be4234e364781f9ae4207a50094f89f","observation_id":"3ceda22f-ceb0-4af3-a2cf-929ddfc0923d","resolution":{"observed_at":"2026-08-15T20:05:06.519810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:06.956377Z","title":"NVLink.https://en.wikipedia.org/wiki/NVLink","venue":null,"work_id":"25ee7da0-9796-467c-a750-2feefd4cac33","year":null},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.523938Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:e6321562b6260100064091a2e4899b61aada61ee7f2a77e00fa3cbb2e4f6f82c","observation_id":"4a57b75d-e3bb-4783-8b24-1a5b2f3cb3ec","resolution":{"observed_at":"2026-08-15T20:05:06.960296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:06.527751Z","title":"Cache me if you can: Accelerating diffusion models through block caching","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.527751Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:7865c3cbf87ad0033ddce677da79ff863f358554ebe13f48e6c82640b832881c","observation_id":"293b7419-54dd-475d-89be-088c6e2838c9","resolution":{"observed_at":"2026-08-15T20:05:06.527751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:06.934830Z","title":"Preact: Predictive resource allocation for bursty workloads in a co-located data center","venue":null,"work_id":"30e2f260-0c7e-44a4-8896-978e4f335d40","year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.531612Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:4e06fa004ecc3ce67accd92f63970ae8618bcedca288905d810ae15eb0d8650b","observation_id":"63df851d-b387-463a-8250-45dd56ba37ea","resolution":{"observed_at":"2026-08-15T20:05:06.939121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-08-15T19:52:28.153954Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-15T20:05:06.535684Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer.arXiv preprint arXiv:2408.06072, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.535684Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:d74009d0d327f8a1fcf946cf6cb55ec56556fe133784a4a9882f17e06061f4f4","observation_id":"46ae53c2-2565-4ed4-b3ec-0021dd8296f1","resolution":{"observed_at":"2026-08-15T20:05:06.535684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:06.917336Z","title":"Orca: A distributed serving system for {Transformer-Based} generative models","venue":null,"work_id":"00a56fbb-22d1-4c1e-a81a-7c1062beb989","year":2022},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.540557Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:8327da6c7b875595add6692b5a7bf36644fc81d29b0a616cc432aad1a343611a","observation_id":"eafb86e6-4a05-45d1-8638-5eafa4f9a10f","resolution":{"observed_at":"2026-08-15T20:05:06.923834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08552","last_updated":"2024-10-18T12:05:21Z","snapshot_observed_at":"2026-08-16T13:43:37.612344Z","submitted_at":"2024-06-12T18:00:08Z","title":"DiTFastAttn: Attention Compression for Diffusion Transformer Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08552","snapshot_observed_at":"2026-08-15T20:05:06.545013Z","title":"Ditfas- tattn: Attention compression for diffusion transformer models.arXiv preprint arXiv:2406.08552, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.545013Z"},"links":{"cited_paper":"/paper/2406.08552","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:1d3618e1d1631eb4e2248f467e524c59ba7bc871968a2054f17bf92967e08e79","observation_id":"a9393754-35b7-4b19-b409-61a895cd667a","resolution":{"observed_at":"2026-08-15T20:05:06.545013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02747","last_updated":"2025-02-26T10:49:33Z","snapshot_observed_at":"2026-08-16T14:03:56.951368Z","submitted_at":"2024-04-03T13:44:41Z","title":"Faster Diffusion via Temporal Attention Decomposition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02747","snapshot_observed_at":"2026-08-15T20:05:06.549223Z","title":"Cross-attention makes in- ference cumbersome in text-to-image diffusion models.arXiv preprint arXiv:2404.02747, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.549223Z"},"links":{"cited_paper":"/paper/2404.02747","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:af00931407c007f2afe19439efc12cc457d481fc474da4897abf84451873564f","observation_id":"9bf367cf-2d7e-4562-965a-12c78c0ebb7c","resolution":{"observed_at":"2026-08-15T20:05:06.549223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10266","last_updated":"2025-05-11T09:53:27Z","snapshot_observed_at":"2026-08-16T18:16:12.363815Z","submitted_at":"2024-03-15T12:53:50Z","title":"DSP: Dynamic Sequence Parallelism for Multi-Dimensional Transformers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10266","snapshot_observed_at":"2026-08-15T20:05:06.553354Z","title":"Dsp: Dynamic sequence parallelism for multi-dimensional transformers.arXiv preprint arXiv:2403.10266, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.553354Z"},"links":{"cited_paper":"/paper/2403.10266","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:4486f1442795b5c8893ac79d001aee4081444cba96932770f2652bbbb1b5b3a1","observation_id":"3c7775af-a8e7-4625-ad2d-14f2edcf4b52","resolution":{"observed_at":"2026-08-15T20:05:06.553354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12588","last_updated":"2025-02-27T07:00:30Z","snapshot_observed_at":"2026-08-16T13:24:31.259921Z","submitted_at":"2024-08-22T17:54:21Z","title":"Real-Time Video Generation with Pyramid Attention Broadcast","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12588","snapshot_observed_at":"2026-08-15T20:05:06.557898Z","title":"Real-time video generation with pyramid attention broadcast.arXiv preprint arXiv:2408.12588, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.557898Z"},"links":{"cited_paper":"/paper/2408.12588","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:fcdc0890a020bf0cb1d4dc73121c6c2f1bc653a6d58e02883f7bc79b5e36b880","observation_id":"84245383-cba9-4a01-a43b-05d640fb7874","resolution":{"observed_at":"2026-08-15T20:05:06.557898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:05:06.562133Z","title":"Open-sora: Democratizing efficient video production for all, March 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.562133Z"},"links":{"citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:b59fcc2a6e6ec8d10e96306e4a401bf4ae56098ff4d291b825c6077ab786e541","observation_id":"2103e915-1e4a-4c46-ab00-cf103ed9f552","resolution":{"observed_at":"2026-08-15T20:05:06.562133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-15T20:05:06.565942Z","title":"Open- sora: Democratizing efficient video production for all.arXiv preprint arXiv:2412.20404, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.565942Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:3151595e50b4196a0e68b34d3256dc0340fdf7237576e4e556ad3bb15069d90e","observation_id":"8f99295a-6bb4-48b5-9981-c6af53d2edc7","resolution":{"observed_at":"2026-08-15T20:05:06.565942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09670","last_updated":"2024-06-06T15:50:51Z","snapshot_observed_at":"2026-08-16T14:26:37.115667Z","submitted_at":"2024-01-18T01:03:38Z","title":"DistServe: Disaggregating Prefill and Decoding for Goodput-optimized Large Language Model Serving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09670","snapshot_observed_at":"2026-08-15T20:05:06.570203Z","title":"Distserve: Disaggregating prefill and decoding for goodput-optimized large language model serving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T20:05:06.570203Z"},"links":{"cited_paper":"/paper/2401.09670","citing_paper":"/paper/2506.13497"},"observation_digest":"sha256:61ce94291c44847f86f3d263fce8e08c9c276093bc9b61837995999b31fa77f3","observation_id":"11ed2b9a-3168-48be-a6e4-6bc18ce08a01","resolution":{"observed_at":"2026-08-15T20:05:06.570203Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.13497","last_updated":"2025-06-16T13:54:41Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-18T05:39:06.774742Z","submitted_at":"2025-06-16T13:54:41Z","title":"DDiT: Dynamic Resource Allocation for Diffusion Transformer Model Serving"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 5 inbound Pith citation observations for arXiv:2506.13497."}