{"as_of":"2026-08-15T07:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4190c9c0645834170a4d5d030f5170e95f35bd292949df413d92bd4d3d4cb360","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":39,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T18:31:29.051222Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:59:57.977754Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2310.05737","last_updated":"2024-03-29T17:44:41Z","snapshot_observed_at":"2026-08-02T18:23:02.746177Z","submitted_at":"2023-10-09T14:10:29Z","title":"Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation","version":3},"reference_index":241,"source":"arxiv_source","source_observed_at":"2026-05-13T20:06:44.480769Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2310.05737"},"observation_digest":"sha256:ad22034b7170f0d16a1d614fed1e2dac5135afc061e128f825857847aa9fe3f8","observation_id":"259772ae-d76a-4d13-8ab0-b3a869a452e7","resolution":{"observed_at":"2026-05-13T20:06:44.709299Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-12T18:31:29.051222Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11505","last_updated":"2025-03-06T07:26:35Z","snapshot_observed_at":"2026-08-14T05:47:23.540005Z","submitted_at":"2024-11-18T12:05:27Z","title":"LaVin-DiT: Large Vision Diffusion Transformer","version":4},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-12T18:31:29.051222Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2411.11505"},"observation_digest":"sha256:437c85ad86d5f9558b70d473b608150894c6aa84034424699d095c1c5d319a6b","observation_id":"62ff35ec-0675-42b6-b596-5828acd7c3c0","resolution":{"observed_at":"2026-08-12T18:31:29.051222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-11T22:12:27.514147Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.03791","last_updated":"2025-05-29T01:03:51Z","snapshot_observed_at":"2026-08-15T07:13:23.225779Z","submitted_at":"2024-12-05T01:00:07Z","title":"INRFlow: Flow Matching for INRs in Ambient Space","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-11T22:12:27.514147Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2412.03791"},"observation_digest":"sha256:f83fd078469b26d52b84dafccf976b0491e42cc9968674d28997a7b1202c51c4","observation_id":"e911b030-c58c-4527-98b0-1ae3ce5ef19b","resolution":{"observed_at":"2026-08-11T22:12:27.514147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-11T20:37:01.962804Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05628","last_updated":"2024-12-07T11:52:41Z","snapshot_observed_at":"2026-08-14T12:51:51.348513Z","submitted_at":"2024-12-07T11:52:41Z","title":"Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T20:37:01.962804Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2412.05628"},"observation_digest":"sha256:a7be58709cb6bf1221c7eeb53b016c493c5ce0e6a7099ccfe03854df09aa48aa","observation_id":"18ab7e93-b2b8-4d33-b6d6-936aa6fae1bc","resolution":{"observed_at":"2026-08-11T20:37:01.962804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-11T14:20:49.571961Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12095","last_updated":"2024-12-17T18:45:55Z","snapshot_observed_at":"2026-08-14T05:13:44.637603Z","submitted_at":"2024-12-16T18:59:29Z","title":"Causal Diffusion Transformers for Generative Modeling","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T14:20:49.571961Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2412.12095"},"observation_digest":"sha256:a26e66b0081591716c11ffe0da3fcf31956b561d3ed1db7ff6099ccfd807e262","observation_id":"3343cfab-9a23-4c18-93b7-b4968e06e0f8","resolution":{"observed_at":"2026-08-11T14:20:49.571961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-11T01:02:56.117688Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19104","last_updated":"2024-12-26T07:47:20Z","snapshot_observed_at":"2026-08-12T03:51:21.211579Z","submitted_at":"2024-12-26T07:47:20Z","title":"Improving Generative Pre-Training: An In-depth Study of Masked Image Modeling and Denoising Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T01:02:56.117688Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2412.19104"},"observation_digest":"sha256:72bb30e0628f86a2760d786b601aad482ba603cc8d573a4721ab6c454048c5f5","observation_id":"79d7d66e-c587-4e38-8cd1-03f8cdf3894c","resolution":{"observed_at":"2026-08-11T01:02:56.117688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-10T22:34:14.559949Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01423","last_updated":"2025-03-10T11:43:42Z","snapshot_observed_at":"2026-08-11T01:06:46.210110Z","submitted_at":"2025-01-02T18:59:40Z","title":"Reconstruction vs. Generation: Taming Optimization Dilemma in Latent Diffusion Models","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T22:34:14.559949Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2501.01423"},"observation_digest":"sha256:55f4e5ce00d3b21950a09004c95e780fee31a428df28d99270bfb5cb779dec3d","observation_id":"2f5d5819-a497-423e-bfa0-39fc45d5d85f","resolution":{"observed_at":"2026-08-10T22:34:14.559949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-09T19:22:41.755072Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00359","last_updated":"2025-02-01T07:42:12Z","snapshot_observed_at":"2026-08-10T10:14:26.773878Z","submitted_at":"2025-02-01T07:42:12Z","title":"Exploring Representation-Aligned Latent Space for Better Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T19:22:41.755072Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2502.00359"},"observation_digest":"sha256:73d2c9d2a29f21035e969fc6f1f2555e41f404c8d0b7a1e2cf4f50126efe129e","observation_id":"eea0c7b9-9832-46ec-9bed-6bf4cc9eda5d","resolution":{"observed_at":"2026-08-09T19:22:41.755072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-09T19:21:56.339709Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00382","last_updated":"2025-02-01T09:41:01Z","snapshot_observed_at":"2026-08-13T10:30:36.353400Z","submitted_at":"2025-02-01T09:41:01Z","title":"Masked Generative Nested Transformers with Decode Time Scaling","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T19:21:56.339709Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2502.00382"},"observation_digest":"sha256:f39cf9835d32efee4da0e722539d36e94f8ccd1a75e35c44a402e1ce1776382b","observation_id":"8ad5099c-9541-4c90-933b-d69adb866c68","resolution":{"observed_at":"2026-08-09T19:21:56.339709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-07T21:17:55.982594Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09509","last_updated":"2025-08-04T10:44:54Z","snapshot_observed_at":"2026-08-15T07:13:28.916209Z","submitted_at":"2025-02-13T17:21:51Z","title":"EQ-VAE: Equivariance Regularized Latent Space for Improved Generative Image Modeling","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T21:17:55.982594Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2502.09509"},"observation_digest":"sha256:fd3eadc43ec99908d1d7bc76bb47836f1e4bd54ed8c6bb92a646a84bdef78ae8","observation_id":"001834eb-dab0-447b-82ee-3f5c530f4a75","resolution":{"observed_at":"2026-08-07T21:17:55.982594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2506.13763","last_updated":"2026-04-16T06:16:45Z","snapshot_observed_at":"2026-07-06T21:43:03.415527Z","submitted_at":"2025-06-16T17:59:54Z","title":"Diagnosing and Improving Diffusion Models by Estimating the Optimal Loss Value","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-19T09:05:58.516845Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2506.13763"},"observation_digest":"sha256:2469593bd30f75204ee70e3ec517021c0b1ace0659e15bbe9e54efa53a0f6d76","observation_id":"7edd54e0-07dd-485b-827b-f91ffa599e20","resolution":{"observed_at":"2026-05-19T09:07:14.037023Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-06T20:49:43.657417Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-14T20:40:32.970220Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:43.657417Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:767d5bb3d4c55a3f45032cdd770e9a0d219b78b1b4b27d88948d088e0ebcc343","observation_id":"13829bd9-c1ef-4d9a-b6d1-7032636d9a26","resolution":{"observed_at":"2026-08-06T20:49:43.657417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-06T16:48:34.038440Z","title":"pause tokens,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13401","last_updated":"2025-07-16T20:56:57Z","snapshot_observed_at":"2026-08-13T23:50:55.894948Z","submitted_at":"2025-07-16T20:56:57Z","title":"MADI: Masking-Augmented Diffusion with Inference-Time Scaling for Visual Editing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:48:34.038440Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2507.13401"},"observation_digest":"sha256:f0a7be13f20ce89e385b06f819a099729134e15ce3dc90f7014447157cab1d17","observation_id":"54f2b4ff-c8c9-4a47-9964-0a21b2e591d9","resolution":{"observed_at":"2026-08-06T16:48:34.038440Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-06T15:44:53.604445Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15216","last_updated":"2025-07-21T03:36:58Z","snapshot_observed_at":"2026-08-14T19:45:04.377115Z","submitted_at":"2025-07-21T03:36:58Z","title":"Improving Joint Embedding Predictive Architecture with Diffusion Noise","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:44:53.604445Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2507.15216"},"observation_digest":"sha256:afa522fd5bce23cf4b7fca0bd812dec1bdda6f045569574c7a5c78538f0995b5","observation_id":"1261d8e6-cabb-4627-a43f-00f83fb3e609","resolution":{"observed_at":"2026-08-06T15:44:53.604445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-05T05:27:34.379629Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05441","last_updated":"2025-09-10T22:15:25Z","snapshot_observed_at":"2026-08-15T07:14:04.163978Z","submitted_at":"2025-09-05T18:49:08Z","title":"Missing Fine Details in Images: Last Seen in High Frequencies","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-05T05:27:34.379629Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2509.05441"},"observation_digest":"sha256:6e1bbb0908fcb6786353035b4a1d0b09601905ec2708b26ea14d9b029b93966a","observation_id":"2b6ecdaa-0d4e-48e4-93fd-4e1daec5a277","resolution":{"observed_at":"2026-08-05T05:27:34.379629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2510.18457","last_updated":"2026-04-23T08:02:03Z","snapshot_observed_at":"2026-08-15T03:31:43.799649Z","submitted_at":"2025-10-21T09:30:45Z","title":"VFM-VAE: Vision Foundation Models Can Be Good Tokenizers for Latent Diffusion Models","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-18T05:22:05.125849Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2510.18457"},"observation_digest":"sha256:4d5afd31c96cf05b79eec8a80ac450dfdc7acfea327f354eb66c04af0c822454","observation_id":"fb61079b-6df8-4dd6-83f7-232c5fb4b940","resolution":{"observed_at":"2026-05-18T05:22:23.937867Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-03T15:35:00.843984Z","title":"Fast training of diffusion models with masked transformers.arXiv preprint arXiv:2306.09305, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.16636","last_updated":"2026-07-18T11:24:13Z","snapshot_observed_at":"2026-08-07T17:53:52.987639Z","submitted_at":"2025-12-18T15:10:42Z","title":"REGLUE Your Latents with Global and Local Semantics for Entangled Diffusion","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-03T15:35:00.843984Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2512.16636"},"observation_digest":"sha256:44600b2a06bf9c9324668d77a6f665d432d2ccf89be2b353a2a69a93cd6f9ae0","observation_id":"7467a394-75b9-4e97-8669-c4ac14672611","resolution":{"observed_at":"2026-08-03T15:35:00.843984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-03T14:53:03.638057Z","title":"Sulphur-crested cockatoo","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.19311","last_updated":"2026-07-12T14:26:35Z","snapshot_observed_at":"2026-08-07T18:54:26.140556Z","submitted_at":"2025-12-22T12:00:12Z","title":"MixFlow Training: Alleviating Exposure Bias with Slowed Interpolation Mixture","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T14:53:03.638057Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2512.19311"},"observation_digest":"sha256:b83502fcaa8cacae83e0c7eaae2b5e63c50d22da015ebabbc95a9df4e9120523","observation_id":"f37e1941-f099-465d-af4b-0c9760651f68","resolution":{"observed_at":"2026-08-03T14:53:03.638057Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2602.06886","last_updated":"2026-07-31T08:35:56Z","snapshot_observed_at":"2026-08-05T23:10:18.924353Z","submitted_at":"2026-02-06T17:19:53Z","title":"Prompt Reinjection: Alleviating Prompt Forgetting in Multimodal Diffusion Transformers for Text-to-Image Generation","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T13:00:22.875471Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2602.06886"},"observation_digest":"sha256:59e67391c3a5d329ee3d469212dcf045def0ac77d75dd5d8a851fdd0065424ee","observation_id":"65a1ecf4-f5d1-44c8-8569-7c0e8ee21e22","resolution":{"observed_at":"2026-05-21T13:04:10.580837Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-03T03:50:47.050868Z","title":"Zheng, W","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.06886","last_updated":"2026-07-31T08:35:56Z","snapshot_observed_at":"2026-08-05T23:10:18.924353Z","submitted_at":"2026-02-06T17:19:53Z","title":"Prompt Reinjection: Alleviating Prompt Forgetting in Multimodal Diffusion Transformers for Text-to-Image Generation","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T03:50:47.050868Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2602.06886"},"observation_digest":"sha256:17b766662e886115660b915549ab8c604947bebc5211552bcc3b4c12d5abf637","observation_id":"44f08017-9a0e-4aa1-964f-852df110be70","resolution":{"observed_at":"2026-08-03T03:50:47.050868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-03T01:25:20.415023Z","title":"Fast training of diffusion models with masked transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10099","last_updated":"2026-07-03T15:19:24Z","snapshot_observed_at":"2026-08-06T13:27:43.962812Z","submitted_at":"2026-02-10T18:58:04Z","title":"Learning on the Manifold: Unlocking Standard Diffusion Transformers with Representation Encoders","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T01:25:20.415023Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2602.10099"},"observation_digest":"sha256:d0ce6df6ff040188dc45579c83c199ab9eb3c4a1c75e10fd897fd72b22501aca","observation_id":"de8052a5-d3d6-4468-a7ba-8a3cf75730a6","resolution":{"observed_at":"2026-08-03T01:25:20.415023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2604.07397","last_updated":"2026-04-08T08:55:49Z","snapshot_observed_at":"2026-08-11T05:46:59.574678Z","submitted_at":"2026-04-08T08:55:49Z","title":"Data Warmup: Complexity-Aware Curricula for Efficient Diffusion Training","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T18:55:26.852585Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2604.07397"},"observation_digest":"sha256:7bf08e007876a62f7298c955532d58ba60e2a83eb6575c5ff066dcf57cb61262","observation_id":"3b2adf24-8812-4ff2-b41e-dccb7770bff9","resolution":{"observed_at":"2026-05-10T23:40:54.141984Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2604.09168","last_updated":"2026-07-23T07:42:32Z","snapshot_observed_at":"2026-08-06T11:01:30.223629Z","submitted_at":"2026-04-10T09:53:27Z","title":"ELT: Elastic Looped Transformers for Visual Generation","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-10T17:19:22.543462Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2604.09168"},"observation_digest":"sha256:749032db21c892a456ada6ee17a41a9f3187872f1930c4bec682568fdcacbe17","observation_id":"de66bacb-14e1-44a3-93de-80c9b6cc2eef","resolution":{"observed_at":"2026-05-11T07:06:00.051356Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-02T16:35:03.444701Z","title":"Zheng, W","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.09168","last_updated":"2026-07-23T07:42:32Z","snapshot_observed_at":"2026-08-06T11:01:30.223629Z","submitted_at":"2026-04-10T09:53:27Z","title":"ELT: Elastic Looped Transformers for Visual Generation","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-02T16:35:03.444701Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2604.09168"},"observation_digest":"sha256:17f8a388ee6fa9185a86ce28c5318a3ce0980b21ff329228d9f6652421af41b1","observation_id":"fb315d39-8a1f-4662-82e3-14adc4bb2564","resolution":{"observed_at":"2026-08-02T16:35:03.444701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2604.19141","last_updated":"2026-04-21T06:44:44Z","snapshot_observed_at":"2026-08-15T01:06:17.822078Z","submitted_at":"2026-04-21T06:44:44Z","title":"Denoising, Fast and Slow: Difficulty-Aware Adaptive Sampling for Image Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-10T03:06:43.992858Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2604.19141"},"observation_digest":"sha256:2b1e6957a97b5ead08d9848f93bea9442e28a69a3659e1fa3dedbcf78a12a8b7","observation_id":"c0344861-4a63-4bcb-b361-0d0ebe3e3b13","resolution":{"observed_at":"2026-05-10T03:08:59.205615Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2605.00503","last_updated":"2026-05-04T10:19:31Z","snapshot_observed_at":"2026-08-13T10:47:30.778928Z","submitted_at":"2026-05-01T08:25:51Z","title":"End-to-End Autoregressive Image Generation with 1D Semantic Tokenizer","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-09T19:41:03.302303Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.00503"},"observation_digest":"sha256:c7a0414fd0654ab86187c99856da92abb3bd9a3d38d65153e954663318304673","observation_id":"cc77dfbe-21c3-4a73-8d4c-ff633c2d4d8c","resolution":{"observed_at":"2026-05-11T15:36:05.832440Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2605.10790","last_updated":"2026-05-11T16:21:45Z","snapshot_observed_at":"2026-08-11T12:36:02.727982Z","submitted_at":"2026-05-11T16:21:45Z","title":"Elucidating Representation Degradation Problem in Diffusion Model Training","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-12T04:08:11.110912Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.10790"},"observation_digest":"sha256:30404a260780bdd24cb7289ccf1b1fa2aa1713d5e23e3b1e6bad53c0c677bb14","observation_id":"1dcca901-4945-4546-ad7f-bc3c9574ddbb","resolution":{"observed_at":"2026-05-12T06:36:26.415612Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2605.16949","last_updated":"2026-05-16T12:01:04Z","snapshot_observed_at":"2026-08-12T22:15:06.703156Z","submitted_at":"2026-05-16T12:01:04Z","title":"Beyond Point-Wise Matching: Structural Representation Alignment for Accelerating Diffusion Transformers","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-19T20:49:25.902880Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.16949"},"observation_digest":"sha256:5177de622bb71e52c57a4e9dffaefba5ab9d64580f8db74380f00bf8ecd272c3","observation_id":"170e9b77-d498-4fb1-b5fb-6f73cdd884ec","resolution":{"observed_at":"2026-05-19T20:52:46.192834Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2605.17759","last_updated":"2026-05-18T02:25:07Z","snapshot_observed_at":"2026-08-15T06:05:37.431425Z","submitted_at":"2026-05-18T02:25:07Z","title":"FrequencyBooster: Full-Frequency Modeling for High-Fidelity Pixel Diffusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-20T12:43:58.746650Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.17759"},"observation_digest":"sha256:dfe92701efaec53a7ced3afc42f55f90add73a5745fce43165b073bd2b237ff6","observation_id":"d1b7b837-8ef6-4925-b570-055f3e15fbde","resolution":{"observed_at":"2026-05-20T12:48:17.664054Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T11:59:54.139888Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:0b59d7f48b0cb320f2dd8db9f665a27fb8418e10db21ca4317a474e7120cb604","observation_id":"dd868de8-cddc-4767-8129-b14f1093c79e","resolution":{"observed_at":"2026-05-20T12:03:15.331324Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T18:39:40.667006Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:45347083cbe118682c99eb2a17cf5fb49f0ec6b8be27881086cb2086e616c5e0","observation_id":"2f3ca426-072d-4c4c-a7ab-f65a2a6395bb","resolution":{"observed_at":"2026-06-30T18:45:00.712640Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-02T13:49:19.876126Z","title":"Fast training of diffusion models with masked transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T13:49:19.876126Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:31e1e6e0d7716980feeaa465b33014be87c1c1ee7d566d0ae57197083a1ec652","observation_id":"921c3a4c-0e22-469e-a5d9-275bda7cbeb5","resolution":{"observed_at":"2026-08-02T13:49:19.876126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2605.18390","last_updated":"2026-05-18T13:38:43Z","snapshot_observed_at":"2026-08-13T22:07:18.094754Z","submitted_at":"2026-05-18T13:38:43Z","title":"Vision Foundation Models as Generalist Tokenizers for Image Generation","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-20T11:01:24.738195Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2605.18390"},"observation_digest":"sha256:e270c22dcc1dfaa9dbc402a6d1f272714a90cbaf4a55db8b96eadb825cf51a7d","observation_id":"07539e4e-6a3f-4ae2-ae0c-00fbec1cf69b","resolution":{"observed_at":"2026-05-20T11:03:13.472208Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2606.08788","last_updated":"2026-06-07T19:11:22Z","snapshot_observed_at":"2026-08-14T17:02:51.118640Z","submitted_at":"2026-06-07T19:11:22Z","title":"MaskAlign: Token-Subset Representation Alignment for Efficient Diffusion Training","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T18:44:41.266768Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2606.08788"},"observation_digest":"sha256:b4375b25f99cb45f8ec607730e36e77988f912243d2ac6a5c5f47ea51a114fd3","observation_id":"4b08c0d9-0f40-4cfb-a1d4-0d27e8bca0dc","resolution":{"observed_at":"2026-07-02T22:37:26.196124Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2606.11096","last_updated":"2026-06-09T16:53:30Z","snapshot_observed_at":"2026-08-12T15:22:32.843957Z","submitted_at":"2026-06-09T16:53:30Z","title":"IDEAL: In-DEpth ALignment Makes A Discrete Representation AutoEncoder","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-27T13:10:14.308216Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2606.11096"},"observation_digest":"sha256:4485afdbb15c15a6618e4deed5b659ffd06ca1dbf66d098d4f339bd62330ad72","observation_id":"69277d24-07ac-4c3c-a60c-59bdb0c99a53","resolution":{"observed_at":"2026-07-03T05:37:40.236125Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2606.24888","last_updated":"2026-06-23T17:59:55Z","snapshot_observed_at":"2026-08-08T16:38:03.178919Z","submitted_at":"2026-06-23T17:59:55Z","title":"DiffusionBench: On Holistic Evaluation of Diffusion Transformers","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-26T00:06:11.951205Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2606.24888"},"observation_digest":"sha256:8c638eaf8aa8fc04bc1891c5fd77bddb1013dfa7cc00eb7287af1757d1525ea5","observation_id":"cc6a1552-d762-46c7-b7f8-246ac4a4d2a5","resolution":{"observed_at":"2026-07-04T16:59:57.979676Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2606.27760","last_updated":"2026-06-26T06:39:06Z","snapshot_observed_at":"2026-07-31T06:11:06.764017Z","submitted_at":"2026-06-26T06:39:06Z","title":"PixelU: A U-Shaped Transformer for Efficient End-to-End Pixel Diffusion","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-29T04:31:57.169935Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2606.27760"},"observation_digest":"sha256:b8fb8f3a4a1a066d2f4d98d13b78e60b2e41114337e3776beea3f9e54758586a","observation_id":"46d55d90-dee0-4983-bb48-8d8908df0fa0","resolution":{"observed_at":"2026-06-29T20:03:57.140969Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":"2306.09305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-07-04T16:59:57.977754Z","title":"Zheng, W","venue":null,"work_id":"a43c3057-0634-4c2b-b3dc-78d15ca3029d","year":2023},"citing_paper":{"arxiv_id":"2607.02508","last_updated":"2026-07-02T17:59:25Z","snapshot_observed_at":"2026-07-07T00:07:56.573640Z","submitted_at":"2026-07-02T17:59:25Z","title":"From SRA to Self-Flow: Data Augmentation or Self-Supervision?","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-03T14:36:59.833888Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2607.02508"},"observation_digest":"sha256:01d8225880646a79cfd9cd40219c80d1553ca19b7b18edffd94152c0c5129e0e","observation_id":"9b452c7b-b3c8-46d9-b918-b0a9efdb9971","resolution":{"observed_at":"2026-07-03T14:38:28.526783Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09305","snapshot_observed_at":"2026-08-08T01:07:11.974745Z","title":"Fast train- ing of diffusion models with masked transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03082","last_updated":"2026-08-04T03:51:15Z","snapshot_observed_at":"2026-08-10T23:38:17.010766Z","submitted_at":"2026-08-04T03:51:15Z","title":"DiverseDiT++: Quantifying, Analyzing, and Promoting Representation Diversity in Diffusion Transformers","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T01:07:11.974745Z"},"links":{"cited_paper":"/paper/2306.09305","citing_paper":"/paper/2608.03082"},"observation_digest":"sha256:dea028957913f686ce38bb1e29b47bfa8a4f6b1af4a88bdf9d6c3e13faee4377","observation_id":"51831a14-7900-4cd2-95da-7d1eb6f19e1f","resolution":{"observed_at":"2026-08-08T01:07:11.974745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2306.09305/citation-record","integrity":"/paper/2306.09305/integrity","json":"/paper/2306.09305/citation-record.json","paper":"/paper/2306.09305"},"outbound":[],"paper":{"arxiv_id":"2306.09305","last_updated":"2024-03-05T01:10:18Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T19:55:50.519855Z","submitted_at":"2023-06-15T17:38:48Z","title":"Fast Training of Diffusion Models with Masked Transformers"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 39 inbound Pith citation observations for arXiv:2306.09305."}