{"as_of":"2026-08-09T15:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:41fc6d819df5fa41c90b574e580c901ddb98336158dff12c01c50f2090d23c11","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":30,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T04:47:30.325347Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:59:58.012604Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":"2303.14389","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-07-04T16:59:58.012604Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":"a67f1e5f-43fb-4052-b944-30056dfb4e0c","year":2023},"citing_paper":{"arxiv_id":"2310.05737","last_updated":"2024-03-29T17:44:41Z","snapshot_observed_at":"2026-08-02T18:23:02.746177Z","submitted_at":"2023-10-09T14:10:29Z","title":"Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation","version":3},"reference_index":280,"source":"arxiv_source","source_observed_at":"2026-05-13T20:06:44.480769Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2310.05737"},"observation_digest":"sha256:1827314fa950d3504c9e3c92c223de5ba8f8c816b141a101ac05396355fbfa7e","observation_id":"a3c115d1-95b5-476c-a5f3-0b8cf90d3e1b","resolution":{"observed_at":"2026-05-13T20:06:44.675088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":"2303.14389","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-07-04T16:59:58.012604Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":"a67f1e5f-43fb-4052-b944-30056dfb4e0c","year":2023},"citing_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-13T13:43:11.024069Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2402.17177"},"observation_digest":"sha256:e644f415efa99981abe5903d9779db4d8680b011e63215e5113f165c748615bc","observation_id":"b60265b0-3ddf-4f78-a5ba-936a32777c4a","resolution":{"observed_at":"2026-05-13T13:43:11.119271Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":"2303.14389","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-07-04T16:59:58.012604Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":"a67f1e5f-43fb-4052-b944-30056dfb4e0c","year":2023},"citing_paper":{"arxiv_id":"2410.06940","last_updated":"2025-06-18T04:35:42Z","snapshot_observed_at":"2026-07-06T19:30:26.233621Z","submitted_at":"2024-10-09T14:34:53Z","title":"Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think","version":4},"reference_index":135,"source":"arxiv_source","source_observed_at":"2026-05-12T15:09:36.982610Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2410.06940"},"observation_digest":"sha256:15b5b3237b5fa5a40bee8f42ce7730c5e287341d53883285750c2b90d0f605cd","observation_id":"c748cf1f-e842-4b8b-aac5-81ce88449306","resolution":{"observed_at":"2026-05-12T15:09:37.128274Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-09T04:47:30.325347Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthe- sizer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03444","last_updated":"2025-05-30T05:49:31Z","snapshot_observed_at":"2026-08-09T04:41:07.556668Z","submitted_at":"2025-02-05T18:42:04Z","title":"Masked Autoencoders Are Effective Tokenizers for Diffusion Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T04:47:30.325347Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2502.03444"},"observation_digest":"sha256:9839c553f9b6166aa6512932066c850a1f0515b56b28c7e0deacb4c4f8b22dca","observation_id":"9abfc1e2-5d1f-4142-a911-d84939b87c1a","resolution":{"observed_at":"2026-08-09T04:47:30.325347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-07T15:00:35.728615Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer.arXiv preprint arXiv:2303.14389, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16792","last_updated":"2025-05-22T15:34:33Z","snapshot_observed_at":"2026-08-07T23:50:58.184955Z","submitted_at":"2025-05-22T15:34:33Z","title":"REPA Works Until It Doesn't: Early-Stopped, Holistic Alignment Supercharges Diffusion Training","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:00:35.728615Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2505.16792"},"observation_digest":"sha256:3b1e6528966e11c4d610dd1dee8974980ddd55d7fde315382fa48de162ddcbdc","observation_id":"9f270128-508b-4203-8517-6dbd5f9c8f3d","resolution":{"observed_at":"2026-08-07T15:00:35.728615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-07T14:22:20.756291Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19089","last_updated":"2025-05-25T10:57:35Z","snapshot_observed_at":"2026-08-07T22:16:50.088839Z","submitted_at":"2025-05-25T10:57:35Z","title":"Plug-and-Play Context Feature Reuse for Efficient Masked Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:20.756291Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2505.19089"},"observation_digest":"sha256:114da80460cb3aef34387cf9f3f0e9ea72452d95ca86124274481b7197754f8a","observation_id":"8c35af6d-d189-4965-aad3-4868b574bc21","resolution":{"observed_at":"2026-08-07T14:22:20.756291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-07T11:15:23.667405Z","title":"Masked diffusion transformer is a strong image synthesizer.arXiv preprint arXiv:2303.14389, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03131","last_updated":"2025-06-03T17:57:33Z","snapshot_observed_at":"2026-08-07T23:51:36.891678Z","submitted_at":"2025-06-03T17:57:33Z","title":"Native-Resolution Image Synthesis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:15:23.667405Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2506.03131"},"observation_digest":"sha256:dc32b936a1fe635342daaf777d7d281f92c54b44d6dc8fe0d40c0b721c2cd78d","observation_id":"fca8e983-a16a-4156-8cd2-08fe6dec3114","resolution":{"observed_at":"2026-08-07T11:15:23.667405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":"2303.14389","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-07-04T16:59:58.012604Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":"a67f1e5f-43fb-4052-b944-30056dfb4e0c","year":2023},"citing_paper":{"arxiv_id":"2506.13763","last_updated":"2026-04-16T06:16:45Z","snapshot_observed_at":"2026-07-06T21:43:03.415527Z","submitted_at":"2025-06-16T17:59:54Z","title":"Diagnosing and Improving Diffusion Models by Estimating the Optimal Loss Value","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-19T09:05:58.516845Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2506.13763"},"observation_digest":"sha256:c1a38377422eb3e226080729f08096da7ef670de58437df2abefbc294122f126","observation_id":"401345ff-99d8-4eb5-b57b-6a59e26d4037","resolution":{"observed_at":"2026-05-19T09:07:14.043576Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-06T20:49:40.899190Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01756","last_updated":"2025-07-22T02:25:49Z","snapshot_observed_at":"2026-08-08T16:57:37.559490Z","submitted_at":"2025-07-02T14:33:52Z","title":"Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:49:40.899190Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2507.01756"},"observation_digest":"sha256:28dd56ee21adcc53d315e2f5e6e4bc81cbb64655bed56e3c8f80e318e839289e","observation_id":"5989a483-4b75-4a5c-b7af-aa9ee27973ad","resolution":{"observed_at":"2026-08-06T20:49:40.899190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-06T18:45:44.758445Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07410","last_updated":"2025-07-10T04:08:28Z","snapshot_observed_at":"2026-08-09T08:22:50.770391Z","submitted_at":"2025-07-10T04:08:28Z","title":"EscherNet++: Simultaneous Amodal Completion and Scalable View Synthesis through Masked Fine-Tuning and Enhanced Feed-Forward 3D Reconstruction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:45:44.758445Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2507.07410"},"observation_digest":"sha256:9835c8e5850735d0cbd2bef207c4d0427674451ac7a1f4f8c5099ae137b2e8bf","observation_id":"bd805cc5-1ac4-4910-ac5d-10bdbab896af","resolution":{"observed_at":"2026-08-06T18:45:44.758445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-06T15:44:53.522159Z","title":"Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.15216","last_updated":"2025-07-21T03:36:58Z","snapshot_observed_at":"2026-08-06T15:35:49.818397Z","submitted_at":"2025-07-21T03:36:58Z","title":"Improving Joint Embedding Predictive Architecture with Diffusion Noise","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:44:53.522159Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2507.15216"},"observation_digest":"sha256:096960d9407c611ecbcabcae08f3a58d32cb62b8f3d26575970dd74b5e9e9ef4","observation_id":"c12c6ebb-442b-42a5-9324-23bc55832735","resolution":{"observed_at":"2026-08-06T15:44:53.522159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-05T10:19:54.345097Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04394","last_updated":"2025-09-04T17:05:59Z","snapshot_observed_at":"2026-08-06T05:46:13.034506Z","submitted_at":"2025-09-04T17:05:59Z","title":"Transition Models: Rethinking the Generative Learning Objective","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T10:19:54.345097Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2509.04394"},"observation_digest":"sha256:1ee433d7634c30cfa4e8f5dca91b113712bdb1565b241c12fce1ee9a7988199b","observation_id":"db2af227-aaaf-4caf-bb17-4bf7d8774840","resolution":{"observed_at":"2026-08-05T10:19:54.345097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-03T15:34:55.110363Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer.arXiv preprint arXiv:2303.14389, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.16636","last_updated":"2026-07-18T11:24:13Z","snapshot_observed_at":"2026-08-07T17:53:52.987639Z","submitted_at":"2025-12-18T15:10:42Z","title":"REGLUE Your Latents with Global and Local Semantics for Entangled Diffusion","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T15:34:55.110363Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2512.16636"},"observation_digest":"sha256:7262c62736ca06b89ac659e046c6e9cdd582ff1dfb303b524e661f5e899e432e","observation_id":"e3d926a7-1985-4081-add0-46666feb9b61","resolution":{"observed_at":"2026-08-03T15:34:55.110363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-03T14:52:58.486535Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer.arXiv preprint arXiv:2303.14389,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.19311","last_updated":"2026-07-12T14:26:35Z","snapshot_observed_at":"2026-08-07T18:54:26.140556Z","submitted_at":"2025-12-22T12:00:12Z","title":"MixFlow Training: Alleviating Exposure Bias with Slowed Interpolation Mixture","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T14:52:58.486535Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2512.19311"},"observation_digest":"sha256:8a0cdf99f0603404118e6c228ee737f90c4805fc7ff6204bc467a3f8d30b3ca9","observation_id":"03f3bb6d-8818-4b00-a448-c7feabaf1779","resolution":{"observed_at":"2026-08-03T14:52:58.486535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-03T11:04:31.510886Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.07773","last_updated":"2026-07-10T09:39:56Z","snapshot_observed_at":"2026-08-03T11:04:29.339883Z","submitted_at":"2026-01-12T17:52:11Z","title":"Self-transcendence: Is External Feature Guidance Indispensable for Accelerating Diffusion Transformer Training?","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T11:04:31.510886Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2601.07773"},"observation_digest":"sha256:aae766eabac94d3865f8127b98e528191aa290098909995cbb5149dd2f7699f8","observation_id":"c079214e-807c-49f7-9c58-21387021e06b","resolution":{"observed_at":"2026-08-03T11:04:31.510886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-03T01:25:17.988811Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthe- sizer.arXiv preprint arXiv:2303.14389,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10099","last_updated":"2026-07-03T15:19:24Z","snapshot_observed_at":"2026-08-06T13:27:43.962812Z","submitted_at":"2026-02-10T18:58:04Z","title":"Learning on the Manifold: Unlocking Standard Diffusion Transformers with Representation Encoders","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T01:25:17.988811Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2602.10099"},"observation_digest":"sha256:9010b602d48d907be489ff33e783619caec9029db2628980441a59283cc2acb9","observation_id":"58183840-cbc9-43e1-9211-a898cf2618d1","resolution":{"observed_at":"2026-08-03T01:25:17.988811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":"2303.14389","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-07-04T16:59:58.012604Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":"a67f1e5f-43fb-4052-b944-30056dfb4e0c","year":2023},"citing_paper":{"arxiv_id":"2604.15521","last_updated":"2026-04-16T21:00:41Z","snapshot_observed_at":"2026-07-06T23:03:02.938732Z","submitted_at":"2026-04-16T21:00:41Z","title":"Frequency-Aware Flow Matching for High-Quality Image Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T10:58:05.541289Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2604.15521"},"observation_digest":"sha256:d2bc4c4708c00d7f2c24e5666fb20aa37ffd888688a97e9d4ce6f3069ea55f87","observation_id":"5c1518a8-dd5e-4994-8795-6d20b65f287c","resolution":{"observed_at":"2026-05-10T11:00:04.070450Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":"2303.14389","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-07-04T16:59:58.012604Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":"a67f1e5f-43fb-4052-b944-30056dfb4e0c","year":2023},"citing_paper":{"arxiv_id":"2605.10790","last_updated":"2026-05-11T16:21:45Z","snapshot_observed_at":"2026-07-06T23:22:42.512039Z","submitted_at":"2026-05-11T16:21:45Z","title":"Elucidating Representation Degradation Problem in Diffusion Model Training","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T04:08:11.110912Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2605.10790"},"observation_digest":"sha256:fa8bcbd6ce2731d32ac63796fbc9c04645af87ac3b0c0572beebbe04604844dc","observation_id":"ac176980-f38e-4997-a44e-7c5816f76ab2","resolution":{"observed_at":"2026-05-12T06:36:26.493662Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":"2303.14389","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-07-04T16:59:58.012604Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":"a67f1e5f-43fb-4052-b944-30056dfb4e0c","year":2023},"citing_paper":{"arxiv_id":"2605.16949","last_updated":"2026-05-16T12:01:04Z","snapshot_observed_at":"2026-08-01T18:23:13.593122Z","submitted_at":"2026-05-16T12:01:04Z","title":"Beyond Point-Wise Matching: Structural Representation Alignment for Accelerating Diffusion Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-19T20:49:25.902880Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2605.16949"},"observation_digest":"sha256:4dd6e73230367720c4261fe4748a26699799c9372eb0df564766fa86e0af21fe","observation_id":"a1027c89-f100-4471-a510-0f14b6e9707a","resolution":{"observed_at":"2026-05-19T20:52:46.132591Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":"2303.14389","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-07-04T16:59:58.012604Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":"a67f1e5f-43fb-4052-b944-30056dfb4e0c","year":2023},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T11:59:54.139888Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:e30398fcef75b641cd2437c7474448372de0c7b050bae2c20906dd5ba5a5efe1","observation_id":"381547cd-0aad-44ec-9f86-95726728a654","resolution":{"observed_at":"2026-05-20T12:03:15.293463Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":"2303.14389","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-07-04T16:59:58.012604Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":"a67f1e5f-43fb-4052-b944-30056dfb4e0c","year":2023},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T18:39:40.667006Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:2886b07e8c4d31a0ab8c9c1141690a76df0a830dbb26c191715a503caeb515b6","observation_id":"51d63d71-cd4d-46bc-9816-ccfe3db4ca51","resolution":{"observed_at":"2026-06-30T18:45:00.660682Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-02T13:49:20.048386Z","title":"MDTv2: Masked diffusion transformer is a strong image synthesizer,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.18267","last_updated":"2026-07-24T06:29:36Z","snapshot_observed_at":"2026-08-02T13:49:17.490757Z","submitted_at":"2026-05-18T12:03:41Z","title":"SRC-Flow: Compact Semantic Representations Enable Normalizing Flows for Image Generation","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T13:49:20.048386Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2605.18267"},"observation_digest":"sha256:7dbb7a1ba24d4c4bb28355e7791f534871142d5c0ecd76f237a33ea4487ccc6c","observation_id":"ec2e448b-0fb0-4faa-b06e-1d8544d558fe","resolution":{"observed_at":"2026-08-02T13:49:20.048386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":"2303.14389","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-07-04T16:59:58.012604Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":"a67f1e5f-43fb-4052-b944-30056dfb4e0c","year":2023},"citing_paper":{"arxiv_id":"2605.21981","last_updated":"2026-05-21T04:21:43Z","snapshot_observed_at":"2026-07-06T23:32:20.708664Z","submitted_at":"2026-05-21T04:21:43Z","title":"RiT: Vanilla Diffusion Transformers Suffice in Representation Space","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T07:50:29.461854Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2605.21981"},"observation_digest":"sha256:3d7a83f04a4e3e989d7b53fc223e9ef2ab19f52c3edececa79a40952eb29037f","observation_id":"5b1e99e9-8407-44bd-b327-24cc0efafc44","resolution":{"observed_at":"2026-05-22T07:51:15.941712Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":"2303.14389","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-07-04T16:59:58.012604Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":"a67f1e5f-43fb-4052-b944-30056dfb4e0c","year":2023},"citing_paper":{"arxiv_id":"2606.08788","last_updated":"2026-06-07T19:11:22Z","snapshot_observed_at":"2026-07-06T23:48:16.585598Z","submitted_at":"2026-06-07T19:11:22Z","title":"MaskAlign: Token-Subset Representation Alignment for Efficient Diffusion Training","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T18:44:41.266768Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2606.08788"},"observation_digest":"sha256:962d6f57001367bcf2e07f5714d96ceb94f6cb4d47c0904914fca3fb36ef55da","observation_id":"c957eadd-8778-47bd-8db0-732198915409","resolution":{"observed_at":"2026-07-02T22:37:26.189973Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":"2303.14389","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-07-04T16:59:58.012604Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":"a67f1e5f-43fb-4052-b944-30056dfb4e0c","year":2023},"citing_paper":{"arxiv_id":"2606.24888","last_updated":"2026-06-23T17:59:55Z","snapshot_observed_at":"2026-08-08T16:38:03.178919Z","submitted_at":"2026-06-23T17:59:55Z","title":"DiffusionBench: On Holistic Evaluation of Diffusion Transformers","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-26T00:06:11.951205Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2606.24888"},"observation_digest":"sha256:cbcee01d8573735c7f0c5dd3a5b22ea6d82314986a528c7cf5dac2e471292b38","observation_id":"82f24cb8-1f4d-4109-877e-af91f694d9f6","resolution":{"observed_at":"2026-07-04T16:59:58.013972Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":"2303.14389","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-07-04T16:59:58.012604Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer","venue":null,"work_id":"a67f1e5f-43fb-4052-b944-30056dfb4e0c","year":2023},"citing_paper":{"arxiv_id":"2606.32039","last_updated":"2026-06-30T17:59:57Z","snapshot_observed_at":"2026-07-07T00:05:41.920778Z","submitted_at":"2026-06-30T17:59:57Z","title":"GEAR: Guided End-to-End AutoRegression for Image Synthesis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-01T05:19:21.647714Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2606.32039"},"observation_digest":"sha256:8cf6e57ecb121714273201087ff13ac7787a87d3b012c84e0121090ecd2f716c","observation_id":"1a779831-6544-43a7-a186-39e6a22f8d61","resolution":{"observed_at":"2026-07-01T10:35:42.650156Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-01T13:25:53.938768Z","title":"Mdtv2: Masked diffusion transformer is a strong image synthesizer.arXiv preprint arXiv:2303.14389, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19139","last_updated":"2026-07-30T16:07:04Z","snapshot_observed_at":"2026-08-03T13:02:29.806237Z","submitted_at":"2026-07-21T14:29:59Z","title":"Text Template Tokens Are Implicit Semantic Registers in Diffusion Transformers","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T13:25:53.938768Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2607.19139"},"observation_digest":"sha256:3318c6349ea5f167d21d59571edb5bb1111769006b3e1ea7c6ec4a954ae5bd0a","observation_id":"36f981b6-bb10-4ddd-81f4-3ea6dfe240cb","resolution":{"observed_at":"2026-08-01T13:25:53.938768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-01T04:30:01.208956Z","title":"arXiv preprint arXiv:2303.14389 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22531","last_updated":"2026-07-24T17:59:39Z","snapshot_observed_at":"2026-08-07T13:04:18.211748Z","submitted_at":"2026-07-24T17:59:39Z","title":"Twins: Learn to Predict Unified Representations with Focal Loss","version":1},"reference_index":164,"source":"arxiv_source","source_observed_at":"2026-08-01T04:30:01.208956Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2607.22531"},"observation_digest":"sha256:e451e1ba9ffb8327a1df1bd8bcb79dfa93ea45ebef7572db4c8a3fbbe2fa4b64","observation_id":"23ce7ac8-7ea6-49cb-957a-eaa4f6ab1f47","resolution":{"observed_at":"2026-08-01T04:30:01.208956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-08T01:07:12.008720Z","title":"Mdtv2: Masked dif- fusion transformer is a strong image synthesizer,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03082","last_updated":"2026-08-04T03:51:15Z","snapshot_observed_at":"2026-08-08T15:16:52.081280Z","submitted_at":"2026-08-04T03:51:15Z","title":"DiverseDiT++: Quantifying, Analyzing, and Promoting Representation Diversity in Diffusion Transformers","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-08T01:07:12.008720Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2608.03082"},"observation_digest":"sha256:f7623d224f15d68b9f5660dd38f19b24f361dda3a7c31eb5e2cd4ee8a7e6aecb","observation_id":"9cad9d96-40dd-4e63-920c-63489b70685c","resolution":{"observed_at":"2026-08-08T01:07:12.008720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14389","snapshot_observed_at":"2026-08-06T22:57:59.676462Z","title":"arXiv preprint arXiv:2303.14389 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04525","last_updated":"2026-08-05T06:57:30Z","snapshot_observed_at":"2026-08-08T23:11:50.943497Z","submitted_at":"2026-08-05T06:57:30Z","title":"Coupled Continuous-Discrete Generation for Scene Text Image Super-Resolution","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T22:57:59.676462Z"},"links":{"cited_paper":"/paper/2303.14389","citing_paper":"/paper/2608.04525"},"observation_digest":"sha256:fe360d97b5d3bb06ba7fab64c0e5d942c05ee0635c1d0d115d24f8abf90fd7ec","observation_id":"271ee0eb-d2ec-493e-8114-f614818b8612","resolution":{"observed_at":"2026-08-06T22:57:59.676462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2303.14389/citation-record","integrity":"/paper/2303.14389/integrity","json":"/paper/2303.14389/citation-record.json","paper":"/paper/2303.14389"},"outbound":[],"paper":{"arxiv_id":"2303.14389","last_updated":"2024-02-21T15:45:20Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T15:07:52.629778Z","submitted_at":"2023-03-25T07:47:21Z","title":"MDTv2: Masked Diffusion Transformer is a Strong Image Synthesizer"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 30 inbound Pith citation observations for arXiv:2303.14389."}