{"as_of":"2026-08-18T05:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8124d49ce0faa7589904ee8afcd4245e282a739c7b3811d0ad37f5a0bb4332b4","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T14:57:58.156327Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:46:46.801330Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T21:00:08.910100Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-08-12T10:26:51.096797Z","title":"Makeany- thing: Harnessing diffusion transformers for multi- domain procedural sequence generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.00136","last_updated":"2025-07-11T09:19:13Z","snapshot_observed_at":"2026-08-13T10:43:01.522240Z","submitted_at":"2024-11-28T16:19:37Z","title":"FonTS: Text Rendering with Typography and Style Controls","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T10:26:51.096797Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2412.00136"},"observation_digest":"sha256:e2f6b5986598f8e8d84bf6fcd9a04066c600e02cbb0cd9807b31344f6010fbc1","observation_id":"039d8667-d1a3-41fd-9afe-7bca0471645e","resolution":{"observed_at":"2026-08-12T10:26:51.096797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-08-09T16:37:25.874358Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.01105","last_updated":"2025-08-13T17:32:12Z","snapshot_observed_at":"2026-08-16T07:18:36.512166Z","submitted_at":"2025-02-03T06:49:58Z","title":"LayerTracer: Cognitive-Aligned Layered SVG Synthesis via Diffusion Transformer","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T16:37:25.874358Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2502.01105"},"observation_digest":"sha256:4f94b02614d21df70b8ede6c520017df73324fe0beb1cc4418f8f43f06c4a36c","observation_id":"374737ec-16f5-40c0-b49a-e0c6f6ecceb1","resolution":{"observed_at":"2026-08-09T16:37:25.874358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-08-16T05:46:46.801330Z","title":"Makeany- thing: Harnessing diffusion transformers for multi- domain procedural sequence generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19894","last_updated":"2025-04-28T15:28:14Z","snapshot_observed_at":"2026-08-18T01:50:51.373925Z","submitted_at":"2025-04-28T15:28:14Z","title":"CineVerse: Consistent Keyframe Synthesis for Cinematic Scene Composition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T05:46:46.801330Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2504.19894"},"observation_digest":"sha256:aae49d01c2e04d2a65b1870c65dcc3c1e3bdaac4c2bb5961fae2e25f92dac359","observation_id":"e8ec263a-0240-437d-905e-534b3b71a9be","resolution":{"observed_at":"2026-08-16T05:46:46.801330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-08-07T14:34:09.275472Z","title":"Makeanything: Harnessing diffusion transformers for multi-domain procedural sequence generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18445","last_updated":"2025-05-24T01:00:20Z","snapshot_observed_at":"2026-08-14T15:33:29.385759Z","submitted_at":"2025-05-24T01:00:20Z","title":"OmniConsistency: Learning Style-Agnostic Consistency from Paired Stylization Data","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:09.275472Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2505.18445"},"observation_digest":"sha256:047796fc3c413f358ed9215355d0cb60c0224f0fcac9963f8f1d313eb53a530f","observation_id":"26bdb86f-125e-4a6e-a8e5-d1089ff65177","resolution":{"observed_at":"2026-08-07T14:34:09.275472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-08-07T14:29:18.374730Z","title":"Makeanything: Harnessing diffusion transformers for multi-domain procedural sequence generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21541","last_updated":"2025-09-01T09:14:35Z","snapshot_observed_at":"2026-08-13T07:49:40.923014Z","submitted_at":"2025-05-24T16:08:04Z","title":"DiffDecompose: Layer-Wise Decomposition of Alpha-Composited Images via Diffusion Transformers","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:18.374730Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2505.21541"},"observation_digest":"sha256:cd7bde071fc4b730e89d7a3aec13044ae0febda9f0b9d023f5548866cbeba5a8","observation_id":"8d6b19c1-8468-4d46-90eb-7cf261940b9c","resolution":{"observed_at":"2026-08-07T14:29:18.374730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-08-07T11:57:35.512200Z","title":"Makeanything: Harnessing diffusion transformers for multi-domain procedural sequence generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01011","last_updated":"2025-06-01T13:44:20Z","snapshot_observed_at":"2026-08-17T07:31:41.008252Z","submitted_at":"2025-06-01T13:44:20Z","title":"Autoregressive Images Watermarking through Lexical Biasing: An Approach Resistant to Regeneration Attack","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:35.512200Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2506.01011"},"observation_digest":"sha256:837b8732eda231197f9a5665cf68f447aa1f4f2bea569334fa06cc3e550fde30","observation_id":"5bdbdaad-4883-4a05-a982-36cedb85592c","resolution":{"observed_at":"2026-08-07T11:57:35.512200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-08-07T11:26:28.950281Z","title":"Makeanything: Harnessing diffusion transformers for multi-domain procedural sequence generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02528","last_updated":"2025-06-03T07:06:35Z","snapshot_observed_at":"2026-08-15T06:04:23.769034Z","submitted_at":"2025-06-03T07:06:35Z","title":"RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:26:28.950281Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2506.02528"},"observation_digest":"sha256:f0085c14deefe4f26b8c106d9c6fcd0b78375badc1f34185921cf54acfedbc6a","observation_id":"b82dea6b-4752-40b1-9b8d-7f4016464b36","resolution":{"observed_at":"2026-08-07T11:26:28.950281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-08-06T22:29:28.515245Z","title":"MakeAnything: Harnessing diffusion trans- formers for multi-domain procedural sequence generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.21681","last_updated":"2025-06-26T18:09:09Z","snapshot_observed_at":"2026-08-17T09:26:36.263335Z","submitted_at":"2025-06-26T18:09:09Z","title":"TanDiT: Tangent-Plane Diffusion Transformer for High-Quality 360{\\deg} Panorama Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:29:28.515245Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2506.21681"},"observation_digest":"sha256:23d58732d70ea13189cc9ebe67b77c647df07426d235ad30b3a2ba1239664547","observation_id":"9daa639e-1679-4377-a5cf-b135dfdf5524","resolution":{"observed_at":"2026-08-06T22:29:28.515245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-08-03T20:54:30.382188Z","title":"Makeany- thing: Harnessing diffusion transformers for multi- domain procedural sequence generation.arXiv preprint arXiv:2502.01572, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17979","last_updated":"2026-06-30T16:15:01Z","snapshot_observed_at":"2026-08-14T05:13:29.300383Z","submitted_at":"2025-11-22T08:46:18Z","title":"FeRA: Frequency-Energy Constrained Routing for Effective Diffusion Adaptation Fine-Tuning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T20:54:30.382188Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2511.17979"},"observation_digest":"sha256:3c6cfdc7acf13ab305b9ef3bb298deb4d29349119c8b7f8f4298d589cba0956f","observation_id":"5584b48b-59b3-4299-9abc-2b5772edbb69","resolution":{"observed_at":"2026-08-03T20:54:30.382188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-08-03T19:54:50.070424Z","title":"Makeany- thing: Harnessing diffusion transformers for multi- domain procedural sequence generation.arXiv preprint arXiv:2502.01572, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.22098","last_updated":"2026-07-16T03:47:27Z","snapshot_observed_at":"2026-08-03T19:54:46.253087Z","submitted_at":"2025-11-27T04:40:37Z","title":"WorldWander: Bridging Egocentric and Exocentric Worlds in Video Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T19:54:50.070424Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2511.22098"},"observation_digest":"sha256:8b93f1768c70172dcf89e36fb77bcb417237808a900226b6263f60af7ddb5e2b","observation_id":"1c48d2df-6219-4d34-961b-48c58467b5e9","resolution":{"observed_at":"2026-08-03T19:54:50.070424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":"2502.01572","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-07-04T21:00:08.910100Z","title":"Makeany- thing: Harnessing diffusion transformers for multi- domain procedural sequence generation","venue":null,"work_id":"6fa877fe-bc2e-4e6a-9954-1f0687a2fe88","year":2025},"citing_paper":{"arxiv_id":"2605.07455","last_updated":"2026-05-08T09:01:20Z","snapshot_observed_at":"2026-08-14T14:05:13.773061Z","submitted_at":"2026-05-08T09:01:20Z","title":"EditTransfer++: Toward Faithful and Efficient Visual-Prompt-Guided Image Editing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-11T01:57:20.762939Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2605.07455"},"observation_digest":"sha256:d85b81fe6a50da9c214745a6a21514fa58c4ccc322f26b3a8120d5a55574b2dd","observation_id":"884e91e2-fc72-4291-9d66-89a6a73f1b86","resolution":{"observed_at":"2026-05-11T04:05:57.812352Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":"2502.01572","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-07-04T21:00:08.910100Z","title":"Makeany- thing: Harnessing diffusion transformers for multi- domain procedural sequence generation","venue":null,"work_id":"6fa877fe-bc2e-4e6a-9954-1f0687a2fe88","year":2025},"citing_paper":{"arxiv_id":"2605.12038","last_updated":"2026-05-12T12:21:11Z","snapshot_observed_at":"2026-08-13T07:43:17.033243Z","submitted_at":"2026-05-12T12:21:11Z","title":"OmniHumanoid: Streaming Cross-Embodiment Video Generation with Paired-Free Adaptation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T06:54:49.169238Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2605.12038"},"observation_digest":"sha256:c97ba455d010dde7dfed9cc612acf2701d19244b565e4fd2649934e879444bb2","observation_id":"0229818d-37de-4389-82ea-c0bb07a5de2d","resolution":{"observed_at":"2026-05-13T06:57:27.947168Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":"2502.01572","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-07-04T21:00:08.910100Z","title":"Makeany- thing: Harnessing diffusion transformers for multi- domain procedural sequence generation","venue":null,"work_id":"6fa877fe-bc2e-4e6a-9954-1f0687a2fe88","year":2025},"citing_paper":{"arxiv_id":"2605.17248","last_updated":"2026-05-17T04:10:55Z","snapshot_observed_at":"2026-08-16T00:14:17.051626Z","submitted_at":"2026-05-17T04:10:55Z","title":"Image-to-Video Diffusion: From Foundations to Open Frontiers","version":1},"reference_index":144,"source":"pdf_text","source_observed_at":"2026-05-20T15:06:02.084336Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2605.17248"},"observation_digest":"sha256:3b82f5ff712c1c30aa9af3c3516efe337199f49d52b22d51e136a87260c90050","observation_id":"d3135517-97c4-45a3-87c0-b1fece647bf3","resolution":{"observed_at":"2026-05-20T15:08:24.936744Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":"2502.01572","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-07-04T21:00:08.910100Z","title":"Makeany- thing: Harnessing diffusion transformers for multi- domain procedural sequence generation","venue":null,"work_id":"6fa877fe-bc2e-4e6a-9954-1f0687a2fe88","year":2025},"citing_paper":{"arxiv_id":"2605.17312","last_updated":"2026-05-17T08:03:53Z","snapshot_observed_at":"2026-08-15T08:44:55.588302Z","submitted_at":"2026-05-17T08:03:53Z","title":"VISTA: Triplet-Supervised Video Style Transfer with Diffusion Transformers","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-20T14:14:41.662856Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2605.17312"},"observation_digest":"sha256:bf9a0bc21fcf119f886fd2c1ed2a81cf4da5d83f54475bfa21d596996053c1e9","observation_id":"243503ef-a2f1-4584-8130-ffa7c93bdd52","resolution":{"observed_at":"2026-05-20T14:18:21.403107Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":"2502.01572","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-07-04T21:00:08.910100Z","title":"Makeany- thing: Harnessing diffusion transformers for multi- domain procedural sequence generation","venue":null,"work_id":"6fa877fe-bc2e-4e6a-9954-1f0687a2fe88","year":2025},"citing_paper":{"arxiv_id":"2605.19319","last_updated":"2026-05-19T03:54:46Z","snapshot_observed_at":"2026-08-14T13:28:16.735840Z","submitted_at":"2026-05-19T03:54:46Z","title":"SWEET: Sparse World Modeling with Image Editing for Embodied Task Execution","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-20T07:04:24.854846Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2605.19319"},"observation_digest":"sha256:e4bf1f61613e2abf691e67e171fc3bfb13b538608f7766080593edd9f63c4631","observation_id":"60aa761a-87bd-4d84-abc8-a2b9fd974172","resolution":{"observed_at":"2026-05-20T07:08:07.235554Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":"2502.01572","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-07-04T21:00:08.910100Z","title":"Makeany- thing: Harnessing diffusion transformers for multi- domain procedural sequence generation","venue":null,"work_id":"6fa877fe-bc2e-4e6a-9954-1f0687a2fe88","year":2025},"citing_paper":{"arxiv_id":"2605.22051","last_updated":"2026-05-21T06:38:22Z","snapshot_observed_at":"2026-08-15T23:12:56.135889Z","submitted_at":"2026-05-21T06:38:22Z","title":"EasyVFX: Frequency-Driven Decoupling for Resource-Efficient VFX Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-22T06:30:18.961069Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2605.22051"},"observation_digest":"sha256:adad9909f85c37f9056239753d5af1b9df720c087762e8f49b3a3f9d4fc9078e","observation_id":"750429f9-242b-464e-b298-08b65dbb7ebc","resolution":{"observed_at":"2026-05-22T06:31:09.841652Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":"2502.01572","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-07-04T21:00:08.910100Z","title":"Makeany- thing: Harnessing diffusion transformers for multi- domain procedural sequence generation","venue":null,"work_id":"6fa877fe-bc2e-4e6a-9954-1f0687a2fe88","year":2025},"citing_paper":{"arxiv_id":"2606.01399","last_updated":"2026-05-31T18:45:11Z","snapshot_observed_at":"2026-07-06T23:41:58.121923Z","submitted_at":"2026-05-31T18:45:11Z","title":"PAI-Studio: Cinematic Video Background Replacement with Camera-Aware Motion","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T17:14:23.336848Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2606.01399"},"observation_digest":"sha256:dba0cea0fb8e75f8e6b9e472f1f97d27919e4cebbd94f42a431a6077045f5942","observation_id":"71e8e947-b14b-498d-b180-e51565d28807","resolution":{"observed_at":"2026-07-01T21:16:14.776414Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":"2502.01572","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-07-04T21:00:08.910100Z","title":"Makeany- thing: Harnessing diffusion transformers for multi- domain procedural sequence generation","venue":null,"work_id":"6fa877fe-bc2e-4e6a-9954-1f0687a2fe88","year":2025},"citing_paper":{"arxiv_id":"2606.26092","last_updated":"2026-07-03T12:28:57Z","snapshot_observed_at":"2026-08-10T18:41:47.962564Z","submitted_at":"2026-06-24T17:59:06Z","title":"TryOnCrafter: Unleashing Camera Trajectories for Realistic Video Virtual Try-on via a Renderable 4D Try-on Proxy","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-25T19:20:45.217627Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2606.26092"},"observation_digest":"sha256:571aa57781e994a3ed13c8cff2634e9db8fce11673ab0993f9e35b55f7dc11e7","observation_id":"184f5782-62c2-44df-ae36-c36b97546f76","resolution":{"observed_at":"2026-07-04T21:00:08.911840Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-07-12T12:05:10.800662Z","title":"arXiv preprint arXiv:2502.01572 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26092","last_updated":"2026-07-03T12:28:57Z","snapshot_observed_at":"2026-08-10T18:41:47.962564Z","submitted_at":"2026-06-24T17:59:06Z","title":"TryOnCrafter: Unleashing Camera Trajectories for Realistic Video Virtual Try-on via a Renderable 4D Try-on Proxy","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-12T12:05:10.800662Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2606.26092"},"observation_digest":"sha256:3045a663606c8fec00e1454834cf1dd75502ebff8d92ec68c19ed1a6057c1006","observation_id":"259fd55a-5b7f-4a69-a4d4-2788c280fab9","resolution":{"observed_at":"2026-07-12T12:05:10.800662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01572","snapshot_observed_at":"2026-08-14T04:38:38.201575Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08460","last_updated":"2026-08-09T04:01:21Z","snapshot_observed_at":"2026-08-17T06:12:36.446548Z","submitted_at":"2026-08-09T04:01:21Z","title":"InstructionCrafter: Generating Consistent and High-Fidelity Visual Instructions","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T04:38:38.201575Z"},"links":{"cited_paper":"/paper/2502.01572","citing_paper":"/paper/2608.08460"},"observation_digest":"sha256:6ec8f3b70f3afdd0611cd71c64fd6999e78820484d9b9ad7e0b95f3f598dc29e","observation_id":"36625f80-31f9-4d13-9351-4ce90de08b3c","resolution":{"observed_at":"2026-08-14T04:38:38.201575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.01572/citation-record","integrity":"/paper/2502.01572/integrity","json":"/paper/2502.01572/citation-record.json","paper":"/paper/2502.01572"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:57.988902Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:57.988902Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:bf1e16377c2e168a7a6714fa83f8ad8cb3c91ebba35d9f008afb853bbbb728d5","observation_id":"6ed27e3c-55f7-469c-85c2-4c87668648d7","resolution":{"observed_at":"2026-08-09T14:57:57.988902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.600315Z","title":"Flux.1 ai, 2024","venue":null,"work_id":"9f3dd6a1-e0c7-496c-a6de-0d680afcb0a2","year":2024},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:57.996271Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:520ad945cdd2ee17e163947d38b258b46d96c579fbba2c54ec0d4087038d9a8f","observation_id":"dc11ca15-d72e-4199-b1b6-885d09cf2cee","resolution":{"observed_at":"2026-08-09T14:57:58.604078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-17T12:45:30.627161Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-09T14:57:58.000060Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.000060Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:edb3239026bbc0076b8775cfbbc2c94c41440d15513d16faf4adefb2fc3be365","observation_id":"967a6a00-4b04-433f-801f-06c86d308947","resolution":{"observed_at":"2026-08-09T14:57:58.000060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.004667Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.004667Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:2e2258c115f6953bd266b4133a06feb6152101c711104de7ab8116be2d0164d4","observation_id":"3b58efa6-e432-4d7c-8a19-d21b6a666b93","resolution":{"observed_at":"2026-08-09T14:57:58.004667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.582562Z","title":null,"venue":null,"work_id":"2fb7b6fb-155e-4523-b105-1f5e3df81865","year":2024},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.008301Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:e5c1356532abf3af70262a11c37504d124bb847ca9702cbe30a4b0a44c3db2c7","observation_id":"8481abd6-d524-4a23-a9fd-928b7e97c8d8","resolution":{"observed_at":"2026-08-09T14:57:58.586239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.570920Z","title":"Civitai website","venue":null,"work_id":"e777e072-1e70-46f2-bf7f-f7161e45d303","year":2025},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.012090Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:bb8c75713889be569f9331f497683bda6aef35af9904dcbf943bc4cdc765b887","observation_id":"81e2a627-fb26-4bb9-8261-3fa36e7e6232","resolution":{"observed_at":"2026-08-09T14:57:58.575417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.015856Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.015856Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:96c663dfd196871ae23292c4579f1e69f0d353fdaf753b1bf9c8b8d47c579a7c","observation_id":"acb46ef1-9320-4c13-9171-0df2d654a0d5","resolution":{"observed_at":"2026-08-09T14:57:58.015856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.019882Z","title":"Clipdraw: Exploring text-to-drawing synthesis through language-image encoders","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.019882Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:ef2ccd0a6504dac850daf2dc21feed09b2ecce5318b464bd0bbf563b8acc7338","observation_id":"9e15c2e3-47c8-48d2-a546-57682fe78bae","resolution":{"observed_at":"2026-08-09T14:57:58.019882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-17T14:04:31.230742Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-09T14:57:58.023421Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.023421Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:2a5fb1806d61b2849f934a90614f130a3ac060d2548ae56756af305a5b0825d9","observation_id":"80996edd-4386-4e98-a497-5f986ead27e7","resolution":{"observed_at":"2026-08-09T14:57:58.023421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.03477","last_updated":"2017-05-19T16:40:16Z","snapshot_observed_at":"2026-08-17T19:56:22.199047Z","submitted_at":"2017-04-11T18:09:01Z","title":"A Neural Representation of Sketch Drawings","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.03477","snapshot_observed_at":"2026-08-09T14:57:58.027450Z","title":"and Eck, D","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.027450Z"},"links":{"cited_paper":"/paper/1704.03477","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:fe2fce2307e6687a172bc9762a745f537bb609abb800b87255f21a9c45738825","observation_id":"38c31ad1-2d63-4f12-933e-aaf3e0bf6814","resolution":{"observed_at":"2026-08-09T14:57:58.027450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.547112Z","title":"Paint by numbers: Abstract image representations","venue":null,"work_id":"1ae07bda-a929-4bd0-a431-09b05502f478","year":1990},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.031414Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:e848ee3d447097cef02d505d89472d5aa281c6aede4266134febba0138ffd7f3","observation_id":"299516d9-8c10-4bd6-b0b8-90862536e6b2","resolution":{"observed_at":"2026-08-09T14:57:58.550776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-08-17T00:44:11.103098Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-09T14:57:58.035334Z","title":"Prompt-to-prompt image editing with cross attention control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.035334Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:e580a0ef7743dbb83de2b7cd8a177dbf80f2ead6bdfd0d4f1c3c84ce4f547cf2","observation_id":"25c90448-1742-4ee5-bfea-bb6a907dc033","resolution":{"observed_at":"2026-08-09T14:57:58.035334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.536204Z","title":"A survey of stroke-based rendering","venue":null,"work_id":"fa8e3d1b-427b-41dd-b58f-61ca2750752d","year":2003},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.039035Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:9a7b10a43794eb821459bec89895f48f29da2f629c09f4ee2ba7da63d22e2dfe","observation_id":"1ab4c696-1fb0-44c3-8ebb-73d29dc703f1","resolution":{"observed_at":"2026-08-09T14:57:58.539916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.042415Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.042415Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:088fc8e18ad0395f3357d82d0a66fe7a5a88e62b36c3fda06f25cd496212d693","observation_id":"ece8bcf7-9dca-4ebf-8c74-9aa2b1e60a0a","resolution":{"observed_at":"2026-08-09T14:57:58.042415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.045617Z","title":"J., Shen, Y., Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.045617Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:7836ed92ca37ab8cb44a72bd4955193b7242def2108767cb4f46cc33b786796c","observation_id":"0db9db6c-249e-495b-a5a2-25820d370ba3","resolution":{"observed_at":"2026-08-09T14:57:58.045617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.512854Z","title":"Ideogram ai, 2023","venue":null,"work_id":"9099326b-f0fc-4e04-adfd-ea2bece06954","year":2023},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.048767Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:ef78fd5dc40ab93b31e997af502098e77763d8bb3defe7faa0e3f341076531ac","observation_id":"31e41bd4-0bb2-48fe-bf7a-5df89af22e44","resolution":{"observed_at":"2026-08-09T14:57:58.516645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.501194Z","title":"Rethinking style transfer: From pixels to parameterized brushstrokes","venue":null,"work_id":"fa07b0a6-e8c0-4b60-9cb2-b7ac72dca548","year":2021},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.051945Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:8c12e7d91ccc4de2aee5fd71f710cd4f706a3940bf9544f2eaf37802c6a3e720","observation_id":"61324d8e-628b-4ab4-9ed4-b7f7891b8e98","resolution":{"observed_at":"2026-08-09T14:57:58.505513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.055186Z","title":"Multi-concept customization of text-to-image diffusion","venue":null,"work_id":null,"year":1931},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.055186Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:d920c49bd62898ce1138a440091b4ef55d53a118693da773a17774c6d2e2b6a8","observation_id":"ef03b348-84aa-4c4a-9b84-830d8d31e2e7","resolution":{"observed_at":"2026-08-09T14:57:58.055186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.483627Z","title":"Processing images and video for an impressionist effect","venue":null,"work_id":"c6575df2-da8e-42f4-b3b0-0c4a51b59984","year":1997},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.058582Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:850ab27b75c7cfd297181c24bbeff7e4e1a455d4182225b9088788c3e8d31e6c","observation_id":"76b7851e-1838-4126-abd3-28caba2d5720","resolution":{"observed_at":"2026-08-09T14:57:58.487684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08453","last_updated":"2023-03-20T10:52:26Z","snapshot_observed_at":"2026-08-13T05:43:28.614772Z","submitted_at":"2023-02-16T17:56:08Z","title":"T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.08453","snapshot_observed_at":"2026-08-09T14:57:58.062017Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.062017Z"},"links":{"cited_paper":"/paper/2302.08453","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:f9fcb1361dfafc3e811e48ce0fd57ba4095dc7d9546dac5075745579af11a0ad","observation_id":"6c17d20d-1ecd-4fab-b06f-7436c801c50f","resolution":{"observed_at":"2026-08-09T14:57:58.062017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08410","last_updated":"2019-04-22T17:14:53Z","snapshot_observed_at":"2026-08-14T16:45:17.082987Z","submitted_at":"2019-04-17T03:03:49Z","title":"Neural Painters: A learned differentiable constraint for generating brushstroke paintings","version":2},"cited_work":{"arxiv_id":"1904.08410","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.08410","snapshot_observed_at":"2026-08-09T14:57:58.314668Z","title":"Neural Painters: A learned differentiable constraint for generating brushstroke paintings","venue":"cs.CV","work_id":"92959385-e13e-44c1-90e2-e49dfbee902b","year":2019},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.065436Z"},"links":{"cited_paper":"/paper/1904.08410","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:30dc5ddabda6d9dbbc9977fab57a921dfd17bbe086020a55ac82128c1f363847","observation_id":"ed4d4351-6757-4553-a80d-147b9b7fe592","resolution":{"observed_at":"2026-08-09T14:57:58.318771Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.04107","last_updated":"2020-09-09T05:06:44Z","snapshot_observed_at":"2026-08-12T02:41:17.543622Z","submitted_at":"2020-09-09T05:06:44Z","title":"Multi-modal Attention for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.04107","snapshot_observed_at":"2026-08-09T14:57:58.069148Z","title":"Multi-modal attention for speech emotion recognition","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.069148Z"},"links":{"cited_paper":"/paper/2009.04107","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:261c7635d20e146334ec6cb7003698c2a9a5e58ac022241a36363efaf844c48f","observation_id":"7c6409e1-6aa2-4a5b-be23-50389245a262","resolution":{"observed_at":"2026-08-09T14:57:58.069148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.072539Z","title":"and Xie, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.072539Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:69867227521ba951f4e681bcfd497261f7efb798f86962ff790fc18e8ae3e04e","observation_id":"7eb2123e-6bfd-4cc7-8b10-4dc0e9f9210f","resolution":{"observed_at":"2026-08-09T14:57:58.072539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.076014Z","title":"W., Hallacy, C., Ramesh, A., Goh, G., Agarwal, S., Sastry, G., Askell, A., Mishkin, P., Clark, J., Krueger, G., and Sutskever, I","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.076014Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:2e2c7f29c1ad6fe9361c909a6c5af5821bfc9b2837851fcee9585c318568d243","observation_id":"e6047b3a-39ab-4ad9-950c-230962d20e45","resolution":{"observed_at":"2026-08-09T14:57:58.076014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.079239Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.079239Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:545687f3c3329c430a689973b8cda4e68186f725d06eb87c4ef809f77a4d8a6e","observation_id":"12edf0bf-f2c4-416b-9a0f-012a01d00a8f","resolution":{"observed_at":"2026-08-09T14:57:58.079239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.082516Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.082516Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:7eaf01f3866f5bc51fabf7a2b3007cb4c4af089e72c15c5e3a3ab13c434b390c","observation_id":"ae651089-c66f-4721-87a1-bd861f3c4998","resolution":{"observed_at":"2026-08-09T14:57:58.082516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-09T14:57:58.085800Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.085800Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:160844e274d95dba0eba36ec64b85e9d47485386c2573acd53441df507df47b4","observation_id":"3bf57cfb-9b2d-46a4-bfc4-80b46b2e894a","resolution":{"observed_at":"2026-08-09T14:57:58.085800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.447434Z","title":"Cliptexture: Text-driven texture synthesis","venue":null,"work_id":"59b413d4-cbde-4f42-a1d3-e595f7f6fde8","year":2022},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.092496Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:3afcaefd2dd5420fcf7da4abb90dfbb3aa96c9d6138e12b268f18d196eb65488","observation_id":"4a3380dc-6b68-42dd-a6ac-17a074365652","resolution":{"observed_at":"2026-08-09T14:57:58.451337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.436456Z","title":"and Zhang, Y","venue":null,"work_id":"2124b02b-0ea5-4681-9914-77aef677d62e","year":2022},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.096273Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:8b1496cd9eaca6db910a303d296625d0efd70280094c6ed2bd558d0a82724d78","observation_id":"d7ca27cc-ad10-4fca-b39e-48c7bbb7f91e","resolution":{"observed_at":"2026-08-09T14:57:58.440371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.425629Z","title":"Clipvg: Text-guided image manipulation using differentiable vector graphics","venue":null,"work_id":"85fda40f-1ad5-4e9d-aecd-39970e70941e","year":2023},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.099517Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:439286bdbf28d0530fe438b6f469f71e45212adefa0090e3a1314df6a6cede3f","observation_id":"19bb9016-1b6b-4d49-804d-d5017cad067c","resolution":{"observed_at":"2026-08-09T14:57:58.429433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06062","last_updated":"2024-07-20T07:23:19Z","snapshot_observed_at":"2026-08-16T13:44:39.608173Z","submitted_at":"2024-06-10T07:18:41Z","title":"ProcessPainter: Learn Painting Process from Sequence Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06062","snapshot_observed_at":"2026-08-09T14:57:58.102941Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.102941Z"},"links":{"cited_paper":"/paper/2406.06062","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:802a1d5fa777fcf004edf799cdefe479d7b18d043d97e008d8913a287c156329","observation_id":"88ce3f48-f97a-42c6-ad5b-1d1c4ef834d3","resolution":{"observed_at":"2026-08-09T14:57:58.102941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14580","last_updated":"2024-12-19T07:00:03Z","snapshot_observed_at":"2026-08-15T18:47:07.779383Z","submitted_at":"2024-12-19T07:00:03Z","title":"DiffSim: Taming Diffusion Models for Evaluating Visual Similarity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14580","snapshot_observed_at":"2026-08-09T14:57:58.106513Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.106513Z"},"links":{"cited_paper":"/paper/2412.14580","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:5f4b7f0237cf2a9550273014a6576745f55cce70993b358915063a7fd37658cc","observation_id":"f535af2e-85fb-4ee1-a22c-131bac3f06c0","resolution":{"observed_at":"2026-08-09T14:57:58.106513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.110101Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.110101Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:2d59edb239b6bc58010d9778223090aa4bb3e22c74bb4c344667e3bd0d0efb8b","observation_id":"5309b183-e9e4-4938-9e3f-50064fae9e25","resolution":{"observed_at":"2026-08-09T14:57:58.110101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15098","last_updated":"2025-07-07T17:33:23Z","snapshot_observed_at":"2026-08-12T17:19:10.028618Z","submitted_at":"2024-11-22T17:55:15Z","title":"OminiControl: Minimal and Universal Control for Diffusion Transformer","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15098","snapshot_observed_at":"2026-08-09T14:57:58.113457Z","title":"Ominicontrol: Minimal and universal control for diffusion transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.113457Z"},"links":{"cited_paper":"/paper/2411.15098","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:f83054503c510ef497bb36cdd79b1511bd7fd92799961864e391d4c2e2947219","observation_id":"67323dc3-a4b1-434e-be71-d9be14f87e76","resolution":{"observed_at":"2026-08-09T14:57:58.113457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.408069Z","title":"Paints-undo github page, 2024","venue":null,"work_id":"ab733e55-848f-4480-bf26-327b5ccd25e8","year":2024},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.117170Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:a12826582240f375039468357db983b57581ec5296ea28385484b4acba0969b1","observation_id":"34a37c1c-8454-4240-8d89-774469540e6a","resolution":{"observed_at":"2026-08-09T14:57:58.411702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10718","last_updated":"2025-06-30T10:03:43Z","snapshot_observed_at":"2026-08-15T09:39:55.298033Z","submitted_at":"2024-12-14T07:22:03Z","title":"Grid: Omni Visual Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10718","snapshot_observed_at":"2026-08-09T14:57:58.120592Z","title":"Grid: Visual layout generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.120592Z"},"links":{"cited_paper":"/paper/2412.10718","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:5e23c4a8720f7b8f872dc8808d730886673b95cf4388d794b547384e0e40e6c3","observation_id":"a10e90a1-63ff-47d2-8c60-a7ff45f02df5","resolution":{"observed_at":"2026-08-09T14:57:58.120592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.396695Z","title":"Artist agent: A reinforcement learning approach to automatic stroke generation in oriental ink painting","venue":null,"work_id":"dd98a101-2430-4a17-9338-5dee517e46b1","year":2013},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.124149Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:93740374dd153d913fd486179618ae4fb55a9ede22551b8688c7b38ac2aebee7","observation_id":"c1ac490e-afa9-417c-a990-1bfbedf15a0e","resolution":{"observed_at":"2026-08-09T14:57:58.400616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-09T14:57:58.127544Z","title":"Ip-adapter: Text compatible image prompt adapter for text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.127544Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:1b610b9f3622dc3b46add403215cdc683b2e2290be0757cc89f470201cf154dc","observation_id":"273926e2-47b9-4156-897f-2c4adc7a357d","resolution":{"observed_at":"2026-08-09T14:57:58.127544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05543","last_updated":"2023-11-26T22:26:12Z","snapshot_observed_at":"2026-08-14T19:07:37.876970Z","submitted_at":"2023-02-10T23:12:37Z","title":"Adding Conditional Control to Text-to-Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05543","snapshot_observed_at":"2026-08-09T14:57:58.131170Z","title":"and Agrawala, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.131170Z"},"links":{"cited_paper":"/paper/2302.05543","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:a660d5b96418a0f100b0acb27b4659fe92338fa9f048312409f5b8b6bff208a2","observation_id":"b9534e1e-acd4-411a-a547-f07f9b1a2109","resolution":{"observed_at":"2026-08-09T14:57:58.131170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.384449Z","title":"Ssr-encoder: Encoding selective subject representation for subject-driven generation","venue":null,"work_id":"ae382bc5-dc97-4ceb-883c-16d1724011fd","year":2024},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.134785Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:7bf8127e75eb70fc4dffd1bb77b0cb19da9c6b2b198f6186c429852928bc0eea","observation_id":"e71dcd27-f69d-4a46-93f0-a6185da8bfad","resolution":{"observed_at":"2026-08-09T14:57:58.389419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T14:57:58.373226Z","title":"Fast personalized text to image synthesis with attention injection","venue":null,"work_id":"461693af-8b59-4b92-9ca4-ec9671e3d62b","year":2024},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.138152Z"},"links":{"citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:71bdf0e1ceec8b01d161cbd39e1ecfd5cc12573447b44454783ddfc84d13bc77","observation_id":"64a4109a-07f8-4d9d-b2c3-62868f6a90d9","resolution":{"observed_at":"2026-08-09T14:57:58.377175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07764","last_updated":"2025-04-01T08:37:38Z","snapshot_observed_at":"2026-08-16T14:10:31.597499Z","submitted_at":"2024-03-12T15:53:14Z","title":"Stable-Makeup: When Real-World Makeup Transfer Meets Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07764","snapshot_observed_at":"2026-08-09T14:57:58.141487Z","title":"Stable-makeup: When real-world makeup transfer meets diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.141487Z"},"links":{"cited_paper":"/paper/2403.07764","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:971f46633baef990f371b11fbacce1353d42c4a64d978afc8a48db613b061853","observation_id":"2d7ee338-ef0c-47fb-86c5-923bf2923bb0","resolution":{"observed_at":"2026-08-09T14:57:58.141487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14078","last_updated":"2024-12-10T16:04:50Z","snapshot_observed_at":"2026-08-16T13:32:49.752400Z","submitted_at":"2024-07-19T07:14:23Z","title":"Stable-Hair: Real-World Hair Transfer via Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14078","snapshot_observed_at":"2026-08-09T14:57:58.145032Z","title":"Stable-hair: Real-world hair transfer via diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.145032Z"},"links":{"cited_paper":"/paper/2407.14078","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:6403e7992a5016c8ad6ff6d00d5217fd233e78b6388990e9de8abc0942b44930","observation_id":"e5c72d21-2129-45cc-8ac4-d27f581a566c","resolution":{"observed_at":"2026-08-09T14:57:58.145032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16322","last_updated":"2023-10-29T15:59:24Z","snapshot_observed_at":"2026-08-16T15:29:35.916405Z","submitted_at":"2023-05-25T17:59:58Z","title":"Uni-ControlNet: All-in-One Control to Text-to-Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16322","snapshot_observed_at":"2026-08-09T14:57:58.149110Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.149110Z"},"links":{"cited_paper":"/paper/2305.16322","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:e0cca67155103890e44374cecdeee8cbc8faa8870d1c9530766c7917ba9c3dae","observation_id":"fb1d8669-99ec-4fa1-bf53-74bd44a3205e","resolution":{"observed_at":"2026-08-09T14:57:58.149110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.05977","last_updated":"2018-10-14T05:25:49Z","snapshot_observed_at":"2026-08-14T18:15:05.560768Z","submitted_at":"2018-10-14T05:25:49Z","title":"Learning to Sketch with Deep Q Networks and Demonstrated Strokes","version":1},"cited_work":{"arxiv_id":"1810.05977","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.05977","snapshot_observed_at":"2026-08-09T14:57:58.195907Z","title":"Learning to Sketch with Deep Q Networks and Demonstrated Strokes","venue":"cs.CV","work_id":"23b7965b-c16f-4003-b977-11d0dd833bba","year":2018},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.152904Z"},"links":{"cited_paper":"/paper/1810.05977","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:e8a9b0b1a73387fc58096381c0c894ababd6e3d46f114e602acd194271d714ab","observation_id":"03ce2a9e-2bd1-4011-80a8-5f453fa1911e","resolution":{"observed_at":"2026-08-09T14:57:58.201363Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16842","last_updated":"2024-02-27T18:06:29Z","snapshot_observed_at":"2026-08-16T14:15:11.301394Z","submitted_at":"2024-02-26T18:59:12Z","title":"Asymmetry in Low-Rank Adapters of Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16842","snapshot_observed_at":"2026-08-09T14:57:58.156327Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T14:57:58.156327Z"},"links":{"cited_paper":"/paper/2402.16842","citing_paper":"/paper/2502.01572"},"observation_digest":"sha256:569fbfffc5a7e84030799e3d6e49f1ac127f0e4824b5bda8bb80b732cb78ab86","observation_id":"eaa5234f-991c-48cc-86bd-876407d1bdc6","resolution":{"observed_at":"2026-08-09T14:57:58.156327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.01572","last_updated":"2025-02-05T02:44:42Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T09:25:55.758278Z","submitted_at":"2025-02-03T17:55:30Z","title":"MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":2,"verified_fuzzy":14},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 20 inbound Pith citation observations for arXiv:2502.01572."}