{"as_of":"2026-08-21T08:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a5aee3c5f0aa3320bbbd08a9b3a5f4545598c675c6c59b66477a83be726c3df1","coverage":[{"denominator":76,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":76,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T18:33:58.020660Z","state":"measured"},{"denominator":98,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":98,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:38:31.678978Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T06:29:37.949735Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-11T23:53:46.868411Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02114","last_updated":"2025-03-18T10:51:59Z","snapshot_observed_at":"2026-08-20T06:05:03.037735Z","submitted_at":"2024-12-03T03:10:19Z","title":"Beyond Generation: Unlocking Universal Editing via Self-Supervised Fine-Tuning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T23:53:46.868411Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2412.02114"},"observation_digest":"sha256:a1a614b094217517cd1c6dace0671d22db0f354c1baca03e4fe0f1d559b274d6","observation_id":"624e8f0d-0a8f-48e4-bcb5-67e6aad1615b","resolution":{"observed_at":"2026-08-11T23:53:46.868411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":"2412.07774","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-07-04T06:29:37.949735Z","title":"UniReal: Universal Image Generation and Editing via Learn- ing Real-world Dynamics","venue":null,"work_id":"332cdff1-3d93-4083-b113-924fd7d22054","year":2024},"citing_paper":{"arxiv_id":"2503.07598","last_updated":"2025-03-11T06:44:25Z","snapshot_observed_at":"2026-07-06T20:50:05.070886Z","submitted_at":"2025-03-10T17:57:04Z","title":"VACE: All-in-One Video Creation and Editing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T00:53:53.855965Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2503.07598"},"observation_digest":"sha256:ef623a6126a11cd6150e78ba5a9eb21314e754eb6476d43c07563955bae3df30","observation_id":"9e32d577-f4ab-4503-b162-f9ca96187b29","resolution":{"observed_at":"2026-05-16T00:53:54.087578Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-16T11:38:31.678978Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.15009","last_updated":"2025-04-21T10:19:12Z","snapshot_observed_at":"2026-08-18T16:44:15.904499Z","submitted_at":"2025-04-21T10:19:12Z","title":"Insert Anything: Image Insertion via In-Context Editing in DiT","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:38:31.678978Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2504.15009"},"observation_digest":"sha256:f672fe829c3a89de5d5f9dd9da3b0fc95840691022044df9b11f92f30684d19d","observation_id":"5dca44e2-f1c7-434d-ba09-9e17200f4100","resolution":{"observed_at":"2026-08-16T11:38:31.678978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-16T00:43:56.095195Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02823","last_updated":"2025-05-05T17:50:24Z","snapshot_observed_at":"2026-08-19T14:07:56.914586Z","submitted_at":"2025-05-05T17:50:24Z","title":"MUSAR: Exploring Multi-Subject Customization from Single-Subject Dataset via Attention Routing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:43:56.095195Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2505.02823"},"observation_digest":"sha256:bd0dc0ae855957d3ac603da91206de16327aa1e41cc0a77660e62f88d4b20fd0","observation_id":"01fefccd-c054-450c-8b23-faa792628daa","resolution":{"observed_at":"2026-08-16T00:43:56.095195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-07T14:25:21.664689Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19084","last_updated":"2025-05-25T10:40:52Z","snapshot_observed_at":"2026-08-16T11:10:25.521396Z","submitted_at":"2025-05-25T10:40:52Z","title":"Jodi: Unification of Visual Generation and Understanding via Joint Modeling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:21.664689Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2505.19084"},"observation_digest":"sha256:ad51e165a0d6e85d48d14b3909e5e2a58ff038bd015b18875f85dc26433352ff","observation_id":"ab528964-950d-4149-ab96-c82f5e05e0cd","resolution":{"observed_at":"2026-08-07T14:25:21.664689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-07T13:59:28.964637Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20292","last_updated":"2025-06-03T10:11:00Z","snapshot_observed_at":"2026-08-14T22:17:57.799591Z","submitted_at":"2025-05-26T17:59:46Z","title":"OpenS2V-Nexus: A Detailed Benchmark and Million-Scale Dataset for Subject-to-Video Generation","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:59:28.964637Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2505.20292"},"observation_digest":"sha256:0f74fd71db249cb9e647ccba2ceaca228a5bd3dbefa8a5199a45ab1daca41463","observation_id":"32a1c487-0f0f-45d1-b6cb-035ad5f57224","resolution":{"observed_at":"2026-08-07T13:59:28.964637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-07T11:14:04.913110Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03107","last_updated":"2025-06-11T06:11:36Z","snapshot_observed_at":"2026-08-13T15:37:59.000522Z","submitted_at":"2025-06-03T17:39:47Z","title":"ByteMorph: Benchmarking Instruction-Guided Image Editing with Non-Rigid Motions","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:14:04.913110Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2506.03107"},"observation_digest":"sha256:00611d6ab9076328d508205838684e3ea4d9d5177a697d512942196adcd37223","observation_id":"a094c6ca-2e94-43e1-ab11-cc6705b54a3a","resolution":{"observed_at":"2026-08-07T11:14:04.913110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-07T10:51:38.316876Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics.arXiv preprint arXiv:2412.07774, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04158","last_updated":"2025-06-04T16:57:24Z","snapshot_observed_at":"2026-08-19T15:53:14.360702Z","submitted_at":"2025-06-04T16:57:24Z","title":"Image Editing As Programs with Diffusion Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:51:38.316876Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2506.04158"},"observation_digest":"sha256:2a0ed3d5b9c81a23b61cf376bcf2ee2595120fe590c552cdda2631bfee4c85f0","observation_id":"070e05e2-3fec-4cfd-9dd1-6af808e2c668","resolution":{"observed_at":"2026-08-07T10:51:38.316876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-07T10:51:43.070533Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics.arXiv preprint arXiv:2412.07774, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04216","last_updated":"2025-06-04T17:57:43Z","snapshot_observed_at":"2026-08-17T15:59:48.747710Z","submitted_at":"2025-06-04T17:57:43Z","title":"UNIC: Unified In-Context Video Editing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:51:43.070533Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2506.04216"},"observation_digest":"sha256:96bb985eaefa11608a32d8187020fa57145d59feb04f5315e0cc37efabf6b3f3","observation_id":"135a8b6f-0c09-4fc7-af1c-1b687d006953","resolution":{"observed_at":"2026-08-07T10:51:43.070533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-07T05:43:40.028036Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics.arXiv preprint arXiv:2412.07774, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07227","last_updated":"2025-06-08T17:23:36Z","snapshot_observed_at":"2026-08-21T01:48:35.854275Z","submitted_at":"2025-06-08T17:23:36Z","title":"Hallucination at a Glance: Controlled Visual Edits and Fine-Grained Multimodal Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:43:40.028036Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2506.07227"},"observation_digest":"sha256:3c9a5fdc50a840104d1cd3fd8d7bf9d4e5a1a15f61f5add9a37bd40070a42d3b","observation_id":"30ddf113-d876-428b-b26e-898c2a7e035f","resolution":{"observed_at":"2026-08-07T05:43:40.028036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-06T22:31:37.447843Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics.arXiv preprint arXiv:2412.07774, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21416","last_updated":"2025-06-26T16:04:16Z","snapshot_observed_at":"2026-08-14T15:32:43.998293Z","submitted_at":"2025-06-26T16:04:16Z","title":"XVerse: Consistent Multi-Subject Control of Identity and Semantic Attributes via DiT Modulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:31:37.447843Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2506.21416"},"observation_digest":"sha256:ac6d0f310c5e8ee96d6d5c4431af5763139bd1aee3da84d521def5634a1ba23a","observation_id":"014d59ee-aa01-4d8d-ab3c-afd2cc834df1","resolution":{"observed_at":"2026-08-06T22:31:37.447843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-06T19:56:37.386683Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04285","last_updated":"2025-07-06T07:58:36Z","snapshot_observed_at":"2026-08-18T11:02:12.079129Z","submitted_at":"2025-07-06T07:58:36Z","title":"SeqTex: Generate Mesh Textures in Video Sequence","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:56:37.386683Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2507.04285"},"observation_digest":"sha256:f9aebf9d8509e7921138950c774230e405fe5d9e49ee7a3ba586dffa24df522b","observation_id":"46e8bf1c-3661-41d6-a1d8-1005c3bf9d12","resolution":{"observed_at":"2026-08-06T19:56:37.386683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-06T15:09:51.842385Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16813","last_updated":"2025-07-22T17:59:21Z","snapshot_observed_at":"2026-08-16T23:44:10.641835Z","submitted_at":"2025-07-22T17:59:21Z","title":"HOComp: Interaction-Aware Human-Object Composition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:09:51.842385Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2507.16813"},"observation_digest":"sha256:f1ed0ea9f2d8faaa92842986bddf288a6eed555cf0eb5c396fcf424206d24939","observation_id":"c7c9f2e3-1128-46a8-b834-678c30e3a6bd","resolution":{"observed_at":"2026-08-06T15:09:51.842385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-05T22:32:51.746505Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06905","last_updated":"2025-08-26T12:18:14Z","snapshot_observed_at":"2026-08-20T13:02:12.160946Z","submitted_at":"2025-08-09T09:36:21Z","title":"MultiRef: Controllable Image Generation with Multiple Visual References","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T22:32:51.746505Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2508.06905"},"observation_digest":"sha256:efc04151f42de780b5842961d35e6a0a50eda6763c80274aeeaa6ed9f6b44367","observation_id":"7538dfb0-3678-4926-8cb4-af1755f7b91e","resolution":{"observed_at":"2026-08-05T22:32:51.746505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-05T18:15:09.214089Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17437","last_updated":"2025-08-26T16:57:07Z","snapshot_observed_at":"2026-08-18T18:20:08.175803Z","submitted_at":"2025-08-20T19:24:04Z","title":"Pixie: Fast and Generalizable Supervised Learning of 3D Physics from Pixels","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T18:15:09.214089Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2508.17437"},"observation_digest":"sha256:b72eb035cf5ca2c7612af4aaac3b889bf14e86b78fb2ec20092f6f1adb329350","observation_id":"c9ce814f-e447-4f02-8573-ed68ca605cbd","resolution":{"observed_at":"2026-08-05T18:15:09.214089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-04T23:06:09.036965Z","title":"Unireal: Universal image generation and editing via learning real-world dynamics.arXiv preprint arXiv:2412.07774, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06818","last_updated":"2025-09-08T15:54:55Z","snapshot_observed_at":"2026-08-17T16:50:28.882150Z","submitted_at":"2025-09-08T15:54:55Z","title":"UMO: Scaling Multi-Identity Consistency for Image Customization via Matching Reward","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T23:06:09.036965Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2509.06818"},"observation_digest":"sha256:453eb2e6e57d43a55bef8006029b101c39cea070b82faa7ef87ac3da78ed41d3","observation_id":"65e9867e-d57f-4ac7-bf4b-459c078fbebf","resolution":{"observed_at":"2026-08-04T23:06:09.036965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-02T19:58:15.013476Z","title":"Unireal: Universal image generation and editing via learning real- world dynamics.arXiv preprint arXiv:2412.07774, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.00461","last_updated":"2026-06-10T06:57:00Z","snapshot_observed_at":"2026-08-12T20:25:39.865322Z","submitted_at":"2026-02-28T04:42:34Z","title":"ReMoT: Reinforcement Learning with Motion Contrast Triplets","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T19:58:15.013476Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2603.00461"},"observation_digest":"sha256:28eeb2fb674537585e50f6120fe9465ddb1cfdaf91827f3c49be39687b11e012","observation_id":"85cafed6-9bf7-46bb-b1da-268f07680143","resolution":{"observed_at":"2026-08-02T19:58:15.013476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":"2412.07774","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-07-04T06:29:37.949735Z","title":"UniReal: Universal Image Generation and Editing via Learn- ing Real-world Dynamics","venue":null,"work_id":"332cdff1-3d93-4083-b113-924fd7d22054","year":2024},"citing_paper":{"arxiv_id":"2604.23763","last_updated":"2026-04-30T04:05:16Z","snapshot_observed_at":"2026-08-11T09:39:21.336709Z","submitted_at":"2026-04-26T15:28:02Z","title":"Edit Where You Mean: Region-Aware Adapter Injection for Mask-Free Local Image Editing","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-08T06:47:22.451132Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2604.23763"},"observation_digest":"sha256:7ae68bfd357a493f62e3ec47ff9727bd7fb86f10d47a1925e12afef41095fa35","observation_id":"9550ee2f-71d8-42d6-9f45-076d1807c10d","resolution":{"observed_at":"2026-05-11T21:06:13.629870Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":"2412.07774","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-07-04T06:29:37.949735Z","title":"UniReal: Universal Image Generation and Editing via Learn- ing Real-world Dynamics","venue":null,"work_id":"332cdff1-3d93-4083-b113-924fd7d22054","year":2024},"citing_paper":{"arxiv_id":"2605.00707","last_updated":"2026-05-01T14:51:52Z","snapshot_observed_at":"2026-08-10T21:03:33.146040Z","submitted_at":"2026-05-01T14:51:52Z","title":"PhysEdit: Physically-Consistent Region-Aware Image Editing via Adaptive Spatio-Temporal Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-09T19:33:13.609552Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2605.00707"},"observation_digest":"sha256:919ebfcb03d413c710c9ff9df86ff1b4be3009fd5bb8f09835070059a6d77a6b","observation_id":"9b456ffe-b76d-40e4-8ef4-aa153883c5e2","resolution":{"observed_at":"2026-05-11T15:36:10.288554Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":"2412.07774","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-07-04T06:29:37.949735Z","title":"UniReal: Universal Image Generation and Editing via Learn- ing Real-world Dynamics","venue":null,"work_id":"332cdff1-3d93-4083-b113-924fd7d22054","year":2024},"citing_paper":{"arxiv_id":"2605.10859","last_updated":"2026-05-11T17:05:52Z","snapshot_observed_at":"2026-08-02T17:39:12.809856Z","submitted_at":"2026-05-11T17:05:52Z","title":"Masked Generative Transformer Is What You Need for Image Editing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T04:35:52.355925Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2605.10859"},"observation_digest":"sha256:15f8d058abe26d19da7dd640743a15323a93059ad74acda264ba4732ff4b13a1","observation_id":"42e26078-a221-49d1-bae0-e1d63e8a1bb2","resolution":{"observed_at":"2026-05-12T06:06:26.020344Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":"2412.07774","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-07-04T06:29:37.949735Z","title":"UniReal: Universal Image Generation and Editing via Learn- ing Real-world Dynamics","venue":null,"work_id":"332cdff1-3d93-4083-b113-924fd7d22054","year":2024},"citing_paper":{"arxiv_id":"2606.21337","last_updated":"2026-07-31T19:36:30Z","snapshot_observed_at":"2026-08-14T05:51:38.916526Z","submitted_at":"2026-06-19T11:31:43Z","title":"DataClaw0: Agentic Tailoring Multimodal Data from Raw Streams","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-26T14:24:19.702588Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2606.21337"},"observation_digest":"sha256:1ee9485ddef09c8f564b2ae54865b2c6acea80121e83c78e94fd340b9f1afbb1","observation_id":"5a82cd6d-9108-438b-a77c-f075d23001ee","resolution":{"observed_at":"2026-07-04T06:29:37.951313Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07774","snapshot_observed_at":"2026-08-04T02:47:40.421718Z","title":"Unireal: Universal im- age generation and editing via learning real-world dynamics.arXiv preprint arXiv:2412.07774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.21337","last_updated":"2026-07-31T19:36:30Z","snapshot_observed_at":"2026-08-14T05:51:38.916526Z","submitted_at":"2026-06-19T11:31:43Z","title":"DataClaw0: Agentic Tailoring Multimodal Data from Raw Streams","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T02:47:40.421718Z"},"links":{"cited_paper":"/paper/2412.07774","citing_paper":"/paper/2606.21337"},"observation_digest":"sha256:cbb891c9ffb4aba7b233e4d1d50f65b6fe4e7632f77572dbab7f0f997355a9e3","observation_id":"ee11e9a0-c025-489d-b0d9-8713002e8185","resolution":{"observed_at":"2026-08-04T02:47:40.421718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.07774/citation-record","integrity":"/paper/2412.07774/integrity","json":"/paper/2412.07774/citation-record.json","paper":"/paper/2412.07774"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:59.021714Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":"5bd31b97-03c6-483c-af56-297ee258d0b3","year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.721764Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:adeb1b7610b096b3bad855b95cbcbabfdecdf503326e5e59be976593c8815be0","observation_id":"e9f94f53-2f51-4e6b-95d5-8529fa484d72","resolution":{"observed_at":"2026-08-11T18:33:59.026306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:59.009171Z","title":"A computational approach to edge detection","venue":null,"work_id":"432d9a5d-8c2b-4b59-ba8e-cd8f8cc9b3f2","year":1986},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.725996Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:07e2ccd43b3fcd43003c3acfcf2508b12c0fed4efb27204969ea47922d513916","observation_id":"895345a0-bfab-480f-9945-cffe76e38903","resolution":{"observed_at":"2026-08-11T18:33:59.013383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.996257Z","title":"Masactrl: Tuning-free mutual self-attention control for consistent image synthesis and editing","venue":null,"work_id":"bec06914-2baa-42ef-88c9-b9b2d4280a2e","year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.730031Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:ffec4f2f1b3d7fad20bab399f4a743ef3f8089a9abb19d3cd7c85a05d97f2fec","observation_id":"f36ad07a-46f5-41a8-98c4-ca6455c61a60","resolution":{"observed_at":"2026-08-11T18:33:59.000891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:57.733845Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.733845Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:6fb22ce127f3f4304687f1576a41211c1cd78b519d39f1cb7c6f4cb2e5efd718","observation_id":"b96b96ef-8aca-4005-ba8f-f2a66831e18e","resolution":{"observed_at":"2026-08-11T18:33:57.733845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.975940Z","title":"Pixart-alpha: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":"124c7bb1-c469-4edd-98bc-551e9909d1d5","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.737465Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:6bfd7c2b636159302e3f993ab5635f49c29cf813117ac491556f8a0c82c49eae","observation_id":"33e3e1ea-0bcb-47d3-9f88-b521fe54967e","resolution":{"observed_at":"2026-08-11T18:33:58.980079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.963559Z","title":"Wear-any-way: Manip- ulable virtual try-on via sparse correspondence alignment","venue":null,"work_id":"fc4c521a-5a40-4a5a-b869-d3ade59fae8b","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.741675Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:b75125a0d1d77d27fca274cf10fd857ec4da9cefe1770bcc94a4a6dd8cca556d","observation_id":"b3a1c4fc-168b-4c86-80ba-cf4a6387aa43","resolution":{"observed_at":"2026-08-11T18:33:58.967837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.950760Z","title":"Re-imagen: Retrieval-augmented text-to-image generator","venue":null,"work_id":"5d641da7-ade2-4107-b9b7-bf7e28988b15","year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.746089Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:06d8e06659828caf1cc3bb40e9acff4a5e2a72ac302eb65f76c2dc7db34e761b","observation_id":"c3e65cca-ed5d-4997-ad76-6b869c38fc4c","resolution":{"observed_at":"2026-08-11T18:33:58.955271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.937852Z","title":"Subject-driven text-to-image generation via apprenticeship learning","venue":null,"work_id":"4f6f2251-ae51-4133-954a-29e6b5275796","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.749910Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:c207d5bf1cd901f0ccfb4aeb2d865575247b56d1b765caaae327b7f2be87d531","observation_id":"31916d49-519a-42bf-8e71-d51befd741c7","resolution":{"observed_at":"2026-08-11T18:33:58.942164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.924553Z","title":"Zero-shot image editing with reference imitation","venue":null,"work_id":"d3400ebd-02c7-4922-972b-9c3f562fd197","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.753726Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:15958499240241ef22987ea9f424cf0957ce3d0f7040af027869269df115eabc","observation_id":"a219ff8a-8092-4833-9bd0-b41102b6a779","resolution":{"observed_at":"2026-08-11T18:33:58.929249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.910929Z","title":"Anydoor: Zero-shot object-level image customization","venue":null,"work_id":"cf0e545c-21c5-4af2-b655-c05a34419954","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.757523Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:57fef5912958adf3454395acdb094cc400b743d729df5a8943bf089c03005cda","observation_id":"8dfac905-46ad-4072-bb38-55074f9e35db","resolution":{"observed_at":"2026-08-11T18:33:58.915391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.899073Z","title":"Viton-hd: High-resolution virtual try-on via misalignment-aware normalization","venue":null,"work_id":"4bc6e9a5-68d0-41b2-9e88-8cc12b477fa7","year":2021},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.761640Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:3b90c6c34ce5ff15dc26124be8b44bd7ed6755f8a46d4b2bbd618544ba0aed91","observation_id":"10fc6e68-0ba3-4941-87f0-a98165929b05","resolution":{"observed_at":"2026-08-11T18:33:58.902722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07199","last_updated":"2025-04-28T14:16:29Z","snapshot_observed_at":"2026-08-19T05:12:45.528867Z","submitted_at":"2024-11-11T18:21:43Z","title":"OmniEdit: Building Image Editing Generalist Models Through Specialist Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07199","snapshot_observed_at":"2026-08-11T18:33:57.765474Z","title":"Omniedit: Building image editing generalist models through specialist supervision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.765474Z"},"links":{"cited_paper":"/paper/2411.07199","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:b2df7cda78b1791fea95b19791390c1f98fd50202f21bf4bcc91e1f1f758217c","observation_id":"8b275b54-be1f-4dc3-b741-7f2cb7f13abe","resolution":{"observed_at":"2026-08-11T18:33:57.765474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.887290Z","title":"Guiding instruction-based image editing via multimodal large language models","venue":null,"work_id":"ac7ad008-8a2b-49ed-bdc1-e0319373c749","year":null},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.770350Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:c304afc1971a36c4e7018d4593f9a47007c6e33c517bf490ca87a4b69636c7e8","observation_id":"2a11af4f-8ed8-4e46-b2fb-0e6f0b6b1c71","resolution":{"observed_at":"2026-08-11T18:33:58.891083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14396","last_updated":"2025-03-02T07:53:44Z","snapshot_observed_at":"2026-08-12T19:12:43.246639Z","submitted_at":"2024-04-22T17:56:09Z","title":"SEED-X: Multimodal Models with Unified Multi-granularity Comprehension and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14396","snapshot_observed_at":"2026-08-11T18:33:57.774676Z","title":"Seed-x: Multimodal models with unified multi-granularity compre- hension and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.774676Z"},"links":{"cited_paper":"/paper/2404.14396","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:ce099acefa42815faf7530f76ca5dfeabe4b03f880ffc50c4e6bdbbb0f506602","observation_id":"fc749943-4800-4fb6-94be-7c19e52ac240","resolution":{"observed_at":"2026-08-11T18:33:57.774676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00086","last_updated":"2024-11-05T12:25:32Z","snapshot_observed_at":"2026-08-18T10:32:50.281654Z","submitted_at":"2024-09-30T17:56:27Z","title":"ACE: All-round Creator and Editor Following Instructions via Diffusion Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00086","snapshot_observed_at":"2026-08-11T18:33:57.778792Z","title":"Ace: All- round creator and editor following instructions via diffusion transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.778792Z"},"links":{"cited_paper":"/paper/2410.00086","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:9e3ce26232e92490e4bcef9516f8febd247efbaf5e1e276ee9e8d69a4dcaa181","observation_id":"695297ea-9af9-4ab6-b779-4e28a9b31aef","resolution":{"observed_at":"2026-08-11T18:33:57.778792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.875356Z","title":"Prompt-to-prompt image editing with cross attention control","venue":null,"work_id":"9368c999-33ec-434b-92aa-98214b53cb2a","year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.783193Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:cae679e75e44a79c5dfe6ec1b58c6c2d3a7d86587a6e8daf018839ab4be199e2","observation_id":"8f25f6d1-24b3-4124-a5c0-0fe849f6dbab","resolution":{"observed_at":"2026-08-11T18:33:58.879105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.863597Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"c50597d1-2ef8-4031-b1fb-b1736d94d7db","year":2020},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.787169Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:30e7ffcab0cff813ef1dc669843b842aa6e78bc4c703a0cabfbe18feed1ce7a9","observation_id":"54108397-2a62-4ce2-9075-8a99cda98217","resolution":{"observed_at":"2026-08-11T18:33:58.867872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.851631Z","title":"Cogvideo: Large-scale pretraining for text-to-video generation via transformers","venue":null,"work_id":"f3484e73-f23f-4637-b152-5e965fe86a0e","year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.791185Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:8cf1f623b177b78953a205c90b455562931c3837312159c4d49b6d6fc37a23b3","observation_id":"b78e5fb2-42fe-45b0-8598-6dd991d235f7","resolution":{"observed_at":"2026-08-11T18:33:58.855742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.839306Z","title":"Instruct-imagen: Image generation with multi-modal instruction","venue":null,"work_id":"f16a5243-8117-4495-889e-0dc1eabcddbc","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.795257Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:43e7c9da18e9385dd07256f9c3434bad164f3262281ce327580fe727195c0228","observation_id":"f342a9af-f117-4de1-b5c4-30b067a989ff","resolution":{"observed_at":"2026-08-11T18:33:58.843708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.823065Z","title":"Composer: Creative and controllable image synthesis with composable conditions","venue":null,"work_id":"40fa8cc5-0140-4bbf-aed4-acdbd286f7fa","year":null},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.798945Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:de6dc42b25e9ede8f0ae65b8f6c80f530e1f8b78e0e238c1ddc78d99d4be4577","observation_id":"29de189c-1d43-47e5-9632-efdfa9d07fe3","resolution":{"observed_at":"2026-08-11T18:33:58.831043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09990","last_updated":"2024-04-15T17:59:31Z","snapshot_observed_at":"2026-08-16T14:00:43.952995Z","submitted_at":"2024-04-15T17:59:31Z","title":"HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09990","snapshot_observed_at":"2026-08-11T18:33:57.803323Z","title":"Hq-edit: A high-quality dataset for instruction-based image editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.803323Z"},"links":{"cited_paper":"/paper/2404.09990","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:3a79aafb6727d597fb7599ec3dfc17c4f16135e4f5d70c1cafaaf9ca62f05d96","observation_id":"cdafa799-d651-4c04-b0bd-bed43f187253","resolution":{"observed_at":"2026-08-11T18:33:57.803323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:57.808200Z","title":"Brushnet: A plug-and-play image inpainting model with decomposed dual-branch diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.808200Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:05b52b4ed2b6e1f9c5b54a1c5639503c7924ae345e25647a3fe17dcf599b453c","observation_id":"8f2d526b-4699-476f-8c85-481b91e47c42","resolution":{"observed_at":"2026-08-11T18:33:57.808200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:57.812958Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.812958Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:ea275cfa8c9122096ebd319c2b042bd09e8d93c8ee92ed36c0e52aca78d43f32","observation_id":"48ba5aac-3dd1-4bfe-90b7-90825bfabf56","resolution":{"observed_at":"2026-08-11T18:33:57.812958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.793076Z","title":"Referitgame: Referring to objects in pho- tographs of natural scenes","venue":null,"work_id":"70e4f239-43c0-4235-b6d1-8a6f8f0a822d","year":2014},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.816726Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:b068870694652a922644f873dc958624939c4d31dfe898fc3b41df6cc144328a","observation_id":"8fc3bfc1-1e65-4ec0-a835-89a9209acc27","resolution":{"observed_at":"2026-08-11T18:33:58.797385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.779910Z","title":"Stableviton: Learning semantic corre- spondence with latent diffusion model for virtual try-on","venue":null,"work_id":"4ee9bd7d-cc47-4142-9b9a-d96c1d8a8987","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.820477Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:3dd5aaa0bf55df11609e29d689fb92d2192a43983564a85307c04e06f31f09c3","observation_id":"b9b72a98-4f69-4c11-af69-d4a19a7173d9","resolution":{"observed_at":"2026-08-11T18:33:58.784262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:57.823983Z","title":"Multi-concept customization of text-to-image diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.823983Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:a46f5d3092cd47b3bdcd49138036321f5422027357c1f6fd470cd6846c6d92ec","observation_id":"614530b7-0686-4638-9b81-e931d37243e9","resolution":{"observed_at":"2026-08-11T18:33:57.823983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.759471Z","title":"Blip-diffusion: Pre- trained subject representation for controllable text-to-image generation and editing","venue":null,"work_id":"5f4d9111-e968-42a3-8404-dc6224f21354","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.828357Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:93a5e967836cccb53c026dd44c4b74fdd5e9fe49d4be8e6acad422b2f90dd15c","observation_id":"fa4ef2f3-4f33-48a9-9b06-54fecd6d7b21","resolution":{"observed_at":"2026-08-11T18:33:58.763872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.744563Z","title":"Photomaker: Customizing realistic human photos via stacked id embedding","venue":null,"work_id":"8bc95e87-b35a-473a-b575-fba00fb04ef0","year":null},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.832142Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:1d910d8e0edc214d845bc45cfbdb5b2b31e84f63b6b2dc31ece8af789d61b5c9","observation_id":"3ae6b054-9040-4508-a637-e6c580deb48e","resolution":{"observed_at":"2026-08-11T18:33:58.749846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15278","last_updated":"2025-02-27T10:18:59Z","snapshot_observed_at":"2026-08-16T13:16:09.315358Z","submitted_at":"2024-09-23T17:59:46Z","title":"PixWizard: Versatile Image-to-Image Visual Assistant with Open-Language Instructions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15278","snapshot_observed_at":"2026-08-11T18:33:57.836250Z","title":"Pixwizard: Versatile image- to-image visual assistant with open-language instructions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.836250Z"},"links":{"cited_paper":"/paper/2409.15278","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:8e2f95228f1b4c79ef6e76327450ffd9659208e3c7fb66ea6689c634d2e50540","observation_id":"3fc74c25-f842-4d82-8d38-90742d42a60c","resolution":{"observed_at":"2026-08-11T18:33:57.836250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.730131Z","title":"Flow matching for generative modeling","venue":null,"work_id":"68ff51ac-4218-48de-b1d3-616dfda53c68","year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.840352Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:e22bda80c42019390cb5c0a4fe2032cf1dc41283c5fa424d4645b5764e56db0a","observation_id":"69c3e385-7474-4f08-8cf9-718c75476641","resolution":{"observed_at":"2026-08-11T18:33:58.735333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.716396Z","title":"Cones: Concept neurons in diffusion models for customized generation","venue":null,"work_id":"6ae49568-034c-4865-bec8-f5ad13a9d8d6","year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.843835Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:c2b2037f2e7e79116cecf0907ff6d08a889a4fed89f85f37ac53a1c53634d79c","observation_id":"f43cd28e-978f-496f-a873-f0b52a9dcbce","resolution":{"observed_at":"2026-08-11T18:33:58.720692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.703390Z","title":"Cones 2: Customizable image synthesis with multiple subjects","venue":null,"work_id":"3a4f4551-b901-4177-a16a-c6ba38c288ea","year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.847285Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:73ca4828c213b137566c11f6d0310d2322d8461abdd13ba9b0a2d60b6798d1b9","observation_id":"7ded4431-d45f-4476-a75e-62cf791d1bf7","resolution":{"observed_at":"2026-08-11T18:33:58.707382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.690340Z","title":"Generation and comprehension of unambiguous object descriptions","venue":null,"work_id":"056f7552-f64c-4956-be68-9111a74c9132","year":2016},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.850399Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:bc20f150cf2f3681c16ce5a306ed4c6c21b834a68d311930a89be407e1d7d6f6","observation_id":"8e2b2f05-7aaf-4c16-905c-713d853b3902","resolution":{"observed_at":"2026-08-11T18:33:58.694186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.678417Z","title":"Sdedit: Guided image synthesis and editing with stochastic differential equa- tions","venue":null,"work_id":"9f02f907-dc4b-45ba-9cda-e8cee1bf8a75","year":2022},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.853717Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:cf337971245f0d41157a0f1158d0203c896182df16d2bb2a3167dd609675b85a","observation_id":"23f8e44f-a907-48fa-8bd3-bcca324021ea","resolution":{"observed_at":"2026-08-11T18:33:58.682184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.665865Z","title":"Null-text inversion for editing real images using guided diffusion models","venue":null,"work_id":"c37f065b-cb69-4267-b16a-a9bef53267f6","year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.857585Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:62e182282d1219d40b14e0ff1f240404d2139560d0b186989152c5b5ac8f2476","observation_id":"d3f16b44-36ff-4229-bda6-f0a3255e1498","resolution":{"observed_at":"2026-08-11T18:33:58.670280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:57.861707Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.861707Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:5f9a6cbbe84e42f931169a4337d7b055884e8ec4ae39f303830aaa2e0b850f86","observation_id":"8d8e2b92-e988-47f7-a485-e7cd5532340b","resolution":{"observed_at":"2026-08-11T18:33:57.861707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.646025Z","title":"Gpt-4o mini: advancing cost-efficient intelligence","venue":null,"work_id":"a706bbf9-892c-4926-a3a7-8fb4d9a5c3cd","year":null},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.865650Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:a3fa3ffb269d3e76c854920ab9202f621f43b02b394a230dced2cbd2eba71d91","observation_id":"c7664459-20c2-45c4-8f25-7f440cbb06ae","resolution":{"observed_at":"2026-08-11T18:33:58.650079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.633283Z","title":"Sora: Creating video from text","venue":null,"work_id":"76f7f09b-1542-4fc0-87f0-91a532a70e73","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.869981Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:8159b6f2a98f57f59a381ec3f7fa8222f067929646df1a1774c6a0d8b40718d4","observation_id":"aecb9b1e-0c14-4bc7-9983-c35e19e1c078","resolution":{"observed_at":"2026-08-11T18:33:58.637771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.620963Z","title":"Kosmos-2: Grounding multimodal large language models to the world","venue":null,"work_id":"d9834319-4f46-47c7-9248-62a87b21e095","year":null},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.873650Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:efcbbf87a6568096859b6c58d0664ae719a346c875d9a371914302129e8fd1eb","observation_id":"cd655e81-e0c6-449f-ac83-cb88cdf4b152","resolution":{"observed_at":"2026-08-11T18:33:58.625173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.608125Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":"0c4f6282-4e1f-4924-9287-031fe46d9d50","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.878014Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:46420ec79afbff17a4e0a0f6f76a0e9781554d75e0bc0b9daa1c34ff47a4c362","observation_id":"720e331f-8855-460a-8420-4a91a1dbef5c","resolution":{"observed_at":"2026-08-11T18:33:58.613165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-17T10:09:03.767186Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-11T18:33:57.881627Z","title":"Movie gen: A cast of media foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.881627Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:00784f3b5c457a64d283bd9137daa768d55ae5bdad253ba9ff486d2289bad0a0","observation_id":"64945124-7385-488e-99ba-75bfc66e0cef","resolution":{"observed_at":"2026-08-11T18:33:57.881627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13974","last_updated":"2024-01-25T06:18:20Z","snapshot_observed_at":"2026-08-18T17:18:11.881569Z","submitted_at":"2024-01-25T06:18:20Z","title":"BootPIG: Bootstrapping Zero-shot Personalized Image Generation Capabilities in Pretrained Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13974","snapshot_observed_at":"2026-08-11T18:33:57.885994Z","title":"Bootpig: Bootstrapping zero-shot personalized im- age generation capabilities in pretrained diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.885994Z"},"links":{"cited_paper":"/paper/2401.13974","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:717594fdc4e1f25fb57cd070efd6738cade44c7d26604e3326de1e7cccdbeeaf","observation_id":"c9687b4e-b5b9-4961-aa4e-194da38e5233","resolution":{"observed_at":"2026-08-11T18:33:57.885994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.591789Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"c3c54724-182a-4de8-b188-0c71d43409a9","year":2021},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.890109Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:27a64c5a4f84f02e02abebbeb58f61f4849db7cad9fd5f09a4916f4de822b366","observation_id":"861cf328-aaae-43fc-92ce-0da7e5fa2323","resolution":{"observed_at":"2026-08-11T18:33:58.596574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.579305Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":"697f0437-b8e1-481c-85a4-66278884f88b","year":2020},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.894400Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:a36f90faa093fec315e8d2ab415c16d5fdf3a8489205be2d5b68555a64832dc1","observation_id":"fd995517-2111-464f-b819-57b6a8d8525e","resolution":{"observed_at":"2026-08-11T18:33:58.583482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-11T18:33:57.898379Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.898379Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:9c5cadbc713edb1005ccc65e040372cea346c9bb5a5b479959e321c238323141","observation_id":"7ce94041-9ef8-4ca5-9d53-4c1ef748cf0d","resolution":{"observed_at":"2026-08-11T18:33:57.898379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:57.902744Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.902744Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:3ed393d238355f30879e6560f34f3b4c92cbdd2b08667793d270a3a587ca282d","observation_id":"e0d7d24a-dc03-4569-b0c7-32be3d0af978","resolution":{"observed_at":"2026-08-11T18:33:57.902744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.558880Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"42ca2cd7-c63a-4cba-8a6a-4d9c42663d6a","year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.906767Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:d810489e93fd385fe026c7e26c5fd25324552646e2db49d4ec6f9a3a816af742","observation_id":"c3f76fe2-a09e-4780-b352-24fdb29883f3","resolution":{"observed_at":"2026-08-11T18:33:58.563130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.546584Z","title":"Emu edit: Precise image editing via recognition and genera- tion tasks","venue":null,"work_id":"14ba710e-010f-48cb-9b8e-896bfcc818ff","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.910724Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:a938f5bc6eb2235628e55cb87461588ca4865336125403fa6f0b557bd3e1eda7","observation_id":"bdac20a4-30d7-43ae-bbb1-db68dc0238f2","resolution":{"observed_at":"2026-08-11T18:33:58.551210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.532668Z","title":"Styledrop: Text-to-image generation in any style","venue":null,"work_id":"7fa520e0-76e8-42b3-af8b-7b28eb582df3","year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.914929Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:6f4fef9000215fddb023751a2778fec7d19cff16e12ac972778a0265c4581110","observation_id":"3739bb4e-b329-43b6-9f4f-e1bec454e015","resolution":{"observed_at":"2026-08-11T18:33:58.537784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.520319Z","title":"Objectstitch: Object compositing with diffusion model","venue":null,"work_id":"515c366d-6092-45cc-a4be-1df2543c5034","year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.918869Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:b963213420a51693e07e2f6c04f55df7dfe591baf4d2adbb32472fb24226148f","observation_id":"41236103-2aca-42c6-958d-28e6336e4b05","resolution":{"observed_at":"2026-08-11T18:33:58.523886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.508204Z","title":"Imprint: Generative object compositing by learning identity-preserving representation","venue":null,"work_id":"f82b8659-810a-401f-b762-4a2da6890546","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.922917Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:5f355d35cc78ed04b1263989425564d3d45067cf66c02dd06b3827f14d084950","observation_id":"2266a2f7-5719-4462-889e-4f2243735d82","resolution":{"observed_at":"2026-08-11T18:33:58.511930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.496970Z","title":"Cosxl model card","venue":null,"work_id":"f30e2f0f-cc2a-41a6-abca-c187e45173a0","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.926610Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:8d9943d0401b076e29055a4e487d4422e0f02b998500e1c23dee5ca257fa5120","observation_id":"7dec477c-ec79-482c-9a59-0928c02b238c","resolution":{"observed_at":"2026-08-11T18:33:58.500246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.486176Z","title":"Generative multimodal models are in-context learners","venue":null,"work_id":"7ef1f9b4-7b9d-43f4-965b-49d7ab8d74ba","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.929901Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:e1b87602361969f5faf088a6026aa24a7fce73b6f8998928c811911eb74708c3","observation_id":"3cedecc0-063d-43c2-b807-664404d0671c","resolution":{"observed_at":"2026-08-11T18:33:58.489999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.474040Z","title":"Realfill: Reference-driven generation for authentic image completion","venue":null,"work_id":"52388c92-8d3c-4cb4-b047-377ad6b49a25","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.933919Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:c19d3f6f528311fbcf9cac77db84b015f7b1a2e3e418d11cc4adac382dd07db8","observation_id":"fc7968a6-4845-46e6-9b9e-cdfbd0190a4a","resolution":{"observed_at":"2026-08-11T18:33:58.478409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.461718Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":"3e37d7c0-f919-4b8c-9804-f295ebe87084","year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.937610Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:a2dd42a882412b65f5cb1bd1838d3aa39391fdde36a94c7ba274b1f3e67d7f48","observation_id":"34e6debc-a696-4d24-96d4-f1f0687544bb","resolution":{"observed_at":"2026-08-11T18:33:58.465940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02733","last_updated":"2024-04-04T19:42:32Z","snapshot_observed_at":"2026-08-16T14:03:57.454330Z","submitted_at":"2024-04-03T13:34:09Z","title":"InstantStyle: Free Lunch towards Style-Preserving in Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02733","snapshot_observed_at":"2026-08-11T18:33:57.940921Z","title":"Instantstyle: Free lunch towards style- preserving in text-to-image generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.940921Z"},"links":{"cited_paper":"/paper/2404.02733","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:db2613d2336cc73e632e314a4df2e993d05780a2c89100f5990a4453ea6a68fb","observation_id":"beb42cb6-b930-48aa-9635-20a0102d2fc0","resolution":{"observed_at":"2026-08-11T18:33:57.940921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07519","last_updated":"2024-02-02T16:15:22Z","snapshot_observed_at":"2026-08-16T06:18:35.139211Z","submitted_at":"2024-01-15T07:50:18Z","title":"InstantID: Zero-shot Identity-Preserving Generation in Seconds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.07519","snapshot_observed_at":"2026-08-11T18:33:57.944875Z","title":"Instan- tid: Zero-shot identity-preserving generation in seconds","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.944875Z"},"links":{"cited_paper":"/paper/2401.07519","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:3d9c3359e9538a689ebc407a9880bd5d2ad58890192049876b3fcef03523db92","observation_id":"8640933d-c192-420b-98ba-922d8f97a84b","resolution":{"observed_at":"2026-08-11T18:33:57.944875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.448672Z","title":"Elite: Encoding visual con- cepts into textual embeddings for customized text-to-image generation","venue":null,"work_id":"9efdc555-3ff4-4484-8f52-02cfc0c6139f","year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.948423Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:224c4b06e1d76201bde783860d5fc5f445dd2745fc7fa7e9c7ee84ee86b77901","observation_id":"a4cf857e-5700-46a2-94d9-b93036a69784","resolution":{"observed_at":"2026-08-11T18:33:58.453223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04429","last_updated":"2025-03-04T16:31:57Z","snapshot_observed_at":"2026-08-01T23:38:04.510222Z","submitted_at":"2024-09-06T17:49:56Z","title":"VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04429","snapshot_observed_at":"2026-08-11T18:33:57.951832Z","title":"Vila-u: a unified foundation model integrat- ing visual understanding and generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.951832Z"},"links":{"cited_paper":"/paper/2409.04429","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:6e0894db2b6fb65f00cd420cf615b2a5f7817a006f3d125dd3d81d6a7cef4800","observation_id":"0e9e71a2-b0d9-4b99-8fee-709a462ac081","resolution":{"observed_at":"2026-08-11T18:33:57.951832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11340","last_updated":"2024-11-21T14:09:12Z","snapshot_observed_at":"2026-08-20T07:26:30.722636Z","submitted_at":"2024-09-17T16:42:46Z","title":"OmniGen: Unified Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11340","snapshot_observed_at":"2026-08-11T18:33:57.956025Z","title":"Omnigen: Unified image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.956025Z"},"links":{"cited_paper":"/paper/2409.11340","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:31c4b4af1dcccc3a88be5b7770818f340329dd6e5b739d130491ccbe97809d50","observation_id":"1fb9dedc-167a-411b-854a-dc676fb895ba","resolution":{"observed_at":"2026-08-11T18:33:57.956025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12528","last_updated":"2025-09-08T02:42:57Z","snapshot_observed_at":"2026-08-18T17:34:44.890427Z","submitted_at":"2024-08-22T16:32:32Z","title":"Show-o: One Single Transformer to Unify Multimodal Understanding and Generation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12528","snapshot_observed_at":"2026-08-11T18:33:57.959943Z","title":"Show-o: One single transformer to unify multimodal understanding and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.959943Z"},"links":{"cited_paper":"/paper/2408.12528","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:7a5bf6345e9d0b69f4bd7b5dbb4c58b59d0b5f504d2fb2cd4acdeb5b179bc743","observation_id":"3d115039-021a-48b1-a09a-08f1ec65be30","resolution":{"observed_at":"2026-08-11T18:33:57.959943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.436430Z","title":"Flux-ip-adapter model card","venue":null,"work_id":"cbed1165-a651-4715-9fbb-a0ca120b3104","year":null},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.963887Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:a6a88f52a2d0b46abd238f08f26f6206d9eaad376f99a3f19d5818635202b69b","observation_id":"3729e44c-6c42-4e67-8051-0d25cf0e3a6e","resolution":{"observed_at":"2026-08-11T18:33:58.440485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01779","last_updated":"2024-03-07T06:35:35Z","snapshot_observed_at":"2026-08-16T14:13:13.042989Z","submitted_at":"2024-03-04T07:17:44Z","title":"OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01779","snapshot_observed_at":"2026-08-11T18:33:57.967666Z","title":"Ootdiffusion: Outfitting fusion based latent diffusion for controllable virtual try-on","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.967666Z"},"links":{"cited_paper":"/paper/2403.01779","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:65d5f865553517496f0c6660c1aeeec3ed2b2ecf698afbca9c22431fe630a124","observation_id":"c5dc4ce8-0a72-426f-8dec-db4bd9cd0c0d","resolution":{"observed_at":"2026-08-11T18:33:57.967666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.423251Z","title":"Paint by example: Exemplar-based image editing with diffusion models","venue":null,"work_id":"2e37bb7e-39dc-45df-b243-9bfd1c518958","year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.971657Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:472bfdcb2a4f2384f70547921af3f1cb2a3028c300be8c102af59fe3e608c0ad","observation_id":"cba8c054-b84a-42a8-aeb5-e94269283b64","resolution":{"observed_at":"2026-08-11T18:33:58.427760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.410636Z","title":"Depth anything v2","venue":null,"work_id":"86b15b31-1493-4615-bf55-e8cfcb0ac674","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.975388Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:7ea454fc9d0b8578fea868ed7aa04b4040c944141f49b3d1efa79e1cc8886e5f","observation_id":"df689ac2-4815-493d-b3a8-e801d9bb0288","resolution":{"observed_at":"2026-08-11T18:33:58.414828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14785","last_updated":"2024-05-23T16:54:17Z","snapshot_observed_at":"2026-08-16T13:50:05.943341Z","submitted_at":"2024-05-23T16:54:17Z","title":"EditWorld: Simulating World Dynamics for Instruction-Following Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14785","snapshot_observed_at":"2026-08-11T18:33:57.978932Z","title":"Editworld: Simulat- ing world dynamics for instruction-following image editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.978932Z"},"links":{"cited_paper":"/paper/2405.14785","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:9604a0f4692a7b386bbe9e3426c4077ebc36c1066ca188465084480429420566","observation_id":"74da5e8e-556e-4179-9104-29f6f45e9714","resolution":{"observed_at":"2026-08-11T18:33:57.978932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-08-15T19:52:28.153954Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-11T18:33:57.983330Z","title":"Cogvideox: Text-to-video diffu- sion models with an expert transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.983330Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:c661b63d30a006ddb2633ee20f79f58b024e9fcceacccc947c6d650d0bf58918","observation_id":"30b78857-1daa-4101-b705-24d2006bd27e","resolution":{"observed_at":"2026-08-11T18:33:57.983330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-11T18:33:57.987538Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.987538Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:625b77f5856774c078e53ad84327ab048c47274c7a71599e00866cd40ad9542e","observation_id":"2efd7014-9fda-4f3c-ae1f-5ef627d961e8","resolution":{"observed_at":"2026-08-11T18:33:57.987538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.397838Z","title":"Magicbrush: A manually annotated dataset for instruction- guided image editing","venue":null,"work_id":"d19a5712-154a-49f1-9754-00aaaca98769","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.991657Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:c46ef655a313a58eee86e87a371a68640c15022578f059a67ab587fc0e9b1786","observation_id":"c315edf6-2d4b-4eb6-9d7b-334ed1cfee97","resolution":{"observed_at":"2026-08-11T18:33:58.402356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:57.995546Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.995546Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:9fda27e75c581fd4af1a3e93d43de8a06055889c8c92cd419d753bfb63f86775","observation_id":"1587edae-0479-42c3-8ed6-3253db218847","resolution":{"observed_at":"2026-08-11T18:33:57.995546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:57.999351Z","title":"Flashface: Human image personalization with high-fidelity identity preservation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:57.999351Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:954bd9313b521395512e0e259a0bf786cf4b979dbc01e58ce9afff18b3cfc497","observation_id":"70a334b6-fb71-4c9a-9883-aa2064dab14c","resolution":{"observed_at":"2026-08-11T18:33:57.999351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.374826Z","title":"Ultraedit: Instruction-based fine-grained image editing at scale","venue":null,"work_id":"32e9c1fa-b2b0-48b0-9411-665d17c7af81","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:58.003172Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:dd3881a64de6cf9c141f328e21e4d255fef6f776fe53337b6c93cb6d495e6802","observation_id":"06ab526e-58a4-453d-9b77-41330ba79e2f","resolution":{"observed_at":"2026-08-11T18:33:58.379742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.359516Z","title":"Open-sora: Democratizing efficient video production for all","venue":null,"work_id":"aa78d05d-8967-4893-b41f-4f7f04b014e3","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:58.007167Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:2b3c8290e99eabaa00ba2ad9f898c2c9b067b530a99b583ff6bfac594576e377","observation_id":"999ba6ff-c42a-4e08-a5c8-dd73f63ebb6a","resolution":{"observed_at":"2026-08-11T18:33:58.363941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-08-19T12:50:53.888784Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-11T18:33:58.012511Z","title":"Transfusion: Predict the next token and diffuse images with one multi-modal model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:58.012511Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:796ff7706b9efd4a201df83e14c47b3d63b5b0f959a2fec87e24bea5cad414e8","observation_id":"f348260f-824f-44fb-bec8-de5442f712b0","resolution":{"observed_at":"2026-08-11T18:33:58.012511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.347169Z","title":"Transfill: Reference-guided image inpainting by merging multiple color and spatial transformations","venue":null,"work_id":"32bb13df-1c8f-44d4-9f3e-8291623d8b0e","year":2021},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:58.016991Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:8deadebee8570a5141daacfe30b2975b82f99fd7978cae2570f531c6c28a2454","observation_id":"27a116a9-7951-45e6-a3c3-9988704aca9d","resolution":{"observed_at":"2026-08-11T18:33:58.351781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:33:58.332550Z","title":"A task is worth one word: Learning with task prompts for high-quality versatile image inpainting","venue":null,"work_id":"b49f2f9f-0e58-4f2f-b0c2-20da69bade01","year":2024},"citing_paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T18:33:58.020660Z"},"links":{"citing_paper":"/paper/2412.07774"},"observation_digest":"sha256:3b13902f744ae3bbe634d4398c5d13be7ab2b9d3bdbc91f81f7f72ebbdd30452","observation_id":"6d394b3c-bedc-404e-8c96-56af791e95d9","resolution":{"observed_at":"2026-08-11T18:33:58.338604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.07774","last_updated":"2024-12-11T22:51:08Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T17:44:25.192702Z","submitted_at":"2024-12-10T18:59:55Z","title":"UniReal: Universal Image Generation and Editing via Learning Real-world Dynamics"},"reference_resolution":{"displayed":76,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":50},"total_outbound_references":76},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 76 of 76 outbound references and 22 inbound Pith citation observations for arXiv:2412.07774."}