{"as_of":"2026-08-14T22:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f94ea8be4497e8b455ba8d3cb54e0a1d4815a7aac537adc041d12486291ae197","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T04:38:02.315863Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.01223/citation-record","integrity":"/paper/2412.01223/integrity","json":"/paper/2412.01223/citation-record.json","paper":"/paper/2412.01223"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:03.201861Z","title":"Blended diffusion for text-driven editing of natural images","venue":null,"work_id":"7180be61-0e67-43d0-8e53-790493548d94","year":2022},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.012781Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:e83ebe3e2c9f44e4dfab0b9555da9183a88fe96ba811a4d1cce6ef1405398efd","observation_id":"5f05aef1-a993-4694-9018-ccfb5477c9db","resolution":{"observed_at":"2026-08-12T04:38:03.207516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:03.180857Z","title":"Blended latent diffusion","venue":null,"work_id":"5c30077b-395d-4edd-a8e7-8d9fee670d3d","year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.018143Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:98b161784695de5ea573c34735fb2e9dd226561ebcf275bd415b1c03bd849dee","observation_id":"4624540a-00a8-45ed-8fbe-3ff6ee0f3808","resolution":{"observed_at":"2026-08-12T04:38:03.189654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.022984Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.022984Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:4b51031ad5cc7fb5909189856b58930f8ac740ddb2b4b607862ba07033416718","observation_id":"4848f318-6f1b-4f8b-b1c4-30890d19eb30","resolution":{"observed_at":"2026-08-12T04:38:02.022984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-12T04:38:02.028337Z","title":"Pixart- α: Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.028337Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:78fc9aa084d8ee82751b5542912ce62172805a4896fc313025f845e62dcb346e","observation_id":"ddc2e7d1-d955-410d-b73e-fa640e208613","resolution":{"observed_at":"2026-08-12T04:38:02.028337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12793","last_updated":"2023-11-28T08:52:50Z","snapshot_observed_at":"2026-08-14T06:42:43.375489Z","submitted_at":"2023-11-21T18:58:11Z","title":"ShareGPT4V: Improving Large Multi-Modal Models with Better Captions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12793","snapshot_observed_at":"2026-08-12T04:38:02.033710Z","title":"Sharegpt4v: Improving large multi-modal models with better captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.033710Z"},"links":{"cited_paper":"/paper/2311.12793","citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:aa6619890a85a9775347419f53119292cc28466a5792a28243800b547a7b74e5","observation_id":"220b7bba-95cc-4f0f-bc84-1baf7a9da7c4","resolution":{"observed_at":"2026-08-12T04:38:02.033710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:03.151520Z","title":"Latentpaint: Image inpainting in latent space with diffusion models","venue":null,"work_id":"c7cbc250-480b-4d3a-9bbf-1c759e5bfe21","year":2024},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.038909Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:734c88a3cd2bb79bc3be4c4073ff5d41653cbe18b5bf843292bf4d8c521b1d51","observation_id":"7dafb205-ca3a-427b-b1b9-958d3d1704f4","resolution":{"observed_at":"2026-08-12T04:38:03.156947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:03.135813Z","title":"Van Gogh Diffusion Model","venue":null,"work_id":"745e5e21-7e0f-4f4f-831a-0049a3776791","year":2022},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.055965Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:6ca6c5bffdfd8ce1cc7f397d9d15637eea466bb3f45fa458d805e42ac20f7dce","observation_id":"1bd21f8c-a976-49f2-a8a7-8e590d5a12c2","resolution":{"observed_at":"2026-08-12T04:38:03.140971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.061632Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.061632Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:7c3cbd18965801bcc433a5abe98999ef1822f0d468b8cf7369b538af931a2c26","observation_id":"0e9df746-6387-4d09-95f0-2a3e80315212","resolution":{"observed_at":"2026-08-12T04:38:02.061632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-12T04:38:02.066901Z","title":"An image is worth one word: Personalizing text-to- image generation using textual inversion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.066901Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:5d1ac7370d4309cb96e50a86aeda6a904fc1daa8b14d608a107d8050895f4578","observation_id":"d6decae3-c276-41c9-9de7-98e690c09beb","resolution":{"observed_at":"2026-08-12T04:38:02.066901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.072185Z","title":"Generative adversarial networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.072185Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:99f2f2feffc23e89dbe5952ff7f6b5479d10b1f568c2eca1b13c0274852c7d14","observation_id":"4bf3130a-526f-4993-8061-7b28d77d2e6c","resolution":{"observed_at":"2026-08-12T04:38:02.072185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:03.097931Z","title":"Counterfeit-v3.0","venue":null,"work_id":"d0e2e194-9178-44e2-b05b-511672f9fe2a","year":2024},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.077092Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:bd776259302a061f32b9092a65dbf7d88ad338e03a4d2230bb6710ba7313971b","observation_id":"338d881f-cbbc-4c78-99e1-2dbd3aa682b3","resolution":{"observed_at":"2026-08-12T04:38:03.104038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-12T04:38:02.082036Z","title":"Prompt-to-prompt image editing with cross attention control.(2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.082036Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:9534c103dd2f632ae740ba75afd7f24d653fa290f369521d3dfe0cf4c2e2386a","observation_id":"67d376c2-9bcd-4f28-92ab-c97b5208e1c6","resolution":{"observed_at":"2026-08-12T04:38:02.082036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-12T04:38:02.087533Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.087533Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:2ad66714415c8821574d2320a6f1f8ecdeb195cee5df5b3c78b2b56a44a3b29b","observation_id":"5080f77e-1a6b-4a62-bbbf-ab7c61740938","resolution":{"observed_at":"2026-08-12T04:38:02.087533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.093046Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.093046Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:7d88c649a1d9f713389846ac549917e2b48655edea7f9834e293d011a28ef860","observation_id":"ae7d3960-88d6-4f14-bb8f-6b9ea9e79a88","resolution":{"observed_at":"2026-08-12T04:38:02.093046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:03.070604Z","title":"Introvae: Introspective variational autoencoders for photo- graphic image synthesis","venue":null,"work_id":"755c77f2-f3c2-4b5a-92c9-a66020015606","year":2018},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.098137Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:5a4f5848d03868f6f2b06f29fd934113d57dd6a4ce793d80369c5d3d591861d3","observation_id":"bb06ac7a-6134-48c0-b923-b1699421b51d","resolution":{"observed_at":"2026-08-12T04:38:03.075736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06976","last_updated":"2024-03-11T17:59:31Z","snapshot_observed_at":"2026-08-13T00:57:21.525577Z","submitted_at":"2024-03-11T17:59:31Z","title":"BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06976","snapshot_observed_at":"2026-08-12T04:38:02.102930Z","title":"Brushnet: A plug-and-play image inpaint- ing model with decomposed dual-branch diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.102930Z"},"links":{"cited_paper":"/paper/2403.06976","citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:af44afde1af28e012319ffb499253ab803e8a127d0fe252ef3af78acff83610b","observation_id":"f027f0f6-bdc2-4ce6-a208-668ee89b2f1a","resolution":{"observed_at":"2026-08-12T04:38:02.102930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.10196","last_updated":"2018-02-26T15:33:34Z","snapshot_observed_at":"2026-07-06T06:06:26.276752Z","submitted_at":"2017-10-27T15:28:35Z","title":"Progressive Growing of GANs for Improved Quality, Stability, and Variation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.10196","snapshot_observed_at":"2026-08-12T04:38:02.108722Z","title":"Progressive growing of gans for improved qual- ity, stability, and variation.arXiv preprint arXiv:1710.10196,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.108722Z"},"links":{"cited_paper":"/paper/1710.10196","citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:5f1220166898390f26c8230666d55edbcc9d76ac71d20a7e479417cbe04441f9","observation_id":"44e79534-fc81-412a-8287-1eed21168981","resolution":{"observed_at":"2026-08-12T04:38:02.108722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.113825Z","title":"A style-based generator architecture for generative adversarial networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.113825Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:755356330c0de1472f68adf1c9094b69d954e14b8d39ccfaefaf35fe9dfb3621","observation_id":"c3e37608-c1f3-495f-96be-d6b939c770da","resolution":{"observed_at":"2026-08-12T04:38:02.113825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.118488Z","title":"The open images dataset v4: Unified image classification, object detection, and visual relationship detection at scale","venue":null,"work_id":null,"year":1956},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.118488Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:1bd48f8be3904f046d6c97154d43bb29b61f4a1c9202e056b2d54cb1e235397a","observation_id":"1831a27f-70d6-4059-a430-0e3ffae1f274","resolution":{"observed_at":"2026-08-12T04:38:02.118488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.123137Z","title":"Blip-diffusion: Pre- trained subject representation for controllable text-to-image generation and editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.123137Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:678044d04121aad5477eb5580c2817f72f93158f55b62203ae5edad26418dd38","observation_id":"e46eaf5e-9563-408a-ae6e-3dd2ad176540","resolution":{"observed_at":"2026-08-12T04:38:02.123137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.127606Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.127606Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:f53f8eb127dac16d5c4c7a2ebbbb38af741bae3c5180c239d4059ed73290467b","observation_id":"5e2d2eb4-83c3-4b47-a261-3993e2615695","resolution":{"observed_at":"2026-08-12T04:38:02.127606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-12T04:38:02.132017Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.132017Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:3d12d80da64a57caf00d0723011a729d28c308d7623bbf2978c2f7d3d1ea6c39","observation_id":"9608787f-f3d9-4a1c-9d13-185746bf4711","resolution":{"observed_at":"2026-08-12T04:38:02.132017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.136569Z","title":"Deep learning face attributes in the wild","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.136569Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:e9541a573c398b7032f5264e99368db0070509f3e3e781d8ef57f057365c4b97","observation_id":"5bd25526-f49a-49fe-b264-cd3d4ec2f417","resolution":{"observed_at":"2026-08-12T04:38:02.136569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:03.001846Z","title":"Spe- cialist diffusion: Plug-and-play sample-efficient fine-tuning of text-to-image diffusion models to learn any unseen style","venue":null,"work_id":"1167bd4d-a71c-43e1-a137-6cc4ef0ef5fe","year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.140877Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:9dee8fbb0db0345a03a5b9dac18e546c2da8ac7b7da25139387f8680f239cf08","observation_id":"29f94f3d-5545-42c8-9bbb-ee9d3ce5e4f7","resolution":{"observed_at":"2026-08-12T04:38:03.007198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.145307Z","title":"Repaint: Inpainting using denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.145307Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:ad238cb5df16efb951aabd894706fdca7c1a3c7372f09500b837c7331b7c7810","observation_id":"91ee503a-dfaa-477d-b9a5-3bb69e6b13d7","resolution":{"observed_at":"2026-08-12T04:38:02.145307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14091","last_updated":"2024-03-18T16:48:13Z","snapshot_observed_at":"2026-08-13T04:55:54.883202Z","submitted_at":"2023-12-21T18:09:30Z","title":"HD-Painter: High-Resolution and Prompt-Faithful Text-Guided Image Inpainting with Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14091","snapshot_observed_at":"2026-08-12T04:38:02.150262Z","title":"Hd-painter: high-resolution and prompt-faithful text-guided image inpainting with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.150262Z"},"links":{"cited_paper":"/paper/2312.14091","citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:9f5b04b671e2f59148f2344986749da2ae91282f1a400ee2521b1c2c61160273","observation_id":"195eab47-b378-4ac6-848a-9e2c120db411","resolution":{"observed_at":"2026-08-12T04:38:02.150262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.973608Z","title":"9 On distillation of guided diffusion models","venue":null,"work_id":"150da876-3a8d-43c1-92c8-0008eae36bd2","year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.154949Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:c3582ce626ad0e2d82944d59c168575fcec00fdc547fa0fed0c5a6d7c44c17a7","observation_id":"97b9a741-4258-4870-b88d-e994c42db0bd","resolution":{"observed_at":"2026-08-12T04:38:02.978959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.160072Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.160072Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:147f62035601c13c105069f47f0c06ec572a4f6dae4a36a539a3b2801a22bcfd","observation_id":"b9c9adfa-c601-4064-80ed-dd51ccc4ae86","resolution":{"observed_at":"2026-08-12T04:38:02.160072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.164824Z","title":"Gen- erating diverse structure for image inpainting with hierar- chical vq-vae","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.164824Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:a43945775a716dd6bb8a888e589fbc36db26edadae625d5a8180f4d5a507514b","observation_id":"664f6b88-6f46-4cbb-8559-79c2c381d4ed","resolution":{"observed_at":"2026-08-12T04:38:02.164824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-12T04:38:02.169245Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.169245Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:05f61245f268d00399dfe85e2171c90770152ee990f3fc3baf0bebffc1171e26","observation_id":"605f0573-b13f-4314-86e8-0700cfa1ab60","resolution":{"observed_at":"2026-08-12T04:38:02.169245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.936663Z","title":"Deep learning-based image and video inpainting: A survey","venue":null,"work_id":"5cd234e2-e453-4736-9073-20ce110cddef","year":2024},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.173902Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:5cfac4fe24b96a9782980224c227f3afa35a1f4668a816b61285d3fc9cd5a381","observation_id":"65cebef8-8b80-4b15-a427-d292352aa56a","resolution":{"observed_at":"2026-08-12T04:38:02.941700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.919853Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"9ea7bf42-c163-474b-bc21-968da1fdb27d","year":2021},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.178465Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:a28c8d0407fc8f6a58c9790e814d97f781212ffc4dbc760b79e8183870c91ef9","observation_id":"0fbdadc0-c71d-46ae-8f08-62e8530bf03a","resolution":{"observed_at":"2026-08-12T04:38:02.925373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.183352Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.183352Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:4826bc718d97d8e475d130603bfaea0ed3409d8f742e06a27e077760a01170e6","observation_id":"162ebc24-fa95-44f9-b5aa-0dd63af9adf6","resolution":{"observed_at":"2026-08-12T04:38:02.183352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-12T04:38:02.188077Z","title":"Hierarchical text-conditional image gener- ation with clip latents","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.188077Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:202f3732933b19c1d123a202f0b6c7d804bf520d474fc1df5effe054a79f6854","observation_id":"e00b82db-9c9a-48d9-adc5-f207385ae29b","resolution":{"observed_at":"2026-08-12T04:38:02.188077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.891675Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"3f06ac5b-22a6-490c-8bd8-d741c315b2d5","year":2022},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.193159Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:7f75588cf24a5e0c92280c8d1225988638406f0855d429f50de8f80d78418054","observation_id":"6f1b02ec-ae0e-4c18-9de6-08e24b74d8af","resolution":{"observed_at":"2026-08-12T04:38:02.896933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.198113Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.198113Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:5944dc82873bd7da34b520f27fe5a9b702143c14c8b1984c2f51a26e0f5e7761","observation_id":"4add31f2-50d3-4509-978e-597eade4be58","resolution":{"observed_at":"2026-08-12T04:38:02.198113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.202734Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.202734Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:471f3a8ce06e6f8b05ad4a22b06aeed9dc5888085b83b5c03332f5daf4e48b3f","observation_id":"274dec7e-a332-46d5-8412-9c2f05e14da6","resolution":{"observed_at":"2026-08-12T04:38:02.202734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.207225Z","title":"Mi-gan: A simple baseline for image in- painting on mobile devices","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.207225Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:593b0db2737c76073bdd77e63efa288e60ff1300c305295349073f72ac5c974d","observation_id":"90ef4f30-8f25-4d56-b0c1-44894d9b6e82","resolution":{"observed_at":"2026-08-12T04:38:02.207225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.211782Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.211782Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:b1aa1f99553ba808462e5c6fb89aaed19ff91ec099c63031677b7026cddd5e1a","observation_id":"75fe57bf-3dc4-49e6-bdad-bf701a884e6b","resolution":{"observed_at":"2026-08-12T04:38:02.211782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.828717Z","title":null,"venue":null,"work_id":"ecd421ab-a4f6-4491-a972-5777ac068fb5","year":2024},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.216278Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:2bb97257a99a2dce501a48200533862aef2f9afb6e669adfa959a8a573052d86","observation_id":"942a54fd-e32d-4207-8c33-0ed2a5339c26","resolution":{"observed_at":"2026-08-12T04:38:02.833858Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.812756Z","title":"Chatglm: A family of large language mod- els from glm-130b to glm-4 all tools","venue":null,"work_id":"acfb9fb9-477a-4f53-878c-e6d3caec5491","year":2024},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.220822Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:175c1f86bb9986ffa45783d366fc38955cdd0cab43261cd5f83d7d9630fc2ff4","observation_id":"106bb60e-25f4-4047-b4c5-5cffb3f71b11","resolution":{"observed_at":"2026-08-12T04:38:02.817770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.796252Z","title":"High-fidelity pluralistic image completion with transform- ers","venue":null,"work_id":"4509ee9a-bd51-4af1-8832-955f404a874c","year":2021},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.225115Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:f06c2f19388b252c014508b7820ba2353827aa388a46fd79c694be17cfa6d34a","observation_id":"08a11d1c-1ca7-4d59-96fc-fddcc29df6e9","resolution":{"observed_at":"2026-08-12T04:38:02.801600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.780658Z","title":"Imagen editor and editbench: Advancing and evaluating text-guided im- age inpainting","venue":null,"work_id":"6c1b61af-f836-4303-94bf-b9dd2e21684d","year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.229528Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:2cd9fb5a0e26d604034908594385bd817a1955082e9b99e87baa85a772d5f047","observation_id":"0d9b42e2-439e-47b0-8527-fd429371549c","resolution":{"observed_at":"2026-08-12T04:38:02.785516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.14806","last_updated":"2021-04-30T07:40:35Z","snapshot_observed_at":"2026-08-12T04:22:15.303374Z","submitted_at":"2021-04-30T07:40:35Z","title":"GODIVA: Generating Open-DomaIn Videos from nAtural Descriptions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.14806","snapshot_observed_at":"2026-08-12T04:38:02.234358Z","title":"Godiva: Gen- erating open-domain videos from natural descriptions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.234358Z"},"links":{"cited_paper":"/paper/2104.14806","citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:b2066e5f7d30fd7348867849c97eecaca0b55d7fe8e04e171faf116692bc70d4","observation_id":"a945daad-0538-4d4f-89f3-35acf74e3936","resolution":{"observed_at":"2026-08-12T04:38:02.234358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.764573Z","title":"Smartbrush: Text and shape guided object inpainting with diffusion model","venue":null,"work_id":"2321031a-5f66-4297-99f0-5ccf3852f8e0","year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.239204Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:6221f092f11418fe7f527e394c73cb6bac399a4dda8eaed677c21157072383f9","observation_id":"b1513de4-90e6-48d0-8cc0-2e187417b97e","resolution":{"observed_at":"2026-08-12T04:38:02.769958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03771","last_updated":"2023-12-05T22:23:19Z","snapshot_observed_at":"2026-08-13T05:09:09.098874Z","submitted_at":"2023-12-05T22:23:19Z","title":"DreamInpainter: Text-Guided Subject-Driven Image Inpainting with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03771","snapshot_observed_at":"2026-08-12T04:38:02.244064Z","title":"Dreaminpainter: Text-guided subject-driven image inpaint- ing with diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.244064Z"},"links":{"cited_paper":"/paper/2312.03771","citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:72a1c210cc031b06e33af6738690eca3b1b0cc99c3626c96ee3c453e8dcdc66b","observation_id":"dc88320c-9062-4835-8f85-6a69ec9fe707","resolution":{"observed_at":"2026-08-12T04:38:02.244064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.250520Z","title":"Imagere- ward: Learning and evaluating human preferences for text- to-image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.250520Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:6751580d8c8581ac158fb07ee3fb3020bd7fbc458377a826e96dbb7e012b8b71","observation_id":"bc4e570b-5e0f-43c9-940e-7f3bb4c799c6","resolution":{"observed_at":"2026-08-12T04:38:02.250520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.256127Z","title":"Image completion with heterogeneously filtered spectral hints","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.256127Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:cf5ef5a3396b0158969d3dbd5e5a8a2b6efde11933085a0a644f808f696b9c89","observation_id":"bcc258ab-3954-489f-9f6b-c1382ee0a8fc","resolution":{"observed_at":"2026-08-12T04:38:02.256127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.728526Z","title":"A review of image in- painting methods based on deep learning","venue":null,"work_id":"c8c40610-c689-45e7-b294-ec96f29b8320","year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.261871Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:8817968200bc4537e55ae54bc35eeca2ad32690be7bdd4aa55efdeb427e45579","observation_id":"e8f6f98b-7ed0-405d-8377-17033d58ad34","resolution":{"observed_at":"2026-08-12T04:38:02.733696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.712573Z","title":"Uni-paint: A unified framework for multimodal image inpainting with pretrained diffusion model","venue":null,"work_id":"841d61b6-9440-4a45-a368-a49ee1e5a51e","year":null},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.268835Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:fea4210b4989805ae96a1bcbe5edfc982e98a4edd51ff17e76f73e3f8d1734b9","observation_id":"d99c2d05-c783-4a7e-b08c-050e6929347e","resolution":{"observed_at":"2026-08-12T04:38:02.717653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.695777Z","title":"Towards coherent image in- painting using denoising diffusion implicit models","venue":null,"work_id":"2feadf96-f4b4-4f70-ae37-9a40bf8d2125","year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.275905Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:ede3f336ccb642c8df368bd139b38ad13ccdfeebd69a9b4ecf81f8d1ec48f043","observation_id":"dfe5428e-6a8b-445a-9757-0fe97cfc1f04","resolution":{"observed_at":"2026-08-12T04:38:02.701316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.678386Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"7028c96a-bc06-4a91-b5bc-9a06b3b8789c","year":2023},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.282522Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:2d888ed998603050c2369175182c202bcc98859273edf8a5f274a75fc46b9674","observation_id":"67167e36-4b0a-4bce-9009-2c93cbece0e2","resolution":{"observed_at":"2026-08-12T04:38:02.683317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.10428","last_updated":"2021-03-18T17:59:11Z","snapshot_observed_at":"2026-08-13T19:55:33.904329Z","submitted_at":"2021-03-18T17:59:11Z","title":"Large Scale Image Completion via Co-Modulated Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.10428","snapshot_observed_at":"2026-08-12T04:38:02.288176Z","title":"Large scale image comple- tion via co-modulated generative adversarial networks.arXiv preprint arXiv:2103.10428, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.288176Z"},"links":{"cited_paper":"/paper/2103.10428","citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:c51e8ee973768924ea79590263a85f26722dfefadf7bebff8da0e48629b49585","observation_id":"ef3560c7-f4ed-4fce-8abc-b80c37b63855","resolution":{"observed_at":"2026-08-12T04:38:02.288176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.294160Z","title":"Pluralistic image completion","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.294160Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:96dc635d979033cbde0e427a277bf54edd7ece24cb28d9d31d00441ba1390bd4","observation_id":"e185bfba-95e8-457e-a282-03296a4954ea","resolution":{"observed_at":"2026-08-12T04:38:02.294160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.651770Z","title":"Image inpainting with cascaded modulation gan and object-aware training","venue":null,"work_id":"ced66428-34aa-42d9-8c7d-f14976f77b1b","year":2022},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.299692Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:63bd98069348eeb10760d0ed21df3dcb7d69385d20208e3c6ff6ec5290c24a5b","observation_id":"8ae1702d-2fb9-426f-8f4e-9df092f1317a","resolution":{"observed_at":"2026-08-12T04:38:02.656575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.635519Z","title":null,"venue":null,"work_id":"4361a781-cf10-4b1b-918f-a05b76519590","year":null},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.304968Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:fabcc0bcf21dcaaa98a7986c883d0528fd319e5afae53395a30394b640c94e14","observation_id":"c484a0c9-237f-428c-af1d-9232d884b024","resolution":{"observed_at":"2026-08-12T04:38:02.640377Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.619482Z","title":null,"venue":null,"work_id":"6260e7af-b1e6-47a7-a9e2-5aae54b48776","year":null},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.310075Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:bfc55d1085a23eb019de4ea382cf2e3b70c141a8da0c9c8f64bcae73c7ccadc4","observation_id":"9646e536-038b-4f3c-94d8-46dbd49dc2fb","resolution":{"observed_at":"2026-08-12T04:38:02.624367Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T04:38:02.600955Z","title":"8, our PainterBench ensures a uniform distribution among various categories, including humans, animals, cartoons, as well as indoor and outdoor scenes","venue":null,"work_id":"1734a78a-d5ff-484b-b522-edb4b7015a3b","year":null},"citing_paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T04:38:02.315863Z"},"links":{"citing_paper":"/paper/2412.01223"},"observation_digest":"sha256:ff5f2b1d22d800aa11c637a8a55aaf5d3317305ce9d8682c35e91311c6cc8231","observation_id":"788d3a88-bdb8-4da8-bf87-ef5ffc1b847c","resolution":{"observed_at":"2026-08-12T04:38:02.608340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.01223","last_updated":"2024-12-02T07:40:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T14:07:30.838807Z","submitted_at":"2024-12-02T07:40:47Z","title":"PainterNet: Adaptive Image Inpainting with Actual-Token Attention and Diverse Mask Control"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2412.01223."}