{"as_of":"2026-08-14T07:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ad017167b0ed149d40c28968d8f2bc511a40624b93e41b0683f05fd3053cc6d2","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:03:43.742499Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.09575/citation-record","integrity":"/paper/2508.09575/integrity","json":"/paper/2508.09575/citation-record.json","paper":"/paper/2508.09575"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:40.887729Z","title":"Ntire 2017 challenge on single image super-resolution: Dataset and study","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:40.887729Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:f22cc926e10c268946b76f84432e3e79b66964d956fd63af98b39889a1da6f16","observation_id":"8b55ff6c-1158-40af-92b0-7851867c9c19","resolution":{"observed_at":"2026-08-05T21:03:40.887729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:40.954369Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:40.954369Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:c7fdf5598a5187eb64104f5b762fd8a8f0da0b4e0a7513dbe734079e36c14616","observation_id":"2ba987d3-cd9f-4215-92f0-8c91cbf8d4fc","resolution":{"observed_at":"2026-08-05T21:03:40.954369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:41.051973Z","title":"Arcface: Additive angular margin loss for deep face recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:41.051973Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:17d09f68b438ebc3cd0f86da0aec6b4cb2fc18b18ae2bedb2a55462bc37b7d57","observation_id":"e97700d5-e708-4394-9098-ecc1e6aa2562","resolution":{"observed_at":"2026-08-05T21:03:41.051973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:41.126486Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:41.126486Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:4228fb0a41e0ae22ae877656a7158524bd0206cd99b03a5c076563cfbac0f776","observation_id":"b0ac4411-47f3-48ad-95c8-882ddbc146c0","resolution":{"observed_at":"2026-08-05T21:03:41.126486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11084","last_updated":"2020-05-22T10:01:04Z","snapshot_observed_at":"2026-08-13T22:38:49.230119Z","submitted_at":"2020-05-22T10:01:04Z","title":"Point2Mesh: A Self-Prior for Deformable Meshes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.11084","snapshot_observed_at":"2026-08-05T21:03:41.235810Z","title":"Point2mesh: A self-prior for deformable meshes","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:41.235810Z"},"links":{"cited_paper":"/paper/2005.11084","citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:5389b94077f5f49c8e8f6bc3023b6b6ebb6772b261a88ff2b2c98c6da046e26d","observation_id":"1e0d5a2e-d777-4a17-be9d-d46dcf7fc9fd","resolution":{"observed_at":"2026-08-05T21:03:41.235810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:41.345197Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:41.345197Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:696051d2e11a0545e2c5215f3e9b1e636783bcf29aab9f05512401789989a739","observation_id":"e27f238d-a81c-4316-b27e-468f81a9a02d","resolution":{"observed_at":"2026-08-05T21:03:41.345197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-05T21:03:41.427879Z","title":"Prompt-to-prompt im- age editing with cross attention control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:41.427879Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:aacfb441beba1e811c257fc0d4bc3a5f79900a27764d575894eeae8266b06f43","observation_id":"e2d326a1-404f-4613-af6e-3a6c7c649ef3","resolution":{"observed_at":"2026-08-05T21:03:41.427879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:41.506777Z","title":"Delta de- noising score","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:41.506777Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:8d4e5889c77182f5b2b1e6db70e6f874058fdb028e06204a7aa04916a0bca2a3","observation_id":"64e63722-d16d-4ea4-b1b9-b8b8e607151f","resolution":{"observed_at":"2026-08-05T21:03:41.506777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-05T21:03:41.618279Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:41.618279Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:19a2244c655918db0ae7e4ee5317c22100530c83bf24a0e459ecc7dc7b2192b7","observation_id":"7d41e3fc-8af3-4f7e-a31a-ed35b6580618","resolution":{"observed_at":"2026-08-05T21:03:41.618279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:41.654793Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:41.654793Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:acf13b7cbe4e1939542aba94afcf63a0cfac44a3c45aad6dbe0b72081659b12d","observation_id":"9f50aca5-a0e0-4bac-8b95-1191c17d5164","resolution":{"observed_at":"2026-08-05T21:03:41.654793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:41.727546Z","title":"Surface reconstruction from point clouds: A survey and a benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:41.727546Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:7dea0b3a876b106e272474e9d99f108edafd6ae229cb4f4e725d29b9ffa2a76e","observation_id":"e78e1bbe-7dd3-4065-9c7d-30d1f3810bdd","resolution":{"observed_at":"2026-08-05T21:03:41.727546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19930","last_updated":"2025-03-25T04:09:21Z","snapshot_observed_at":"2026-08-14T05:43:58.852018Z","submitted_at":"2025-02-27T09:59:38Z","title":"Identity-preserving Distillation Sampling by Fixed-Point Iterator","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19930","snapshot_observed_at":"2026-08-05T21:03:41.779840Z","title":"Identity-preserving distillation sampling by fixed-point iterator","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:41.779840Z"},"links":{"cited_paper":"/paper/2502.19930","citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:c1ce650f5fbd29cb63e69846740029b3bb63d5bdc70bad4d90c3af5350ed86a1","observation_id":"9ab91341-c682-41bb-bd25-258823c073a1","resolution":{"observed_at":"2026-08-05T21:03:41.779840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:41.910418Z","title":"Segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:41.910418Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:9ed2edd2f3d7f741b3c945996fff6dd3d6f68594c0ff162e47e30fab8be5faa1","observation_id":"90a4b248-ace3-4b00-8645-4db323bf2031","resolution":{"observed_at":"2026-08-05T21:03:41.910418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:41.979235Z","title":"Ctrl-x: Controlling structure and appearance for text-to-image generation without guidance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:41.979235Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:cca687ecec8b094f91735ea5e5cab786f7d970c39e213be5d6f84417bfb6c0c4","observation_id":"49188990-78cf-4414-9d10-2d41ca71a62e","resolution":{"observed_at":"2026-08-05T21:03:41.979235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:42.079233Z","title":"Dpm-solver: A fast ode solver for diffu- sion probabilistic model sampling in around 10 steps","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:42.079233Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:49a586662daac53c775dbe79623aa190ee3fe5253f4ccee9e1107cc6bdb9cc99","observation_id":"83de5908-4a88-4d49-88bb-3cc5fa5415c0","resolution":{"observed_at":"2026-08-05T21:03:42.079233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:42.148116Z","title":"Dpm-solver++: Fast solver for guided sam- pling of diffusion probabilistic models.Machine Intelligence Research, pages 1–22, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:42.148116Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:6ddaa8026fd0003865715395ed1bef0f907b4d2265b0cf1ff67d0b49b520c7a9","observation_id":"163c87f2-31f3-4286-91e4-485a2552a85b","resolution":{"observed_at":"2026-08-05T21:03:42.148116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:42.258458Z","title":"Freecontrol: Training-free spatial control of any text-to-image diffusion model with any condition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:42.258458Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:da4c7cb32d16d07b6b47c01afc0e6d5655c1643d2b41a9df5265d8eb8910e777","observation_id":"ccc9c3e6-1618-40f7-832e-18fa49fcb226","resolution":{"observed_at":"2026-08-05T21:03:42.258458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:42.333788Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:42.333788Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:4f660e84e12f541167375ff505d8c3dbfe61226f27350ba555b48002cac658a7","observation_id":"5b568b13-e0d0-4315-86cf-f35562d172b6","resolution":{"observed_at":"2026-08-05T21:03:42.333788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:42.416394Z","title":"Contrastive denoising score for text- guided latent diffusion image editing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:42.416394Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:ea5cecb1f66b64f7c1d487ba8d0083277bac1d022c852aa46c525f1958329e04","observation_id":"38662c5d-aac3-4fe4-9cd5-15d1fd525144","resolution":{"observed_at":"2026-08-05T21:03:42.416394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-05T21:03:42.498460Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:42.498460Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:4ccc37406f75819ba8722169eb8ae39b3cf04b7da9ba547d5fb94f4cb31230c8","observation_id":"ca800c2b-5718-4819-95c5-8a68f91466ee","resolution":{"observed_at":"2026-08-05T21:03:42.498460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-05T21:03:42.574111Z","title":"Dreamfusion: Text-to-3d using 2d diffusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:42.574111Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:ca73444995943ac11d2398f37b733828462437850ec040df19eb8936e6a8eebd","observation_id":"d5cb9e2b-0f0a-4ffb-8f4a-9d9591fdd088","resolution":{"observed_at":"2026-08-05T21:03:42.574111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11147","last_updated":"2023-11-02T17:59:06Z","snapshot_observed_at":"2026-08-13T11:39:17.693095Z","submitted_at":"2023-05-18T17:41:34Z","title":"UniControl: A Unified Diffusion Model for Controllable Visual Generation In the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11147","snapshot_observed_at":"2026-08-05T21:03:42.639892Z","title":"Unicontrol: A unified diffusion model for controllable visual generation in the wild","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:42.639892Z"},"links":{"cited_paper":"/paper/2305.11147","citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:1d49884a1684661426659eea88078838d44c228cfac91d7694a0e7ef18b1403f","observation_id":"b11c8fd0-2443-44c1-8ae1-698bee15675c","resolution":{"observed_at":"2026-08-05T21:03:42.639892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:42.742421Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:42.742421Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:50f75f7953f20135b1e6808cc0d5e0390eaf25b99fb6a1392bf6f216d83b3436","observation_id":"27699b31-c043-457e-96a9-79d16db0b33b","resolution":{"observed_at":"2026-08-05T21:03:42.742421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:42.826444Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:42.826444Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:66341876862d6e4d3eadcdf34c54bc183bffb05dc55bf0bd99faf890c169f4b3","observation_id":"0e182c9a-83e2-4f57-bc95-223dd42ce0f9","resolution":{"observed_at":"2026-08-05T21:03:42.826444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:42.934740Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:42.934740Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:256e3413405582bc002a78448b766143d3c7a9998fbb5b56fbfc5bd28521c2c5","observation_id":"48235b7a-b0d1-4a7e-981b-4dcb29a0d6e5","resolution":{"observed_at":"2026-08-05T21:03:42.934740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:43.016454Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:43.016454Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:20f8ac3d2b22ee8edcb5daddd80e3c25ea60c9d729873c6722fa990e2b1c78b4","observation_id":"f184e5df-6647-491b-89c9-cccfcf09064e","resolution":{"observed_at":"2026-08-05T21:03:43.016454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-05T21:03:43.085766Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:43.085766Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:be4086ab9da1cd4629eb6e1bcfc80e72ade70da8d70faea955a1dd84ee0f7f10","observation_id":"2fbbf9e5-e06a-41e2-8190-fedc539837e2","resolution":{"observed_at":"2026-08-05T21:03:43.085766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-05T21:03:43.201504Z","title":"Score-based generative modeling through stochastic differential equa- tions","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:43.201504Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:e96063fa764835179c2e5fce2453fd02f11c136e4bb8951540677022d352dbbb","observation_id":"2ecb8efa-9480-4e13-8ea0-bfe199727a36","resolution":{"observed_at":"2026-08-05T21:03:43.201504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:43.286300Z","title":"Splicing vit features for semantic appearance transfer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:43.286300Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:b25af8445616057403135a01f15463a26015ae7f6a866a1fc53d2ab82671c72d","observation_id":"9a053ff2-ead8-4b2c-8d55-395048d34a60","resolution":{"observed_at":"2026-08-05T21:03:43.286300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:43.383113Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":null,"year":1921},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:43.383113Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:a784b4daee6faf2f5e08e61a1fa33b126754ad790b8ab1227cea39907b4cee32","observation_id":"7d0940ce-cf05-4bdb-ad22-b69b5dbcd9a1","resolution":{"observed_at":"2026-08-05T21:03:43.383113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-05T21:03:43.483378Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:43.483378Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:0561209f907ef6bcc938d58862184fb2f8f099159667e7c5e82fd65b23442bd9","observation_id":"2e6e57f6-7380-4e4d-894f-222035126079","resolution":{"observed_at":"2026-08-05T21:03:43.483378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:43.604961Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:43.604961Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:e9bcef312a3950a453110d3d619228d910d1ae07beadf6ccd0d05635235b6ad9","observation_id":"11b4cd21-5549-4232-87aa-13380a1aae79","resolution":{"observed_at":"2026-08-05T21:03:43.604961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:03:43.657016Z","title":"Unipc: A unified predictor-corrector framework for fast sampling of diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:43.657016Z"},"links":{"citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:8936f48fdd9431c02eb69231fb5d19e1b7b9456fc40f670a2e960320eea626d2","observation_id":"98437b91-71d9-4eb9-94ab-cddb2d0660a9","resolution":{"observed_at":"2026-08-05T21:03:43.657016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1605.04797","last_updated":"2016-07-02T03:15:10Z","snapshot_observed_at":"2026-08-13T18:52:52.120338Z","submitted_at":"2016-05-16T15:09:19Z","title":"Thingi10K: A Dataset of 10,000 3D-Printing Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.04797","snapshot_observed_at":"2026-08-05T21:03:43.742499Z","title":"A photo of a statue on stones","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T21:03:43.742499Z"},"links":{"cited_paper":"/paper/1605.04797","citing_paper":"/paper/2508.09575"},"observation_digest":"sha256:e2537b07ed1103952eb3765e19acda9a7e8ded6655790758fdb498b028243df1","observation_id":"5363355b-cb0c-4a89-8938-48f90ae8fcbf","resolution":{"observed_at":"2026-08-05T21:03:43.742499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.09575","last_updated":"2025-08-13T07:46:00Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T10:50:33.326949Z","submitted_at":"2025-08-13T07:46:00Z","title":"Dual Recursive Feedback on Generation and Appearance Latents for Pose-Robust Text-to-Image Diffusion"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2508.09575."}