{"as_of":"2026-08-09T16:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f80d4d8603929618bf54e93638fb2b766fd59b0e3279688f93f6b37f2c4c97c0","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:10:57.109432Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.11533/citation-record","integrity":"/paper/2507.11533/integrity","json":"/paper/2507.11533/citation-record.json","paper":"/paper/2507.11533"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:02.394275Z","title":"Retinaface: Single-shot multi-level face localisation in the wild","venue":null,"work_id":"0b07abda-2c92-473b-9a70-c1c656ed9241","year":null},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:53.810512Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:acbf498a8cf905b738bfc82c4a5b6a62940f3a1b9280e617a137817edcd2cb0e","observation_id":"265b6ac2-a354-4164-b08a-bd6f92252d8b","resolution":{"observed_at":"2026-08-06T17:11:02.473423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:02.234374Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"a29fcc21-7f68-44be-930b-4395b41abf03","year":null},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:53.916151Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:36cfb820717cd899b5a416e0f9db34a778ea2f8661a9f2319e7496087c60d01e","observation_id":"d4d4d99e-3e07-48e2-91ec-0dca81fc1b74","resolution":{"observed_at":"2026-08-06T17:11:02.309918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:02.067479Z","title":"Scaling rec- tified flow transformers for high-resolution image synthesis","venue":null,"work_id":"18c62af2-2b0a-4923-b33d-1dd2512b75ac","year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:53.995128Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:e9ec718c323ccd8732d8747495f458f5343825fce2143cc68b21575b68290be4","observation_id":"95b34fec-ef58-41b3-b912-02801e2f3f77","resolution":{"observed_at":"2026-08-06T17:11:02.158346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:01.872989Z","title":"An image is worth one word: Personalizing text- to-image generation using textual inversion","venue":null,"work_id":"fba0b52a-7774-4eb3-8d6f-ed52a385b0fc","year":2023},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.073083Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:fa88a670fe334a947a5a1048dfe8a74ef5623333e778b2375841201235dc89b8","observation_id":"3ea06750-5236-4c99-8371-0c9a0932f962","resolution":{"observed_at":"2026-08-06T17:11:01.963883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:01.672315Z","title":"Generative adversarial networks","venue":null,"work_id":"9ea20909-e127-45ed-95e1-c6e80cc17eea","year":2020},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.154372Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:f7f53feb7878fcfdf29e172dcd032c980617808a8f5adb52966eb7d23490dc86","observation_id":"bb8e4ad0-8f64-419b-afeb-a9477f804cd9","resolution":{"observed_at":"2026-08-06T17:11:01.749680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:01.488185Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"54da40be-eb61-4ff6-8b2a-dbd896f87eed","year":2016},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.241237Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:c72e68d06b41f9c40bc5c69075744929db0367171128b285fb4ee2d3f5b9743c","observation_id":"8cbbe56a-6f21-4543-96fb-1d0665e97818","resolution":{"observed_at":"2026-08-06T17:11:01.561353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:01.280056Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"1b75d72f-388b-4f09-aa4c-8097460fcee7","year":2020},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.395124Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:cb6051a8d5939e4191e0f577e22bb46a24f7b266fe1e2a8240a5841cca223132","observation_id":"ce765af6-ea03-4580-8862-977cdb6da211","resolution":{"observed_at":"2026-08-06T17:11:01.370400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:01.141166Z","title":"Kingma and Max Welling","venue":null,"work_id":"297b034c-1168-421c-aa11-3d91466efbc5","year":2014},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.481985Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:3019019894f12b1bf1e32c791d887701a08d31a874fcb875baa9e81fb7893414","observation_id":"71efcc97-4f08-4a4d-9da4-ee9b37eeead8","resolution":{"observed_at":"2026-08-06T17:11:01.196214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:00.987974Z","title":"Segment anything","venue":null,"work_id":"062ecd89-c527-4352-b1ea-1679848b157d","year":2023},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.566502Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:0b03140ae8d0352c32200adeb3b307409724534bd41b6babcd161f767de372df","observation_id":"1c731071-646b-4bb5-84a4-d1228db1fab1","resolution":{"observed_at":"2026-08-06T17:11:01.049919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-06T17:10:54.669280Z","title":"Hunyuanvideo: A systematic framework for large video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.669280Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:782232ee6582818374042f97f2868f362714dc98f3d7cd71345e1e94dfc4cf47","observation_id":"541d7c7e-1122-40ff-8914-f5b37e8c522b","resolution":{"observed_at":"2026-08-06T17:10:54.669280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:00.847303Z","title":"Multi-concept customization of text-to-image diffusion","venue":null,"work_id":"c793037d-4592-4016-9dcc-734052a72493","year":1931},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.758410Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:c329696db6a8df09aacbc424c48a9eb864580895d575485a2b8404ef78ed87fc","observation_id":"ed865555-2815-4eb1-b6c1-d21cd62a0432","resolution":{"observed_at":"2026-08-06T17:11:00.929691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:00.683278Z","title":null,"venue":null,"work_id":"4d8340bd-f696-4f06-a986-c59eb5669860","year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.837662Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:9547ab56cf03d41400a02cc5812549d60df429d82f2eb882561207a208213dba","observation_id":"c15efee1-8daa-4f0e-bf07-e6b08cea0006","resolution":{"observed_at":"2026-08-06T17:11:00.786271Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:00.546285Z","title":"Photomaker: Customizing realistic human photos via stacked id embedding","venue":null,"work_id":"67446e7e-d953-4ecf-80a3-3d00a807913d","year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.948289Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:6b66450a9badabcb3325b894e7d9d2e7c7960d0be2c8da1f8c37b95ca333977e","observation_id":"3be95fc9-996a-4283-b29a-80df6a42d51c","resolution":{"observed_at":"2026-08-06T17:11:00.600287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08748","last_updated":"2024-05-14T16:33:25Z","snapshot_observed_at":"2026-07-06T18:14:16.386835Z","submitted_at":"2024-05-14T16:33:25Z","title":"Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08748","snapshot_observed_at":"2026-08-06T17:10:55.041081Z","title":"Hunyuan-dit: A powerful multi-resolution diffusion transformer with fine-grained chinese understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.041081Z"},"links":{"cited_paper":"/paper/2405.08748","citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:8432825575d6ee2d8cb24fc7b337b2fdccd25e2d01edb3a948cb7fd1e37cf571","observation_id":"131fe098-44f5-4301-a768-3fb169eca97f","resolution":{"observed_at":"2026-08-06T17:10:55.041081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:00.387474Z","title":"AnyI2V: Animating any conditional image with motion control generation","venue":null,"work_id":"300bb697-b52d-486e-9c03-c64c280f59a9","year":2025},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.141118Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:1cc5be2fd760a0384305e34ee742f83a0ce4444d18cd93a09b188e505bdde1b2","observation_id":"a1b4a5d5-0a12-4e78-bede-cc2f615007cd","resolution":{"observed_at":"2026-08-06T17:11:00.474974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:00.230535Z","title":"One-prompt-one-story: Free-lunch consistent text- to-image generation using a single prompt","venue":null,"work_id":"b2aad65d-b500-4aad-a4ba-ed82b1e45cd9","year":2025},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.224649Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:70ac215934f386c7e7a3b02165ec8d12a4c852f6a5b035a8dc042676f3bb05db","observation_id":"5d62c815-a590-4268-b36d-76dec8eee726","resolution":{"observed_at":"2026-08-06T17:11:00.290184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:00.048088Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":"29696b24-4cdc-4425-94c0-06c61bc08d55","year":2023},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.341211Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:e0507fe2a4289fc25e8a6c7898caa362113df9955d6fffed0acdb3e92cba37fc","observation_id":"f02eaabf-7c0d-48ac-826d-2c2e89251d87","resolution":{"observed_at":"2026-08-06T17:11:00.115795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:59.878436Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"cccb6090-b873-4d9f-9dac-02590a9621fe","year":2023},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.427965Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:6f20f65fd1c3be69f21d9ef5e0b4a53382f5a504af2f9c0d3fb8b0d6cf97f651","observation_id":"73803863-a351-4d06-b6a6-07821a42d077","resolution":{"observed_at":"2026-08-06T17:10:59.946075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:59.651598Z","title":"SDXL: improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":"7322602f-e1d7-44a0-a09b-329a629bba5a","year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.498786Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:e875624a04b576087f7b337268411636935deae29903755fe13711d239fc2861","observation_id":"64e77799-9e1d-47a5-b174-8f8cd678e63c","resolution":{"observed_at":"2026-08-06T17:10:59.740977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:59.457121Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"a94bffab-30ef-43f7-91f9-33f92be08d50","year":2021},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.595331Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:041c701ff03950d5971142b0a193efd586b786beefc55b319cea60e5978fdd65","observation_id":"9443f140-ff8c-4dc7-8e6b-07c597e6831e","resolution":{"observed_at":"2026-08-06T17:10:59.553142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:55.670649Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.670649Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:b35c280dfd91de963042f259ddc06ae8d9dc4a451a4371a26477977337117960","observation_id":"bfd3321e-31d2-489d-aee3-81801d18f70a","resolution":{"observed_at":"2026-08-06T17:10:55.670649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:59.254465Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"259ceb04-95ab-403a-8dc6-9cebd381d87f","year":2022},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.809417Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:4e167779e9116f4f51dc0347b45353f82cfcdc9a42e1d9dee77efcb8964a27d4","observation_id":"3224c327-776c-431d-9144-f722ea14dfb6","resolution":{"observed_at":"2026-08-06T17:10:59.383025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:55.893734Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.893734Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:3e173bc4e9788258327546517f763f34840c0e5ca217b3f6f3d944f9dda11bfa","observation_id":"2348b00f-bc24-4429-bb9c-5b4d2e01ac6d","resolution":{"observed_at":"2026-08-06T17:10:55.893734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:59.055083Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"33b266d0-bc37-4060-a9d1-ecb29fba6282","year":2023},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.997508Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:013e0fb76d7ec1e45462899d0d4268bd144cb5a4643f92237b938f8dd71e001e","observation_id":"7b2b5a6e-7c4b-4ee4-914d-3b405d67aaae","resolution":{"observed_at":"2026-08-06T17:10:59.159353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:58.897222Z","title":"Facenet: A unified embedding for face recognition and clustering","venue":null,"work_id":"635b8a25-5d18-415f-b9cd-f021ad8f001e","year":2015},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.063689Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:2de8825998daffb0269c2b3c4ee38f5d584f388d4d08c34c1852e64c5e060e2e","observation_id":"a55721b5-0f75-4681-824f-5f1863c78822","resolution":{"observed_at":"2026-08-06T17:10:58.965028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14555","last_updated":"2024-06-20T17:58:52Z","snapshot_observed_at":"2026-08-08T18:59:34.400882Z","submitted_at":"2024-06-20T17:58:52Z","title":"A Survey of Multimodal-Guided Image Editing with Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14555","snapshot_observed_at":"2026-08-06T17:10:56.151197Z","title":"A survey of multimodal-guided image editing with text-to-image diffu- sion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.151197Z"},"links":{"cited_paper":"/paper/2406.14555","citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:933cb0c11a387e19311abe996dcd7617217edca99975c7371f1fe489c6d1cb69","observation_id":"8165f4f7-8e44-44bb-922b-a229563d7772","resolution":{"observed_at":"2026-08-06T17:10:56.151197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:58.686105Z","title":"Free-form motion control: A synthetic video generation dataset with controllable camera and object motions","venue":null,"work_id":"2381e8f1-d427-49ff-8186-af90f759b2d6","year":2025},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.250798Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:16493d156ad5fa0347c22657eaca774368dc4ceb736268d9fa5fcc9f390030cd","observation_id":"210bbe84-1eeb-4c50-8f5c-081c9a7b6a0e","resolution":{"observed_at":"2026-08-06T17:10:58.790267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:58.451210Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":"36db0cd6-e429-4573-8f84-4fd8c92afb7a","year":null},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.358144Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:d9fcefb04d6294bb51ce0108a14fb7f05eb56645dc7dd2dd1e241060af9a60df","observation_id":"e596d6b7-1db6-4078-bcee-21d4a989525c","resolution":{"observed_at":"2026-08-06T17:10:58.560402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:56.451153Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.451153Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:f790a611e73c9793d671123b3afbda61d13aadaf91f2f6ff5c21ebb5c999f5e5","observation_id":"d5af6f67-cdba-4160-b75d-2fa7cd195d18","resolution":{"observed_at":"2026-08-06T17:10:56.451153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:58.229457Z","title":"Emergent correspondence from image diffusion","venue":null,"work_id":"d48b2d5e-59c1-41e8-8e70-a1414366b28a","year":2023},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.551186Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:12094979fe795ba0b18f1e3858b0598330407ab12fc7d1839937bef280a67bcb","observation_id":"07f1135e-8562-41ad-8500-b891fe871a40","resolution":{"observed_at":"2026-08-06T17:10:58.358214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:58.049251Z","title":"Training-free consistent text-to-image generation","venue":null,"work_id":"7f65c93d-275a-45cf-9784-2ad91505786a","year":null},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.668290Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:d7feca9374b9274bbfe4aa8db303b572b7f2fb37be3717a6ae7f29b8e41d2355","observation_id":"21e60ba0-b5bd-4d7d-8029-237341a5baa6","resolution":{"observed_at":"2026-08-06T17:10:58.134020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:57.736148Z","title":"Attention is all you need","venue":null,"work_id":"0f0908ae-c838-41ff-afe1-d9fb63218849","year":2017},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.714147Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:8358c95db27821bb2507237b3c16b2bfb998e472170ea42af3f0360f28eeee3a","observation_id":"108b17d9-3625-4633-b77b-31e2aa34c54c","resolution":{"observed_at":"2026-08-06T17:10:57.907876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:57.529899Z","title":"Q-align: teaching lmms for visual scoring via discrete text-defined levels","venue":null,"work_id":"07f54c99-a079-4f01-9fde-2b7a411de009","year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.723071Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:630338cc6a3382e72aa6e89dd89f38da0e4d3c369571c2dd011c2be4d26491a4","observation_id":"da84b0e4-84a7-46a0-bb4b-1ecdb073d806","resolution":{"observed_at":"2026-08-06T17:10:57.636294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-06T17:10:56.878136Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.878136Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:f5f59a75a1cfd51eed4f3734def9f3a06d7e380924a5fe73716d0003d5ae8f21","observation_id":"a7494b70-cfe7-4124-aa67-23d691a675ef","resolution":{"observed_at":"2026-08-06T17:10:56.878136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-06T17:10:56.991014Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.991014Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:c1aa6251d4cbd4d466b1e75250a00293ae0f25956108edad630a3184a34298f6","observation_id":"030c493d-34de-4aed-a0f8-1315caaf9fc8","resolution":{"observed_at":"2026-08-06T17:10:56.991014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:57.299770Z","title":"Storydiffusion: Consistent self- attention for long-range image and video generation","venue":null,"work_id":"f24bfc93-aa64-4d33-8602-47665d86fa16","year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:57.109432Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:6bdd474eef5b4927c91db996775d2cccc01fc7c5c783039e0129fffd2e010b1d","observation_id":"a8ea0be4-4528-4dd0-a484-1a53ddd6c1f1","resolution":{"observed_at":"2026-08-06T17:10:57.423235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2507.11533."}