{"as_of":"2026-08-15T05:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3ad21bf79c5a2c7b6cd0172c3ac489c71c654ce2577ce27ed62d03434d6a8c5b","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T23:16:03.879115Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T01:57:15.550335Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T14:59:55.959873Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"cited_work":{"arxiv_id":"2412.20725","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.20725","snapshot_observed_at":"2026-07-04T14:59:55.959873Z","title":"Dialogue director: Bridging the gap in dialogue visualization for multimodal storytelling","venue":null,"work_id":"2ce62d6e-e3c5-4289-b671-a340c4d8f3a4","year":2024},"citing_paper":{"arxiv_id":"2505.16819","last_updated":"2026-05-19T15:22:52Z","snapshot_observed_at":"2026-08-01T07:12:14.758494Z","submitted_at":"2025-05-22T15:54:42Z","title":"Character-Centered Dialogue Generation from Scene-Level Prompts","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-22T13:31:43.083678Z"},"links":{"cited_paper":"/paper/2412.20725","citing_paper":"/paper/2505.16819"},"observation_digest":"sha256:a5bd49db963f8d1e62a7c09b945a751ce818b3834c86ca1fab8358fd36d38359","observation_id":"77543878-efb6-4f3d-8c32-9b0fc691b049","resolution":{"observed_at":"2026-05-22T13:34:53.723769Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"cited_work":{"arxiv_id":"2412.20725","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.20725","snapshot_observed_at":"2026-07-04T14:59:55.959873Z","title":"Dialogue director: Bridging the gap in dialogue visualization for multimodal storytelling","venue":null,"work_id":"2ce62d6e-e3c5-4289-b671-a340c4d8f3a4","year":2024},"citing_paper":{"arxiv_id":"2606.24107","last_updated":"2026-07-03T09:17:12Z","snapshot_observed_at":"2026-08-01T13:42:02.404759Z","submitted_at":"2026-06-23T03:50:28Z","title":"DramaDirector: Geometry-Guided Short Drama Generation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-26T01:57:15.550335Z"},"links":{"cited_paper":"/paper/2412.20725","citing_paper":"/paper/2606.24107"},"observation_digest":"sha256:e54e4c742ec2f4b68512d2e2e4a9fa0a95ce57ed07c61ec6753c6653cc2abd08","observation_id":"37f0c61c-d26c-4942-9f19-9762a8121cff","resolution":{"observed_at":"2026-07-04T14:59:55.961246Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.20725/citation-record","integrity":"/paper/2412.20725/integrity","json":"/paper/2412.20725/citation-record.json","paper":"/paper/2412.20725"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:03.716571Z","title":"Video generation models as world simulators,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.716571Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:47ba7068c11deaf144077ad45534081ca3d96f9da79b0170ab3bde4010f4c8ea","observation_id":"15f84df4-8949-4709-80ab-609fdfa4f2fe","resolution":{"observed_at":"2026-08-10T23:16:03.716571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.420532Z","title":"Video-driven sketch animation via cyclic reconstruction mechanism,","venue":null,"work_id":"f8c72321-ebf0-41bd-a9c8-23a1f4e3d738","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.720606Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:a0eb7cdd009f7c6d590cc9861e28ad1309cd9bd385d03387f31f40b002066a46","observation_id":"e8666aff-2b02-4bb8-b8c4-749f45a2e591","resolution":{"observed_at":"2026-08-10T23:16:04.425250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.407162Z","title":"Styleself: Style-controllable high- fidelity conversational virtual avatars generation,","venue":null,"work_id":"4dee4a1e-304b-44a1-a5cd-6aeafb6ff70a","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.724278Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:cf3adc0f805bd344ab4c982747950c6fded6ac8896aaf7c30f4fddbae02a6a65","observation_id":"f9765e16-912f-4daf-aada-3df10a94cf57","resolution":{"observed_at":"2026-08-10T23:16:04.411374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.393949Z","title":"Training-free semantic video composition via pre-trained diffusion model,","venue":null,"work_id":"72ba6a84-eefb-490e-a99e-d57b2b86f209","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.728278Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:f9491f4ddc79fdff4df01efb0310219e02bfd086878a1fd508b01a2139761d47","observation_id":"8c70f683-43fe-47f5-89e1-597db6c4e7e5","resolution":{"observed_at":"2026-08-10T23:16:04.398165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.379546Z","title":"Reisz, G","venue":null,"work_id":"87085de9-6d28-4e02-9a79-ad19bccc3a7a","year":2010},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.732032Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:a55e452b809185840a6207fcffe7651c05b6fb19f6e67e49afac8c56ee3acaa7","observation_id":"a3e1f07d-572d-4a2c-b8fe-f7dc51e95503","resolution":{"observed_at":"2026-08-10T23:16:04.384077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.365854Z","title":"Storygan: A sequential conditional gan for story visualization,","venue":null,"work_id":"710e98eb-a6bd-40eb-af7d-cf6115735f15","year":2019},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.735725Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:e1a6fe123c0c90d23492538f2e10216a413ad2395e8595de751d3d164125d250","observation_id":"46875828-c4ee-4471-9224-fdd835ac7eba","resolution":{"observed_at":"2026-08-10T23:16:04.370417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.351855Z","title":"Character-preserving coherent story visualization,","venue":null,"work_id":"3cef9978-e84b-413c-a205-e9bd72ea16e6","year":2020},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.739751Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:dc6742ac11ed97b80eccf787a2f54383b3eb848627df6cefdb9ddb466c53862e","observation_id":"f9f10ea0-4cb3-414f-9ec7-62a0bcaadb61","resolution":{"observed_at":"2026-08-10T23:16:04.356685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.338752Z","title":"Learning to model multimodal semantic alignment for story visualization,","venue":null,"work_id":"ba4af88b-3e2d-4fca-9dec-6ea389811377","year":2022},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.743166Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:e5cfb013f9f2f1853a09866acd26e2669d1951413683eac7e529ce932d0a40cc","observation_id":"39ec40ce-cb1e-4f07-9510-8538f64f9914","resolution":{"observed_at":"2026-08-10T23:16:04.343231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.325372Z","title":"Integrating visuospatial, linguistic, and commonsense structure into story visualization,","venue":null,"work_id":"062f0b79-c351-4736-93cb-66176b2799e5","year":2021},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.746956Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:ecba815613c2d9ff203d0e64594567db338a2e0798985878128d57636c96fa82","observation_id":"fb1456cd-1221-4a99-8ac8-0f85a7d7b0d2","resolution":{"observed_at":"2026-08-10T23:16:04.329923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11340","last_updated":"2024-11-21T14:09:12Z","snapshot_observed_at":"2026-08-14T06:13:17.008769Z","submitted_at":"2024-09-17T16:42:46Z","title":"OmniGen: Unified Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11340","snapshot_observed_at":"2026-08-10T23:16:03.750839Z","title":"Omnigen: Unified image generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.750839Z"},"links":{"cited_paper":"/paper/2409.11340","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:eb512a257a77f5905cbefc83304b1ff72abea087ad3e861deb37671aa5ceeff2","observation_id":"374aac90-e955-4f9b-a17c-33a499cc47db","resolution":{"observed_at":"2026-08-10T23:16:03.750839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17082","last_updated":"2025-02-24T07:35:14Z","snapshot_observed_at":"2026-08-12T23:57:13.746219Z","submitted_at":"2024-05-27T11:55:35Z","title":"Ensembling Diffusion Models via Adaptive Feature Aggregation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17082","snapshot_observed_at":"2026-08-10T23:16:03.755285Z","title":"Ensembling diffusion models via adaptive feature aggregation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.755285Z"},"links":{"cited_paper":"/paper/2405.17082","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:8eb8928fea0030541e92d98686af099c79056cd26ab553efd9139819f090e6ec","observation_id":"e18355b4-d03b-4ae3-9328-03ae1b0e2607","resolution":{"observed_at":"2026-08-10T23:16:03.755285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02511","last_updated":"2024-06-04T17:32:52Z","snapshot_observed_at":"2026-08-12T23:50:17.546227Z","submitted_at":"2024-06-04T17:32:52Z","title":"V-Express: Conditional Dropout for Progressive Training of Portrait Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02511","snapshot_observed_at":"2026-08-10T23:16:03.759851Z","title":"V-express: Conditional dropout for progressive training of portrait video generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.759851Z"},"links":{"cited_paper":"/paper/2406.02511","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:bb7bad307383b3c810c4305ae815cbee68e1b96655803c644228f89403177327","observation_id":"891f91a3-c3ad-409b-b580-5b11b3d0a857","resolution":{"observed_at":"2026-08-10T23:16:03.759851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.313902Z","title":"Ic-light github page,","venue":null,"work_id":"5e29cbe8-b29b-43d1-ad10-7b019de2fb71","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.764409Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:30433899feba074b710317e984f862e1f3608caed243c69f998983da6e94998c","observation_id":"439e96dc-0164-4424-95bf-eb3b1531575e","resolution":{"observed_at":"2026-08-10T23:16:04.317460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.301624Z","title":"Towards efficient generative large language model serving: A survey from algorithms to systems,","venue":null,"work_id":"9ca5aca3-407d-49b9-bd91-53f578a60ec4","year":2023},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.768351Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:82c184e54504dcdee53c5fa6214d39a795f7a8cb5b7d629af30f7e6d0898fb1e","observation_id":"06694654-6781-4e95-99fd-d163900cbb5a","resolution":{"observed_at":"2026-08-10T23:16:04.305625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.288482Z","title":"Resolving multi- condition confusion for finetuning-free personalized image generation,","venue":null,"work_id":"4858fb73-aca6-4812-b3e4-25e4cde6dfd1","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.772438Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:d5b46b81fdb1e9f2c6bc71f3e4735e3b0311f1ef9bec85a8ee90590dd007c46a","observation_id":"27c195c0-75f5-426b-aeb0-3795b61a3aac","resolution":{"observed_at":"2026-08-10T23:16:04.293077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.274538Z","title":"Storymaker: Towards holistic consistent characters in text-to-image generation,","venue":null,"work_id":"a67033f1-8a05-4a03-85d4-7af791c41d6d","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.776665Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:cacee9f4a2e190ccd00a692eed38ea23c8fe2480201f85ca9455e64335cfb4cf","observation_id":"fbbb943d-23ed-4b51-b350-96c498e1412d","resolution":{"observed_at":"2026-08-10T23:16:04.278720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.261829Z","title":"Storydiffusion: Consistent self-attention for long-range image and video generation,","venue":null,"work_id":"b2cf76b7-8711-460b-8df8-7be7d8f74cb0","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.781297Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:566d79b09a4e3d0da330ef8b5b2a08b2933b0a07ef325a2765f6cb357d9180fa","observation_id":"3d450783-be3d-4cca-a6a0-89f05ed10131","resolution":{"observed_at":"2026-08-10T23:16:04.266083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.249436Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":"85ddcfdb-2030-4b35-9d01-1f3f60338738","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.785910Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:b7ea5ec23322aa9ca0f1117f8f39750af2765eada2df2a8b7f3f344ec61939f0","observation_id":"016f939b-6dd7-4d5d-8e75-c8f156ca3638","resolution":{"observed_at":"2026-08-10T23:16:04.253442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.237495Z","title":"Retrieval- augmented generation for knowledge-intensive nlp tasks,","venue":null,"work_id":"f2c0f06a-3d92-4f82-a0ab-9aa9fd09283e","year":2020},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.789674Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:dcdb24d4e9911a591742ebeb99b2e41f5046db8c09ab57b31450670f6147998e","observation_id":"6ba3988d-a91e-4b50-8804-6e957ee15860","resolution":{"observed_at":"2026-08-10T23:16:04.241701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.225547Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":"cd00a13f-71ea-4256-b7a2-7b5d4af574b1","year":2022},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.793550Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:2ee7b03703661b1ac93dcb1c763c1da04a465284b85733f1f767c713b2826f83","observation_id":"9363132b-f11f-43ce-8820-f4463dbe6b87","resolution":{"observed_at":"2026-08-10T23:16:04.229898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06313","last_updated":"2024-11-21T12:06:59Z","snapshot_observed_at":"2026-08-13T05:53:21.154401Z","submitted_at":"2023-10-10T05:13:17Z","title":"Advancing Pose-Guided Image Synthesis with Progressive Conditional Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06313","snapshot_observed_at":"2026-08-10T23:16:03.797664Z","title":"Advancing pose-guided image synthesis with progressive conditional diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.797664Z"},"links":{"cited_paper":"/paper/2310.06313","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:d2c8cb388f064baa1cce67e41cb7c9560070e8a7f5c49fb55d2c3b1faa97bd7a","observation_id":"820362cb-c77e-4b36-8616-49746a0dc710","resolution":{"observed_at":"2026-08-10T23:16:03.797664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.213466Z","title":"Exploring warping- guided features via adaptive latent diffusion model for virtual try-on,","venue":null,"work_id":"30904dbe-8f28-41e4-94bb-ad472e800ae9","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.801888Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:0338dcebcad067e6908cdae2b39c93e318d956f4b8d58c7ace4018dff406fa2f","observation_id":"8b5d59f7-9fc4-45c0-9037-138fc3b876a8","resolution":{"observed_at":"2026-08-10T23:16:04.217972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.200407Z","title":"Imagpose: A unified conditional framework for pose-guided person generation,","venue":null,"work_id":"9d1e0ee3-eb4d-40e8-9624-e52747b7a4cc","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.805693Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:232497a1462768d0f955fb57421832138d7f671b49520533810c0e395f0ad2f4","observation_id":"6124a1ca-73b9-419a-b15c-5ec417096d09","resolution":{"observed_at":"2026-08-10T23:16:04.204745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.186633Z","title":"Mastering text-to-image diffusion: Recaptioning, planning, and generating with multimodal llms,","venue":null,"work_id":"69de9191-615a-4466-aa52-9ba48c800b74","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.809533Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:13243895d8339f99a87f6f6c746ef13b04ca328e3c8b360256299d5d1d28cdb7","observation_id":"4b1f8d80-1cc2-4609-921f-c0d18a3a0100","resolution":{"observed_at":"2026-08-10T23:16:04.191019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12705","last_updated":"2024-08-06T13:06:26Z","snapshot_observed_at":"2026-08-12T23:20:12.207906Z","submitted_at":"2024-07-17T16:26:30Z","title":"IMAGDressing-v1: Customizable Virtual Dressing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12705","snapshot_observed_at":"2026-08-10T23:16:03.813285Z","title":"Imagdressing-v1: Customizable virtual dressing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.813285Z"},"links":{"cited_paper":"/paper/2407.12705","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:1fbf3f7df55c0a8fa054f0634b10b7ed8e35e3e757806b0470743eb8819cf34e","observation_id":"c6d01489-089a-4a3f-9574-25539fe1db5d","resolution":{"observed_at":"2026-08-10T23:16:03.813285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.172763Z","title":"Layoutgpt: Compositional visual planning and generation with large language models,","venue":null,"work_id":"44c3a84d-b38e-4698-a7ef-b87ceb19cb12","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.817507Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:0b10074c0c95558d2cf94cc1f31f289ecf75f0c09071513896bdd585f6c94604","observation_id":"8c4cb2f4-ce71-46e5-9fd8-a1063092071e","resolution":{"observed_at":"2026-08-10T23:16:04.177130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.160849Z","title":"Interactive story visualization with multiple characters,","venue":null,"work_id":"8cfdc153-fe19-466f-842c-91be38a92aed","year":2023},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.821602Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:bfa0f65a9aabe90b66b0bfb94f7cf125b39d790c9b6f75dfbb0a1312067d9b25","observation_id":"85e8bc47-6cf2-4a7f-bc92-199659796859","resolution":{"observed_at":"2026-08-10T23:16:04.164715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.147978Z","title":"Anim-director: A large multimodal model powered agent for control- lable animation video generation,","venue":null,"work_id":"c27d81d7-d20c-4a73-ae8e-583f232ced7e","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.825643Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:6c0adbf6cfe56c88cca975d8227bf6e5aa48bb2ba9ece80477d8e80f6f5f4ae2","observation_id":"60333c3d-be3b-4e5d-94bf-8588990e7059","resolution":{"observed_at":"2026-08-10T23:16:04.152495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.135736Z","title":"Synthesizing coherent story with auto-regressive latent diffusion models,","venue":null,"work_id":"6025852e-8d7b-41a4-9670-5bccbe7d9edb","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.829573Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:0f101f19a3aadaaf1dfde5cefd543428674d9751b9bf1dab92b8c9b698b5e49c","observation_id":"31bb458e-4ac7-42a0-b9aa-f21c44b33257","resolution":{"observed_at":"2026-08-10T23:16:04.139506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02482","last_updated":"2024-07-03T18:17:01Z","snapshot_observed_at":"2026-08-12T23:30:11.505210Z","submitted_at":"2024-07-02T17:58:07Z","title":"Boosting Consistency in Story Visualization with Rich-Contextual Conditional Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02482","snapshot_observed_at":"2026-08-10T23:16:03.833466Z","title":"Boosting consistency in story visualization with rich-contextual condi- tional diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.833466Z"},"links":{"cited_paper":"/paper/2407.02482","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:a9a965b2d9f9c6454bc99ea4b132de47f3b63993e7640ee1440a16df341d2d25","observation_id":"c7b1917b-6bab-4fec-9662-c3cff172ae44","resolution":{"observed_at":"2026-08-10T23:16:03.833466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-10T23:16:03.837967Z","title":"Ip-adapter: Text compatible image prompt adapter for text-to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.837967Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:58ce93450e33f753085c03e6044f06a92efc99ffd50462618dbab3d4d9bfdea9","observation_id":"8a7646ea-7c84-41df-87d9-294f40ff0466","resolution":{"observed_at":"2026-08-10T23:16:03.837967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23775","last_updated":"2024-11-05T06:41:27Z","snapshot_observed_at":"2026-08-15T04:09:37.577947Z","submitted_at":"2024-10-31T09:45:00Z","title":"In-Context LoRA for Diffusion Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23775","snapshot_observed_at":"2026-08-10T23:16:03.842123Z","title":"In-context lora for diffusion transformers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.842123Z"},"links":{"cited_paper":"/paper/2410.23775","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:1e4a62a6f02b2888eb102e33a1948a01fa05fa279a95029c1b80569cb5864434","observation_id":"57f2965a-10ec-4c27-acd9-67c2e1f785f9","resolution":{"observed_at":"2026-08-10T23:16:03.842123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03632","last_updated":"2024-12-04T18:48:20Z","snapshot_observed_at":"2026-08-12T16:39:36.574010Z","submitted_at":"2024-12-04T18:48:20Z","title":"MV-Adapter: Multi-view Consistent Image Generation Made Easy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03632","snapshot_observed_at":"2026-08-10T23:16:03.846971Z","title":"Mv-adapter: Multi-view consistent image generation made easy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.846971Z"},"links":{"cited_paper":"/paper/2412.03632","citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:0eb43cd2779685786c87bc4dd281f6cf0e7adbdf0c19671f0cbbb062f61121ab","observation_id":"44c7bb6f-3656-498f-826d-228f0ed0552b","resolution":{"observed_at":"2026-08-10T23:16:03.846971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.121775Z","title":"Tencent hunyuan3d-1.0: A unified framework for text-to-3d and image-to-3d generation,","venue":null,"work_id":"f79491da-2216-4b4b-b006-c1465d95e1d0","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.850889Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:cead92df44a02e26fea10f6fc5ed23b1633401de83d1445d45221f973179a605","observation_id":"6fd96cf3-5ca2-4083-a1ab-650d243f64c5","resolution":{"observed_at":"2026-08-10T23:16:04.127766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.109477Z","title":"Chatgpt (version 4),","venue":null,"work_id":"9d92c21c-1dac-4c50-bddb-3a4384beed9e","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.854212Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:efad0dd86e5aa406b5347d232d37dfbe7b239c7185a8e8cfc0f31f7c7d34780b","observation_id":"0084e240-54e1-4440-93b0-73e610e8d920","resolution":{"observed_at":"2026-08-10T23:16:04.113549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.094079Z","title":"Dream creation: Virtual 3d or e-commerce scene key visual poster or blind box ip display c4d super visual","venue":null,"work_id":"687408c0-365a-4501-b4b8-f730fe9896b2","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.858075Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:03f02c8c1174a5eebf3d5593f63d35fdcdfb028f234396fcd7442436a9fdaf0c","observation_id":"f1a1006f-6944-450a-a258-89993af58728","resolution":{"observed_at":"2026-08-10T23:16:04.099060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.080509Z","title":"Making a “completely blind","venue":null,"work_id":"437f8e05-f922-46ff-b3f0-313abded55b8","year":2013},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.861731Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:03a0fccfd13ced97dd4375b0593892b05c79814eecb8b5e5fa54c75c3624a620","observation_id":"95a8e95f-12b3-4217-bf32-dafb48f0cbaa","resolution":{"observed_at":"2026-08-10T23:16:04.084601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:03.865054Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.865054Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:9a3607c30384c60dde49a511bbd0536275db899c8e0039cf3a690fa27886c355","observation_id":"d6cc16f3-2c3d-448a-9fa1-293676843d97","resolution":{"observed_at":"2026-08-10T23:16:03.865054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.059128Z","title":"Dall·e 3: Text-to-image generation","venue":null,"work_id":"4cac8228-5ba2-4461-81f9-67ff5a20c604","year":2024},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.868424Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:ca423dc581bfd6fcc81661805bf23b223fd6be9cd7795e7c0af95c162a28b65f","observation_id":"c796b756-97ce-414b-8f0d-f552bb9df2a5","resolution":{"observed_at":"2026-08-10T23:16:04.063582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.046085Z","title":"Before sunset","venue":null,"work_id":"6bdb1caa-f211-42f2-836b-a1cc3c09f907","year":2004},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.871829Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:986e09208be7e3449029b201f0669285dc39e8996bf5f54bf2182cb4ec8d2957","observation_id":"55619957-9e4c-45bf-8d6a-1325237412ce","resolution":{"observed_at":"2026-08-10T23:16:04.050222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.032435Z","title":"de Saint-Exup ´ery, The Little Prince","venue":null,"work_id":"8fdb4b4b-e5b6-44b5-8a2a-eb0e6a618104","year":1943},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.875392Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:a62611cc0f1156ba72730fd6ea8a6f38e056a5f62e6798182b32eded88742efc","observation_id":"24d506b1-8940-4000-9455-e5949aa21c70","resolution":{"observed_at":"2026-08-10T23:16:04.037734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:16:04.017115Z","title":null,"venue":null,"work_id":"fada867d-c09c-4a22-99c7-d738a495220e","year":null},"citing_paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T23:16:03.879115Z"},"links":{"citing_paper":"/paper/2412.20725"},"observation_digest":"sha256:41e96521f032d0b71561b5ab0fede39513db3e884522177f9487c1059e516432","observation_id":"f3087e41-4b74-4549-a109-4b4b38b117b3","resolution":{"observed_at":"2026-08-10T23:16:04.023260Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.20725","last_updated":"2024-12-30T05:54:23Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T15:21:44.162256Z","submitted_at":"2024-12-30T05:54:23Z","title":"Dialogue Director: Bridging the Gap in Dialogue Visualization for Multimodal Storytelling"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":30},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 2 inbound Pith citation observations for arXiv:2412.20725."}