Pith. sign in

Paper Citation Record · LEDGER

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset

As of 9 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 6 inbound Pith citation observations for arXiv:2506.18851.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.18851 v1

Coverage vector

measured 49 of 49 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T23:20:12.568377Z

measured 55 of 55 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 6 of 6 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-05T05:01:36.599895Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-01T22:26:17.493582Z

Reference resolution

49 of 49 outbound references displayed

  • verified exact0
  • verified fuzzy13
  • unresolved36
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation e054ca19-271c-42b6-8a20-7e96b239d4f7 · outbound

This paper cites https://app.klingai.com/cn/image-to-video/frame-mode/new.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset https://app.klingai.com/cn/image-to-video/frame-mode/new

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:14.987254Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:20:07.281280Z digest=sha256:160a637edde1c39f468d63be31efb2cdd95da1596ab3728e70b1b0a2b9f93eaa

Observation 936aa0b0-b79c-4a16-a8e4-7ed62334a08a · outbound

This paper cites Qwen2.5-VL Technical Report.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Qwen2.5-VL Technical Report

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:07.412919Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:07.412919Z digest=sha256:07f9f3a267b0278b738e078ce96e70288880dbb7275ac608161cc4622e2e9a50

Observation c5d73f85-b81a-4a94-99d3-fcf0bf3a9c45 · outbound

This paper cites Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:07.559950Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:07.559950Z digest=sha256:30410239f9ad791323525fa1ae146b27135850d01b2fb361d865a54bbbb04d92

Observation 242bf04c-e758-4187-b6d1-cf2130d6b3c4 · outbound

This paper cites Video generation models as world simulators, 2024.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Video generation models as world simulators, 2024

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:14.818122Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:20:07.661980Z digest=sha256:a619a5046258ab1fb32e32f45757e3d06bfc59025c023a38926493713f268e46

Observation 548c22ba-b600-4b5a-bf1d-30c42a03901e · outbound

This paper cites Goku: Flow Based Video Generative Foundation Models.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Goku: Flow Based Video Generative Foundation Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:07.782664Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:07.782664Z digest=sha256:f4c30030b862e7aa9e3197e49ef6c47f513fd595e3a4c5b2e2bf1ec45c2c8814

Observation ccb1ac78-a014-4123-8381-65deac622c07 · outbound

This paper cites Multi-subject Open-set Personalization in Video Generation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Multi-subject Open-set Personalization in Video Generation

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:07.898058Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:07.898058Z digest=sha256:4265aef27375232e881ec67b402328d075ba3ae106fefd52e27f330c842173ab

Observation d8217f7b-09bc-4179-971b-4fc5e54330c7 · outbound

This paper cites Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.003946Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.003946Z digest=sha256:81651b561dfc6b9fd3d1363d8b85d1141bc15b9b58c9cbcd154de6edf9ed6fc6

Observation 971e06cd-2ee5-4ab8-a7fa-a831ca7511a0 · outbound

This paper cites Arcface: Additive angular margin loss for deep face recognition.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Arcface: Additive angular margin loss for deep face recognition

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.123630Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.123630Z digest=sha256:59eccd13bae076439d480c7e8f669761ee8406054a94f89434caa7ebea2ef967

Observation 3e6fad62-7218-485c-ae16-187812f6a501 · outbound

This paper cites CINEMA: Coherent Multi-Subject Video Generation via MLLM-Based Guidance.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset CINEMA: Coherent Multi-Subject Video Generation via MLLM-Based Guidance

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.256451Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.256451Z digest=sha256:f4b1e9baef3756344fd7037d2b7246afa2e23d034c73433e86a93d969e6fa6c4

Observation 3578d72a-dae4-4e0f-9541-0faced2c218e · outbound

This paper cites SkyReels-A2: Compose Anything in Video Diffusion Transformers.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset SkyReels-A2: Compose Anything in Video Diffusion Transformers

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.358935Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.358935Z digest=sha256:e7ceb9f0ba37e88fe9b0ce331862a5bbdca3dfe3d12551df4a03fe1d4242a5a0

Observation 57719d53-065c-4e7b-b3a9-0bc249ad4b04 · outbound

This paper cites I2vcontrol-camera: Precise video camera control with adjustable motion strength.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset I2vcontrol-camera: Precise video camera control with adjustable motion strength

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:14.649542Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:20:08.485574Z digest=sha256:87e3602f391b101aba84ee8d90ce299c8ca899f585a35865dd2c69d2bf66c12f

Observation 227326dc-bb45-4984-981c-ad6bb01eef67 · outbound

This paper cites Animatediff: Animate your personalized text-to-image diffusion models without specific tuning.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Animatediff: Animate your personalized text-to-image diffusion models without specific tuning

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:14.474650Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:20:08.625636Z digest=sha256:913da2ef18d2bf48d53149f6f813e2f6dc995de229d072cb964001d2a514b9d7

Observation ade09c8e-7940-458e-a4f2-31fbdbd37459 · outbound

This paper cites PuLID: Pure and Lightning ID Customization via Contrastive Alignment.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset PuLID: Pure and Lightning ID Customization via Contrastive Alignment

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.734489Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.734489Z digest=sha256:0ee8993573814258baa749a7e60f2c8095e1589191e5c99128999ae9e3a84e1a

Observation 11c68245-bd68-4e00-8edf-4e413d3f47ed · outbound

This paper cites Classifier-Free Diffusion Guidance.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Classifier-Free Diffusion Guidance

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.795807Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.795807Z digest=sha256:350cadbfc46847d4a1bae75180027f8a7b0320cbe0f6b8b8080dc2a7800023b4

Observation e5b62196-1ce5-4a5b-a4a0-0392792676e0 · outbound

This paper cites Denoising diffusion probabilistic models.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Denoising diffusion probabilistic models

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.907570Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.907570Z digest=sha256:d2b9cd87b50d89f76934232caeafe498e6030617890ce8d01ea0cc7f78baaa54

Observation 58f7b177-7e25-4ffd-9e74-4d96c07dd3e0 · outbound

This paper cites Animate anyone: Consistent and controllable image-to-video synthesis for character animation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Animate anyone: Consistent and controllable image-to-video synthesis for character animation

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:08.983118Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:08.983118Z digest=sha256:fc1364b89bf213aecdfcb1f2e2e6143129c320a359d6e98bb393092b7bb82ede

Observation 4fe3aad9-1022-4d98-a760-24ab29b51e31 · outbound

This paper cites HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset HunyuanCustom: A Multimodal-Driven Architecture for Customized Video Generation

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.055319Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.055319Z digest=sha256:aae5c27e8887aab644d7cadda8ab11c6b5a96a6a17b47b47101723c4696fd668

Observation 2f7e3dc0-1256-49f6-a739-3e6d4563e608 · outbound

This paper cites ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.114978Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.114978Z digest=sha256:350b63e382b8eea68b7804c0799898f44f51f1796587c52baf4164424148a6c2

Observation 769b552b-9c95-4183-b04a-ada93d330dec · outbound

This paper cites Vbench: Comprehensive benchmark suite for video generative models.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Vbench: Comprehensive benchmark suite for video generative models

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:14.336502Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:20:09.162659Z digest=sha256:d23520c9361d1c9114b87faba2a1a5bfd0fa784cc1f6ca91f13d802e4ba51891

Observation 5f8fba00-c4c0-4fd9-98ff-0d666e4b8f59 · outbound

This paper cites VACE: All-in-One Video Creation and Editing.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset VACE: All-in-One Video Creation and Editing

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.206886Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.206886Z digest=sha256:e43047dfbf74eaf99f60d1079eb727fa40794352052afd19d324757a5a2557f7

Observation 6d30fc64-2077-4d5d-b3d9-fb1fae6e4570 · outbound

This paper cites FullDiT: Multi-Task Video Generative Foundation Model with Full Attention.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset FullDiT: Multi-Task Video Generative Foundation Model with Full Attention

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.305048Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.305048Z digest=sha256:333cecc1fe18497c8404a5908a141863863a5c7049c741e5e6a6422ca030d9ad

Observation ec7b89bf-d2d0-48a1-a74b-f7d73eb4e67c · outbound

This paper cites Videopoet: a large language model for zero-shot video generation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Videopoet: a large language model for zero-shot video generation

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:14.163161Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:20:09.407365Z digest=sha256:b533be9af5f07089a4e31ef51dc9541a305aeecd6395a1b091b1276d668b77c5

Observation c129c7a5-e80e-46b0-b21e-6dd4e20cd887 · outbound

This paper cites HunyuanVideo: A Systematic Framework For Large Video Generative Models.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset HunyuanVideo: A Systematic Framework For Large Video Generative Models

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.515493Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.515493Z digest=sha256:8942ffd990ab2d81bf8a95b46fd1ff289b67c0a211a762ef4805a110fbcaeecc

Observation 8f8ddeed-db8f-4a40-9ddb-f0c2b1ebc380 · outbound

This paper cites Movie Weaver: Tuning-Free Multi-Concept Video Personalization with Anchored Prompts.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Movie Weaver: Tuning-Free Multi-Concept Video Personalization with Anchored Prompts

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.663233Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.663233Z digest=sha256:8ab44b9c7632a31d4cca02dc6b4f0c854f75d084c5564053cd8a34f193f6883e

Observation 87b65c95-68b9-4163-86f1-1f87160406fe · outbound

This paper cites Flow Matching for Generative Modeling.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Flow Matching for Generative Modeling

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.789388Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.789388Z digest=sha256:adab6ca432df9061d741af3a633196ae709ce5d92874fbc33a9ed22a9455cc0d

Observation c8e34aed-e30e-4720-8208-b41d58262609 · outbound

This paper cites Improving Video Generation with Human Feedback.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Improving Video Generation with Human Feedback

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.835019Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.835019Z digest=sha256:10931524aee47b4ab9ddd0e606504861fc6bfffac7bd8762b673a25e6746cdc2

Observation cde2f2fb-60aa-483a-8704-ee42bd252af6 · outbound

This paper cites Phantom: Subject-consistent video generation via cross-modal alignment.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Phantom: Subject-consistent video generation via cross-modal alignment

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.885970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.885970Z digest=sha256:a582698c1cecee9d4509931f54937c57d4372a7afd506de8159c190872270b41

Observation e32443b8-c6cc-45a4-b9b2-e08c609cd345 · outbound

This paper cites Flow straight and fast: Learning to generate and transfer data with rectified flow.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Flow straight and fast: Learning to generate and transfer data with rectified flow

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:13.994524Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:20:09.945008Z digest=sha256:5394e027ffe0d1402c6517cbd7e15a71aba00bb54383895694268d3bf13996cd

Observation 6fc12ddd-5bd7-47c0-9aa3-6803ee8a27d2 · outbound

This paper cites Dreamo: A unified framework for image customization.arXiv preprint arXiv:2504.16915, 2025.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Dreamo: A unified framework for image customization.arXiv preprint arXiv:2504.16915, 2025

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:10.014742Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:10.014742Z digest=sha256:2e02b595587f760958777670f2b1bde004ddf2b7cbd37356aca7019c4a48fe56

Observation bb18a231-7d10-40bf-9495-4b25aa743b7b · outbound

This paper cites DINOv2: Learning Robust Visual Features without Supervision.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset DINOv2: Learning Robust Visual Features without Supervision

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:10.131887Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:10.131887Z digest=sha256:68436164a3307f23fffa6ffa417ac71f1953edf8cb444b59b92e46893dbc660b

Observation 4d755b7a-55be-4e1e-b26e-43458ca8b5fa · outbound

This paper cites Dinov2: Learning robust visual features without supervision.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Dinov2: Learning robust visual features without supervision

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:13.800703Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:20:10.226623Z digest=sha256:6f442a82e5fc41831526ac2e58ba7637de765e0972b38c0262deb1d8311a753c

Observation c8554331-8089-4797-8ee1-b3731b9d9c15 · outbound

This paper cites DreamBench++: A Human-Aligned Benchmark for Personalized Image Generation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset DreamBench++: A Human-Aligned Benchmark for Personalized Image Generation

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:10.324650Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:10.324650Z digest=sha256:25d807ae86dc9e5dbc9dedfcc93a2e51e8d4403b747806519aae46d18ba5780c

Observation 15c9c35d-d7e8-45c9-918e-6c3ee2b72c86 · outbound

This paper cites Movie Gen: A Cast of Media Foundation Models.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Movie Gen: A Cast of Media Foundation Models

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:10.412598Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:10.412598Z digest=sha256:a76ecd52355a08d4ac6aa6b46a6a2e29821247ba7668a416a6b2ba900221e5fb

Observation 34b8a0e4-285d-4c45-8c7c-6881a8c5a151 · outbound

This paper cites Learning transferable visual models from natural language supervision.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Learning transferable visual models from natural language supervision

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:10.519908Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:10.519908Z digest=sha256:84cfbb1868bda5d92ba0806c36c674f50218df412eb3165d183cf1e825851e52

Observation b461a489-b1b1-4cb4-b54f-bd9d57b55bff · outbound

This paper cites Magi-1: Autoregressive video generation at scale, 2025.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Magi-1: Autoregressive video generation at scale, 2025

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:13.626322Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:20:10.671514Z digest=sha256:9fad42b219e2428015015530bde5ef1be859ac8bde6716e10aad9b29c2926505

Observation 2acd82f9-768b-417d-9c3a-133d924b6aef · outbound

This paper cites Laion-5b: An open large-scale dataset for training next generation image-text models.Advances in neural information processing systems, 35:25278–25294, 2022.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Laion-5b: An open large-scale dataset for training next generation image-text models.Advances in neural information processing systems, 35:25278–25294, 2022

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:13.475758Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:20:10.817178Z digest=sha256:2bd297df9a4a74166fefc9f526866c50d1fd4ffad670781316e09815b748bc8e

Observation 4ec1201b-19ef-4f14-b7b5-35fd9534eabf · outbound

This paper cites Seaweed-7B: Cost-Effective Training of Video Generation Foundation Model.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Seaweed-7B: Cost-Effective Training of Video Generation Foundation Model

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:10.982218Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:10.982218Z digest=sha256:3b2b5352fd2132dcc26342cae7bcfbd105f826ed0d5cfc8b37109d7d1a4ec224

Observation 27480fe9-8169-42c9-91bd-d49daaab8682 · outbound

This paper cites 1st solution in google universal image embedding.https://www.kaggle.com/ datasets/louieshao/guieweights0732, april 2023.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset 1st solution in google universal image embedding.https://www.kaggle.com/ datasets/louieshao/guieweights0732, april 2023

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:13.342298Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:20:11.107832Z digest=sha256:6f21ebc3b9ce8e7425c019586d00fed6acdb8bb0e7ccf4cc850e045d81c36d49

Observation e02e20b3-e3c6-4622-a35b-ca2169098098 · outbound

This paper cites Wan: Open and Advanced Large-Scale Video Generative Models.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Wan: Open and Advanced Large-Scale Video Generative Models

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:11.402590Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:11.402590Z digest=sha256:f6f6a43a5c9fc55fa7097106223d5b5168be47a5bac5485770b1ff5c3d2c58e6

Observation 295f7e3f-39f7-4945-aefd-4fdb20e9e6b0 · outbound

This paper cites Koala-36M: A Large-scale Video Dataset Improving Consistency between Fine-grained Conditions and Video Content.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Koala-36M: A Large-scale Video Dataset Improving Consistency between Fine-grained Conditions and Video Content

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:11.524559Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:11.524559Z digest=sha256:cf258f859445e2a1f9b7d9da842d519c0f2803359dbb2bff1c11d7dc9a97b4d5

Observation 93a72d36-888b-4810-a952-d98bbb964178 · outbound

This paper cites MagicVideo-V2: Multi-Stage High-Aesthetic Video Generation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset MagicVideo-V2: Multi-Stage High-Aesthetic Video Generation

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:11.666371Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:11.666371Z digest=sha256:5ddb2bbbcc347ce144013e69e65acac21f984e47c7edc0dc4fcc16193f63b6cf

Observation 24ed82c9-4a1f-4a8c-8bf0-0df209fdbbdd · outbound

This paper cites ObjectMate: A Recurrence Prior for Object Insertion and Subject-Driven Generation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset ObjectMate: A Recurrence Prior for Object Insertion and Subject-Driven Generation

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:11.805625Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:11.805625Z digest=sha256:e372e7777e45b5e9f918413ec6861a2acff7aaaa5ce3df8f67fad270386183a0

Observation fee5c2ec-4bfc-471b-9a24-5c858f01a338 · outbound

This paper cites Automated Movie Generation via Multi-Agent CoT Planning.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Automated Movie Generation via Multi-Agent CoT Planning

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:11.903050Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:11.903050Z digest=sha256:c3b01d93075530b968db70451be8884c959aa5cb7778296e7c2d0083c78d8bad

Observation a5f0b523-a422-4d12-956f-003f6cb3b5d5 · outbound

This paper cites Demystifying clip data.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Demystifying clip data

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:13.201869Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:20:12.011700Z digest=sha256:e9bc873c32e15d8656f209d44a6ea6fef687690ae8ed5a68061bd08c024a8a39

Observation 7a66a847-caf4-4edb-8a1f-4a23c9279113 · outbound

This paper cites Magicanimate: Temporally consistent human image animation using diffusion model.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Magicanimate: Temporally consistent human image animation using diffusion model

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:12.136554Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:12.136554Z digest=sha256:ea71e66e9362706c257a3185312963874d7b84740e1ad5b3d5707febdd03e226

Observation 13d8e36f-b585-41e5-b67b-88d083295212 · outbound

This paper cites Qwen2.5 Technical Report.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Qwen2.5 Technical Report

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:12.221510Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:12.221510Z digest=sha256:8767bbbe766f95b6f4f91a95844b03e53aa4d32870dd989a6237d6154790e448

Observation a0d0ab4a-a491-4c73-8109-3edb5a25304c · outbound

This paper cites CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:12.336672Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:12.336672Z digest=sha256:43ed97cbc2cc0703914ce3d1ca2438150e7c98b5084d468f365de5cd6c62befb

Observation e8f64890-f3de-4bc5-99b4-93aeaf419afe · outbound

This paper cites Make pixels dance: High-dynamic video generation.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Make pixels dance: High-dynamic video generation

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T23:20:13.067847Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-06T23:20:12.457366Z digest=sha256:b85d3280fb5dd184b1b27ded30292d497680f2394e784477fcef17d623576bf9

Observation 76c4d674-998f-407b-bbb5-a3ba01a77a12 · outbound

This paper cites Concat-ID: Towards Universal Identity-Preserving Video Synthesis.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset Concat-ID: Towards Universal Identity-Preserving Video Synthesis

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:12.568377Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:12.568377Z digest=sha256:b38879e7f94cce366057a660f10a6f08ab846fb486cee8a296fd9ef3718e6d8a

Pith citing papers

Observation d7942705-b27f-4f09-890e-891109501909 · inbound

Learning Zero-Shot Subject-Driven Video Generation Using 1% Compute cites this paper.

Learning Zero-Shot Subject-Driven Video Generation Using 1% Compute Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-05-22T17:51:54.300099Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-22T17:51:41.947939Z digest=sha256:5a5ae2486614b434c9e81291af60ec912755e273e7062abc4d596409c6049375

Observation a1f20d76-310a-4586-a321-85045de90fa4 · inbound

Effectively obtaining acoustic, visual and textual data from videos cites this paper.

Effectively obtaining acoustic, visual and textual data from videos Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-05T05:01:36.599895Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T05:01:36.599895Z digest=sha256:2fefd08725e09efdd19f31d4d3ff3475585a04b4d86b2ec619cc34affbc33d17

Observation f8a3e20d-7692-4182-9507-4d1993b7f947 · inbound

Rethinking Position Embedding as a Context Controller for Multi-Reference and Multi-Shot Video Generation cites this paper.

Rethinking Position Embedding as a Context Controller for Multi-Reference and Multi-Shot Video Generation Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset

Reference 5

Resolution
unresolved
no resolver link, observed 2026-07-13T12:23:05.876881Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T12:23:05.876881Z digest=sha256:36365786282a451a0acef77d35b8e8ccdda5e2d7a6a0be3031a55a5abb5b2e5d

Observation 8fe950cd-cffc-4b16-a4ea-2cea998ba90f · inbound

Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation cites this paper.

Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset

Reference 6

Resolution
verified exact
arxiv_id, observed 2026-05-20T14:13:21.413127Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-20T14:08:30.802619Z digest=sha256:8bfe91bc8e8272f757bbaabe4e0c3e24758acb722aaccc0ed9d5c0718ac80465

Observation 6f242034-23f8-49cc-aae1-3121792460bf · inbound

Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation cites this paper.

Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-07-01T22:26:17.495216Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-28T15:25:22.778550Z digest=sha256:c1faf3786fa56b9c86950a2ba1186ae8800f4f7f14eb2a9fcab25a1b0d67640f

Observation d0b5bbb2-e48a-4852-b2d2-ab7b4d43a9b4 · inbound

FlowMimic: Mask-free Visual Editing and Generation with Pixel-pair Warped Flow Field for Online Video Editing Data Generation and Modality Mimicry cites this paper.

FlowMimic: Mask-free Visual Editing and Generation with Pixel-pair Warped Flow Field for Online Video Editing Data Generation and Modality Mimicry Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-01T15:42:03.214892Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:42:03.214892Z digest=sha256:6a93802d899ee3cc2c8ba8096a00b6e98c566b34d9658afc323486c6ab2cd797