Pith. sign in

Paper Citation Record · LEDGER

ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 26 inbound Pith citation observations for arXiv:2501.04698.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2501.04698 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 26 of 26 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 26 of 26 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:59:30.608834Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T21:10:09.709506Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 9bce90ec-478b-47cb-b44c-164db67157ec · inbound

Learning Zero-Shot Subject-Driven Video Generation Using 1% Compute cites this paper.

Learning Zero-Shot Subject-Driven Video Generation Using 1% Compute ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 24

Resolution
verified exact
arxiv_id, observed 2026-05-22T17:51:54.407679Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-22T17:51:41.947939Z digest=sha256:15563ff45cb419cd96f2ff7fe008fed012f747434a7a9e4c7e1e31f567e848d1

Observation ed245bbb-b229-4733-8b8c-c399a21ac318 · inbound

OpenS2V-Nexus: A Detailed Benchmark and Million-Scale Dataset for Subject-to-Video Generation cites this paper.

OpenS2V-Nexus: A Detailed Benchmark and Million-Scale Dataset for Subject-to-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T13:59:30.608834Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:59:30.608834Z digest=sha256:c35e50772a55d595006ad10aad59abccfefa92000177f7d654e0d8c9b4a8cd05

Observation bc92ba84-61f2-483c-bbe5-3ecf2d2c648f · inbound

AnimeShooter: A Multi-Shot Animation Dataset for Reference-Guided Video Generation cites this paper.

AnimeShooter: A Multi-Shot Animation Dataset for Reference-Guided Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T11:12:09.347154Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:12:09.347154Z digest=sha256:4233fd70896397d0869044be58986593aa3c481c6538961effa21b014b121c3d

Observation d83768e2-1f8f-49fa-8f50-efcbe685ae2e · inbound

UNIC: Unified In-Context Video Editing cites this paper.

UNIC: Unified In-Context Video Editing ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T10:51:43.034695Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:51:43.034695Z digest=sha256:1a27bcff109e925e9009452ec48da511416b0debfeb466b34a1fbd604041eb40

Observation a2ebc5f8-5042-4246-882d-8f37098a098e · inbound

PolyVivid: Vivid Multi-Subject Video Generation with Cross-Modal Interaction and Enhancement cites this paper.

PolyVivid: Vivid Multi-Subject Video Generation with Cross-Modal Interaction and Enhancement ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T05:30:32.938000Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T05:30:32.938000Z digest=sha256:d31b6e773f71a6e9ec930844c142695d18400d8dd965575737d91b576337a4d2

Observation b6a00451-3efa-4c79-b637-4fe082db90d5 · inbound

DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers cites this paper.

DreamActor-H1: High-Fidelity Human-Product Demonstration Video Generation via Motion-designed Diffusion Transformers ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T04:27:37.785167Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:27:37.785167Z digest=sha256:374bceae840940d1a0d049622a3a64d28fc69088fd68c21b1e12e25990cb1ef0

Observation 2f7e3dc0-1256-49f6-a739-3e6d4563e608 · inbound

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset cites this paper.

Phantom-Data : Towards a General Subject-Consistent Video Generation Dataset ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T23:20:09.114978Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:20:09.114978Z digest=sha256:350b63e382b8eea68b7804c0799898f44f51f1796587c52baf4164424148a6c2

Observation e6a7988e-ba77-4313-8e12-a66031786887 · inbound

Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation cites this paper.

Tora2: Motion and Appearance Customized Diffusion Transformer for Multi-Entity Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T19:19:32.718300Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:19:32.718300Z digest=sha256:4b2eaf626798f68bcaca4b4ad2e9aa954b6e2084dcfced833d3d6e279ba19f10

Observation 5b2e4943-7699-4f24-afe0-f875b9a9d6f2 · inbound

A Survey on Long-Video Storytelling Generation: Architectures, Consistency, and Cinematic Quality cites this paper.

A Survey on Long-Video Storytelling Generation: Architectures, Consistency, and Cinematic Quality ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-06T18:51:26.486990Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:51:26.486990Z digest=sha256:60b98e84e5121b350d1ebe9b22916b6a2608c8f52ec2ad06cc02879059d55a64

Observation 01466845-10fd-4bbc-add5-daa1763e6c93 · inbound

Hierarchical Fine-grained Preference Optimization for Physically Plausible Video Generation cites this paper.

Hierarchical Fine-grained Preference Optimization for Physically Plausible Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-05T20:20:21.541805Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T20:20:21.541805Z digest=sha256:ed727a51443a2b41a9e819ee83635975513654698cd793fa20415b2afe6d55dd

Observation 7633f67c-7c56-4891-9b9f-5ee546cad326 · inbound

From Black Box to Transparency: Enhancing Automated Interpreting Assessment with Explainable AI in College Classrooms cites this paper.

From Black Box to Transparency: Enhancing Automated Interpreting Assessment with Explainable AI in College Classrooms ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-05T20:17:46.362851Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T20:17:46.362851Z digest=sha256:9d8c8d3a02024e323f41bd7178d0b7e3c485cfe15996f59861c7b620da54b416

Observation 72a86b75-9ad0-468f-9b00-5473d56c1d02 · inbound

UniVideo: Unified Understanding, Generation, and Editing for Videos cites this paper.

UniVideo: Unified Understanding, Generation, and Editing for Videos ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-04T10:49:47.891881Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T10:49:47.891881Z digest=sha256:7a314a7bfc487a048e34d1bbc4d66be9068f5a67c8b3c59f65460c50addf3e26

Observation c0dd0f0e-00ef-4909-8186-4fc85c7d673c · inbound

TinyHistory: Lightweight Video History Embeddings via Two-Stage Context Learning cites this paper.

TinyHistory: Lightweight Video History Embeddings via Two-Stage Context Learning ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-03T13:35:49.924520Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:35:49.924520Z digest=sha256:37380271bc5c57b13f67724aa7c91963f78dc84b4c8362834f003e3b7c26d8c8

Observation b4008e0f-c0e0-471b-8358-1cc55af29945 · inbound

OmniCustom: Sync Audio-Video Customization Via Joint Audio-Video Generation Model cites this paper.

OmniCustom: Sync Audio-Video Customization Via Joint Audio-Video Generation Model ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-03T00:11:12.760454Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T00:11:12.760454Z digest=sha256:893e4561209cb3e98a2a0969ed055713c39da4b761e9f02fe690d9852c7f9f61

Observation 4662f14c-70fb-4f48-b7ad-121f5df50210 · inbound

RefAlign: Representation Alignment for Reference-to-Video Generation cites this paper.

RefAlign: Representation Alignment for Reference-to-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 8

Resolution
unresolved
no resolver link, observed 2026-07-13T18:01:19.034578Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T18:01:19.034578Z digest=sha256:c3acc5d7b3dcf0ec0f89dbd00c0be1de75744ea532363181d6005fa1bd36b1ea

Observation b30b31c6-a1d1-4735-bb03-49e2646c36d0 · inbound

Evolution of Video Generative Foundations cites this paper.

Evolution of Video Generative Foundations ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 200

Resolution
verified exact
arxiv_id, observed 2026-05-11T00:05:51.145730Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-10T18:41:38.616611Z digest=sha256:c3035f1d3517de03677478fecc4c0aed045f04d4ed3817dfc871dba60390d642

Observation 1282d86b-ae12-45e8-b754-f981c3fd0c4c · inbound

MMControl: Unified Multi-Modal Control for Joint Audio-Video Generation cites this paper.

MMControl: Unified Multi-Modal Control for Joint Audio-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-11T12:46:27.934831Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-10T02:55:09.008954Z digest=sha256:3d0a82fe2d267d3ba1ab2727b4475ab715b24aba9ddc8c5ce3e2fd7e4668f9f7

Observation 4cefa5a1-8fef-4ea5-ac43-94455231321f · inbound

Generate Your Talking Avatar from Video Reference cites this paper.

Generate Your Talking Avatar from Video Reference ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 22

Resolution
verified exact
arxiv_id, observed 2026-05-12T10:36:29.843825Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-07T05:32:04.519820Z digest=sha256:d150d793a2e7d4a0186e5586f6285491477570ac04a37e5ed48505576ca5616a

Observation 11517605-6d84-44ab-a550-3c9313f52c6e · inbound

Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation cites this paper.

Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-05-20T14:13:21.384877Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-20T14:08:30.802619Z digest=sha256:367eba57d5521a257244d1c68f3dcc431d69213fdaba5125cc10e1ab7335d618

Observation a07afe0d-0600-4324-a49b-b8427c7bedf8 · inbound

Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation cites this paper.

Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 25

Resolution
verified exact
arxiv_id, observed 2026-07-01T22:26:17.512073Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-28T15:25:22.778550Z digest=sha256:8a49aa9641fe1350e6d7db9619201cfefeed984d86468ac034502feacdd44639

Observation dbcb1a7e-0dca-4051-bdbc-f1294d9c43a6 · inbound

CineOrchestra: Unified Entity-Centric Conditioning for Cinematic Video Generation cites this paper.

CineOrchestra: Unified Entity-Centric Conditioning for Cinematic Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 30

Resolution
verified exact
arxiv_id, observed 2026-07-03T14:58:32.691488Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-27T06:51:31.625416Z digest=sha256:a38787b65d349d3b6fe6f1e985dec1f0894f446e938c63df4ec1a9d85bfeb3bc

Observation e3362c3a-3a0e-47f3-b016-494ea6adaf48 · inbound

DomainShuttle: Freeform Open Domain Subject-driven Text-to-video Generation cites this paper.

DomainShuttle: Freeform Open Domain Subject-driven Text-to-video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 30

Resolution
verified exact
arxiv_id, observed 2026-07-04T21:10:09.711131Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-25T19:00:23.260939Z digest=sha256:169c19df25bc2b345082801e79488aff26d0c7d83d267faed1b9152a553e2639

Observation 7fe408cd-237d-4aee-8bf7-25b166a643ed · inbound

Aura: Consistent Multi-Subject Video Generation via VLM-Grounded Semantic Alignment cites this paper.

Aura: Consistent Multi-Subject Video Generation via VLM-Grounded Semantic Alignment ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 30

Resolution
unresolved
no resolver link, observed 2026-07-11T20:11:31.576642Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-11T20:11:31.576642Z digest=sha256:500d30e75686181c81c53ee8d682430dc6fea6c67c207df1bc486368b7f2a03d

Observation 8bb3d810-d29e-4267-8a07-2b790f672b0d · inbound

HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enhancement cites this paper.

HOMIE: Human-object Centric Video Personalization via Multimodal Intelligent Enhancement ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-01T15:42:21.185336Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T15:42:21.185336Z digest=sha256:7bc63022684b94556c1b9694a139120acc2cde11574f7a2360e830fdf8d65f4c

Observation bdb58df2-513b-4a68-b6e3-380c51764cea · inbound

Vera: Identity-Faithful Human Subject-to-Video Generation cites this paper.

Vera: Identity-Faithful Human Subject-to-Video Generation ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-01T10:24:51.877301Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T10:24:51.877301Z digest=sha256:884050c2859a26a7da4b1bc3327a2a783a340a63d2c6829bb210ee50a7db0558

Observation 894eccdd-71ec-43ce-8c0a-1cf6048bdf0a · inbound

ID-V2V: Identity-Preserving Video Restylization cites this paper.

ID-V2V: Identity-Preserving Video Restylization ConceptMaster: Multi-Concept Video Customization on Diffusion Transformer Models Without Test-Time Tuning

Reference 193

Resolution
unresolved
no resolver link, observed 2026-08-01T04:27:31.572932Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-01T04:27:31.572932Z digest=sha256:5d09097c77e2035b8b36aaa0e9a889e32463e42e1d44457579514e5bb937e0e0