Pith. sign in

Paper Citation Record · LEDGER

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models

As of 18 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2508.00289.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2508.00289 v1

Coverage vector

measured 44 of 44 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T10:19:02.457827Z

measured 44 of 44 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-18T06:34:40.430872+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

44 of 44 outbound references displayed

  • verified exact0
  • verified fuzzy29
  • unresolved14
  • parse uncertain1
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 61f32914-3bf4-4ef5-99a5-9ed11e27bdd0 · outbound

This paper cites Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T10:18:56.826240Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:18:56.826240Z digest=sha256:4b685cf6dd479a14f214369f153980e28e2ac024ba6fb909d6554e2c179fc7fa

Observation 97ff0b24-2483-4afe-b4c9-ff89109da48c · outbound

This paper cites Universal guidance for diffusion models.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Universal guidance for diffusion models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-06T10:18:56.952634Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:18:56.952634Z digest=sha256:28fbd954b6983784d1e8f8b650ea349fcc7419b115d7c2c1aa28ec0f5bed3328

Observation 65cb2da8-1ade-4ef7-9343-8835e291098a · outbound

This paper cites Gradients without Backpropagation.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Gradients without Backpropagation

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-06T10:18:57.082183Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:18:57.082183Z digest=sha256:0d74e99d35fda3d4ea427ee56ad8605df3d5a9e794752ab7491a6e0b23799d77

Observation 5e741762-9efd-4d2e-9896-cd1944370230 · outbound

This paper cites Vggsound: A large-scale audio-visual dataset.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Vggsound: A large-scale audio-visual dataset

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:11.702942Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:18:57.192695Z digest=sha256:f2abfc669f61ef976ec9c50c4c550631fcea1e0a8bf30b1d1d094efeae64ef4b

Observation 85c9296b-5c14-4974-a0a9-539afb891a64 · outbound

This paper cites Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-06T10:18:57.269811Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:18:57.269811Z digest=sha256:3545f0f1bb7358d58012e05493ed931b9738851449d3b163dad70febaea62b95

Observation 6613ac4e-a0ee-4d69-888d-5f7d6afcd8a9 · outbound

This paper cites FLATTEN: optical FLow-guided ATTENtion for consistent text-to-video editing.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models FLATTEN: optical FLow-guided ATTENtion for consistent text-to-video editing

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-06T10:18:57.439470Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:18:57.439470Z digest=sha256:ca3ae803bc505b92545fda894af2cc2c09a5e14623471453a10ecfd075404df4

Observation 4794412c-6459-41b2-8565-d8ec71da7764 · outbound

This paper cites Tweedie’s formula and selection bias.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Tweedie’s formula and selection bias

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:11.424128Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:18:57.613325Z digest=sha256:db4b923a7665131645d87ecb08b4b67ffb00b9872a3ea1835a89f7d3f6b7755f

Observation e045067b-375a-4c81-9083-815f84451c25 · outbound

This paper cites Douceur, Jon Howell, and Jared Saul.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Douceur, Jon Howell, and Jared Saul

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:11.166560Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:18:57.724040Z digest=sha256:a1b74131e9423a6f7278f3c77f2e82e0a8adb6fc5c1e27872d88e28d2e11dffa

Observation e1f4623e-a616-43d3-b1b2-ef71f27d9dbc · outbound

This paper cites Can forward gra- dient match backpropagation? In International Conference on Machine Learning, pages 10249–10264.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Can forward gra- dient match backpropagation? In International Conference on Machine Learning, pages 10249–10264

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:10.878163Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:18:57.821630Z digest=sha256:b202730e7a95c4dade81a26df014ce19934e2fe76e0ad8e4888af7e494dbe5a2

Observation 780e7832-8161-4df9-8f09-8a3602faf2b3 · outbound

This paper cites Imagebind: One embedding space to bind them all.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Imagebind: One embedding space to bind them all

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:10.534267Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:18:57.972339Z digest=sha256:ad2b98352e9ee227723929bc9b8a057643c687433e353bb5084e136e103ecdd5

Observation 353fe7c7-d430-439c-a0c6-2b15c9063727 · outbound

This paper cites Animatediff: Animate your personalized text-to- image diffusion models without specific tuning.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Animatediff: Animate your personalized text-to- image diffusion models without specific tuning

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:10.212799Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:18:58.085809Z digest=sha256:b1b3f1cd79255a44509a6fb9aacb21cf689eb13509177544b343af60a62c0733

Observation 0c7c502e-e2ee-4244-aa30-ef2f52fa8d91 · outbound

This paper cites Manifold preserving guided diffusion.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Manifold preserving guided diffusion

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:09.868357Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:18:58.205603Z digest=sha256:814c5235b4a0ce3d0ef1378b8cfd1de973bdf650dd7ad1c1af501ddcabedbb00

Observation e5f97f8a-a3fc-42d4-af10-67abb484eccc · outbound

This paper cites Denoising dif- fusion probabilistic models.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Denoising dif- fusion probabilistic models

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:09.502025Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:18:58.394471Z digest=sha256:05d6eaafe1b4109938fd22eeb810556ddd720d56a112dea56d7c36cab6c2d2f8

Observation ca448dae-a797-4ecf-91a5-667456f374ad · outbound

This paper cites Deep learning face attributes in the wild.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Deep learning face attributes in the wild

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:09.273484Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:18:58.564074Z digest=sha256:3a535c91a24a5ecfec47061982cb98a500d43ce31ce49674ef890746cb33c0b5

Observation 109e8f0a-ab82-41a2-97a5-9426a5050ddd · outbound

This paper cites SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-06T10:18:58.687765Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:18:58.687765Z digest=sha256:4ab516c8ee1c8572934f0a86aa846ecee85793efadf99705c3191484941ac530

Observation bc306bb7-b91a-4b83-871f-8e77b75dd7e2 · outbound

This paper cites T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T10:18:58.787547Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:18:58.787547Z digest=sha256:3b40a910f539a4adde529eb42a993f691640b84b7bfcdd0dc4ee0eeeff0080d8

Observation f701c130-ba86-49e1-8dc5-720392997abb · outbound

This paper cites Patel, and Tim K.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Patel, and Tim K

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:08.928742Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:18:58.894322Z digest=sha256:76eaea326f668df43d8f16de147dd1594f54e881b5806dbd9e01dcfe35c7fe55

Observation b664519c-6427-4068-9362-0873ec69e3ca · outbound

This paper cites Steered diffusion: A generalized framework for plug- and-play conditional image synthesis.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Steered diffusion: A generalized framework for plug- and-play conditional image synthesis

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:08.636474Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:18:59.035988Z digest=sha256:7339d02ba1bd8714f3c0dde0adda715dc5221cfd7c3d6d1c35a5cdb6b457d502

Observation 84481e46-f891-4932-a068-bdd3f63dc99d · outbound

This paper cites Ditto: Diffusion inference-time t- optimization for music generation.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Ditto: Diffusion inference-time t- optimization for music generation

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:08.310674Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:18:59.138737Z digest=sha256:f44ab4eb7cd4c2958cdc130afe918787f9d36fc4338b607418c31360f08a2093

Observation e8293c18-bbc8-4b46-83b0-03320f0856f9 · outbound

This paper cites Automatic differentiation in pytorch.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Automatic differentiation in pytorch

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:07.937331Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:18:59.271633Z digest=sha256:461c4e26dc1a8d5ffe8672319f07abc2b12011ede1754de5dc852df4a0077a35

Observation 6f0f0cf5-2519-4903-bfe6-a7ba4f508d54 · outbound

This paper cites Styleclip: Text-driven manipulation of stylegan imagery.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Styleclip: Text-driven manipulation of stylegan imagery

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:07.673876Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:18:59.412916Z digest=sha256:2319a828dd0d11d8b3b15d7c3cec9199c36250e53e0a31cb2e8d8a0f6b372e25

Observation f431413d-636f-4661-9c85-40a0ccca9d2d · outbound

This paper cites Scaling Forward Gradient With Local Losses.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Scaling Forward Gradient With Local Losses

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-06T10:18:59.548616Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:18:59.548616Z digest=sha256:708c1c8fec8c4160a132a707848d3a8096896eed3953eb8f8cbddab8a1fe6d94

Observation 05ce7fb0-539f-4024-a778-1b7e3702cfcc · outbound

This paper cites Denoising Diffusion Implicit Models.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Denoising Diffusion Implicit Models

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T10:18:59.650703Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:18:59.650703Z digest=sha256:bb2c8b07e8b014ec365208468811ca695a5c91c866924299625fe02cd91ccf11

Observation 5b7dfdf3-f96a-4646-af6a-c4f7a011a005 · outbound

This paper cites Loss-guided diffusion models for plug-and-play controllable generation.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Loss-guided diffusion models for plug-and-play controllable generation

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:07.430315Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:18:59.799031Z digest=sha256:96d0a2510f3c44705c35e8034ab53748463f8378e4561e0002178b0ae5fa8f86

Observation d0929762-7452-4243-8153-6d1db2256879 · outbound

This paper cites Score-Based Generative Modeling through Stochastic Differential Equations.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Score-Based Generative Modeling through Stochastic Differential Equations

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T10:18:59.912795Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:18:59.912795Z digest=sha256:de88143449337a93b1992edd31c34aa39f2891e305f917b5eefcaf330ef0082c

Observation ed4047d1-92d2-4b7a-bcc7-8cc58542da2f · outbound

This paper cites Towards Accurate Generative Models of Video: A New Metric & Challenges.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Towards Accurate Generative Models of Video: A New Metric & Challenges

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-06T10:19:00.091556Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:19:00.091556Z digest=sha256:284804be4680f8013a330f202096352eeaa7528c983f378f66c0f1e288a2b73f

Observation 3cc2f208-d7cc-4330-aaea-86349019cc39 · outbound

This paper cites EDICT: Exact Diffusion Inversion via Coupled Transformations.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models EDICT: Exact Diffusion Inversion via Coupled Transformations

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-06T10:19:00.213508Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:19:00.213508Z digest=sha256:f50f0b676f4cc1d2a1f65bb115354446e031c23e4609efb8b9066d107d6ecf05

Observation 78aa970c-3d51-492f-99c1-2bbb2c9ab251 · outbound

This paper cites End-to-end diffusion latent optimization improves classifier guidance.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models End-to-end diffusion latent optimization improves classifier guidance

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:07.137812Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:00.336983Z digest=sha256:e79b65d81d990dd44d753eb6fdf0a0805095b6666eda5c66e8fe55be9f308c1f

Observation 99ed74fa-e27b-4e31-a287-b25c27dc2ee7 · outbound

This paper cites Exploring video quality assessment on user generated contents from aesthetic and technical perspectives.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Exploring video quality assessment on user generated contents from aesthetic and technical perspectives

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:06.744134Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:00.614727Z digest=sha256:1b3404c814139cf856d7ff1d0370fc55ca189881d1669890f441acc63763218e

Observation ea998301-69ef-477d-a762-6a86dd3169c6 · outbound

This paper cites Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:06.458827Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:00.710597Z digest=sha256:53404c135bd4a2a1102e39700e417f84381145a2c2a6d466b2ea9c78f9ca3766

Observation 8bec9df8-22b1-4dad-bf9e-1b9172dcf155 · outbound

This paper cites Cvpr 2023 text guided video editing competition, 2023.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Cvpr 2023 text guided video editing competition, 2023

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:06.190487Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:00.838968Z digest=sha256:77d78468af0f601e545d491fe9f494343c696ceef513d00cda19575ad6bae34a

Observation 044e5235-c78a-4483-8093-2f2414993387 · outbound

This paper cites Seeing and hearing: Open-domain visual- audio generation with diffusion latent aligners.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Seeing and hearing: Open-domain visual- audio generation with diffusion latent aligners

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:05.917568Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:00.953443Z digest=sha256:911cb9b495d7c6787dde3734523bbde63ae543237a346218217c542def65a27b

Observation 25503311-d8e4-4b04-bb5f-b1719b6d39e0 · outbound

This paper cites CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-06T10:19:01.037098Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:19:01.037098Z digest=sha256:4e6d6297c86d1fe678edbc32744f928d39af10ef1b598b23653e1e4318860851

Observation 6167f9db-803e-41b5-8ee3-9628d404505e · outbound

This paper cites Diverse and aligned audio-to-video genera- tion via text-to-video model adaptation, 2023.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Diverse and aligned audio-to-video genera- tion via text-to-video model adaptation, 2023

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:05.634407Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:01.163520Z digest=sha256:196be86087a6106e5c16deec2b8cbc694a6f2ae99375b9fa5aba7667ad3e182f

Observation 7cfc12ab-ee6c-498c-83d7-65717fb6f311 · outbound

This paper cites Tfg: Unified training-free guidance for diffusion models.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Tfg: Unified training-free guidance for diffusion models

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:05.321040Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:01.311418Z digest=sha256:1618bb78e0e5e1ae9b2e76d770d547e6a4a4a0ac2a41945ef76fdfc585880f33

Observation f0c7fe81-8da2-4468-b3eb-380fd05c7921 · outbound

This paper cites Freedom: Training-free energy-guided condi- tional diffusion model.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Freedom: Training-free energy-guided condi- tional diffusion model

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:04.670407Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:01.596884Z digest=sha256:20061dc179a01c3feb7861ca3d8d9c10fa87a9928a5c92e69d4b7dd477952172

Observation 536b11ec-c3a9-494b-b212-70f0c23e8c2f · outbound

This paper cites Adding conditional control to text-to-image diffusion models.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Adding conditional control to text-to-image diffusion models

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:04.314085Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:01.748117Z digest=sha256:8d4eb4da3e68466247c2c0ddff5c7c871a8b1da3c646ce536f2b8923629bf3d2

Observation 712f5a20-7764-4359-a4a4-f09137e3f6f0 · outbound

This paper cites Let f : Rm − →Rn.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Let f : Rm − →Rn

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:04.092191Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:01.905666Z digest=sha256:71b09a81ddec6c337f2eb84885b2558411e15926cddf868c576970a62c9858ca

Observation 497cee0c-5b7c-429f-bc98-83ce86c2c8f6 · outbound

This paper cites In all experiments, we em- ploy AnimateDiff [11] with epiCRealism 2 as the base text- to-image model to generate 16 frames 8fps.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models In all experiments, we em- ploy AnimateDiff [11] with epiCRealism 2 as the base text- to-image model to generate 16 frames 8fps

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:03.806570Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:02.041513Z digest=sha256:f29c0c3bad399cb5f176f90bd1d2bdedb7258bde7ab337e2812c5789e5d0bd6b

Observation ad2b222c-fb6a-40cc-b1c5-8c00e1f73c1a · outbound

This paper cites A bird in a forest.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models A bird in a forest

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:03.496573Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:02.169544Z digest=sha256:790fe21a41fe51bcdf215ce54bac61ad35e9f7050ccef335c860cb592cb70ad3

Observation 554474bf-cd2d-4e37-87b8-6eb1402f756a · outbound

This paper cites However, since our primary focus is text- to-video tasks, we do not explore this aspect in depth but provide evidence of its applicability.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models However, since our primary focus is text- to-video tasks, we do not explore this aspect in depth but provide evidence of its applicability

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:03.243478Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:02.326749Z digest=sha256:abf06ce4afc4b1330f11df5b11efa8b851e10b6a893ebc2cc30120fc4422161f

Observation 9cc8f007-c6f9-46bb-bc68-7ac05ac747c9 · outbound

This paper cites Following [35], for super resolution, and deblurring tasks, we use the CAT-DDPM diffusion model trained on the CAT dataset [8].

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Following [35], for super resolution, and deblurring tasks, we use the CAT-DDPM diffusion model trained on the CAT dataset [8]

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-06T10:19:02.964526Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:02.457827Z digest=sha256:8f04a994818adf9ac0768b3a822060ff01a9efce1f4dc1f7250258ddde5603f6

Observation 1fa22e79-3b2e-423f-934b-7d712ac44f24 · outbound

This paper cites an unresolved cited work.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Unresolved cited work

Reference 2023

Resolution
parse uncertain
raw_fallback, observed 2026-08-06T10:19:06.976010Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:00.464586Z digest=sha256:dee661ad383bb57e58dd68c0c18aefd552ec4439991c796372247b3d256f0e97

Observation f2631690-0718-47f1-babf-55c4a7fb9daf · outbound

This paper cites an unresolved cited work.

TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models Unresolved cited work

Reference 2024

Resolution
unresolved
raw_fallback, observed 2026-08-06T10:19:04.970152Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.

source=pdf_text observed=2026-08-06T10:19:01.475513Z digest=sha256:4d6baba838f35fffdeb1fcf42718f32e3cee11d91835f801127624bd272c091d

Pith citing papers

No inbound Pith citation observations are available.