Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-05T05:50:17.733574Z
Paper Citation Record · LEDGER
As of 10 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2509.04957.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-05T05:50:17.733574Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links
A source-named dated measurement, never combined with another source.
Source: cited_works
48 of 48 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation f842bb75-a603-4117-9da5-2b066087a606 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Attend-Fusion: Efficient Audio-Visual Fusion for Video Classification
Reference 1
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation d92612f5-0f85-4dc3-8993-f96e18ac2a2f · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 2
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 64b80587-6110-4140-a7e1-9e808d6a1dfe · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 3
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation b083d87c-44e8-4c1f-b798-83715b8af64d · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0a4974b8-f164-4803-9450-e0320ed4036e · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 5
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 8f7afa3b-c735-43ec-b80b-1d9279f0be44 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Scaling Instruction-Finetuned Language Models
Reference 6
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 920e750c-87cb-44a9-90a8-487cc2e9d6d9 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2477458d-f157-461f-a77c-3dec81e27925 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 8
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 8b65355f-770c-42a0-9601-7638765eca5f · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 9
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 01ee2aa1-7ee7-4fd0-95d3-481ff5b6f6b9 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 10
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation ccad6bb4-a840-49e3-8c12-ce157375b9ed · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f2c81e68-5173-487d-a076-ae32126e42b7 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 12
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2daa0361-24c5-4086-8f2b-9dbb3aa95cba · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Classifier-Free Diffusion Guidance
Reference 13
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation adad0761-b7c1-48a1-868f-c62c50dd4d3e · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 14
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 99e9fa52-c8de-4799-bf42-bdf00c1033ba · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 15
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 18893818-3c1a-4f82-b771-ea52e6e531cf · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 16
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation b7ccc4d3-bb00-44a2-a790-a168969d09b1 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Kingma and Jimmy Ba
Reference 17
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 17df4267-1f6d-436d-96a8-c81db972266b · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 18
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 1108955e-afe4-412a-af83-d5f6f9f2b367 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 19
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation f37833bb-2ede-4a41-a0f5-d21a26a422e8 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 20
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1bf7075f-6193-42a6-bd20-d612f08a4319 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 21
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 975cc498-caf8-4376-b9ce-d025e0bd1d04 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper VideoChat: Chat-Centric Video Understanding
Reference 22
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 66111a53-d5f5-48bc-9bb2-83037c25e61c · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Flow Matching for Generative Modeling
Reference 23
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0d32f6cb-e52f-4189-9917-074c376419be · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 24
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation d382af3b-d5a5-497c-b424-bca310888960 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Plumbley
Reference 25
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 67980384-74a7-4b10-a69f-40e82ae3e346 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 26
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 2004328e-cec0-4701-ad35-823601a41df6 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 27
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 52cdf0cd-88c2-47ff-8f27-7cf897e9e091 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 28
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 31785116-109a-4ac6-a46d-f4f50b0ebf38 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 29
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation e9fa5e75-9146-4be3-b3ce-2a4d7c1b470c · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper FoleyGen: Visually-Guided Audio Generation
Reference 30
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 319ee91f-0d9e-4a29-a079-c133b1f3be5e · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 31
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 4b766f44-b95b-4d07-87df-f4552eaff303 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Movie Gen: A Cast of Media Foundation Models
Reference 32
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 17ed6f0b-e814-4182-b78b-2bb016ad8d92 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 33
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 24abc524-30d2-4a93-b5fd-f162697875f6 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 34
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation b7494c12-2a84-418d-92fb-3603cd230f03 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 35
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 18a912f6-1e23-49fe-8f26-677563723251 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper STA-V2A: Video-to-Audio Generation with Semantic and Temporal Alignment
Reference 36
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7da1f194-15b0-4b70-b537-2d88fe5436de · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 37
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 104718a5-30aa-4099-98b6-1dcbbc970e99 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 38
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 99e60a90-e50d-4f49-8c2b-09ca4e1d6b7e · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Stilwell
Reference 39
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 105322e9-47c3-4fe6-a387-86a7f29ce25e · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Gomez, Łukasz Kaiser, and Illia Polosukhin
Reference 40
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 0fdf94d3-d15b-4f2c-90d6-0d5ded89b42b · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Temporally Aligned Audio for Video with Autoregression
Reference 41
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation a01090d7-0673-45c0-9e59-9b88d94a7785 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 42
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 91c118c5-e7c3-42f4-b2af-1d7d9026b95d · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 43
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 9719fa83-b505-4803-b709-146fe5f4a38a · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 44
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation f64d7a23-799d-4b28-95d8-91d5f431c613 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 45
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 27c7109f-22b1-4a40-9825-173789221db5 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper Unresolved cited work
Reference 46
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.
Observation 74f1ff39-134b-41a1-b0fa-820359ac3e42 · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper FoleyCrafter: Bring Silent Videos to Life with Lifelike and Synchronized Sounds
Reference 47
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a6f882af-01b9-441a-9d80-225faee1280e · outbound
Efficient Video-to-Audio Generation via Multiple Foundation Models Mapper MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models
Reference 48
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
No inbound Pith citation observations are available.