Pith. sign in

Paper Citation Record · LEDGER

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds

As of 20 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2608.00463.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2608.00463 v1

Coverage vector

measured 62 of 62 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-15T15:24:02.218099Z

measured 62 of 62 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-20T06:33:59.587034+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

62 of 62 outbound references displayed

  • verified exact2
  • verified fuzzy53
  • unresolved7
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation e20da344-c2f9-400e-a6f7-6fe95ef288e5 · outbound

This paper cites 3D gaussian splatting for real-time radiance field rendering,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds 3D gaussian splatting for real-time radiance field rendering,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.933123Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:01.985894Z digest=sha256:8bb97acc546c4d9328d7f962529877104f71e8434a5ad00078b22aede7e998d1

Observation b3ccbd8b-30c3-4a93-8c1f-5eb9e6055b0e · outbound

This paper cites DreamScene360: Unconstrained text-to-3D scene generation with panoramic gaussian splatting,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds DreamScene360: Unconstrained text-to-3D scene generation with panoramic gaussian splatting,

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.923709Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:01.990530Z digest=sha256:b26041d60fb7a3b923fb9fb735dfe2903734f2e97fbd38ea8e24ade9919c4b5f

Observation 103948ee-1ccf-40a4-bf8d-4ff7ea6019fb · outbound

This paper cites WonderWorld: Interactive 3D scene generation from a single image,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds WonderWorld: Interactive 3D scene generation from a single image,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.913948Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:01.995286Z digest=sha256:3237ed8af22a4cf8cbde8676241e07e561c6aac30ffb57dcd7d4ff103db17e5f

Observation c03191d3-fcbb-40c8-8cbb-ef768978c084 · outbound

This paper cites 19, 2026.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds 19, 2026

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.903969Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:01.999409Z digest=sha256:3cd26481fd2c60c87cfaad844e892e9ffc121d302725bc77b87b976d09ef53a3

Observation e171de73-dc1c-4d07-a69e-2cd330f75bfc · outbound

This paper cites AG2aussian: Anchor-graph structured gaussian splatting for instance-level 3D scene understanding and editing,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds AG2aussian: Anchor-graph structured gaussian splatting for instance-level 3D scene understanding and editing,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.894321Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.002869Z digest=sha256:88a2f889ac35559e9a4a6302c8c6b1f3e988e32e01502a2800fa9bdc46c40648

Observation 997ec9fd-8377-4541-a800-182ecd82f2a9 · outbound

This paper cites PhysSplat: Efficient physics simulation for 3D scenes via MLLM-guided gaussian splatting,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds PhysSplat: Efficient physics simulation for 3D scenes via MLLM-guided gaussian splatting,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.884629Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.006579Z digest=sha256:79289f8197393112ea8294d273affa41c57dc35d1980cc6c0a6c7a23da110f7d

Observation 893143a3-5894-4c7b-bab6-23fc58e1f92c · outbound

This paper cites an unresolved cited work.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Unresolved cited work

Reference 7

Resolution
unresolved
raw_fallback, observed 2026-08-15T15:24:02.876236Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.010121Z digest=sha256:5e2f45d738241e6a261e5892138c2a7f74eeaa8cec1bde133100a657e24db687

Observation 428179b7-2968-41dd-a0a7-4961e39fec64 · outbound

This paper cites Spatialized audio rendering for immersive virtual environments,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Spatialized audio rendering for immersive virtual environments,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.867858Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.013410Z digest=sha256:df18bbabbd275829afad53abb5b8b874ac4ca052c1ca105522ccf08b1e91e25e

Observation 90f8ea17-06dd-4911-b2dc-ae5fec4d95f7 · outbound

This paper cites Sounding that object: Interactive object-aware image to audio generation,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Sounding that object: Interactive object-aware image to audio generation,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.859187Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.016675Z digest=sha256:b5c44a7f9b20bdc6644815bad1de98f62102697c72c6d6d1e22132b6d7d2bbc8

Observation 466c57be-c6c6-441f-9c80-69455de02fe0 · outbound

This paper cites SEE-2-SOUND: Zero-shot spatial environment-to-spatial sound,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds SEE-2-SOUND: Zero-shot spatial environment-to-spatial sound,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.849914Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.021036Z digest=sha256:e2f5c3eb615efa5423cc2f43d4f73c39fbf10dd9071780a6228a0f8074ee754e

Observation 9a63a2d3-920e-4f29-b454-0730a839129e · outbound

This paper cites OmniAudio: Generating spatial audio from 360- degree video,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds OmniAudio: Generating spatial audio from 360- degree video,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.840118Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.025063Z digest=sha256:86726dc7f639bfea9d11197508b16cbcd6834f93b5fe4bc5e27ee9e115851f61

Observation 0bc4a919-6c98-435b-b527-2de4b9827f8d · outbound

This paper cites Visual Acoustic Fields.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Visual Acoustic Fields

Reference 12

Resolution
verified exact
local_arxiv, observed 2026-08-15T15:24:02.373930Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.028590Z digest=sha256:da03d59e40eb96251c656a3e29437d68a6d3ef7e9cc5b6f59c7d4b3205ff3269

Observation 6976fcf2-2015-4cb8-b707-07c02441d55d · outbound

This paper cites Sonora: Human- AI co-creation of 3D audio worlds and its impact on anxiety and cognitive load,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Sonora: Human- AI co-creation of 3D audio worlds and its impact on anxiety and cognitive load,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.830114Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.032399Z digest=sha256:cbf150e180f7e82989842788c06b8703e24f7b8d9aa0391623685a45216e8bd4

Observation 1bfc02af-4e36-4173-93b7-2453ca7df62b · outbound

This paper cites SonoWorld: From one image to a 3D audio-visual scene,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds SonoWorld: From one image to a 3D audio-visual scene,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.820306Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.035750Z digest=sha256:bdec50f1d3620b8305f97b50ec186162f17cc8d609d674823f24ddcf870d9d61

Observation 87d1e26f-2dfa-454a-a901-9578e96c65a5 · outbound

This paper cites Gaussian grouping: Segment and edit anything in 3D scenes,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Gaussian grouping: Segment and edit anything in 3D scenes,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.810078Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.038923Z digest=sha256:1fab9b581bab8c2265af05c89b79e79da1520eaf9055f53085abefb8c96c4fe3

Observation 4ff327c9-65fc-4f02-b9fb-b3dba1cd8fc5 · outbound

This paper cites Object-based 3D audio production for virtual reality using the audio definition model,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Object-based 3D audio production for virtual reality using the audio definition model,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.800058Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.042400Z digest=sha256:4b204b83b73d28871f4ad2d79a8846d4e25372624a6309481bdb4cfe104c44c8

Observation a7bd38b1-73f5-4176-ac50-af234f01674b · outbound

This paper cites Qwen2.5-VL Technical Report.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Qwen2.5-VL Technical Report

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-15T15:24:02.045702Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T15:24:02.045702Z digest=sha256:8dc343bc821cbdb1c21ae5dfd59a54fbe68d37968587a1a2aad496b3b9523aba

Observation 5d8a5188-0c6a-4b25-9894-543efd686d60 · outbound

This paper cites SAM 3: Segment Anything with Concepts.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds SAM 3: Segment Anything with Concepts

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-15T15:24:02.049486Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T15:24:02.049486Z digest=sha256:a8acb5e044fd88b02999c7a6234ba20f400e2e879595b547d0bd14bf75e54e9b

Observation d8122110-1695-4647-b1d7-9c35bd95f391 · outbound

This paper cites Stable audio open,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Stable audio open,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.789741Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.053799Z digest=sha256:b159e457a34500869891008ac27c5e39cbe1d704aaed81c7bc12ddcbfe0b1be6

Observation 26c794c8-fead-479b-a02f-aa3223a76ea4 · outbound

This paper cites AudioLDM 2: Learning holistic audio generation with self-supervised pretraining,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds AudioLDM 2: Learning holistic audio generation with self-supervised pretraining,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.780603Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.057377Z digest=sha256:c3c2c9d3a179dfd1d4f9486245b14ce0c3c8e4745d25a036697e78827e743dee

Observation 77adee3f-667e-4aea-9823-dbc553d55ffe · outbound

This paper cites AudioLCM: Efficient and high-quality text-to- audio generation with minimal inference steps,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds AudioLCM: Efficient and high-quality text-to- audio generation with minimal inference steps,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.771423Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.062093Z digest=sha256:2cff55fc5560d5dec0bd27ecf5e51df4712fbae70ad3cc85c5533b70e71a982d

Observation e4c6950a-b0d7-4f8e-8959-4fd3b769b366 · outbound

This paper cites FlashAudio: Rectified flow for fast and high- fidelity text-to-audio generation,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds FlashAudio: Rectified flow for fast and high- fidelity text-to-audio generation,

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.762703Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.065642Z digest=sha256:6faf53e10d482ddf435fe8b801b8ef4b70b0883c29b7e39bbfc2c5a6c58679eb

Observation 62940b13-fcd5-4867-a1b9-826edd9bb296 · outbound

This paper cites TangoFlux: Super fast and faithful text to audio generation with flow matching and CLAP-ranked preference optimiza- tion,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds TangoFlux: Super fast and faithful text to audio generation with flow matching and CLAP-ranked preference optimiza- tion,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.752569Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.069203Z digest=sha256:ca59a88770a214e865b40e46a46de874cec5ea9adba334ea9daff82ed0afbf7f

Observation 1b109280-b2bf-4a46-aa4c-c91ee12a81b9 · outbound

This paper cites Lumina-Next: Making Lumina-T2X Stronger and Faster with Next-DiT.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Lumina-Next: Making Lumina-T2X Stronger and Faster with Next-DiT

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-15T15:24:02.073129Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T15:24:02.073129Z digest=sha256:985b9d555c1890cc4d5e76c2a01ecec8da130e49049a42d86fdd62751e888f07

Observation 279744d5-2d1c-4a33-9621-9be487734a91 · outbound

This paper cites Diff-Foley: Synchronized video-to-audio synthesis with latent diffusion models,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Diff-Foley: Synchronized video-to-audio synthesis with latent diffusion models,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.742324Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.077750Z digest=sha256:c5e4481c1c99cf667891770aae0185835bd7d57757365d92e273bcb8734cc20f

Observation 97d44d7f-6ce8-4345-b2c4-caad5f602e13 · outbound

This paper cites ThinkSound: Chain-of-thought reasoning in multimodal large language models for audio generation and editing,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds ThinkSound: Chain-of-thought reasoning in multimodal large language models for audio generation and editing,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.732656Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.081366Z digest=sha256:c26898ad510ad3cbc360c4473cdedb2e5e5ab827ced95ee151cbb8de980499a6

Observation c9e53704-3974-40fa-a0e1-db78960f1650 · outbound

This paper cites PrismAudio: Decomposed chain-of-thoughts and multi-dimensional rewards for video-to-audio generation,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds PrismAudio: Decomposed chain-of-thoughts and multi-dimensional rewards for video-to-audio generation,

Reference 27

Resolution
verified exact
raw_fallback, observed 2026-08-15T15:24:02.330905Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.085692Z digest=sha256:5e2941ed01373cc4a79d4a9db12904cdfba38bdedf5ab843f2279a9a5b39667d

Observation cbab2c8a-a111-4bba-9a0d-b96c03c0cb00 · outbound

This paper cites MMAudio: Taming multimodal joint training for high-quality video-to-audio synthesis,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds MMAudio: Taming multimodal joint training for high-quality video-to-audio synthesis,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.723258Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.089916Z digest=sha256:7847eff7ffe2d52faab509888266e9d962d96c812ae9415faacee7cc8ed4e29b

Observation 514cc056-7ee1-4803-8ec0-57339ee3af53 · outbound

This paper cites ImmerseDiffusion: A gener- ative spatial audio latent diffusion model,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds ImmerseDiffusion: A gener- ative spatial audio latent diffusion model,

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.713043Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.094333Z digest=sha256:781cc274ec117eacab7071cfb6a9620b46370f69081cd04bbc67b03ac5f0fa43

Observation e8cc0f82-6e83-4046-8c60-ebca2f20b0a5 · outbound

This paper cites Hearing anything anywhere,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Hearing anything anywhere,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.702013Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.098197Z digest=sha256:2e13c68ea6cb4313739dccc13e77ba00100dd63c6444db6e3302d527affea98f

Observation 22c95381-b859-49e7-9e70-fcd964367e11 · outbound

This paper cites A V-RIR: Audio-visual room impulse response estimation,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds A V-RIR: Audio-visual room impulse response estimation,

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.692719Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.101278Z digest=sha256:12bb9070919adf0bd826b50afc12a32c64b78086aa95b5f2aa422e33fa4c8bc4

Observation 462bc503-17b8-4681-a81e-a33b1f7637c0 · outbound

This paper cites Learning neural acoustic fields,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Learning neural acoustic fields,

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.684000Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.104753Z digest=sha256:1e080ac75dd30d74d2d0ca814a3b17db01d4cccdcf77bf8e5a3b9d9d80ee0f6e

Observation ccbd1135-2aad-49ff-8c6a-e10a3299f257 · outbound

This paper cites Acoustic volume rendering for neural impulse response fields,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Acoustic volume rendering for neural impulse response fields,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.675718Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.107777Z digest=sha256:5bc76b44d4530b5dc3d421b2381d7b35d1d1e98f08f7401aa98dc6a0144dbe22

Observation 12eafd4f-937c-4ae8-bc2c-0f8e45cb929b · outbound

This paper cites Novel-view acoustic synthesis,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Novel-view acoustic synthesis,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.665371Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.111750Z digest=sha256:7c15d36c5eb58b1be8614c7b0a2c63029c9fa951e16a76b4814a506b739c7112

Observation 237f65b3-5593-45ed-a549-bdbcef4080ce · outbound

This paper cites A V-NeRF: Learning neural fields for real-world audio-visual scene synthesis,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds A V-NeRF: Learning neural fields for real-world audio-visual scene synthesis,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.653714Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.115597Z digest=sha256:e0e75b4de9c5a6ce5064ce0e1f8360769aa48ea17377086b46bcb12bf7aa6b4d

Observation 3f607afc-4075-4cad-baea-a6d6af4588a1 · outbound

This paper cites A V-GS: Learning material and geometry aware priors for novel view acoustic synthesis,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds A V-GS: Learning material and geometry aware priors for novel view acoustic synthesis,

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.642524Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.119478Z digest=sha256:1adc6547a4c73b67ac6b917cd90323bcb9bceea1239375c824816339baac157f

Observation 0c9353e2-c4ee-41df-a075-82130f752cea · outbound

This paper cites NeRAF: 3D scene infused neural radiance and acoustic fields,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds NeRAF: 3D scene infused neural radiance and acoustic fields,

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.631817Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.123169Z digest=sha256:24d05d4916c3cc54a993e79e0403bdbc63263dca008131d32b7eb5cd5e5c6c2a

Observation 653e1fb6-052b-42d2-9a8c-9b14e9d7af2a · outbound

This paper cites Object-based audio reproduction and the audio scene description format,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Object-based audio reproduction and the audio scene description format,

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.621151Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.126874Z digest=sha256:9e5593c2c908782295cbe420755904a9673137525aa63a81627478394498f7aa

Observation 7fc65e56-3260-4e63-8770-312115300c01 · outbound

This paper cites An audio-visual system for object- based audio: From recording to listening,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds An audio-visual system for object- based audio: From recording to listening,

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.610454Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.130842Z digest=sha256:f2f801d7fb2a104e6e1ea348af189647eb9dc01d80c898da6e17abba7728c2c9

Observation 7f2f1b9e-defe-4bf8-8092-969d18f37621 · outbound

This paper cites Segment any 3D gaussians,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Segment any 3D gaussians,

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.600513Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.134631Z digest=sha256:5cf9e81478696eb4f1c381b96785a13826411729ca5de0ed16374667be1c0a19

Observation dde620a4-aad5-4039-8f94-619520a0dae5 · outbound

This paper cites OpenSplat3D: Open-vocabulary 3D instance segmentation using gaussian splatting,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds OpenSplat3D: Open-vocabulary 3D instance segmentation using gaussian splatting,

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.590900Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.140017Z digest=sha256:1d19e4dbc25e097535eb9d60dd00ffdedcab4f6cd396de25a02d9bd2ed8def7a

Observation d385a473-8fb5-4174-a8b8-45b1a0419737 · outbound

This paper cites Object-aware gaussian splatting for robotic manipulation,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Object-aware gaussian splatting for robotic manipulation,

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.580652Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.143982Z digest=sha256:7b40ecfa04b15602c9561c18f32c5c193de0f7761b72cd80d9227567d293dc23

Observation e1b7d7dc-5312-4fed-af51-cb8a0b0e3e22 · outbound

This paper cites GaussianCut: Interactive segmentation via graph cut for 3D gaussian splatting,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds GaussianCut: Interactive segmentation via graph cut for 3D gaussian splatting,

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.570539Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.147761Z digest=sha256:d69c8cfa2d5fef680ec6e4752c0aaa61e4f2004c06e5fffe5711f00fc25c760a

Observation c176cd30-f758-462c-9e00-27949925ee73 · outbound

This paper cites Training-free hierarchical scene understanding for gaussian splatting with superpoint graphs,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Training-free hierarchical scene understanding for gaussian splatting with superpoint graphs,

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.560284Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.151793Z digest=sha256:8dccc97ba8fabd77e50bf9edb7c94b208259befa678bb29ca63626832a22ce5d

Observation 77acb656-2ac9-490b-9fde-76944481462e · outbound

This paper cites Lifting by gaussians: A simple, fast and flexible method for 3D instance segmentation,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Lifting by gaussians: A simple, fast and flexible method for 3D instance segmentation,

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.550110Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.155424Z digest=sha256:7f471cfbd9db10857438583d2ff66db5033eca72f04989e6286d8c281bda02ff

Observation 706d0da3-00d2-44a5-9755-7e2cd9f5ee6a · outbound

This paper cites DCSEG: Decoupled 3D open-set segmentation using gaussian splatting,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds DCSEG: Decoupled 3D open-set segmentation using gaussian splatting,

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.539773Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.158916Z digest=sha256:67338ae5037b5dc575736162596b957dcd14b624fd6f299eeef0f5987789a5e6

Observation 0aa08d1f-2670-4c8f-9e27-2ba7d2fef225 · outbound

This paper cites Exploring CLIP for assessing the look and feel of images,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Exploring CLIP for assessing the look and feel of images,

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.528737Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.162404Z digest=sha256:b6df4cbe6d15f2536e0b006c5b8913bd0aaddfd6ee9400dd34dbbee37b6a9d3d

Observation e6773ef4-9adc-45f6-8436-09bd0eebaa5c · outbound

This paper cites gsplat: An open-source library for gaussian splatting,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds gsplat: An open-source library for gaussian splatting,

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.518133Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.166026Z digest=sha256:9c2ac5c5764e0c6fa4ab183550cad647c7b163a7b2a842b96a2146b690bcd529

Observation 7405f0ae-ab6b-4829-8abc-f5c0289ee838 · outbound

This paper cites Fr ´echet audio distance: A reference-free metric for evaluating music enhancement algorithms,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Fr ´echet audio distance: A reference-free metric for evaluating music enhancement algorithms,

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.507490Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.169658Z digest=sha256:d66afc70450a45241954ab3c10ccee172bc1a44203b95adf0729c8a4b6725d7e

Observation e1390ee1-49af-4923-98b6-dae3549c2372 · outbound

This paper cites PANNs: Large-scale pretrained audio neural networks for audio pattern recognition,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds PANNs: Large-scale pretrained audio neural networks for audio pattern recognition,

Reference 50

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.496172Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.173182Z digest=sha256:3d8babc61b168dc555b9bf228721bcf116db03d59abd033c47f5262276165b60

Observation fb317093-1dd0-4249-a05a-5f941923e833 · outbound

This paper cites Correlation of Fr ´echet audio distance with human perception of environmental audio is embedding dependent,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Correlation of Fr ´echet audio distance with human perception of environmental audio is embedding dependent,

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.483230Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.176633Z digest=sha256:ffef4bebb747c789b0f3b710a141764d1ca3c508b24832dc74e7ed24c7e7ef3f

Observation 58a07c9c-cbe5-4c96-96df-705333699a58 · outbound

This paper cites Sound Scene Synthesis at the DCASE 2024 Challenge.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Sound Scene Synthesis at the DCASE 2024 Challenge

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-15T15:24:02.180525Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T15:24:02.180525Z digest=sha256:04b656b26cd78c6b564cbbcf68d570b27b22657f43fc2284acb3468a5661bcaf

Observation b58763fc-a9ee-45ec-a287-4cdc9f8d7bd2 · outbound

This paper cites Clotho: An audio captioning dataset,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Clotho: An audio captioning dataset,

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-15T15:24:02.184402Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T15:24:02.184402Z digest=sha256:9a5e0d31ee0bee7321bb2166f13d3b646356c985e29bfb7ec294d244adfb9e13

Observation 5924b400-9ea6-4bcb-9377-472a91cb46c7 · outbound

This paper cites ImageBind: One embedding space to bind them all,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds ImageBind: One embedding space to bind them all,

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.466587Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.187846Z digest=sha256:c93335dcd77a279d17a7fc7341c141257d5c4f06e193e8e39891de3e43cd919e

Observation 43c67b10-bef8-4086-a518-9ef082d20e5c · outbound

This paper cites Large-scale contrastive language-audio pretrain- ing with feature fusion and keyword-to-caption augmentation,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Large-scale contrastive language-audio pretrain- ing with feature fusion and keyword-to-caption augmentation,

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.455720Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.191632Z digest=sha256:bd9275a6f9e835e5ca329fbc4dd9c3979714d97f8f6015c479d5ade2a42e899d

Observation e77db0bf-9977-4db9-8382-b81d0c8689bd · outbound

This paper cites Tango 2: Aligning diffusion-based text-to-audio generations through direct preference optimization,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Tango 2: Aligning diffusion-based text-to-audio generations through direct preference optimization,

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.445113Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.195272Z digest=sha256:63d7f072cd48fbe43016647c72a70e7a89511ef1d51caca730986107a5764b0f

Observation 5999a93b-152a-4a7b-aacc-0d24e15e3d12 · outbound

This paper cites Seeing and hearing: Open-domain visual-audio generation with diffusion latent aligners,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Seeing and hearing: Open-domain visual-audio generation with diffusion latent aligners,

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.434225Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.199094Z digest=sha256:346e30cc5251c62ea32dd97cb3a2423bd29d5a73f822c7bbaf9570ee0561156a

Observation 349514ba-6c80-4e4c-9e94-324e083f45ca · outbound

This paper cites I hear your true colors: Image guided audio generation,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds I hear your true colors: Image guided audio generation,

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.423349Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.202898Z digest=sha256:44907b88c02e1d8cd8ee9a7b08e83966e2260d5daf23c6e51d12fa8b392e150b

Observation 898af29a-117b-415e-b42e-38a9552f887b · outbound

This paper cites ViSAGe: Video-to-spatial audio generation,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds ViSAGe: Video-to-spatial audio generation,

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-15T15:24:02.206764Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T15:24:02.206764Z digest=sha256:dffa88aaa3d7e071aed6c64e15c50a629e79a64ea72d878835adf8f5925d9c0c

Observation 26bf96cf-0290-4010-99bc-6dc06690f588 · outbound

This paper cites D-SA V360: A dataset of gaze scanpaths on 360° ambisonic videos,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds D-SA V360: A dataset of gaze scanpaths on 360° ambisonic videos,

Reference 60

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.406354Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.210742Z digest=sha256:b1cf771bb5b8e3b9de13b4eee62886bdc50fa3075fdea314267237675979517d

Observation d9c47506-e9db-4e73-b474-82e24937524f · outbound

This paper cites Real acoustic fields: An audio-visual room acoustics dataset and benchmark,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds Real acoustic fields: An audio-visual room acoustics dataset and benchmark,

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.395713Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.214620Z digest=sha256:8305743126460ea601660a80df301ca39671d9a9acf49765c70c2d95d72e88ca

Observation 415686ca-63b2-4c82-a395-2c7206a76332 · outbound

This paper cites FLUX.2 [klein] 9B,.

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds FLUX.2 [klein] 9B,

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T15:24:02.384779Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-15T15:24:02.218099Z digest=sha256:3832a22c04dd77ac512e9b2fad167f87a16aa62a51e575f7171a5cc011180486

Pith citing papers

No inbound Pith citation observations are available.