{"as_of":"2026-08-14T13:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c70fc6bc01691764a949377c6056eefed1060852ce5567a19840523c53d9344b","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:12:32.514636Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:12:29.445618Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:12:32.763786Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"cited_work":{"arxiv_id":"2506.00273","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00273","snapshot_observed_at":"2026-08-07T12:12:32.763786Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","venue":"eess.AS","work_id":"b7d9dcc0-8290-4dc2-905c-c4af61d54673","year":2025},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.445618Z"},"links":{"cited_paper":"/paper/2506.00273","citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:e262d3091eca07d544355f548c29cbc338a40facd859989fc97c79aa6aa674b5","observation_id":"ebff7117-1e89-4077-8be3-251ca117e8b4","resolution":{"observed_at":"2026-08-07T12:12:32.878777Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00273/citation-record","integrity":"/paper/2506.00273/integrity","json":"/paper/2506.00273/citation-record.json","paper":"/paper/2506.00273"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:37.164306Z","title":"Ambisonics, a popular spatial audio format, enables binaural rendering of head-tracked spatial audio and is commonly used in VR [1]","venue":null,"work_id":"ac694fed-51cb-4d02-a953-09ea8928c20f","year":null},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.362348Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:5b432c93fa3d23df3775498bd5e76b2a69929f79fb016d1e4bed943ed0b71cc4","observation_id":"707aa02c-9f34-4e91-8b4b-aa8fd010b9f3","resolution":{"observed_at":"2026-08-07T12:12:37.236391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:36.916094Z","title":"Problem Setup Let a(t, θ, ϕ) be the plane wave amplitude distribution describ- ing an incident sound field","venue":null,"work_id":"b2c06aab-4842-4074-bdcd-0f18b6a69a96","year":null},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.533135Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:8ef98219ebf76efd77fef320ccc4f25536b59ca8295489caba67d398b8cd1eca","observation_id":"dbd1cfed-4848-4d81-8992-eb292f2dde65","resolution":{"observed_at":"2026-08-07T12:12:37.020510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:36.383695Z","title":"We present SI-SDRi (averaged across channels) for the baseline algorithms and SoundSculpt models that use various types of conditioning","venue":null,"work_id":"328d37f7-2c1f-4889-8db5-2f394b1b48e8","year":null},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.829724Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:0a861034f5c6b2d79be380b0284598bfe3b5b867cc7a85d719c2dff2281f1758","observation_id":"543ebcdb-1f5b-465b-8982-7eff7c39e6f0","resolution":{"observed_at":"2026-08-07T12:12:36.446984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:36.242062Z","title":"SoundSculpt consis- tently outperformed traditional signal processing baselines","venue":null,"work_id":"9c4a4b8e-82ce-48a5-a6fa-a6dc4a8d55cf","year":null},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.912317Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:73e8df1d2a543c389e23d0871ebfb56a26c3eb9958803a4d2b833bd7109193d1","observation_id":"ba630ec9-f45c-4623-800f-166889a94363","resolution":{"observed_at":"2026-08-07T12:12:36.307469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:35.737365Z","title":"Direction preserving wiener matrix filtering for ambisonic input-output systems,","venue":null,"work_id":"dad50cd6-fada-425b-810e-da6f6a9d9b61","year":2019},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.269690Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:f3050f9f140a4b30387eb3df1f8d40d22a3bbf4b83015bc2ffaf00cae9c44a52","observation_id":"e695a57c-48bb-4747-9d27-1133ee396e53","resolution":{"observed_at":"2026-08-07T12:12:35.807318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"cited_work":{"arxiv_id":"2506.00273","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00273","snapshot_observed_at":"2026-08-07T12:12:32.763786Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","venue":"eess.AS","work_id":"b7d9dcc0-8290-4dc2-905c-c4af61d54673","year":2025},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.445618Z"},"links":{"cited_paper":"/paper/2506.00273","citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:e262d3091eca07d544355f548c29cbc338a40facd859989fc97c79aa6aa674b5","observation_id":"ebff7117-1e89-4077-8be3-251ca117e8b4","resolution":{"observed_at":"2026-08-07T12:12:32.878777Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05738","last_updated":"2022-04-12T12:26:01Z","snapshot_observed_at":"2026-08-13T16:03:44.307608Z","submitted_at":"2022-04-12T12:26:01Z","title":"Text-Driven Separation of Arbitrary Sounds","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05738","snapshot_observed_at":"2026-08-07T12:12:30.479701Z","title":"Text-driven separation of arbitrary sounds,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.479701Z"},"links":{"cited_paper":"/paper/2204.05738","citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:5044e244904f493b66cdd1db77b9a85bb87ff630f1616b0a1d794fb989980244","observation_id":"c4ae24dc-9f3f-414c-935d-1d75520af679","resolution":{"observed_at":"2026-08-07T12:12:30.479701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:36.048084Z","title":"Zotter and M","venue":null,"work_id":"b961bc12-01aa-4953-a8b8-d5a13c9f0185","year":2019},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.967025Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:03d4e2fe65ee20eaec64ce0e048de7d9e0fcbf2d878de046e4fc199c7641d7d5","observation_id":"8ee4436c-cb64-4808-b138-35921451d59e","resolution":{"observed_at":"2026-08-07T12:12:36.136065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:30.042793Z","title":"Rafaely, Fundamentals of spherical array processing","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.042793Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:d58813f20fe03f808697afe6cf0816ebe804edbe21eed908f6c1229247ecead6","observation_id":"1a9753b9-3cc3-4d24-aefc-ff8e155975f3","resolution":{"observed_at":"2026-08-07T12:12:30.042793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17362","last_updated":"2024-02-27T09:54:40Z","snapshot_observed_at":"2026-08-13T17:50:58.536494Z","submitted_at":"2024-02-27T09:54:40Z","title":"Ambisonics Encoding For Arbitrary Microphone Arrays Incorporating Residual Channels For Binaural Reproduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17362","snapshot_observed_at":"2026-08-07T12:12:30.118676Z","title":"Ambisonics encoding for arbitrary microphone arrays incorpo- rating residual channels for binaural reproduction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.118676Z"},"links":{"cited_paper":"/paper/2402.17362","citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:a4ee521dcbcb4d7f875a9eeb7cb09e9f888cb096bb934c6d5df2159b58c76795","observation_id":"faf72521-cd9a-4f3a-9e71-ffa2acfdee00","resolution":{"observed_at":"2026-08-07T12:12:30.118676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:35.888457Z","title":"Spatial transformations for the en- hancement of ambisonic recordings,","venue":null,"work_id":"43d78461-59d6-4b26-bc5a-b3d030d6d330","year":2014},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.182967Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:6bea8dd97a1250e908cc7923ce2f6b91a5b6c931bba28596ef8106c8eafa4819","observation_id":"100d6bd7-b8c2-4e82-93b1-b2cb0ea44982","resolution":{"observed_at":"2026-08-07T12:12:35.954453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:31.138823Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.138823Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:f0f23fb853f64288caded82dac6a6c7d7b2c232fb1a241bdaf0d565a29881e1c","observation_id":"898bf0de-8412-4f37-a4a8-bc5f6dc6d4a4","resolution":{"observed_at":"2026-08-07T12:12:31.138823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:35.597622Z","title":"Direction and reverberation pre- serving noise reduction of ambisonics signals,","venue":null,"work_id":"b85b3b16-3a29-4db5-bd0e-3d5de5c59ae5","year":2020},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.341171Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:a4346941aea5856a024a472b1e2da9b50c3542ef4455606e9e575cee409ce217","observation_id":"e722abc8-231c-4bae-9f6c-341475efc918","resolution":{"observed_at":"2026-08-07T12:12:35.656869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:34.574486Z","title":"Bert experts (wikibooks),","venue":null,"work_id":"046b3043-b480-4fcd-8c69-8929fe574034","year":2023},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.333775Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:fc5aa10a4da93a4699addae024443fc998eef7358de1c33479781e4241608f55","observation_id":"5c85cd34-ec6c-4eb2-906c-0b22d61c3e09","resolution":{"observed_at":"2026-08-07T12:12:34.704727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:35.423817Z","title":"Real-time target sound extraction,","venue":null,"work_id":"3db83e0c-737a-40db-a89a-2dd14a4582a6","year":2023},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.603238Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:d6c2ea510c0c2a33707578375c65100d04d836eef4a3c7a1d01b971a6ea64903","observation_id":"06c30f9f-1f58-406f-82b2-fe55523ac38f","resolution":{"observed_at":"2026-08-07T12:12:35.492915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:35.223798Z","title":"Se- mantic hearing: Programming acoustic scenes with binaural hear- ables,","venue":null,"work_id":"45000abb-8caa-4b1e-a8de-530a467c8481","year":2023},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.741649Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:91253056d3f86e37d5d7508ddbd9c35ac1533e629c4c4debdec1169fcb77f821","observation_id":"83a85ecc-8ea4-4ee3-a66b-044957d66c74","resolution":{"observed_at":"2026-08-07T12:12:35.312664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:35.023414Z","title":"Binaural angular separation network,","venue":null,"work_id":"336f2b30-bc9f-4b63-8ee1-f66cfc017bc5","year":2024},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:30.938063Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:acf38201e61da1a0b2cf5f67ff1060ce3f072ab81d53a3bfc4458a1d5c5ea93b","observation_id":"4a272632-9102-4474-82a2-8d2cbc122387","resolution":{"observed_at":"2026-08-07T12:12:35.113500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:31.031505Z","title":"Rezero: Region-customizable sound extrac- tion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.031505Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:5d184085daedefe2699acc8b39ea46a927fb1bf477797023294b1ca31ae80876","observation_id":"2a57f6d8-e471-453e-a0b6-9ef5b10ed1d3","resolution":{"observed_at":"2026-08-07T12:12:31.031505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:33.867264Z","title":"On the modeling of rectangular geometries in room acoustic sim- ulations,","venue":null,"work_id":"4ab9cee6-a592-4d60-88f0-5823fcabe7c0","year":2015},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.812238Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:d85ecd470b2c6ef0c515a25db9df54a12ceda84f30c564808ef98c8432ea67ec","observation_id":"88f73f71-2f29-4de0-bfbe-bf02b2903d64","resolution":{"observed_at":"2026-08-07T12:12:33.952354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:34.832037Z","title":"Efficient encoding and decoding of bin- aural sound with resonance audio,","venue":null,"work_id":"67e59268-f886-4244-8bef-4b1a8b23dbbc","year":2019},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.256336Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:459e0cb2c4099543d885538029c547a8dd139b99c9791c28cac8c0575915cd36","observation_id":"ba5e926c-ee2f-4bb0-8a26-992d4ed453d5","resolution":{"observed_at":"2026-08-07T12:12:34.885846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:31.955910Z","title":"Clotho: An audio cap- tioning dataset,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.955910Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:7eafb1690bb2b363264c8398201d43bf1142a4d90b2c8250ba4a650f48a943da","observation_id":"7daeec2b-1c06-4473-b169-545bb4ead6a2","resolution":{"observed_at":"2026-08-07T12:12:31.955910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:31.440819Z","title":"Film: Visual reasoning with a general conditioning layer,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.440819Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:847b8c029ab73b281f5399c067686dd135fd4e28c8cf052f6d07f159a48e8621","observation_id":"84b55b69-aeed-48fa-bca0-242712f964a6","resolution":{"observed_at":"2026-08-07T12:12:31.440819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:36.735193Z","title":"Random source gains and si- lencing of secondary sources were applied to increase diversity","venue":null,"work_id":"c188d734-6a0d-450b-9b20-1030a486d636","year":null},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.681864Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:9a1efd63fab63aaabcd96def9f1b1871ddd34b8b52c019061f6e30481a650c04","observation_id":"827b2d4d-9b6d-4344-8424-a403f80930c0","resolution":{"observed_at":"2026-08-07T12:12:36.819472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:31.551953Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.551953Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:2766eb1edf5abf7892b3b6380a46c8244a2069b4f668e980b220be5c629e352e","observation_id":"c2d7a5c7-9301-4d54-b124-ab2af91b7811","resolution":{"observed_at":"2026-08-07T12:12:31.551953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:36.560610Z","title":"These descriptions were used to extract semantic embeddings for the target sounds","venue":null,"work_id":"241f3b82-9478-4d87-843a-879c1a5549af","year":null},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:29.771917Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:5a576bda62f80950d81ac30b0ca7336a9e3867299d81ddde8adc9b76dab087af","observation_id":"0e47624e-a224-4f15-8982-dfaa9cb2dd0b","resolution":{"observed_at":"2026-08-07T12:12:36.648303Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:34.315406Z","title":"Image method for efficiently sim- ulating small-room acoustics,","venue":null,"work_id":"4630dc84-275b-4c8f-8e21-63221f81001b","year":1979},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.629250Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:078362435955f7756dcfc111d27f9339f4066727b9f5a8312245312e8ce91f30","observation_id":"ee8562c1-befe-409f-a1dc-9ae65d1fc2ce","resolution":{"observed_at":"2026-08-07T12:12:34.393769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:34.096420Z","title":"A note on a method for generating points uniformly on n-dimensional spheres,","venue":null,"work_id":"b033bd2d-322b-42e2-b050-e37f05888e25","year":1959},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.711541Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:e1d58bbfcb63f4b5c2667eb2714ce238bf5bed0008d50924fe80ebd7bb45c137","observation_id":"e141348d-b156-46cb-97a9-d0bf20b4728c","resolution":{"observed_at":"2026-08-07T12:12:34.201320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:33.660192Z","title":"Libri-light: A benchmark for asr with limited or no su- pervision,","venue":null,"work_id":"a15def50-1a94-43e4-9302-257719f840a2","year":2020},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:31.885365Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:743704ddc4320752755e8b60a7095be5fc0415a2773392fb5a863ea4a5bd5914","observation_id":"01fb8b16-ee7a-4b95-9a34-6b579358b0c7","resolution":{"observed_at":"2026-08-07T12:12:33.714244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:33.458532Z","title":"Fsd50k: an open dataset of human-labeled sound events,","venue":null,"work_id":"246d4c88-6166-4f6a-b34c-50a824e2dc69","year":2021},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:32.043804Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:8000de279fdcf86e9cf9859aed13d1e872c9735885761a16a62b3cad03ef2b4d","observation_id":"63a5eef5-1daa-49f7-bc2d-f61ee77b93a1","resolution":{"observed_at":"2026-08-07T12:12:33.552078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:33.232130Z","title":"Freesound - Collaborative database of creative-commons li- censed sound effects,","venue":null,"work_id":"a472cd73-19d3-4efc-b4a0-aa50bc52b66b","year":2025},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:32.119727Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:9eb264cacb5dce79c725ca815426ca797ce6c3d07aeb71426012e56621c2f0cd","observation_id":"dc060940-779a-49c9-a180-7b1693833dab","resolution":{"observed_at":"2026-08-07T12:12:33.353100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02882","last_updated":"2019-04-05T06:05:00Z","snapshot_observed_at":"2026-08-10T09:39:47.608323Z","submitted_at":"2019-04-05T06:05:00Z","title":"LibriTTS: A Corpus Derived from LibriSpeech for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.02882","snapshot_observed_at":"2026-08-07T12:12:32.212526Z","title":"Libritts: A corpus derived from librispeech for text- to-speech,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:32.212526Z"},"links":{"cited_paper":"/paper/1904.02882","citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:9b80e70abe51fbf22bf10a10e77155c9d228d8798c17375dc90af76c86c504bb","observation_id":"1dad2592-052c-4c14-b5f8-414ae112518b","resolution":{"observed_at":"2026-08-07T12:12:32.212526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:32.325036Z","title":"Audio set: An ontology and human-labeled dataset for audio events,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:32.325036Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:bb6a162dea04bbab9fbeb0c1e69c88c5c83a04441f3e6cb7d06fd3ddd144362d","observation_id":"254a95e6-5c72-474c-a940-d72cf7caf6a2","resolution":{"observed_at":"2026-08-07T12:12:32.325036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:32.435566Z","title":"Starss23: An audio-visual dataset of spatial recordings of real scenes with spatiotemporal annotations of sound events,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:32.435566Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:2e40697c3bc3da982cd791e1c036ae198252567faea782ff55cbafec9bf6cb98","observation_id":"d18f55f0-684f-40f0-8247-59d03c9709da","resolution":{"observed_at":"2026-08-07T12:12:32.435566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:12:32.997538Z","title":"Direction specific ambisonics source separation with end-to-end deep learning,","venue":null,"work_id":"57b8d376-0142-4176-b976-a081aee2b5bb","year":2023},"citing_paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:32.514636Z"},"links":{"citing_paper":"/paper/2506.00273"},"observation_digest":"sha256:23e33de9b7fd9cd2c1fd37d487e9fa6767c65fb2f91e07604e521ecf8a424b05","observation_id":"3a172ba9-82d5-49e1-a9a1-eb6c50840c78","resolution":{"observed_at":"2026-08-07T12:12:33.112320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00273","last_updated":"2025-05-30T22:15:10Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-13T12:41:42.722863Z","submitted_at":"2025-05-30T22:15:10Z","title":"SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2506.00273."}