{"as_of":"2026-08-10T17:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b7f361a4db6e88af7887a5f8581221840aa653874352856520c37be470493435","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-25T22:43:45.086693Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-25T22:43:45.086693Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T18:40:02.573284Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"cited_work":{"arxiv_id":"2606.24512","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.24512","snapshot_observed_at":"2026-07-04T18:40:02.573284Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","venue":"eess.AS","work_id":"53099ad8-79f5-476e-b886-66bcf59ecfb3","year":2026},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"cited_paper":"/paper/2606.24512","citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:f635fbea48a42668d8bb9ebb6c42d8284bbb5579d5bf395a368693cc49344786","observation_id":"8b51a36c-36ce-439d-889c-bb5c5480f1d2","resolution":{"observed_at":"2026-07-04T18:40:02.574504Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.24512/citation-record","integrity":"/paper/2606.24512/integrity","json":"/paper/2606.24512/citation-record.json","paper":"/paper/2606.24512"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"cited_work":{"arxiv_id":"2606.24512","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.24512","snapshot_observed_at":"2026-07-04T18:40:02.573284Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","venue":"eess.AS","work_id":"53099ad8-79f5-476e-b886-66bcf59ecfb3","year":2026},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"cited_paper":"/paper/2606.24512","citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:f635fbea48a42668d8bb9ebb6c42d8284bbb5579d5bf395a368693cc49344786","observation_id":"8b51a36c-36ce-439d-889c-bb5c5480f1d2","resolution":{"observed_at":"2026-07-04T18:40:02.574504Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":"Framework Overview Figure 1 illustrates our proposed three-stage self-guided framework for joint separation and classification","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:11018397690cbaee17131727636da52331be48be2172ed2044087f60af2801dd","observation_id":"36320534-72e9-4769-b552-880e8da5062f","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":"Datasets and Augmentation To train our models, we dynamically generated 4-channel mixtures online for each sample using the SpatialScaper simulator [9]","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:9e185e62e8c2aba019739cd8cc156bf860476287491316198eb1b5ae86029f4d","observation_id":"7baf151a-7cd6-46ec-be48-9837f94b8bec","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":"Ablation Study To validate the effectiveness of our proposed methods across the multi-stage framework, we conducted a comprehensive ablation study on the development test set","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:c488fe01733b82ab345031d3411ed636dd4212032c0b3cee14a7caaaf3381180","observation_id":"03ca6ca4-f405-4a04-b5af-3b9e3cdf54b1","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:b20e516f87a421192a842aef591e86442a70e5871d23a6a175303cae5e5ce6bd","observation_id":"a0c4ed46-cc6a-481c-af4f-385e3da5f3b0","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":"RS-2024-00337945), STEAM research grant (No","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:7c3188d1d45e7fa448c49b89985dc53ec9de7263d3c65c256b0bdde8ca36b5db","observation_id":"8b806eea-be57-4f6c-b30a-5d56d2606625","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10676","last_updated":"2025-06-12T13:07:54Z","snapshot_observed_at":"2026-08-07T04:18:06.150385Z","submitted_at":"2025-06-12T13:07:54Z","title":"Description and Discussion on DCASE 2025 Challenge Task 4: Spatial Semantic Segmentation of Sound Scenes","version":1},"cited_work":{"arxiv_id":"2506.10676","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10676","snapshot_observed_at":"2026-07-04T18:40:02.567787Z","title":"Description and discussion on dcase 2025 challenge task 4: Spatial semantic segmentation of sound scenes,","venue":null,"work_id":"e98cb2bc-f13f-4021-b2eb-643fc02eace3","year":2025},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"cited_paper":"/paper/2506.10676","citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:43f504409bb68e0cccb04f1ebf549b963647afd4c26ff8b88fd830676e9aa56c","observation_id":"ea01d0d6-0fc7-4db7-a10a-ea923d19f93b","resolution":{"observed_at":"2026-07-04T18:40:02.569358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.00776","last_updated":"2026-06-01T09:01:38Z","snapshot_observed_at":"2026-07-13T14:51:58.829090Z","submitted_at":"2026-04-01T11:38:37Z","title":"Description and Discussion on DCASE 2026 Challenge Task 4: Spatial Semantic Segmentation of Sound Scenes","version":2},"cited_work":{"arxiv_id":"2604.00776","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.00776","snapshot_observed_at":"2026-07-04T18:40:02.570524Z","title":"Description and Discussion on DCASE 2026 Challenge Task 4: Spatial Semantic Segmentation of Sound Scenes","venue":"eess.AS","work_id":"596337a8-40c6-4892-a33b-fdd90bc31f24","year":2026},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"cited_paper":"/paper/2604.00776","citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:d90772008b27734a7894666be074d88d402789007c5b30981bde6cdf441b2452","observation_id":"788a391b-6e39-4bb6-aab2-5028afe64a4e","resolution":{"observed_at":"2026-07-04T18:40:02.572018Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":"DeepASA: An object- oriented multi-purpose network for auditory scene analysis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:19f9363c8fa9057ecd4cb9b562e9f8e36574e0c379a32e9f8513355c63f54000","observation_id":"a3e495b0-c3b6-4ab8-b66e-0f24b7d68dd1","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":"Self-guided target sound extraction and classification through universal sound separation model and multiple clues,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:b1e2d046d80c77d225b49c67aa7bbe9292990122a4b20c8e3055c15b30029713","observation_id":"fcdf3d59-deab-4d6c-b55a-2308184f07e3","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.15899","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T18:40:02.564553Z","title":"Sound separation and classifi- cation with object and semantic guidance,","venue":null,"work_id":"12c17221-5726-4361-8d84-5f7e4fcee48a","year":2025},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:ed446c4e3bfe2c2621c8aa9a33c719716c5775123297b2e1761308125d9a5761","observation_id":"03d474a7-7621-4ad7-82b5-b1389bb51a93","resolution":{"observed_at":"2026-07-04T18:40:02.566433Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":"Au- dio flamingo 3: Advancing audio intelligence with fully open large audio language models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:68a58ee0cd27b5b808a5beb6e03d6f49f534901ef4adecc292217c4391e6b09e","observation_id":"ed02b3d9-abb5-4b43-96b9-2726999a4214","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":"Temporal film: Capturing long-range sequence depen- dencies with feature-wise modulations","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:32783823b23cc4832306087751ad1c4e8dc051bfe9c938f40d22b42b0352f28d","observation_id":"09421c7e-9eb6-42a4-90ab-2f086a862667","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":"Film: Visual reasoning with a general condi- tioning layer,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:27b39ab3d345aee0cfa11ca58439f631c8744cf84d63952a51bdcd6f20fecf2e","observation_id":"68551387-7597-47ad-aafe-b3e89b2a4622","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":"Spatial scaper: a library to simulate and aug- ment soundscapes for sound event localization and detec- tion in realistic rooms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:5affa0c67dbe8df4450bea779346eea8d20707db740d6cbddf117f7a1da570c9","observation_id":"28e1d384-1534-4c98-99a3-9a19901a24b0","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":"The voice bank cor- pus: Design, collection and data analysis of a large re- gional accent speech database,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:2b167c4fa866ad012aff5d1da6a832bc4713dc0a6e4e9f2f3bd7a03e4ed47d6f","observation_id":"98b72138-d199-4b5c-9a3b-5fbfced7c314","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":"Audio set: An ontology and human-labeled dataset for audio events,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:b10ef8960faf09f5b8ba00202fe8cca9c654edda9b5adcb16124e34f158e22ab","observation_id":"358bedae-16c1-409b-a8b9-6614560f5202","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":"Sa-sdr: A novel loss function for sepa- ration of meeting style data,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:4fcc560011024bc5a4a125adb0cc891fd86ebe53785644949a4fdc030e8454e9","observation_id":"dc0dd560-28f3-43d5-9ee0-446668ffb8cb","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":"Arcface: Ad- ditive angular margin loss for deep face recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:3c0ea190808e1ce4960d655973bff3d052b37cd5b2182eb0acd599c151b1e263","observation_id":"466dd0ab-473d-424d-ad45-b2998ce069e7","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-25T22:43:45.086693Z","title":"Class-aware permutation-invariant signal-to- distortion ratio for semantic segmentation of sound scene with same-class sources,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-25T22:43:45.086693Z"},"links":{"citing_paper":"/paper/2606.24512"},"observation_digest":"sha256:812d37127246df18d6819284ffd134b9bd42fd382d657d98126a42ecd29cd6b8","observation_id":"c1214f66-2143-49af-ba76-77486bcda045","resolution":{"observed_at":"2026-06-25T22:43:45.086693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.24512","last_updated":"2026-06-23T12:43:22Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T16:05:51.384752Z","submitted_at":"2026-06-23T12:43:22Z","title":"A Multi-Stage Separation-and-Classification Framework Guided by Complementary Acoustic-to-Semantic Clues"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 1 inbound Pith citation observation for arXiv:2606.24512."}