{"as_of":"2026-08-17T21:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:16acf2558d19f547374ad386bb3a7d777c37376a62c267a05e0e2b7d4a73e7ab","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T14:49:42.989313Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T01:19:05.797308Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20885","snapshot_observed_at":"2026-08-01T01:19:05.797308Z","title":"Sincqdr-vad: A noise-robust voice activity de- tection framework leveraging learnable filters and ranking-aware optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25870","last_updated":"2026-07-28T15:37:44Z","snapshot_observed_at":"2026-08-14T07:05:38.965063Z","submitted_at":"2026-07-28T15:37:44Z","title":"VAD to the Bone: Ultra-Tiny Speech Activity Detection for Edge Deployment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T01:19:05.797308Z"},"links":{"cited_paper":"/paper/2508.20885","citing_paper":"/paper/2607.25870"},"observation_digest":"sha256:36640e8f48e67bd2897f25b46f5f557f14916fb2c8a5f5973fdfad2aa8fe22b1","observation_id":"7c7f35f5-a180-49c6-b2d6-56f0dccd8a09","resolution":{"observed_at":"2026-08-01T01:19:05.797308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.20885/citation-record","integrity":"/paper/2508.20885/integrity","json":"/paper/2508.20885/citation-record.json","paper":"/paper/2508.20885"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:44.052788Z","title":"Speaker diarization with plda i-vector scoring and unsupervised calibration,","venue":null,"work_id":"176cd71d-713b-4a7c-97eb-10f707262f28","year":2014},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.701004Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:4141ccf1b3d7bccb56fa82b5eb072e8144ad066f0237868f96258da3a47484cb","observation_id":"41206a49-d0f4-45ff-b8ea-8662a8d0c9d1","resolution":{"observed_at":"2026-08-05T14:49:44.057516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:44.034879Z","title":"Recurrent neural networks for voice activity detection,","venue":null,"work_id":"792fa6a8-548d-4e85-b340-03a6c39fb6a4","year":2013},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.706148Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:d1ceedcbfa56cc7c65938587edc015f5c3e6f6eb15b9746ac316bbbff815c4a9","observation_id":"2dbc7b90-91db-4380-bb7d-72dd069b0168","resolution":{"observed_at":"2026-08-05T14:49:44.039983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:44.016750Z","title":"Deep belief networks based voice activity detection,","venue":null,"work_id":"0eb16720-fb4a-4c1a-855c-25b4ed553cc2","year":2013},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.710761Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:62a55816abfff881551c52dfee3cc571e55a1d7b381d0a79f23a4022bba28e1a","observation_id":"0f2720d1-5949-442a-8797-05968ab09bbf","resolution":{"observed_at":"2026-08-05T14:49:44.022829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.997223Z","title":"A statistical model-based voice activity detection,","venue":null,"work_id":"0af1f5ae-8b6e-4b2c-810b-97d399d38b05","year":1999},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.715781Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:ec3339e791363c880fd0e557003255aaca08b47ea4fc541ef33b7d883518d97c","observation_id":"bf4087eb-e7ed-4d62-8271-08973fa1426a","resolution":{"observed_at":"2026-08-05T14:49:44.002830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.980790Z","title":"Real-life voice activity detection with LSTM Recurrent neural networks and an appli- cation to Hollywood movies,","venue":null,"work_id":"023e269e-420c-451f-a7a0-f2a8b8e8c0dd","year":2013},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.720912Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:5fe4fffbd88b74e08097264fdb654118f3321a0022287563151cae5d366e6990","observation_id":"87f61e21-83d3-49fa-aa9f-a1eb195b1db4","resolution":{"observed_at":"2026-08-05T14:49:43.985553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1309.1501","last_updated":"2013-12-10T11:51:39Z","snapshot_observed_at":"2026-08-15T00:04:11.274300Z","submitted_at":"2013-09-05T22:06:58Z","title":"Improvements to deep convolutional neural networks for LVCSR","version":3},"cited_work":{"arxiv_id":"1309.1501","doi":null,"metadata_source":"pith","pith_arxiv_id":"1309.1501","snapshot_observed_at":"2026-08-05T14:49:43.368565Z","title":"Improvements to deep convolutional neural networks for LVCSR","venue":"cs.LG","work_id":"f6c95c67-fba6-4111-a7fa-9b428ee2c2c0","year":2013},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.726329Z"},"links":{"cited_paper":"/paper/1309.1501","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:c118d2a83649b13f5578d02a9c870c596c3cb5e7c418129f7aa775a1e034720d","observation_id":"3db13578-2beb-401c-8294-fff79d77a4a3","resolution":{"observed_at":"2026-08-05T14:49:43.377083Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.965473Z","title":"V oice activity detection for transient noisy environment based on diffusion nets,","venue":null,"work_id":"46546d59-f8d6-4ee3-b337-f3ea1fc465ea","year":2019},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.732681Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:9aba0fc190487ff191a9d08f4a9402857148d366711d208cb2673f5867f233b0","observation_id":"a314cb5e-fe30-4cf0-bfc1-0e15b1e62d7f","resolution":{"observed_at":"2026-08-05T14:49:43.970184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.04261","last_updated":"2020-03-14T04:51:06Z","snapshot_observed_at":"2026-08-10T23:50:32.922715Z","submitted_at":"2019-11-08T07:16:27Z","title":"Voice Activity Detection in presence of background noise using EEG","version":5},"cited_work":{"arxiv_id":"1911.04261","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.04261","snapshot_observed_at":"2026-08-05T14:49:43.341614Z","title":"Voice Activity Detection in presence of background noise using EEG","venue":"cs.SD","work_id":"9af17564-c39b-4008-b608-2e4e0d9376bc","year":2019},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.737188Z"},"links":{"cited_paper":"/paper/1911.04261","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:f79286ce29a85883b3560a1b5e09caa0b1b27297438313300bbf36ee81b260d8","observation_id":"9f130d50-6d99-47be-9732-5c9df7cf1986","resolution":{"observed_at":"2026-08-05T14:49:43.346542Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.950272Z","title":"A bin encoding training of a spiking neural network based voice activity detection,","venue":null,"work_id":"a1a1414e-41f9-4d4b-87bb-859305aec58e","year":2020},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.742122Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:a6d0355a36877c7d3490dd8d50269793047053bdae44767e420615ec171d1660","observation_id":"f3eb3cf8-2e3f-4687-86a3-225b7d727dac","resolution":{"observed_at":"2026-08-05T14:49:43.954696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.934071Z","title":"V oice activity detection in the wild via weakly supervised sound event detection,","venue":null,"work_id":"d54bb2e9-0471-4de8-a60e-8b276fdf1dda","year":2020},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.746458Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:7250b1cc570874044d8b67b56453ab6d96325b08d3317cec871e1507c5a436d6","observation_id":"b9685b7d-1dce-4633-ade0-3944ab38c8ff","resolution":{"observed_at":"2026-08-05T14:49:43.938689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.919904Z","title":"Spiking neural networks trained with backpropagation for low power neuromorphic implementation of voice activity detection,","venue":null,"work_id":"41987045-692b-43bc-b6f9-6c0a39899083","year":2020},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.751118Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:58a744e703c44e5957d9e5dd9500b5e9e35de052d87ac46454bd55b3b08fd0a0","observation_id":"10b2d720-1693-4003-af34-14e7ebd62d2a","resolution":{"observed_at":"2026-08-05T14:49:43.924373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.904225Z","title":"End-to-end domain-adversarial voice activity detection,","venue":null,"work_id":"0581aaed-e064-46cf-a76a-026e511af222","year":2020},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.755250Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:ca94d1777e804a3fb98b91910f8af8adf595e23a25951dd92b53a55adbcd365d","observation_id":"1aebecaa-0757-4573-8db0-f1c05a8565f1","resolution":{"observed_at":"2026-08-05T14:49:43.909145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.889603Z","title":"End-to-end automatic speech recognition integrated with CTC-based voice activity detection,","venue":null,"work_id":"90af8a84-3b58-4627-8511-7e9872e54c7b","year":2020},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.759421Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:7cc5b611b32cfc13c594b2a6481bd03604d19d7bbd586418a7e54a7f659020ec","observation_id":"1e553804-18fb-4f79-a178-a79e3a08314a","resolution":{"observed_at":"2026-08-05T14:49:43.894154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.874098Z","title":"V oice activity detection in the wild: A data-driven approach using teacher-student training,","venue":null,"work_id":"37be88f6-e63c-460d-bad7-09db322eaac1","year":2021},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.763503Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:7019908dd8cf58ce1866975caee07dd5c62730a6150d055c05b2134bb1a2f1e4","observation_id":"cd92ff4a-2bcf-4404-9344-6904a011a4f8","resolution":{"observed_at":"2026-08-05T14:49:43.879321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.859608Z","title":"Improvement of noise-robust single-channel voice activity detection with spatial pre-processing,","venue":null,"work_id":"d8a75e7e-57e1-425d-aa76-06bc62ca7687","year":2021},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.767750Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:37887e8841829bad22163375cd6de524b18665ccaa32aafc2f5dbbc714c8856b","observation_id":"985e4b4b-e2ea-4470-9c08-d925f4e660c1","resolution":{"observed_at":"2026-08-05T14:49:43.864033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.845116Z","title":"A lightweight framework for online voice activity detection in the wild,","venue":null,"work_id":"c5c660b1-3ba5-4f4a-a368-fe256ff278a8","year":2021},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.771891Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:1dfc32f39a0fd35a7ce06cfb64d13f379d03bd188511b9183da71e7409d642cf","observation_id":"bbca8a5e-4dbb-4ebb-9b2b-b93e339d5c45","resolution":{"observed_at":"2026-08-05T14:49:43.849679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11061","last_updated":"2022-09-22T14:53:44Z","snapshot_observed_at":"2026-08-16T16:30:35.894788Z","submitted_at":"2022-09-22T14:53:44Z","title":"Cross-domain Voice Activity Detection with Self-Supervised Representations","version":1},"cited_work":{"arxiv_id":"2209.11061","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.11061","snapshot_observed_at":"2026-08-05T14:49:43.315722Z","title":"Cross-domain Voice Activity Detection with Self-Supervised Representations","venue":"eess.AS","work_id":"6dd5c759-ee79-4255-bfc2-5ed5e79b6569","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.776113Z"},"links":{"cited_paper":"/paper/2209.11061","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:bf631ef7b2806267a0e4b98b01f8b22f04fbb6f723686e766cf9680c22186f49","observation_id":"16344eb1-0c78-495d-b1d0-c95af5789bd1","resolution":{"observed_at":"2026-08-05T14:49:43.321256Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.01691","last_updated":"2022-07-04T19:43:09Z","snapshot_observed_at":"2026-08-16T16:48:24.289921Z","submitted_at":"2022-07-04T19:43:09Z","title":"Adversarial Multi-Task Deep Learning for Noise-Robust Voice Activity Detection with Low Algorithmic Delay","version":1},"cited_work":{"arxiv_id":"2207.01691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.01691","snapshot_observed_at":"2026-08-05T14:49:43.290383Z","title":"Adversarial Multi-Task Deep Learning for Noise-Robust Voice Activity Detection with Low Algorithmic Delay","venue":"eess.AS","work_id":"6aae0a0a-3ace-45f6-828d-79d5e81a3646","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.780832Z"},"links":{"cited_paper":"/paper/2207.01691","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:02dc75fbd4f452703dca355c79b849cdcb93e51f78cf41d1b4a69dab00f3c784","observation_id":"e69d231e-5623-4830-9b34-425d4dcc674b","resolution":{"observed_at":"2026-08-05T14:49:43.296437Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.02996","last_updated":"2022-12-06T14:14:00Z","snapshot_observed_at":"2026-08-16T16:10:37.503877Z","submitted_at":"2022-12-06T14:14:00Z","title":"BC-VAD: A Robust Bone Conduction Voice Activity Detection","version":1},"cited_work":{"arxiv_id":"2212.02996","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.02996","snapshot_observed_at":"2026-08-05T14:49:43.266680Z","title":"BC-VAD: A Robust Bone Conduction Voice Activity Detection","venue":"eess.AS","work_id":"9dd1e754-d0a0-41da-ad09-85b74d6e59a0","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.785836Z"},"links":{"cited_paper":"/paper/2212.02996","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:b828eac74bce256acab92005ccf1c6af0cdbf12478006bfd8058ea9645e6d5c1","observation_id":"4ae54ad8-3159-47d4-82de-de2f1cdd8cea","resolution":{"observed_at":"2026-08-05T14:49:43.271671Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.830378Z","title":"Unsupervised voice activity detection by modeling source and system information using zero frequency filtering,","venue":null,"work_id":"2d8625bd-a17c-466b-8383-1b6c80a884b9","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.790532Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:9918caea2fdafe87de9319f3ce3b54b6c829318b89a0549510980009f7babd3a","observation_id":"f527fc5e-afca-414e-949b-df073b7f6174","resolution":{"observed_at":"2026-08-05T14:49:43.835148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02944","last_updated":"2022-03-06T11:52:00Z","snapshot_observed_at":"2026-08-16T17:16:40.160064Z","submitted_at":"2022-03-06T11:52:00Z","title":"CNN self-attention voice activity detector","version":1},"cited_work":{"arxiv_id":"2203.02944","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.02944","snapshot_observed_at":"2026-08-05T14:49:43.240537Z","title":"CNN self-attention voice activity detector","venue":"cs.SD","work_id":"666253ae-2f25-49f8-869a-ce6c6da0e71c","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.794635Z"},"links":{"cited_paper":"/paper/2203.02944","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:8e37139d5d7fef2e27114ac0748fef744110b513fe6010c6ba32a43682a1c1bf","observation_id":"edbebfd4-177c-44fe-819a-594f8a1d9c03","resolution":{"observed_at":"2026-08-05T14:49:43.246555Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05815","last_updated":"2023-12-10T08:17:21Z","snapshot_observed_at":"2026-08-17T10:41:36.197022Z","submitted_at":"2023-12-10T08:17:21Z","title":"Voice Activity Detection (VAD) in Noisy Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05815","snapshot_observed_at":"2026-08-05T14:49:42.798923Z","title":"V oice activity detection (V AD) in noisy environments,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.798923Z"},"links":{"cited_paper":"/paper/2312.05815","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:52098be1724e4c7401b4e64ee2a75f86e7e85326cd8bc190dbdb459bee0e7f96","observation_id":"3d98060d-e406-4277-9ed6-c2cd0d7ffbe0","resolution":{"observed_at":"2026-08-05T14:49:42.798923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.815350Z","title":"Semantic V AD: Low-latency voice activity detection for speech interaction,","venue":null,"work_id":"53251933-840c-4516-9833-7e1d47f8acea","year":2023},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.803488Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:dc6eb0802738d20682a1f6ea4fc014e400e87f133c4454b99487380cee20aa51","observation_id":"8e52a4d0-086d-43f2-a670-026657c1eef3","resolution":{"observed_at":"2026-08-05T14:49:43.820132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.800711Z","title":"Real-time causal spectro-temporal voice activity detection based on convolutional encoding and residual decoding,","venue":null,"work_id":"ed8d39e4-d13a-40da-aebc-75bb87bb8e86","year":2023},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.807602Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:652f784993c31e42ad0ce01e9419988b5beb2ab5f890f408b659663de75f37f0","observation_id":"ef9380ea-903d-4011-a8f9-0d84516f4adb","resolution":{"observed_at":"2026-08-05T14:49:43.805427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14509","last_updated":"2024-10-18T14:43:34Z","snapshot_observed_at":"2026-08-16T13:08:00.998629Z","submitted_at":"2024-10-18T14:43:34Z","title":"CLIP-VAD: Exploiting Vision-Language Models for Voice Activity Detection","version":1},"cited_work":{"arxiv_id":"2410.14509","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.14509","snapshot_observed_at":"2026-08-05T14:49:43.196833Z","title":"CLIP-VAD: Exploiting Vision-Language Models for Voice Activity Detection","venue":"cs.CV","work_id":"26929588-8309-499b-9210-9b92c713d372","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.812464Z"},"links":{"cited_paper":"/paper/2410.14509","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:553e6ea30748655a341ccd992599438c25b0130123fd5671bef078c59b2acde2","observation_id":"e5d8c046-3ef0-4443-ae98-517deafa40f6","resolution":{"observed_at":"2026-08-05T14:49:43.201786Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16797","last_updated":"2024-05-27T03:31:16Z","snapshot_observed_at":"2026-08-16T13:49:12.930863Z","submitted_at":"2024-05-27T03:31:16Z","title":"A Real-Time Voice Activity Detection Based On Lightweight Neural","version":1},"cited_work":{"arxiv_id":"2405.16797","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.16797","snapshot_observed_at":"2026-08-05T14:49:43.170824Z","title":"A Real-Time Voice Activity Detection Based On Lightweight Neural","venue":"cs.SD","work_id":"23fe9947-a60e-4ef5-8b3a-12ea0ff2e477","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.817480Z"},"links":{"cited_paper":"/paper/2405.16797","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:5912c0735ce4bbb5e78005b535b6ca9ebc38692da80d85b62b26a5300030b80e","observation_id":"e116c1cc-14a5-4e62-aad3-0cff34a938cd","resolution":{"observed_at":"2026-08-05T14:49:43.176117Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.785290Z","title":"A Transformer-based voice activity detector,","venue":null,"work_id":"5f85b36d-d99d-42fd-af47-60095dd2ff1a","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.823583Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:603f71724644914f325e708d25f413682c71d192613327cb53752993a507cbf2","observation_id":"0222f0a4-49c9-4dac-a2d2-052d6cf1e654","resolution":{"observed_at":"2026-08-05T14:49:43.790203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.768119Z","title":"Robust voice activity detection using locality- sensitive hashing and residual frequency-temporal attention,","venue":null,"work_id":"5feda050-bf1a-43bb-b386-79b4cf75e7e7","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.828785Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:1ceb885f65d41f12d1fd9e21d4fe73a4716efd9085b1b26758c6aa785125be05","observation_id":"a3a6b1dd-8143-4efd-ae12-fe9744aa0770","resolution":{"observed_at":"2026-08-05T14:49:43.773172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.751640Z","title":"Channel- combination algorithms for robust distant voice activity and overlapped speech detection,","venue":null,"work_id":"a17152c3-43b2-4d61-93f5-8160b2b8c3e2","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.833400Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:5f4dbf123cc438c64dce1a68c46338980e1203e769dd0ae8c9722f4af4cd8d04","observation_id":"b3880b40-3083-4d1b-8456-2fc45190f2f8","resolution":{"observed_at":"2026-08-05T14:49:43.756335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.737499Z","title":"sV AD: A robust, low-power, and light-weight voice activity detection with spiking neural networks,","venue":null,"work_id":"b541f805-0975-4272-9f24-66f35a7c8e74","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.837894Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:26e571758298eff58aa5a68555ea6e57fa27f49f3c579a686a6015252da048e8","observation_id":"98db8661-c0f8-493d-bdea-ccfb72681f32","resolution":{"observed_at":"2026-08-05T14:49:43.741894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.722948Z","title":"Robust speech activity detection in movie audio: Data resources and experimental evaluation,","venue":null,"work_id":"d17af236-e930-4629-89e1-6943951005ae","year":2019},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.843320Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:c540ee9f9cf051fd35b49fb6663627f46d94f9663e7846c409618c40ec38fdff","observation_id":"ddd52716-7639-427b-8378-b7969cd7659c","resolution":{"observed_at":"2026-08-05T14:49:43.727394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.708362Z","title":"MarbleNet: Deep 1D time- channel separable convolutional neural network for voice activity de- tection,","venue":null,"work_id":"30009117-f969-454f-b838-a90351770f64","year":2021},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.848551Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:cf13aa2cb4685a114c30e2ae2513f4e7d63e3737a32be15a0ae2ec67ae473b92","observation_id":"d0a1064d-94f5-4fa6-ac49-2045e305a5b8","resolution":{"observed_at":"2026-08-05T14:49:43.712574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.693554Z","title":"SG-V AD: Stochastic gates based speech activity detection,","venue":null,"work_id":"bcbbd7e1-8ba4-417c-83f3-44b47557a94b","year":2023},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.853848Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:1907d9a1b7be61d8053b71c0df3d3fc5456db24b8fd9d2e29ea39c02daf647a2","observation_id":"6dda8084-4b71-4c89-9565-42d88ffd4b56","resolution":{"observed_at":"2026-08-05T14:49:43.698226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.679109Z","title":"ResectNet: An efficient architecture for voice activity detection on mobile devices,","venue":null,"work_id":"d09fa5be-2fbf-4fee-a4a5-92e526d96a0c","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.858738Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:c6f76c793d6da3be788d46720c4190dbaa39e0fbd74a726501ce144fe8242e36","observation_id":"87219fda-8bfc-40bf-9342-ceb9b95126a4","resolution":{"observed_at":"2026-08-05T14:49:43.683484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.662659Z","title":"Small-footprint convolutional neural network with reduced feature map for voice activity detection,","venue":null,"work_id":"18d70e75-62fa-4ff4-953d-a166e6918e2a","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.864378Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:c9c0170bd558c8ac9c7f3e7f0ce6728f56b498d47a7a89fb2452e3dfa5e3f6b1","observation_id":"75ea1723-de44-4457-9665-d0db7ea690af","resolution":{"observed_at":"2026-08-05T14:49:43.668467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.647984Z","title":"A tutorial on the cross-entropy method,","venue":null,"work_id":"f28ec9c0-48be-4ec6-b69e-eb05429de5de","year":2005},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.869397Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:38b8c57d41edc64e3b3eb53e01fb97e7b36d84187dcf7568543bd5cbfb4e7dd8","observation_id":"efc34114-a6d6-4920-b41e-1c1598bb2d21","resolution":{"observed_at":"2026-08-05T14:49:43.652463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.631577Z","title":"Speaker recognition from raw waveform with SincNet,","venue":null,"work_id":"eba8591a-f938-415b-9be7-ec0faab3277e","year":2018},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.874203Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:0ebeb512e53f228489173cc01a88bcd4b8c83c53f695dcbe36028196d7755704","observation_id":"a1cb42ce-257d-4650-85d0-5d0b14776bda","resolution":{"observed_at":"2026-08-05T14:49:43.637124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.616898Z","title":"Learning filterbanks from raw speech for phone recogni- tion,","venue":null,"work_id":"35de0b5d-fa47-45b3-8fc8-9e60cd50318b","year":2018},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.879142Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:801b1ddb8ec66c199e11cc04f772a44b3a010efb41970494d8cd9e214fd2ad36","observation_id":"c9a173b0-f917-495a-b68b-2f025224a602","resolution":{"observed_at":"2026-08-05T14:49:43.621222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.601423Z","title":"What do neural networks listen to? Exploring the crucial bands in speech enhancement using sinc- convolution,","venue":null,"work_id":"e45e0b72-0533-4566-a8dc-af0362470512","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.884420Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:f2bd1e6c0a79938c013e622a99af13e206f62e482205e8439a7696dd9cb4a541","observation_id":"acb89ee0-35ad-4b09-99b5-7a2bd63fa977","resolution":{"observed_at":"2026-08-05T14:49:43.606115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.585550Z","title":"Speaker conditional sinc-extractor for personal V AD,","venue":null,"work_id":"2012ea4d-1e1e-4934-9f7c-c153a6ec67b8","year":2024},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.894442Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:b3f54728eb6f357aa9641260547381414964ede1e650fd72e3b513079ddb02ae","observation_id":"7ef9e80b-6ba5-41dc-bd55-5664c297cdd8","resolution":{"observed_at":"2026-08-05T14:49:43.591213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14177","last_updated":"2022-07-04T18:49:54Z","snapshot_observed_at":"2026-08-16T17:11:34.248145Z","submitted_at":"2022-03-27T00:47:00Z","title":"Benchmarking Deep AUROC Optimization: Loss Functions and Algorithmic Choices","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14177","snapshot_observed_at":"2026-08-05T14:49:42.900316Z","title":"Benchmarking deep AUROC opti- mization: Loss functions and algorithmic choices,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.900316Z"},"links":{"cited_paper":"/paper/2203.14177","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:abf59b9e1a554dd8bac802f0464f176fcf68a9b1588afaed8c7b9c5148c08b4f","observation_id":"1a9daf2f-ecb2-4a92-bdfc-5377cdd54649","resolution":{"observed_at":"2026-08-05T14:49:42.900316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.570873Z","title":"AUC optimization for deep learning-based voice activity detection,","venue":null,"work_id":"929e8be8-0ac0-4464-991e-eab2dc30459a","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.905170Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:a888d991deec45a7f8517df200212733acab3e27b1e85ae58a2179d6c57fec95","observation_id":"3f8b449d-50e9-41e7-8835-a6a9583ef32d","resolution":{"observed_at":"2026-08-05T14:49:43.575376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.554656Z","title":"A V A- speech: A densely labeled dataset of speech activity in movies,","venue":null,"work_id":"ecf9473e-7e31-4695-94b0-b74b43a1b1cf","year":2018},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.910100Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:6ea5399ce5819cfe1a11c7a00bdba0a05649d86267a79d3ae0d1251234a04fca","observation_id":"54362b12-4ffd-4e54-897f-d45597d97990","resolution":{"observed_at":"2026-08-05T14:49:43.559608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.539036Z","title":"V oice activity detection using an adaptive context attention model,","venue":null,"work_id":"e45d4018-235d-4db2-80c0-a6c3c772da6f","year":2018},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.914341Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:e81b7eaecbf8812ca97446dd31471d8b4a59c4980d21499d2abb4862cbb2223b","observation_id":"84594d4c-c55e-4525-8666-456fb60d4f44","resolution":{"observed_at":"2026-08-05T14:49:43.543533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.522814Z","title":"Some windows with very good sidelobe behavior,","venue":null,"work_id":"0fb807a9-beba-43a6-8850-86cb683c954b","year":1981},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.919034Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:800e6e07bd49c422d9ed914e2aaffb73a171ef972da0a0822502d3655545114b","observation_id":"ddfa9fef-7710-4bd4-857f-69950e13cb28","resolution":{"observed_at":"2026-08-05T14:49:43.527572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04552","last_updated":"2017-11-29T14:51:40Z","snapshot_observed_at":"2026-08-13T11:54:46.030796Z","submitted_at":"2017-08-15T15:21:53Z","title":"Improved Regularization of Convolutional Neural Networks with Cutout","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04552","snapshot_observed_at":"2026-08-05T14:49:42.923495Z","title":"Improved regularization of convolutional neural networks with cutout,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.923495Z"},"links":{"cited_paper":"/paper/1708.04552","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:9b081e9ce91a11b3eb57e2a858821ef4c660a47158a4214b4b039d0eda4a01c8","observation_id":"3f3cd6b5-f731-4580-ad3d-cf9627c35950","resolution":{"observed_at":"2026-08-05T14:49:42.923495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.01271","last_updated":"2018-04-19T14:32:38Z","snapshot_observed_at":"2026-08-13T10:37:24.864456Z","submitted_at":"2018-03-04T00:20:29Z","title":"An Empirical Evaluation of Generic Convolutional and Recurrent Networks for Sequence Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.01271","snapshot_observed_at":"2026-08-05T14:49:42.928100Z","title":"An empirical evaluation of generic convolutional and recurrent networks for sequence modeling,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.928100Z"},"links":{"cited_paper":"/paper/1803.01271","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:818754e21281522d26b9fd19a29fc88ae371bf99120630cda04ed1f7f906242b","observation_id":"80114a2f-a268-47e0-8ded-0620919cade5","resolution":{"observed_at":"2026-08-05T14:49:42.928100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.507164Z","title":"CSPNet: A new backbone that can enhance learning capability of CNN,","venue":null,"work_id":"9a12ae34-d011-4f33-82e5-f78136d9e80e","year":2020},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.933047Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:e4a73f2feb88d74d066c7c631b66bcefa6ae61e91f7a8a1f514bb4380969f924","observation_id":"d7af3662-94ba-4a17-bcc7-828ffc2beb61","resolution":{"observed_at":"2026-08-05T14:49:43.511760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.03209","last_updated":"2018-04-09T19:58:17Z","snapshot_observed_at":"2026-08-15T16:28:51.252929Z","submitted_at":"2018-04-09T19:58:17Z","title":"Speech Commands: A Dataset for Limited-Vocabulary Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.03209","snapshot_observed_at":"2026-08-05T14:49:42.937483Z","title":"Speech commands: A dataset for limited-vocabulary speech recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.937483Z"},"links":{"cited_paper":"/paper/1804.03209","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:28f399235ec2b7a525631edb0dc6feb20085635f386a717696571c8a7c12c875","observation_id":"ead2a22f-3c70-4941-bba7-ad1435ecd44d","resolution":{"observed_at":"2026-08-05T14:49:42.937483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.492351Z","title":"Freesound technical demo,","venue":null,"work_id":"33f77240-7e73-4516-9e31-83820966bbf9","year":2013},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.942123Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:3fddae8c29e590a608e3f22579dcb0134a0c4dc94bbb8ecc297f41f1ede0f81d","observation_id":"ad5b5b0d-7f68-4134-b605-5646b58dbf92","resolution":{"observed_at":"2026-08-05T14:49:43.496559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.476769Z","title":"ESC: Dataset for environmental sound classification,","venue":null,"work_id":"af24db8c-8d64-4a46-b352-e478e72bcd36","year":2015},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.946726Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:931ee8d812c8ccf5f577cac44e79f8a85f4a32f178209d5ba2f0413ee48f2eb9","observation_id":"c28ff099-3e12-4586-af27-e7c766264015","resolution":{"observed_at":"2026-08-05T14:49:43.481344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04747","last_updated":"2017-06-15T13:21:04Z","snapshot_observed_at":"2026-08-15T03:49:17.013617Z","submitted_at":"2016-09-15T17:32:34Z","title":"An overview of gradient descent optimization algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.04747","snapshot_observed_at":"2026-08-05T14:49:42.951225Z","title":"An overview of gradient descent optimization algorithms,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.951225Z"},"links":{"cited_paper":"/paper/1609.04747","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:82136c3b8acbe990fd0aa4e2f73ff1977941c75ec3d81e1b30fd8dd1289155e1","observation_id":"4c94215b-384e-4117-b362-57c8cf59b289","resolution":{"observed_at":"2026-08-05T14:49:42.951225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.460332Z","title":"Bag of tricks for image classification with convolutional neural networks,","venue":null,"work_id":"bc1e401d-9367-4e53-8925-4c51424c8f18","year":2019},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.955788Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:f8f36fea89c1b8e60dbb66ca445f3914a540bbe857fac36551d5c5e9b4bcef47","observation_id":"e16e2485-335c-493a-a01c-3b606b7e97cc","resolution":{"observed_at":"2026-08-05T14:49:43.464971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.444721Z","title":"The use of the area under the ROC curve in the evaluation of machine learning algorithms,","venue":null,"work_id":"ca0a4878-3d98-450b-9601-112558d1f94a","year":1997},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.960601Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:5249f9ddec804239553ea8709f62c59fc274893c6f8cbac4d666c211a5ce58fe","observation_id":"79174a5d-71b9-481b-a81c-da4c63f1fe87","resolution":{"observed_at":"2026-08-05T14:49:43.449297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.427762Z","title":"A hybrid CNN-BiLSTM voice activity detector,","venue":null,"work_id":"da187175-c5db-43e9-9205-b4cbd3b122ef","year":2021},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.965345Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:e45cd4eb3c124d6b2508ac14b08be5e92d6ed97265b1fbf6c2d66c7dfa2fe218","observation_id":"c80f3cc1-fda4-490c-aacc-a3e323b16508","resolution":{"observed_at":"2026-08-05T14:49:43.433058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.410774Z","title":"ADA-V AD: Unpaired adversarial domain adaptation for noise-robust voice activity detection,","venue":null,"work_id":"7adb1c8e-7557-40c3-b649-f61ad2c57f10","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.971084Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:0b706cb40f4a14c61984c0759936f71d543cb2f11c8e00cbfcef0e1ac4b5251d","observation_id":"003ba52d-3337-43e3-aa15-148607eb391a","resolution":{"observed_at":"2026-08-05T14:49:43.415346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:49:43.392260Z","title":"NAS-V AD: Neural architecture search for voice activity detection,","venue":null,"work_id":"48dd9210-f08d-40a3-bea1-7d57129f37e5","year":2022},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.977622Z"},"links":{"citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:264f801cf17c4da5f209986e5113bb801f05306008fbc84990faf5ea5317bb0d","observation_id":"087a0ee7-f6ea-4f17-9832-bc406f8fe59a","resolution":{"observed_at":"2026-08-05T14:49:43.398494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.07445","last_updated":"2021-05-19T12:30:15Z","snapshot_observed_at":"2026-08-16T18:45:33.357413Z","submitted_at":"2021-02-15T10:37:14Z","title":"On training targets for noise-robust voice activity detection","version":2},"cited_work":{"arxiv_id":"2102.07445","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.07445","snapshot_observed_at":"2026-08-05T14:49:43.050871Z","title":"On training targets for noise-robust voice activity detection","venue":"eess.AS","work_id":"8459006b-ffd4-4a83-95fc-b46106508a52","year":2021},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.983421Z"},"links":{"cited_paper":"/paper/2102.07445","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:83eca1cdc77cd1bd3537c1d01f8db779c5d147bcb13612a83ab85976fe6a79d2","observation_id":"c78bbc80-256c-46ae-94fe-5952daa52642","resolution":{"observed_at":"2026-08-05T14:49:43.058024Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-08-17T20:47:46.242385Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-05T14:49:42.989313Z","title":"Mamba: Linear-time sequence modeling with selective state spaces,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:42.989313Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2508.20885"},"observation_digest":"sha256:60de14f630f8878b544eafd7420fb46a2801d6c52615535916ef6f02ec67ac7e","observation_id":"94456352-0719-4867-9cbb-088ea2bc42a3","resolution":{"observed_at":"2026-08-05T14:49:42.989313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.20885","last_updated":"2025-08-28T15:14:39Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-05T14:49:40.095904Z","submitted_at":"2025-08-28T15:14:39Z","title":"SincQDR-VAD: A Noise-Robust Voice Activity Detection Framework Leveraging Learnable Filters and Ranking-Aware Optimization"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":9,"verified_fuzzy":43},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 1 inbound Pith citation observation for arXiv:2508.20885."}