{"as_of":"2026-08-09T07:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5d2f17b3ae45bec76983181492c8a5b17878856e32b3fe18472c8abc8fdf5e89","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T14:47:16.214424Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T14:47:14.238419Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.18658","snapshot_observed_at":"2026-08-01T14:47:14.238419Z","title":"The ge- ometric variations across different arrays make it difficult to merge existing datasets into a unified, large-scale training cor- pus","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.238419Z"},"links":{"cited_paper":"/paper/2607.18658","citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:3d58f676bc9c8cac329670137e8235b679affbfb26fbaa25f6efd953622eaa54","observation_id":"098ec478-e828-4094-927b-0a434f2d313c","resolution":{"observed_at":"2026-08-01T14:47:14.238419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.18658/citation-record","integrity":"/paper/2607.18658/integrity","json":"/paper/2607.18658/citation-record.json","paper":"/paper/2607.18658"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.18658","snapshot_observed_at":"2026-08-01T14:47:14.238419Z","title":"The ge- ometric variations across different arrays make it difficult to merge existing datasets into a unified, large-scale training cor- pus","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.238419Z"},"links":{"cited_paper":"/paper/2607.18658","citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:3d58f676bc9c8cac329670137e8235b679affbfb26fbaa25f6efd953622eaa54","observation_id":"098ec478-e828-4094-927b-0a434f2d313c","resolution":{"observed_at":"2026-08-01T14:47:14.238419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:14.352723Z","title":"Input features are stacked along the channel dimension, and inter-channel infor- mation is fused within the layer to form the output [10, 11]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.352723Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:ed3acd8c640b2a4e022ac0c2d3870f55011166c615f50109c068988bf885059d","observation_id":"e8946a9f-599c-4e39-9ca1-b97321429d58","resolution":{"observed_at":"2026-08-01T14:47:14.352723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:14.514726Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.514726Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:b2921613a03214db304d583892d73cd154b89071dd68ce10e1557950f4a9bce9","observation_id":"b7c58c4f-3c7b-4ef2-a909-b10a3e5f4752","resolution":{"observed_at":"2026-08-01T14:47:14.514726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:14.612712Z","title":"Impact of Fixed vs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.612712Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:ec1a61ac1b2fd6935da337b0736f0c460c67e24d9c51d6606b01f4c6702e04ee","observation_id":"33da09ee-1385-4128-8cde-6f2716fe0b55","resolution":{"observed_at":"2026-08-01T14:47:14.612712Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:14.681917Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.681917Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:8e753477030172a70e4f63fce6645f1208bf9780d939e0055142a42cfd012bdd","observation_id":"6fc53ebb-4071-4bae-8c25-ec5b0461489d","resolution":{"observed_at":"2026-08-01T14:47:14.681917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:14.834046Z","title":"U25A20409, and in part by SJTU Med-X (Medicine & Engineering) Translational Research Grant (YG2025LC09)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.834046Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:8ac2a63237052e82ce5b799c3f7950eb2fc49da1fe2663ac3b3c8abaad227ae0","observation_id":"24026e50-30ee-4d1b-8b3b-c5c9ff09940d","resolution":{"observed_at":"2026-08-01T14:47:14.834046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:14.939236Z","title":"All scientific content, ideas, analysis, and conclusions are original and fully authored by the researchers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:14.939236Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:d3c5fb79bc67985c699f26efe6a063cb0c0b49b29c1a48e60193751fd083d0f9","observation_id":"52c68b56-89a5-475d-abdc-eee3a1c64aed","resolution":{"observed_at":"2026-08-01T14:47:14.939236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.019958Z","title":"SenSE: Semantic-aware high-fidelity universal speech enhancement,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.019958Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:fb8630d1b547c802edada447f7fe28033afbcec8ab8b8c5199baa5d644774c81","observation_id":"bf94a1e9-040c-43ae-b338-f2b2324bd4a8","resolution":{"observed_at":"2026-08-01T14:47:15.019958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.390874Z","title":"DNN-based geometry- invariant DOA estimation with microphone positional encoding and complexity gradual training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.390874Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:d07d580d1272574d41cdfce58acf074cf27b542a98a24a0f64bfb0629a2ed88f","observation_id":"f0119d4b-071c-4600-936b-06704a5ae9f2","resolution":{"observed_at":"2026-08-01T14:47:15.390874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.086359Z","title":"AnyEnhance: A unified generative model with prompt-guidance and self-critic for voice enhancement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.086359Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:25f1b7b200065d14110777f83dae1cea88258f71e4e91f67dbcc4f37a9408bff","observation_id":"a464dd8f-b77b-4de0-ab51-d6efcb5eb7f6","resolution":{"observed_at":"2026-08-01T14:47:15.086359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.122307Z","title":"End-to- end microphone permutation and number invariant multi-channel speech separation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.122307Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:332b71e2ebfd7ba92eb6a61ed50fc068a8215b4b30efd3bde421707eac4af091","observation_id":"ef4b40e5-5d89-49fc-b7e3-c9eddc8c7901","resolution":{"observed_at":"2026-08-01T14:47:15.122307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.164002Z","title":"TPARN: Triple-path attentive recurrent network for time-domain multichannel speech enhancement,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.164002Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:ab8e84d72fb1504ee09c91b29faa0ed1aec18330823e2b948047d2cc7c17ec2a","observation_id":"6f1eb3e5-6f50-4b62-9055-b8ff512afca5","resolution":{"observed_at":"2026-08-01T14:47:15.164002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.211397Z","title":"Improving design of in- put condition invariant speech enhancement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.211397Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:c0321a58952bd1957405c28be16b549c74e7c0191618f439865b3dbf271fdf8f","observation_id":"bc288d78-d7a0-4a3a-8079-e20bad8b2841","resolution":{"observed_at":"2026-08-01T14:47:15.211397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.14855","last_updated":"2026-07-01T07:15:38Z","snapshot_observed_at":"2026-08-09T00:38:18.948282Z","submitted_at":"2025-09-18T11:22:00Z","title":"AmbiDrop: Array-Agnostic Speech Enhancement Using Ambisonics Encoding and Dropout-Based Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.14855","snapshot_observed_at":"2026-08-01T14:47:15.259938Z","title":"AmbiDrop: Array-agnostic speech enhancement using ambisonics encoding and dropout- based learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.259938Z"},"links":{"cited_paper":"/paper/2509.14855","citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:4aa73d91067ac58b4a95b92ba7432a44ec68d333cf7bd15eea209e07515576e8","observation_id":"be6a1abf-efc3-44d1-8af0-8d8d993f8aba","resolution":{"observed_at":"2026-08-01T14:47:15.259938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.309007Z","title":"UniArray: Unified spectral-spatial modeling for array-geometry-agnostic speech separation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.309007Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:ce0bc7aba44a2a01f47649338cf35a1c4c4c17cf63241c601f405168211099a6","observation_id":"63cb14ad-d358-44fe-9541-771eef592f21","resolution":{"observed_at":"2026-08-01T14:47:15.309007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.359868Z","title":"A memory-based gravitational search al- gorithm for enhancing minimum variance distortionless response beamforming,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.359868Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:f273c40d600eb3673f1eb5773dd4319e2e7399287e3e38815f0219d7a3f878ed","observation_id":"cc8cdf1d-f9fb-4cd8-b90f-c15c70256534","resolution":{"observed_at":"2026-08-01T14:47:15.359868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.855365Z","title":"TF-GridNet: Integrating full- and sub-band modeling for speech separation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.855365Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:efc9f1f607ce2c8cff4fb8301fd3e20e92676881dee037f18f4cef5263ab0920","observation_id":"072a0c16-3ecf-4eaa-89e4-925c094e5186","resolution":{"observed_at":"2026-08-01T14:47:15.855365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.438047Z","title":"Beam-TasNet: Time-domain audio separation net- work meets frequency-domain beamformer,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.438047Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:a5cd946884185851e7fd4f4945afe82e84f630f62ba2cc54bf7b7ff240e021fa","observation_id":"40156162-b37a-49e7-8b50-685bfab7869b","resolution":{"observed_at":"2026-08-01T14:47:15.438047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.485664Z","title":"Closing the gap between time-domain multi-channel speech enhancement on real and simulation conditions,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.485664Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:f62476832996484d60c9b552ed1132b25dda940b2a1a6d77aeb74ce174e438f8","observation_id":"9e9a9017-c9e1-4178-9e8c-ca7181aa7e4e","resolution":{"observed_at":"2026-08-01T14:47:15.485664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.534881Z","title":"NeRF: Representing scenes as neural radiance fields for view synthesis,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.534881Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:52989ff7a821f999128fdb3d48b3b2b4cd9f4ee86f4e55babce8efda36f918fb","observation_id":"331ef254-5a55-4017-8117-a10402d06f1f","resolution":{"observed_at":"2026-08-01T14:47:15.534881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.583084Z","title":"Learning neural acoustic fields,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.583084Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:630047820a43d046ce624bfc278652dfb21f6318df86edf51b0de446d4fc9f96","observation_id":"1a38d113-4b79-4837-b8d7-6aa3718ee59a","resolution":{"observed_at":"2026-08-01T14:47:15.583084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.630613Z","title":"RealMAN: A real-recorded and anno- tated microphone array dataset for dynamic speech enhancement and localization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.630613Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:c97e65aa6c7f0711d733f1b2891ee39098f24bb31e688dfdcfa03010d187e4df","observation_id":"c8299703-9838-4b1d-a987-bb6a06621bdd","resolution":{"observed_at":"2026-08-01T14:47:15.630613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.652676Z","title":"Music source separation with band-split RNN,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.652676Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:a40f132ec9c62c522fee6f9d97a53d356640afb910e5e64968d86652df60a031","observation_id":"977a3356-433a-417d-91bc-b68b2e2b5161","resolution":{"observed_at":"2026-08-01T14:47:15.652676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:15.752642Z","title":"SpatialNet: Extensively learning spatial in- formation for multichannel joint speech separation, denoising and dereverberation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.752642Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:e03be76a5e664eb2890f975f080ff43923ecaac6f4a845237f337dbb511c236d","observation_id":"af068860-f786-4829-a3f4-2b8b79e39dd7","resolution":{"observed_at":"2026-08-01T14:47:15.752642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14623","last_updated":"2026-06-03T05:46:56Z","snapshot_observed_at":"2026-08-05T18:25:38.030161Z","submitted_at":"2025-08-20T11:22:11Z","title":"A Study of the Scale Invariant Signal to Distortion Ratio in Speech Separation with Noisy References","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14623","snapshot_observed_at":"2026-08-01T14:47:15.959730Z","title":"A study of the scale invariant signal to distortion ratio in speech separation with noisy references,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.959730Z"},"links":{"cited_paper":"/paper/2508.14623","citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:e66ac67a7177230ca5e8ee979082bd149180a8082ed0d8934b3cb3efe6130dab","observation_id":"4c04689f-25dd-40f7-bdd7-cb111c83085d","resolution":{"observed_at":"2026-08-01T14:47:15.959730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:16.007853Z","title":"Perceptual eval- uation of speech quality (PESQ)-a new method for speech qual- ity assessment of telephone networks and codecs,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:16.007853Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:a223a1770c31a24a4c0c34d15a2a2d90398d4901d8406d8330c0e9aab9a803c8","observation_id":"76cf895f-face-4ba1-9885-1ff2a040aa81","resolution":{"observed_at":"2026-08-01T14:47:16.007853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:16.088061Z","title":"A short- time objective intelligibility measure for time-frequency weighted noisy speech,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:16.088061Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:28a6ade5732bb569503e9e7861677a970a9e79d8b7b2d2a9c6a45070edaa0731","observation_id":"57113d2b-aaf9-4e63-b171-e60f8e85d21a","resolution":{"observed_at":"2026-08-01T14:47:16.088061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:16.154364Z","title":"DNSMOS P. 835: A non- intrusive perceptual objective speech quality metric to evaluate noise suppressors,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:16.154364Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:2ba7445ffb9d032dea75ff40f1a8ce0315ef8c2b3cbdc1710f06679139f5e149","observation_id":"253f46ee-39c4-4ef6-9434-9587487874d2","resolution":{"observed_at":"2026-08-01T14:47:16.154364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T14:47:16.214424Z","title":"An analysis of environment, microphone and data simulation mismatches in robust speech recognition,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:16.214424Z"},"links":{"citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:6de84848d9115384cd44b37a4fe80ec640eba978257174563de16e81fe7c1ae4","observation_id":"e124e135-f9e1-4c42-9816-27b2d9e4b232","resolution":{"observed_at":"2026-08-01T14:47:16.214424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.24708","last_updated":"2026-04-05T03:27:11Z","snapshot_observed_at":"2026-08-04T09:40:49.585423Z","submitted_at":"2025-09-29T12:34:58Z","title":"SenSE: Semantic-Aware High-Fidelity Universal Speech Enhancement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.24708","snapshot_observed_at":"2026-08-01T14:47:15.050474Z","title":"Available: https://arxiv.org/abs/2509.24708","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T14:47:15.050474Z"},"links":{"cited_paper":"/paper/2509.24708","citing_paper":"/paper/2607.18658"},"observation_digest":"sha256:ba82e46a139289a62f44c07d61c0344cf092cadc21b2fbfbb2c969a6a02bce79","observation_id":"ee406369-01f1-4329-a644-908167f022c2","resolution":{"observed_at":"2026-08-01T14:47:15.050474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.18658","last_updated":"2026-07-21T03:02:57Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-09T00:38:39.973631Z","submitted_at":"2026-07-21T03:02:57Z","title":"Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 1 inbound Pith citation observation for arXiv:2607.18658."}