{"as_of":"2026-08-11T18:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5cb3bfc7dfdb59299ef8195043dbdaaad7d9c463c48101ebdb31082477e005c3","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:42:46.371250Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:42:46.286372Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T14:42:46.494173Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"cited_work":{"arxiv_id":"2507.17941","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.17941","snapshot_observed_at":"2026-08-06T14:42:46.494173Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","venue":"cs.SD","work_id":"994b03e2-6e6d-4981-99fd-57a3bd54e534","year":2025},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.286372Z"},"links":{"cited_paper":"/paper/2507.17941","citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:ab0fe8911d9139d233cc47a8f9b074181e63431f03d4f3b8f2d7225b480570b1","observation_id":"de07afc2-1311-476a-b346-de4ffb576f67","resolution":{"observed_at":"2026-08-06T14:42:46.504514Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.17941/citation-record","integrity":"/paper/2507.17941/integrity","json":"/paper/2507.17941/citation-record.json","paper":"/paper/2507.17941"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"cited_work":{"arxiv_id":"2507.17941","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.17941","snapshot_observed_at":"2026-08-06T14:42:46.494173Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","venue":"cs.SD","work_id":"994b03e2-6e6d-4981-99fd-57a3bd54e534","year":2025},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.286372Z"},"links":{"cited_paper":"/paper/2507.17941","citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:ab0fe8911d9139d233cc47a8f9b074181e63431f03d4f3b8f2d7225b480570b1","observation_id":"de07afc2-1311-476a-b346-de4ffb576f67","resolution":{"observed_at":"2026-08-06T14:42:46.504514Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.708480Z","title":"Features In our approach, we use audio files in Ambisonic format of the De- velopment Dataset 2024 [3]","venue":null,"work_id":"71440763-825d-4686-9d82-f13f69ebf3b3","year":2024},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.290887Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:5c24ebd58d471e220050d770d3c81015c0e6ee25189b4e79a718da898f3d1548","observation_id":"fdc35a21-81ad-42b7-9096-32a71fa58f97","resolution":{"observed_at":"2026-08-06T14:42:46.711543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.699702Z","title":"The network was trained using a multi-phase approach involving syn- thetic, real, and augmented data","venue":null,"work_id":"f3f89e14-b58e-4495-9aaa-16c2fe94ad14","year":2024},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.294734Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:0c7acf826b7ca3e7f0033412fdd5237209d552103d7788516f31a9c76d3c3902","observation_id":"3b0d0bef-2037-4f8a-973a-b57aed8da570","resolution":{"observed_at":"2026-08-06T14:42:46.702772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.691375Z","title":null,"venue":null,"work_id":"2648b348-3e1f-45d6-adde-a95f0a6a8f08","year":null},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.298530Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:a9a279d117cb48339210e8ce510cbd95c0979a21c390aa3507de430d2aba9539","observation_id":"0d22982d-2ff3-4029-a16f-b284aea4c34d","resolution":{"observed_at":"2026-08-06T14:42:46.694245Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.682638Z","title":null,"venue":null,"work_id":"a780430b-5ac0-47df-ac49-7b1a0d4fcc05","year":null},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.302152Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:4d47b202250fd3492aebfc7c02b0fea3aafa929b7338cb4c776cd8e6b6e026c8","observation_id":"0139295a-c866-4ab0-ac8b-49c96bacd21f","resolution":{"observed_at":"2026-08-06T14:42:46.685424Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.673670Z","title":"An improved event-independent network for polyphonic sound event localization and detection,","venue":null,"work_id":"9a6fd7b8-b5ad-47ab-9c7c-32eca6cf2c77","year":2021},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.305720Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:cd6037fdae4b2a27d44187565ccbf155634b5edd597e57b973995dbd7c35555f","observation_id":"677c7f69-3bcd-4e4e-baf1-c583535b9663","resolution":{"observed_at":"2026-08-06T14:42:46.676653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.665097Z","title":"STARSS22: A dataset of spatial recordings of real scenes with spatiotemporal annotations of sound events,","venue":null,"work_id":"4787acd5-d9c0-42ed-9dec-1f99f0b5f20a","year":2022},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.309292Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:0f157a97784966eeed194cabeb11d4ab914cc1a8c55cce0afe3f0bac0ace1062","observation_id":"26c1f7b0-8393-4c6f-8ed1-2bacd3e5e947","resolution":{"observed_at":"2026-08-06T14:42:46.668184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.656452Z","title":"Shimada, A","venue":null,"work_id":"da6a9e12-5ebc-45ce-8488-ae6d3271bc78","year":2024},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.312645Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:d1ec7a02e0c04bbb2d658d9efc87995f02da52f411f46a21a0b9ac125acdd000","observation_id":"a4e9777e-7234-46f4-9b07-9d7c6cb8e13d","resolution":{"observed_at":"2026-08-06T14:42:46.659184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.647794Z","title":"Accdoa: Activity-coupled cartesian direction of arrival representation for sound event localization and de- tection,","venue":null,"work_id":"fd9197ff-1cb4-4ee0-84f8-ab8440563df9","year":2021},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.316853Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:9ec9a9902bc683e6c619212c7bdccaf8ef7239fa8a60e888fa1c4fc7acc9daa1","observation_id":"43fb0b9b-503d-4ab1-8d1c-4602306fb978","resolution":{"observed_at":"2026-08-06T14:42:46.650671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.639671Z","title":"Permutation invariant training for speaker-independent multi-pitch tracking,","venue":null,"work_id":"58d872c1-cc3c-43d5-8bea-2dbe415c61c3","year":2018},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.319982Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:cb6b051c0175f8c365ade6f3dc2f4dea126e59de4ab84a0fb0ac8487148d0115","observation_id":"19f9c593-8223-420e-94d5-5007ad99cda8","resolution":{"observed_at":"2026-08-06T14:42:46.642457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.630604Z","title":"Multi-accdoa: Localizing and detecting overlapping sounds from the same class with aux- iliary duplicating permutation invariant training,","venue":null,"work_id":"d3a9b752-19a4-413e-844d-d0484c44918e","year":2022},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.323127Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:2cd3a3e6828339d480b88aef2a3f1daf1ab476b5fb8a664b62823c925b7f36e9","observation_id":"ba7aafad-fba5-4e99-8754-562c54e55be2","resolution":{"observed_at":"2026-08-06T14:42:46.634088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.621216Z","title":"Sound event localization and detection using foa domain spatial aug- mentation,","venue":null,"work_id":"a4218331-63d4-41be-a867-111a2ba6a64a","year":2019},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.326309Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:7d3851d109dc4a2a2b0765f0338710de14b3cdd09320fedc668ed806b78a0f8b","observation_id":"443618e9-923a-45ca-ba61-51e0870349ed","resolution":{"observed_at":"2026-08-06T14:42:46.624393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.00268","last_updated":"2019-11-05T10:18:18Z","snapshot_observed_at":"2026-08-10T10:30:32.542659Z","submitted_at":"2019-05-01T11:27:28Z","title":"Polyphonic Sound Event Detection and Localization using a Two-Stage Strategy","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.00268","snapshot_observed_at":"2026-08-06T14:42:46.329992Z","title":"Polyphonic sound event detection and localization using a two-stage strategy,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.329992Z"},"links":{"cited_paper":"/paper/1905.00268","citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:6380e3660d4cc2c3be194999ae653e127c6a26f4c89a4b34a928132ea63a82ab","observation_id":"082ac626-c830-4d23-89b3-4e5a42c8c964","resolution":{"observed_at":"2026-08-06T14:42:46.329992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.611798Z","title":"The generalized correlation method for estimation of time delay,","venue":null,"work_id":"2e8603dc-0f9f-489c-96c3-2836c7930fad","year":1976},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.333817Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:8ef7adde5f3bc199c4b4fc6cad7b0ffc9ecd184e49ed4f7382c763190a19c75b","observation_id":"624e239c-d85e-4b52-8ece-17b93354fac1","resolution":{"observed_at":"2026-08-06T14:42:46.614956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.602324Z","title":"Random erasing data augmentation,","venue":null,"work_id":"13fa6e55-737d-4692-b1ca-e7c9b507500f","year":2020},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.337381Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:698f5744de7e05c53bd4bf12f288bd0ae0dfbac8cd8f50cf556bad72a9541b3b","observation_id":"d6a369fc-9938-442e-89e6-9087587e5957","resolution":{"observed_at":"2026-08-06T14:42:46.605443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08779","last_updated":"2019-12-03T18:19:07Z","snapshot_observed_at":"2026-08-09T05:21:08.018150Z","submitted_at":"2019-04-18T17:53:38Z","title":"SpecAugment: A Simple Data Augmentation Method for Automatic Speech Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08779","snapshot_observed_at":"2026-08-06T14:42:46.340920Z","title":"Specaugment: A simple data aug- mentation method for automatic speech recognition,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.340920Z"},"links":{"cited_paper":"/paper/1904.08779","citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:a761e3b3b8b0578c62c6097bcaae85177eecaf2956d125a2cb9210e0dfd10424","observation_id":"b73be1b6-38ab-48fe-9807-0a0d3a789b23","resolution":{"observed_at":"2026-08-06T14:42:46.340920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.592684Z","title":"A four-stage data augmentation approach to resnet-conformer based acoustic modeling for sound event localization and de- tection,","venue":null,"work_id":"ea80e280-1a94-4f7c-b7ef-e71b9da51d80","year":2023},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.344443Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:8b28a5e6e98b37ef122aaa2cb17b2898b78ecb01e7d5dfbd1ebc4e3d2dc99384","observation_id":"5bbb8524-06e1-47ec-9918-6d842bbf44c9","resolution":{"observed_at":"2026-08-06T14:42:46.595849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.584075Z","title":"Conformer: Local features coupling global representations for visual recognition,","venue":null,"work_id":"708d829a-361b-4aac-8deb-06cfd94e1517","year":2021},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.347760Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:d1c65e5db2061f601ee3c87a9d4577027b57a47a68bd7042ab5e54f0d5216f54","observation_id":"22eb01c0-b973-4216-8188-1fb311f9a4d4","resolution":{"observed_at":"2026-08-06T14:42:46.587257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.574327Z","title":"Sound event localization based on sound intensity vector refined by dnn-based denoising and source separation,","venue":null,"work_id":"2bf821f9-3dd0-48a2-acf2-9a4946535cc7","year":2020},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.351115Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:b80c67b171dfc1aa6771acf47b85feb3e05049cd3deb7825b5f3d6875b4298bf","observation_id":"3544f9b7-58ba-417a-9a34-4b0a8ac9da5a","resolution":{"observed_at":"2026-08-06T14:42:46.577618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.564502Z","title":"Spatial scaper: A library to simulate and augment soundscapes for sound event localization and detection in real- istic rooms,","venue":null,"work_id":"78944fe6-e901-4b48-9777-aa4681ad7ae1","year":2024},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.354492Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:0c34b56639e1590e3fcfba1a0925dc98e77c8f7271b562f8b8c960ff32d7f520","observation_id":"5d91b2dc-f9f9-48df-9a08-c625991c9cac","resolution":{"observed_at":"2026-08-06T14:42:46.567970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.555004Z","title":"At- tentional feature fusion,","venue":null,"work_id":"c93bf060-e794-435f-939a-f097fa20b70b","year":2021},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.357816Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:6e6bb95415e0834f4b5967c9029c94f290929b8de570dc9293cf7ab64d5c8676","observation_id":"61aaecea-e59b-4a17-8aff-c6a299624ca3","resolution":{"observed_at":"2026-08-06T14:42:46.558002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.545411Z","title":"Attention mechanism network and data augmentation for sound event localization and detec- tion","venue":null,"work_id":"baa8ffed-eea2-4991-9ccc-7d7d11b9bdfc","year":null},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.360940Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:beb6e82f223d1ca025d519457c421e4f8fc4bfc2a8cbb45cc6ac7bc4fa5b462f","observation_id":"7568d313-3c37-4597-b654-be2bdc2ec6e0","resolution":{"observed_at":"2026-08-06T14:42:46.548384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11827","last_updated":"2024-06-12T13:54:11Z","snapshot_observed_at":"2026-07-06T17:46:20.935124Z","submitted_at":"2024-03-18T14:34:16Z","title":"Sound Event Detection and Localization with Distance Estimation","version":2},"cited_work":{"arxiv_id":"2403.11827","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.11827","snapshot_observed_at":"2026-08-06T14:42:46.439364Z","title":"Sound Event Detection and Localization with Distance Estimation","venue":"cs.SD","work_id":"07fea921-41d5-475e-b3d4-bffa0bdb8289","year":2024},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.364337Z"},"links":{"cited_paper":"/paper/2403.11827","citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:15f27e17108d1d8feaee110cc30941b8a78a19ff73bd8f8bdefaad8ca9646397","observation_id":"19cad754-b1fb-401b-b294-af4e69a96bef","resolution":{"observed_at":"2026-08-06T14:42:46.451060Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.10932241","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"DCASE2024 Task 3 synthetic seld mixtures for baseline training,","venue":"Zenodo (CERN European Organization for Nuclear Research)","work_id":"df4529f8-b6ad-436b-8b9b-9b96c10efb87","year":2024},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.368005Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:7700c72c8a2f8e6fda56cb957eb989a61a0584a9ad63958052af9ed3ae99a6ed","observation_id":"0d931698-43e6-4bc2-8379-0b479f15b248","resolution":{"observed_at":"2026-08-06T14:42:46.417594Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:46.525001Z","title":"Overview and evaluation of sound event localization and detection in dcase 2019,","venue":null,"work_id":"94f2a406-0668-4707-ab6d-cbcbe07cafe6","year":2019},"citing_paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:46.371250Z"},"links":{"citing_paper":"/paper/2507.17941"},"observation_digest":"sha256:0c49f8c8cee34ac9c02028a09fb5bd2fbf7b36dfabb7945687f80e53d9073f4b","observation_id":"7f5e3607-bfa3-479e-8afd-f6fd28038c98","resolution":{"observed_at":"2026-08-06T14:42:46.538080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.17941","last_updated":"2025-07-23T21:18:01Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-10T19:18:37.508351Z","submitted_at":"2025-07-23T21:18:01Z","title":"Resnet-conformer network with shared weights and attention mechanism for sound event localization, detection, and distance estimation"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":3,"verified_fuzzy":18},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 1 inbound Pith citation observation for arXiv:2507.17941."}