{"as_of":"2026-08-09T11:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d2bdc36c821e85b6bb0114614d4685d10d6a9d3ae4a22772b966d183622630cb","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T10:35:50.643862Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.10596/citation-record","integrity":"/paper/2607.10596/integrity","json":"/paper/2607.10596/citation-record.json","paper":"/paper/2607.10596"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Description and discussion on dcase2020 challenge task2: Unsupervised anomalous sound detection for machine condition monitoring,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:df61b861d53e845836906c19dcce77ca43d4293aa58a24096a68b7b50b356cbb","observation_id":"148950ec-832b-43dc-89d2-fb454fabfe42","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Description and discussion on dcase 2021 challenge task 2: Unsupervised anomalous detection for machine condition monitoring under domain shifted conditions,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:a2033f9ed55afc24411f51293bf5cb5481447e6ec78caa5843ce87908e3c9c3c","observation_id":"879c9e29-fe9e-4ce3-8f3d-0e350d6f3700","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Description and discussion on dcase 2022 challenge task 2: Un- supervised anomalous sound detection for machine condition monitoring applying domain generalization techniques,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:a0f2acc7609652afceea68229fb3e8f5aed57957cc97b53255d41441c5df2244","observation_id":"b59f7da5-1441-46b4-817b-fdee44d20150","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Description and discussion on DCASE 2023 challenge task 2: First-shot unsupervised anomalous sound detection for machine condition monitoring,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:72f3ab4f048e9df5ce164718f120b1224d54a587397dc6405edefed3ad1408f6","observation_id":"f89c414a-a67f-4d84-bbf5-5d1665357581","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Description and discussion on dcase 2024 challenge task 2: First- shot unsupervised anomalous sound detection for machine condition monitoring,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:0a8f52dde5ca32ce4101e257b210583031d2d98d81a89dcb99b0c04deafc3a46","observation_id":"54461f04-223c-4199-b7c5-ac43e4ab809a","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Description and discussion on dcase 2025 challenge task 2: First- shot unsupervised anomalous sound detection for machine condition monitoring,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:c6f69eff93d719f81857839dd45d50aa45a6a5c60bf7a479f1690bf50c9fe501","observation_id":"9cb79825-efd9-4a14-98e7-ee84f4e2fdd2","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Anomalous sound detection based on interpolation deep neural network,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:fe5b0de05fabff99947bba07b8016fefad7c58ed7e1bcebcfc1d1c087a071af0","observation_id":"f73862c4-c127-4258-88cb-e0542bfd432b","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Anomaly detection in raw audio using deep autoregressive networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:696376d0abac6e4d8e2f264a0f175517907a72825d493aaaf77291f2501c8505","observation_id":"5239a0d9-a8c7-4696-a645-3fb349423219","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Unsupervised anomaly detection and localization of machine audio: A gan-based approach,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:b9b87929e6b03dcca48f388a79802238d1f9aab82a9386f52508a1eb44552f10","observation_id":"3ba71aa3-23a6-4ff0-bd25-e0d1b5a47a55","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Unsupervised anomalous sound detection using self- supervised classification and group masked autoencoder for density estimation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:27b7a2ba473d9c802cfd2c275433d00ba1f2f3cfd181393353eecd664d19a66e","observation_id":"4c1a8739-b7ea-40a2-b2d2-18864e0b8736","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Self- supervised representation learning for unsupervised anomalous sound detection under domain shift,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:dba9127fb255f47fe5712d4ae76fa0534443dd53a5bcec75f76d5ddbdf573ab8","observation_id":"4b86ef33-81b1-4d39-998c-68c495f0599e","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Outlier-aware Inlier Modeling and Multi-scale Scoring for Anomalous Sound Detection via Multitask Learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:1a7568cdeb6ba843ff04b29e80cab066435271db2295777fb02c45928e31ce5c","observation_id":"c9972b0f-5c8c-4ef2-a41e-f743a7fe2ef8","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Self-supervised learning for anomalous sound detec- tion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:c3c820859c72a8054a0933629204090bb46363355ff68e7e3d9b975db3e9cf37","observation_id":"35641f7f-2b2d-4144-8ab3-11b75ffb102e","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Adaptive prototype learning for anomalous sound detection with partially known attributes,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:4b12b47b1ec6fc97eb6a201477211f0558c7bb37c1e41e49643991f77e394f73","observation_id":"bc83c9ca-2188-4978-8ab0-93ab4ca5cee4","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Self-supervised acoustic anomaly detec- tion via contrastive learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:39282c98ce1b84af8791c7fa6677a9f4f2eeda0cfa4fd26a8d354f9606e88059","observation_id":"d2d3b4e8-b47c-42b1-8cec-d592aaf4f110","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Anomalous sound detection using audio representation with machine id based contrastive learning pretraining,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:b31c7b8b071dbd01d5029f534eec6c4abdf8a557d77e501d3b5d5795c2e4677b","observation_id":"bc27dbb6-c995-440b-b495-f0ecf5bf65ed","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Joint generative-contrastive representation learning for anomalous sound detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:be34e89344393df64d3e456c1e15313f88c76ed2c950655a3a408b4601c4c1b7","observation_id":"8acde8c9-f7ad-44bb-9a35-6d4a0f14990d","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Robust Prototype Learning for Anomalous Sound Detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:d74c8f6444bfa3727bd7475fbe403556fa006c8ea3b8479b14e85b0feade23ee","observation_id":"07441219-e97a-4497-b026-4aa989827172","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:a33c51512c69e9272a08f0c9c7d76a61a89064ca42be14d14fb8c1ec66585f13","observation_id":"300b589b-1e08-44c1-a375-4a0c91ea3bf7","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"AST: Audio Spectrogram Trans- former,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:e741e878b4247e6482c9f37f3e6b785ca43ef2b0fcd2eb7a694adaf2818d1fa1","observation_id":"464ac482-807e-4b4c-942e-4e07d7e2cf0e","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Masked autoencoders that listen,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:3a8905ba1222cfd6a39fa9374cd87aa196582826abc462fae7d0e19b2404017f","observation_id":"4da550b8-74bb-4a7f-b4a7-80f48891de0c","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"BEATs: Audio pre-training with acoustic tokenizers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:2b78d21c8d3c360454c891f8394bc8ede58320d4aaa649ba5d90d56ee6dc71dc","observation_id":"89ad3995-8466-437b-abb1-21946a80ac29","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"EAT: Self- supervised pre-training with efficient audio transformer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:2531f96d935ac6c68b1d25a77e75ee73e5306336d4a3dbac5a26822cda2c23d0","observation_id":"3aa42524-8fa1-4f71-a1e2-eb9dca8d0257","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"CED: Consistent ensemble distillation for audio tagging,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:cdde995917491ea2468bea98a4def8326f2fa6c3e03769d281308882670b9138","observation_id":"e5c00ac4-b1c6-4787-acc8-d52d4c275416","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Scaling up masked audio encoder learning for general audio classification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:94e2f162dcafd606da293b4ceecf4e92054d7fb02b17d14d16ad63cc14dd07d7","observation_id":"4bd206f3-d962-43ab-9806-a9a12549b46a","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Exploring large scale pre-trained models for robust machine anomalous sound detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:1127580467a77c6c1ef1f754b104db55c5369eea65b1ec8a9ff664a3822e8dd8","observation_id":"55d70409-5fd7-416b-910f-b74a57a13078","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Exploring self-supervised audio models for generalized anomalous sound detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:ef75b231e89fe68cb36f77940d200c59ee1d44514a491c577f89aad61e50e30e","observation_id":"c8227c05-2cb9-4b5f-91eb-992ed29c450a","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Anopatch: Towards better consistency in machine anomalous sound detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:1fd20424722f46cc8aa170b60143f3f80958808f8f6443f3b96938edac31d04d","observation_id":"84e6bc1f-b0f0-42c1-833d-cd6ef5738e94","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:844f4ac63230a6609fd17bda750ee62a5a1628476776cd1e605dfeb0e7023f1d","observation_id":"fa138a67-7f30-4c75-9578-4e0800ed050f","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Improving anomalous sound detection via low-rank adaptation fine- tuning of pre-trained audio models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:4699697a325832730f8846147ab0efd0cdffb255d34c6ed0dbd5c1b281b9e7a4","observation_id":"7b773b46-9d43-454c-9dca-25f9da16ff31","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Anomalous Sound Detection Using Self-Attention-Based Frequency Pattern Analysis of Machine Sounds,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:c7113bf464b5c095e18f77d2abb229d876969e79f5f1c5f956fe682bef023e07","observation_id":"5a7864e6-7c69-498e-b985-585f46bb9876","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Robust anomaly sound detection framework for machine condition monitoring,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:d2d5f32f278c31e830dd9482d2a6ab731a01d26e4a811dfcad4efc54ab756525","observation_id":"be4d7d39-a75c-4ef6-8485-61fd84f7245e","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Explaining the decisions of anomalous sound detectors,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:ae9c2debfc1375767bf91a27881b35d76f00a5eaeeb57b5ad2b71bee0d665473","observation_id":"627ee407-4a98-470e-ba80-24413cc34cc1","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"A dual-path framework with frequency-and-time excited network for anomalous sound detec- tion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:878b926bdb02ca3f2529532b51a1681f5edc9ff4ef63b400eacde13eb2a30dd6","observation_id":"16afe455-62bb-4c8a-9c6f-8a54e0cabbba","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"A lightweight framework for unsupervised anomalous sound detection based on selective learning of time-frequency domain features,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:05314881a73cd6d20b0a1c4b6dcf8d5f070a029cfef7fe42dbf8d73dfd748ab3","observation_id":"b77cbaea-439f-45cc-9877-44f039d30388","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Enhancing reliability through interpretability: A comprehensive survey of interpretable intelligent fault diagnosis in rotating machinery,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:6edb19bcbe33592c1f801a00ebc50ffd75197bc143db8099c6abaa8a3a41cf10","observation_id":"a08983ce-a0d6-41c8-9f32-bd3d263a7163","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Explainable artificial intelligence based intelligent fault diagnosis: A systematic review from applications to insights,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:8d6f726b7dfec3d9f3dd375c91f8b1f74e9d2335a675518b326d97a675498c21","observation_id":"30782bab-6ffc-45a6-b30a-165f5bff225e","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:d513255015f0e000ba922e12be380ec43169ba8201e74f07059ac81ee7a38f72","observation_id":"b9fdd813-b719-4ade-88b2-fc991ec0c8b7","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Anomalous sound detection using spectral-temporal information fusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:7a5a2d73148cd2c0174cf7e5bcc8be5ca500b5be806c27df8fc921d4605af723","observation_id":"33220571-18a4-4666-8e32-6e57763ff6de","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Multi-scale scanning network for machine anomalous sound detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:c0f581e3d5b95ce121fe8a76cf266a7fd5bc0b13173de55cc887fed999bbed8a","observation_id":"b3a4f423-dcd1-4682-9ad2-2c11774aff1f","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Multi-spectral and multi-temporal features fusion with se network for anomalous sound detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:c6e9de3adaae782fd0edb233a7e806cb4fe48ffec5690d901a62ffd66e346401","observation_id":"8a20f76b-d0b7-4764-ab03-a7be2d18528c","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Estm: An enhanced dual-branch spectral-temporal mamba for anomalous sound detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:c8754c7ddf9646b421d5162ac2edc444996923e3af19bd215fc47dd201ae6fb4","observation_id":"c9341c66-a41b-41e9-8c98-cac730432118","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Echo: Frequency-aware hierarchical encoding for variable-length signals,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:165ae29197966e2fa34493d61cf426f2be972aa664f72d961d5fd77304178524","observation_id":"c1f45462-fbcc-4781-b499-f75e6728f522","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16696","last_updated":"2026-06-23T08:25:29Z","snapshot_observed_at":"2026-08-06T15:01:40.186977Z","submitted_at":"2025-07-22T15:31:16Z","title":"FISHER: A Foundation Model for Multi-Modal Industrial Signal Comprehensive Representation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16696","snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"FISHER: A foundation model for multi-modal industrial signal comprehensive representation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"cited_paper":"/paper/2507.16696","citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:d9268c23e17de84f22aba3b5bfaebc26863058c14c5b0b4a14a8092dd40d48be","observation_id":"49065796-d797-43be-a5fd-368bff46985d","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Hear: Holistic evaluation of audio representations,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:dd8349f37e4a37949166769b5a94174f1464e1688ef8fa56f3dd060a494495e5","observation_id":"24c39b7c-c772-4e85-9d17-3198fd1400a0","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"SUPERB: Speech Processing Universal PERformance Benchmark,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:6eb057d189098eff7d447ef1247e1ad4af21a72c92479b07042d4407e1d3028c","observation_id":"653a708a-d5a6-4bd7-bfaa-2063fb1e110d","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"X-ares: A comprehensive framework for assessing audio encoder performance,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:257f64c04b8b6cdcfea88186a434d1929ba94b94ddefce3583ea79f9bc0098e1","observation_id":"dfe9f9f6-dd15-4da4-8908-d2cb99dcc26c","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Mimii dataset: Sound dataset for malfunctioning industrial machine investigation and inspection,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:22c14c15277ae2bbc9c7d37c46046c93d7b1b8a6a9b399e18782565c6865d9df","observation_id":"e19beba0-db4a-46e1-a5c6-566c9ba43036","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Toyadmos: A dataset of miniature-machine operating sounds for anomalous sound detection,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:88979c9c80c3edfeef0c0fb17650b9ab609476b86d9d9d722d19ffbc34937e95","observation_id":"855686c3-8d28-493a-b874-6dd908569142","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Mimii due: Sound dataset for malfunctioning industrial machine investigation and inspection with domain shifts due to changes in operational and environmental conditions,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:ed98758afd6ae655ed59a57a29b7a3d1716d663b457cc31516fe480f802d8ce5","observation_id":"b020e35e-a07c-4ed4-860f-ea2cb76bd14b","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Toyadmos2: Another dataset of miniature-machine operating sounds for anomalous sound detection under domain shift conditions,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:f8ea4e8d962d981e24bf8599fa2d3d9aa470e322bf66a38482d4765b72e22b42","observation_id":"3949e414-539a-4d09-8952-01ef4203f394","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Mimii dg: Sound dataset for mal- functioning industrial machine investigation and inspection for domain generalization task,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:13afe0ae3aa85e92ee1962f6b41e57c1c9bfa93ea61c76858f634b8dd24d26df","observation_id":"9db994fa-18da-4cf5-b4b9-4b9514ea5f71","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Toyadmos2+: New toyadmos data and benchmark results of the first- shot anomalous sound event detection baseline,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:22b9d4806929cdfa4235b0d73dc115d36467a22c4f9956639ff65cb241e2a7cd","observation_id":"bc826d23-57d3-4ada-a024-37975171d8d1","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Toyadmos2#: Yet another dataset for the dcase2024 challenge task 2 first-shot anomalous sound detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:69fbe91f952eb99edbd670f5a2b02342b69041548d4ba3aab91eb8fdce765fd9","observation_id":"054b31cf-8eb6-45df-8742-c0a36d8ba5fd","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Toyadmos2025: The evaluation dataset for the dcase2025t2 first-shot unsupervised anomalous sound detection for machine condition moni- toring,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:1a6968b8a5b7b36c42934563554629f93a19f9fbe192bb9400168ca1a0b789b4","observation_id":"c61bb8c4-0041-40cf-a282-c7086740ff1d","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Imad-ds: A dataset for industrial multi-sensor anomaly detection under domain shift conditions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:ef3cd58149de542566ccd64e5b1cda95d17db647e02476c19d4d373bba3da9d3","observation_id":"2dd4bf78-18c1-47ab-ae94-4eb1958c120d","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Audio set: An ontology and human-labeled dataset for audio events,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:634cc874c1d397079c6165a0c6d3a6847fc8034b3b50629b3b6128e2d71cee84","observation_id":"ba2bc318-386c-48d7-bc72-90386d7d7b79","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Vggsound: A large- scale audio-visual dataset,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:2054844985deb59f7f7ac61d2e4a504c721be588a1bb61f8249465b012129b5f","observation_id":"6985406d-332a-4623-9063-70e1530d8225","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Acav100m: Automatic curation of large-scale datasets for audio-visual video representation learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:9d3a30659e7071498276f41d0f4ea6effa69d97f6eb6c80470632d619e843ab9","observation_id":"d388aafc-9bb9-47c2-8d37-542830e4aca8","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"The mtg- jamendo dataset for automatic music tagging,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:ffa9e769e19c02b1ba1f9843cca611792040f4816ff086e9f78ca69b1dffe3a5","observation_id":"12bc11f2-78eb-4c43-8a3c-5b46df41c8b2","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Music4all: A new music database and its applications,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:02ff7e5ad26934529c6c2fccaafb118976798b76abfd09cd500ab4707a70c12a","observation_id":"362ffbcd-6b64-45dd-99f1-d04423b22f1c","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:b0b9ef3d6bad83d44cc0f4ac49778a648844e6d610690abe12c00465423c9ea6","observation_id":"de1f6cf5-20d3-42cc-96ff-fd1b2897dca9","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T10:35:50.643862Z","title":"Wavcaps: A chatgpt-assisted weakly-labelled audio captioning dataset for audio- language multimodal research,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-14T10:35:50.643862Z"},"links":{"citing_paper":"/paper/2607.10596"},"observation_digest":"sha256:f8f173cfbe9b80d9243737eb6a0527c86197a520fd85e28633227342a4d8836a","observation_id":"771740d9-cfb9-4e8e-91cc-a9f9e9dd0b55","resolution":{"observed_at":"2026-07-14T10:35:50.643862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.10596","last_updated":"2026-07-12T06:26:38Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-06T15:08:21.690635Z","submitted_at":"2026-07-12T06:26:38Z","title":"ECHOv2: Two-Level Band-Splitting Representation Learning for Anomalous Sound Detection"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":63,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2607.10596."}