{"as_of":"2026-08-23T19:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4ff07df997f57f3eea42247eb9f1b5dea754419ea3d6aee6f0549c80b30b4f58","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T05:36:17.110557Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.00312/citation-record","integrity":"/paper/2412.00312/integrity","json":"/paper/2412.00312/citation-record.json","paper":"/paper/2412.00312"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.755900Z","title":"A survey on the new generation of deep learning in image processing,","venue":null,"work_id":"7ea6be3a-0088-43cd-967f-b077893253bb","year":2019},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.845382Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:d9aad5dc9fa4dcc0caf319a5874c0d2d2e3a45a23fac54bf8e760a6c1781ab69","observation_id":"18f28e91-97ac-4226-a4eb-83cfa51c5bd0","resolution":{"observed_at":"2026-08-12T05:36:18.760226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.743751Z","title":"Comparison and analysis of SampleCNN architectures for audio classification,","venue":null,"work_id":"700e4435-dd79-4d68-94ea-027451618265","year":2019},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.851044Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:845b59feab917756ca3aa8713ea9e845cf165bdaea7f886e900f1ba3dced4e7f","observation_id":"92ba14ec-f515-4891-8421-229637b5d660","resolution":{"observed_at":"2026-08-12T05:36:18.747653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.85532","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.225793Z","title":"Convolutional Recurrent Neural Networks for Urban Sound Classification Using Raw Waveforms,","venue":null,"work_id":"da8c9151-3160-4615-a0de-313d3f94e41b","year":2018},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.856254Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:a91a0b5afd3a81113ec84f35170527c708170a21d3590c1009707aecdb840fc2","observation_id":"72f03f0b-e653-402e-8209-23c9ea6f041d","resolution":{"observed_at":"2026-08-12T05:36:18.235454Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.730568Z","title":"Rawnet: Advanced end-to-end deep neural network using raw waveforms for text- independent speaker verification,","venue":null,"work_id":"a34d1676-eaa6-4840-9ae9-d2a1207676ba","year":2019},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.861233Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:2c5cf3784b3077777f7dce5ac7024315cd2e61ec1560c1fc3ffe86faefbaafd8","observation_id":"06d0abfc-2a14-42a7-8bf1-88077511f83b","resolution":{"observed_at":"2026-08-12T05:36:18.734874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4555.34045","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.146573Z","title":"Learning the Front-End Speech Feature with Raw Waveform for End-to-End Speaker Recogni- tion,","venue":null,"work_id":"c2e835d7-1da3-4d02-a554-6449e896b868","year":2020},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.866883Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:170c0a99a36ae937c316039501c26c85add43424ab7788e39a9394de793a0eea","observation_id":"15716147-2d46-47f5-b9ea-a6a3eb20e462","resolution":{"observed_at":"2026-08-12T05:36:18.153169Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:16.871711Z","title":"Learning environmental sounds with end- to-end convolutional neural network,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.871711Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:16a788b2ba1671f6dffcc8201ee1855e363a36bf74450e4c8a5685ba5db3a468","observation_id":"c9b13027-5821-4119-8c25-d67a29015ff8","resolution":{"observed_at":"2026-08-12T05:36:16.871711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.717279Z","title":"Acoustic modeling with deep neural networks using raw time signal for L VCSR,","venue":null,"work_id":"ab016c8c-a9ac-4efc-b61c-48b829cf1b25","year":2014},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.878153Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:1795fcd0db9a0226a39425904b03d66509f033e9182d8b18f092582150a8a8db","observation_id":"9af56660-158d-4cb2-9b7d-8bcb041a31c2","resolution":{"observed_at":"2026-08-12T05:36:18.721338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:16.883231Z","title":"Very deep convolutional neural networks for raw waveforms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.883231Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:ef61df6b3ce912d2a411949651152c3992db02d07b47b440b5b7b518327de6f7","observation_id":"4f2cf311-e3cd-4117-9377-2ba461e989c1","resolution":{"observed_at":"2026-08-12T05:36:16.883231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.705437Z","title":"Speaker recognition from raw waveform with sincnet,","venue":null,"work_id":"e854b24f-2483-480c-9e64-037641d2a4df","year":2018},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.888244Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:5b473cd2031beb0c8f8a82ce5d837db2f3e35607e21536b6201e09fee52236bc","observation_id":"b73ef97a-24c7-4d69-838d-95baf430a539","resolution":{"observed_at":"2026-08-12T05:36:18.709439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.692609Z","title":"LEAF: A Learnable Frontend for Audio Classification,","venue":null,"work_id":"c40797c3-0caa-4000-ae4d-8843d5d2331c","year":2021},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.893081Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:b0b82435942ec81ac982f2a923bacc36b21923a2c86bc1fc85633fca293b46ed","observation_id":"2de9015d-f2e2-46fa-b609-fdf2c73ee09d","resolution":{"observed_at":"2026-08-12T05:36:18.697342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:16.897934Z","title":"Discrete Cosine Transform,","venue":null,"work_id":null,"year":1974},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.897934Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:c107220589a28bb2c66018dc4dd32405322b644ce6b4102861dfebde9b9e5537","observation_id":"225d152b-e041-479f-a607-7493acaa0e08","resolution":{"observed_at":"2026-08-12T05:36:16.897934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.86836","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:17.881669Z","title":"An Audio Scene Classification Frame- work with Embedded Filters and a DCT-based Temporal Module,","venue":null,"work_id":"4c51f672-baed-4881-b372-b71b89953b2f","year":2019},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.902522Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:816e2f73bbfee196d6cfdc3da8c343f1fc1aa6578e02d2174f76fcdc681f1342","observation_id":"aed8fecb-ca3a-4ec9-b09f-537e7b5a29f2","resolution":{"observed_at":"2026-08-12T05:36:17.888119Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.680086Z","title":"End-to-end speech enhancement based on dis- crete cosine transform,","venue":null,"work_id":"4f78318f-2ee1-4ec5-9f03-8a89d8c2f6b7","year":2020},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.907186Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:211cc0d681c5e502904aba1fb6fa20718e55a5b099a0da82bb245c6c60473a59","observation_id":"2e6a916b-7b90-466f-8648-59e2007ad551","resolution":{"observed_at":"2026-08-12T05:36:18.684717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.668371Z","title":null,"venue":null,"work_id":"9a9446fc-ad88-470e-8773-c781e5ab5af4","year":2008},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.912099Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:147889265bf8a46e89b1d8adb2f19f08c7f7142c7235493f23d622fba3c7ad12","observation_id":"ec5a181b-8a1f-47b1-b965-8fba66e2eabe","resolution":{"observed_at":"2026-08-12T05:36:18.671902Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2006.88503","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:17.804889Z","title":"Gaussian Mixture Modeling of Short- Time Fourier Transform Features for Audio Fingerprinting,","venue":null,"work_id":"211ddc16-dfff-49b3-a927-d9dbe2f1d9e8","year":2006},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.916354Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:ae8aa40441e1aa8f0958b0a57d9a8f849234244129336dd26ac73836c81b5549","observation_id":"30e3b424-b5bd-4f4a-b989-1e41cdc8e675","resolution":{"observed_at":"2026-08-12T05:36:17.811770Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:16.921080Z","title":"Time- Frequency Filter Bank: A Simple Approach for Audio and Music Sepa- ration,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.921080Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:0b00e998856864f3afe060aad41b629e033b23babced4c45874c69bf80d60f72","observation_id":"8b3edf4f-9f46-49bb-b394-a9211bbb0ceb","resolution":{"observed_at":"2026-08-12T05:36:16.921080Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.87021","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:17.654226Z","title":"Convolutional Neural Network Accelerator with Vector Quantization,","venue":null,"work_id":"d7b075da-e807-4579-a552-d7492ca3a0db","year":2019},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.925180Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:22459a515b1885f8548098fd57ea3c6dde1fad7e29ffb9e5b4350ee40ab26121","observation_id":"0fdb8c89-9573-420b-aca8-8b5000d92df3","resolution":{"observed_at":"2026-08-12T05:36:17.661336Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1410.5401","last_updated":"2014-12-10T16:01:39Z","snapshot_observed_at":"2026-08-12T12:07:42.706444Z","submitted_at":"2014-10-20T19:28:26Z","title":"Neural Turing Machines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1410.5401","snapshot_observed_at":"2026-08-12T05:36:16.929195Z","title":"Neural Turing Machines,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.929195Z"},"links":{"cited_paper":"/paper/1410.5401","citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:b4d4631f0095b9dc33c9e23c797629fac2c5bc1c5a0bf6341128f1f54d23e396","observation_id":"53ced13b-3164-48cf-86d9-0cc9763e3b40","resolution":{"observed_at":"2026-08-12T05:36:16.929195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.656117Z","title":"Meta-Learning with Memory-Augmented Neural Networks,","venue":null,"work_id":"021b421a-ace6-422e-ae2a-b62ce4be7b12","year":2016},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.934712Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:b89f6e9231b05cde2fcfd5f232b9d726746c7197e9b3fe347aec47dd014ac982","observation_id":"d3f4f30c-3160-46f0-aa98-010481799b68","resolution":{"observed_at":"2026-08-12T05:36:18.660788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v32i1.11704","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:17.137553Z","title":"Quan- tized Memory-Augmented Neural Networks,","venue":null,"work_id":"258442f6-f25e-4553-8e9b-47a53221227d","year":2018},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.938937Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:93bc7fb55fd1945e32df8c67d91329af956dcc04c1c8534cb189076933e8c057","observation_id":"6211c741-1edb-48bf-bc0d-0a83acec7cf7","resolution":{"observed_at":"2026-08-12T05:36:17.144499Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.644063Z","title":"Content-based audio classification and retrieval by support vector machines,","venue":null,"work_id":"e3619197-e53f-4abb-b288-328d7d562139","year":2003},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.943882Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:d54dd1a8a3acd7a59fb511600b6d7418a99506536967a736f05b3bc5a8fb141c","observation_id":"8b20e5c1-eaf1-4f66-9ff2-57da6dab419a","resolution":{"observed_at":"2026-08-12T05:36:18.648104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.629392Z","title":"Mixed type audio classification with support vector machine,","venue":null,"work_id":"9cb3586a-d5ac-46e5-aeef-c76b9e3c2963","year":2006},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.948446Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:f4214a2e46d310ed111227b1195e3b11b885e8e23fea1c41f5f4d4fb6daea45d","observation_id":"74e57734-af04-4d89-a37e-228f30391cb0","resolution":{"observed_at":"2026-08-12T05:36:18.635186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.615959Z","title":"Content analysis for audio classi- fication and segmentation,","venue":null,"work_id":"b4a4899d-56ec-45a6-b0be-2c24c84ed7f6","year":2002},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.953216Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:d4b12583e946b790e8f54f4befc8fa17bda3b4712cd934b2274bc4f7689a68f7","observation_id":"1e392bc9-311a-4bb7-ac68-72e8de15b0a9","resolution":{"observed_at":"2026-08-12T05:36:18.620214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.603624Z","title":"Content based audio classification: A neural network approach,","venue":null,"work_id":"ce882e9c-3bab-446d-9a34-bef3304b7278","year":2008},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.957998Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:184ccb11471a337f0103f7668a712f7ef1764cc9f4cdb3c904c9e4f4216df6ea","observation_id":"6c91ae23-d2a5-4f80-ad4e-dd64a790e876","resolution":{"observed_at":"2026-08-12T05:36:18.607712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.590224Z","title":"Audio environment classifi- cation for hearing aids using artificial neural networks with windowed input,","venue":null,"work_id":"067afbe4-a943-41e5-9ec2-b93f767ac7bd","year":2007},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.962693Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:f879f2d56b1f341be493815c81d46e083ba73c89234435ad4cc5b7e81d221476","observation_id":"e4a5a116-631c-460a-8dc1-a3446c00755f","resolution":{"observed_at":"2026-08-12T05:36:18.594178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.577084Z","title":"Applying neural network on the content-based audio classification,","venue":null,"work_id":"8e69686f-9bf5-454f-8e64-80d06ca7d110","year":2003},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.966664Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:c060c1b911a08aa4d2d20a53bcb606d46a9011503a841aa1b814a32de7901e9e","observation_id":"ecf56670-8486-4395-84b5-7bcf998f291f","resolution":{"observed_at":"2026-08-12T05:36:18.581768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:16.971313Z","title":"A comprehen- sive review of synthetic data generation in smart farming by us- ing variational autoencoder and generative adversarial network,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.971313Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:a6022e0c9fb3608376a23ae612555c6db5fe9b6703bc7b83dac30b2d25331237","observation_id":"e5a3edc4-4f36-4358-bc7e-8fed2c390039","resolution":{"observed_at":"2026-08-12T05:36:16.971313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:16.975457Z","title":"Smart farm- ing using artificial intelligence: A review,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.975457Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:d5b79a8dbec51463b8f9a7e8fa9649d8e8faa974013e72b09b16bc926d09d86e","observation_id":"2f6b9fd0-1cd1-461e-a6df-a60bce33e3e1","resolution":{"observed_at":"2026-08-12T05:36:16.975457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.563914Z","title":"Sound classification using convolutional neural network and tensor deep stacking network,","venue":null,"work_id":"8d77bded-2f69-42b8-a777-a55eb8ef7a0a","year":2019},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.980244Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:810bd54250e2b2d3fdc24ebd26548b398cc77270ce12588d7ec9831d15582977","observation_id":"a4435f40-d9bd-41c9-b9ef-683583faafcd","resolution":{"observed_at":"2026-08-12T05:36:18.567696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.551454Z","title":"CNN architectures for large-scale audio classification,","venue":null,"work_id":"dc433759-d54b-4723-b180-4b796e44eb6d","year":2017},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.985106Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:b4a5730aae3e55b64e7f0a094802e324743b5f05dd23e8a3f7fbc3e546276fc4","observation_id":"45296efd-9b40-4ab2-9903-1551848ba821","resolution":{"observed_at":"2026-08-12T05:36:18.555803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.539071Z","title":"Music genre classification using duplicated convolutional layers in neural networks,","venue":null,"work_id":"59f171a9-ba22-4420-8a19-386c0eddc3b0","year":2019},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.989012Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:6840159b42349bf89f6e4802bf3ff927269a9d08461fcccee0ad19013040bbc0","observation_id":"9b44743d-3adf-476a-8540-f371c5d3bccf","resolution":{"observed_at":"2026-08-12T05:36:18.543168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.525784Z","title":"Convolutional recurrent neural networks for the classification of cetacean bioacoustic patterns,","venue":null,"work_id":"dd1013ed-62f0-4fc6-a0d8-847e68dea130","year":2023},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.993877Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:3d0a0101fa68b378f6b176ce00e1fb376528dc695e9522df54fbcf48bf9bada4","observation_id":"4f061442-abba-49c1-9782-c54d38f391eb","resolution":{"observed_at":"2026-08-12T05:36:18.529833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.512690Z","title":"Recurrent neural network transducer for audio-visual speech recognition,","venue":null,"work_id":"3e3809e3-0db1-4434-8505-f57d900b1fa2","year":2019},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:16.998502Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:67ae6295a364fb2cbd7053f7edddb86d052c0fc7c4c6fb33fafc0a08772619b9","observation_id":"ac7a3384-a861-49a9-8c85-14e8b68083dd","resolution":{"observed_at":"2026-08-12T05:36:18.516819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.500544Z","title":"Attention based convolutional recurrent neural network for environmental sound classi- fication,","venue":null,"work_id":"bde50207-d073-49d7-8e28-478e3326a43c","year":2021},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.003580Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:f38a5ef893cc6b2da9fac771b1c7ee55b6209121ba5b34ac3fdd084503664016","observation_id":"df803ddf-c573-416c-ab4b-713598d42401","resolution":{"observed_at":"2026-08-12T05:36:18.504722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.486321Z","title":"A Survey of Audio Classification using Deep Learning,","venue":null,"work_id":"f1bceebe-4c67-47aa-bf76-b14badf9a615","year":2023},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.007945Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:08373cb2cbd5bd3beb9da5b83ea89286fa77d35160b2c1bff33bb7e8606e824e","observation_id":"f1be6c3b-bfaf-4090-b07c-e82446f2862b","resolution":{"observed_at":"2026-08-12T05:36:18.490826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.473169Z","title":null,"venue":null,"work_id":"f5472a19-affd-49d8-b147-c38ed168b7c8","year":2020},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.012173Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:ebaaa79f3d82043c424f8eebcf41eb5dd3abe7c026ba43b91a5a67ffd3d7d7e0","observation_id":"756684eb-5493-4c38-83d7-1de86956c837","resolution":{"observed_at":"2026-08-12T05:36:18.477844Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.459766Z","title":"Multi-channel spectrograms for speech processing applications using deep learning methods,","venue":null,"work_id":"4873792e-2457-4414-a0df-2a59052fdb1d","year":2021},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.016602Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:868c9acf44fdb29bccefbe240db8017ec4ed4b058e0d7080f57329b043e7c8e6","observation_id":"f07d64c1-d9e3-4473-88e2-275ee5fd9b4f","resolution":{"observed_at":"2026-08-12T05:36:18.464192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.444479Z","title":"Deep neural networks for small footprint text-dependent speaker verification,","venue":null,"work_id":"d0197b43-cb52-4bbf-84e6-8184790f43f2","year":2014},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.020746Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:0db95ce1411b5b7b7913865b3153e137e4a0d714905b409c93c1f0946a1224ec","observation_id":"9dc09e02-9813-475d-9acb-2707794e2fb1","resolution":{"observed_at":"2026-08-12T05:36:18.449136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.429925Z","title":"End-to-end text- dependent speaker verification,","venue":null,"work_id":"95264ca5-f19a-4293-b724-114088d09663","year":2016},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.024406Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:8adced335919f876c7e9c3dd944c205900f469941fc9629f4c50977f2ead545a","observation_id":"25001eac-0a7c-4568-a7b3-71aa534ca9d0","resolution":{"observed_at":"2026-08-12T05:36:18.435408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.415914Z","title":"On Learning Interpretable CNNs with Parametric Modulated Kernel-Based Filters,","venue":null,"work_id":"78c4df48-cbd4-4aaa-9276-946ee0b4a794","year":2019},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.028847Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:c961c381a5b578b8895a4c77a3a2b62fcfc1e839fd1232a5674677ce4dfdff4f","observation_id":"4e595787-5c4f-472d-a3b5-45318a221cda","resolution":{"observed_at":"2026-08-12T05:36:18.420042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.402431Z","title":"Cgcnn: Complex Gabor con- volutional neural network on raw speech,","venue":null,"work_id":"ae8e1424-e140-4cd3-9cf2-a77b471eacb1","year":2020},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.033160Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:4c6dee3fa7461b9664b5b5e03eb02fbda6ab6bb99a961db9756bc6da668c8ae0","observation_id":"f8cc5749-108e-4166-96c3-0df4351281c0","resolution":{"observed_at":"2026-08-12T05:36:18.406317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.388852Z","title":"Learning filterbanks from raw speech for phone recognition,","venue":null,"work_id":"86f6a1cc-a36e-4ab8-a10f-9974e5515c94","year":2018},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.037191Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:04340d4493c62a7ba57778d16732be7784752353e6ee2f0529788cdda520ad5d","observation_id":"3fddf618-d6ca-4bb2-9430-e9b482752862","resolution":{"observed_at":"2026-08-12T05:36:18.393041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:17.041796Z","title":"Audio set: An ontology and human-labeled dataset for audio events,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.041796Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:3207ce2b660be04b9cb1c9655bdada155be2e74e922f188767291862d4e62b5f","observation_id":"a87c50bf-981d-454d-ace3-4770ab709024","resolution":{"observed_at":"2026-08-12T05:36:17.041796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.365604Z","title":"Efficientleaf: A faster learnable audio frontend of questionable use,","venue":null,"work_id":"e89f9876-a0da-4968-8b67-b85609e72b54","year":2022},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.046666Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:a391c44c98a2bcf89a09362b421642e20241ac2c5e62d7f93211729400d6f9ff","observation_id":"f17a1261-bade-4a89-89fd-58c22c87d379","resolution":{"observed_at":"2026-08-12T05:36:18.370163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.353168Z","title":"Analysis of CNN-based speech recognition system using raw speech as input,","venue":null,"work_id":"cf50e463-b7ca-47cf-b867-deff6f489cf8","year":2015},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.050948Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:b2376b65b7be08530d7151fe955c9d39b74ac2ce0f95b33cc05de72be225ed3b","observation_id":"fc0cbd64-c24a-464c-ae3f-dc422a794125","resolution":{"observed_at":"2026-08-12T05:36:18.357589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.339636Z","title":"Speech acoustic modeling from raw multichannel waveforms,","venue":null,"work_id":"8419125a-183b-4ee9-8426-32c6f00cf62a","year":2015},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.057083Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:26f38bbbef139497fb74e92e47477337c53db1f1e3ce0ae826b9ad28be268b42","observation_id":"9c312b56-e2c4-4307-af21-ca4cee8ee867","resolution":{"observed_at":"2026-08-12T05:36:18.343969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.326985Z","title":"Speaker location and microphone spacing in- variant acoustic modeling from raw multichannel waveforms,","venue":null,"work_id":"93143dc2-21e2-4fc1-b2ea-40def196978a","year":2015},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.062163Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:e7ddfef24511b8870c2044cd1a9d8de188368db7954daf62352d5a13562656cf","observation_id":"cc6b2ab8-b0fe-4eaf-bd50-820c911d0036","resolution":{"observed_at":"2026-08-12T05:36:18.331512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5622.2019","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:17.428325Z","title":"Audio compression using a modified discrete cosine transform with tem- poral auditory masking,","venue":null,"work_id":"f79ddc04-3a25-4907-844b-e973bd5bd8c1","year":2019},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.066519Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:54fcc357653130a8b20296da8974b020ef47dec640ce0ab531cb8e64f7c2afdf","observation_id":"26dcaa88-0ee5-4899-86d3-f068917b1c9e","resolution":{"observed_at":"2026-08-12T05:36:17.437501Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.314472Z","title":"Efficient object localization using convolutional networks,","venue":null,"work_id":"5462028f-3ba1-40f6-af8d-9b9eef3a7392","year":2015},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.071952Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:cec15f8e8d788dda40a2e34462b857afc9d55c8371e260b4694d9aeb0e016927","observation_id":"49e774ad-ad33-4990-887d-4711b05a9b6c","resolution":{"observed_at":"2026-08-12T05:36:18.318213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.301353Z","title":"Neural discrete representa- tion learning,","venue":null,"work_id":"ec4c961b-7c37-4d97-b40d-9d0e40157b89","year":2017},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.077028Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:b9d9e395135f914ccb6cdc34bd3041c0d6d510fd65d74552e5d59fae2328ca57","observation_id":"301cfc30-56cd-4c14-835d-3c711c03af89","resolution":{"observed_at":"2026-08-12T05:36:18.305982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.287014Z","title":"1D convolutional neural networks and applications: A survey,","venue":null,"work_id":"0c5d2e03-fcbb-4144-b6cb-fdb35153400b","year":2021},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.081308Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:9c2438f9ff38ddf0f4c0e7d5529f0b86529194da7856b5c8fa5150599d78e967","observation_id":"a3e2ba4a-f029-4fdb-991d-584647992d96","resolution":{"observed_at":"2026-08-12T05:36:18.291429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.4400","last_updated":"2014-03-04T05:15:42Z","snapshot_observed_at":"2026-08-14T23:51:30.531758Z","submitted_at":"2013-12-16T15:34:13Z","title":"Network In Network","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.4400","snapshot_observed_at":"2026-08-12T05:36:17.085294Z","title":"Network in network,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.085294Z"},"links":{"cited_paper":"/paper/1312.4400","citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:a0378230b6c84767976d9003619e6f36a64540c8ee4455c82286a320b2c17556","observation_id":"8ef51f6a-ec0c-4186-8571-1086f2aa10d0","resolution":{"observed_at":"2026-08-12T05:36:17.085294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.03209","last_updated":"2018-04-09T19:58:17Z","snapshot_observed_at":"2026-08-15T16:28:51.252929Z","submitted_at":"2018-04-09T19:58:17Z","title":"Speech Commands: A Dataset for Limited-Vocabulary Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.03209","snapshot_observed_at":"2026-08-12T05:36:17.090479Z","title":"Speech Commands: A Dataset for Limited-Vocabulary Speech Recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.090479Z"},"links":{"cited_paper":"/paper/1804.03209","citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:12146af0b398f4bc2ad0043fa1c7b31c172a0d02a0ef3e8b23ea26eb33e084fe","observation_id":"3f0ea0d3-676c-499b-8eb1-c0ac0a965f1d","resolution":{"observed_at":"2026-08-12T05:36:17.090479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.273215Z","title":"IEMOCAP: Interactive emotional dyadic motion capture database,","venue":null,"work_id":"ccccbee0-1524-45df-8331-6cee77ed0607","year":2008},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.095790Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:25cf52c69a7ea9f80e9230942aebff9569297be08207b29b045293b7a26dd784","observation_id":"52cd4775-96dc-46ff-a105-8553b46e397b","resolution":{"observed_at":"2026-08-12T05:36:18.277237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:17.101067Z","title":"Voxceleb: Large- scale speaker verification in the wild,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.101067Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:4ed254cc62a300c8775bec4efce0f6cf77ac6f6186f16d67fd45d13227dcd994","observation_id":"de551ab7-d94d-4371-aa7e-7bbc3dd881ee","resolution":{"observed_at":"2026-08-12T05:36:17.101067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.257985Z","title":"A multi-device dataset for urban acoustic scene classification,","venue":null,"work_id":"d5e8a1d0-f1c8-4e4b-8c05-6a1ea129b364","year":2018},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.106015Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:d5ce8f0ac8ac5133988da960c955f545c2254755837dd1a222ae6b108b5b0b51","observation_id":"5baa733c-34a4-4e08-80c4-26cdd909d5e8","resolution":{"observed_at":"2026-08-12T05:36:18.262734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T05:36:18.244246Z","title":"Neural audio synthesis of musical notes with wavenet au- toencoders,","venue":null,"work_id":"f5abc884-dc4c-47c2-a8f7-1ae6af1dbd35","year":2017},"citing_paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T05:36:17.110557Z"},"links":{"citing_paper":"/paper/2412.00312"},"observation_digest":"sha256:3d42d214c442d88d9360f8b34e58a8e39ed487bdb7a767f96625a8029d3d5a67","observation_id":"015ac11d-3684-4bb9-89d7-e1262004105d","resolution":{"observed_at":"2026-08-12T05:36:18.248441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.00312","last_updated":"2024-11-30T01:39:16Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-15T16:23:33.380498Z","submitted_at":"2024-11-30T01:39:16Z","title":"Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":1,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":12,"verified_exact":2,"verified_fuzzy":37},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2412.00312."}