{"as_of":"2026-08-14T19:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:983fc76a68c04db9e11586d2b9cd82f78f9cd40d76773c069718b9ec7a793b16","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":4,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":4,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T11:32:35.784317Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-11T01:05:36.526806Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1711.02520","last_updated":"2018-06-15T08:04:37Z","snapshot_observed_at":"2026-07-06T06:08:12.462084Z","submitted_at":"2017-11-07T15:10:39Z","title":"End-to-end learning for music audio tagging at scale","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.02520","snapshot_observed_at":"2026-08-14T11:32:35.784317Z","title":"End-to-end learning for music audio tagging at scale,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.08769","last_updated":"2019-10-23T09:43:51Z","snapshot_observed_at":"2026-08-14T17:39:43.476188Z","submitted_at":"2019-08-23T11:55:13Z","title":"Lukthung Classification Using Neural Networks on Lyrics and Audios","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T11:32:35.784317Z"},"links":{"cited_paper":"/paper/1711.02520","citing_paper":"/paper/1908.08769"},"observation_digest":"sha256:e3342992acc590e0c14ebc6d47175cc9db3715c77c97de5f4b8e150c3afeb1d9","observation_id":"d30f4abe-f4b4-4ad4-aa0d-87d1c40c333d","resolution":{"observed_at":"2026-08-14T11:32:35.784317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.02520","last_updated":"2018-06-15T08:04:37Z","snapshot_observed_at":"2026-07-06T06:08:12.462084Z","submitted_at":"2017-11-07T15:10:39Z","title":"End-to-end learning for music audio tagging at scale","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.02520","snapshot_observed_at":"2026-08-12T20:23:11.334625Z","title":"End-to-end learning for music audio tagging at scale","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.09827","last_updated":"2024-11-14T22:24:59Z","snapshot_observed_at":"2026-08-14T09:26:35.790181Z","submitted_at":"2024-11-14T22:24:59Z","title":"The Good, The Efficient and the Inductive Biases: Exploring Efficiency in Deep Learning Through the Use of Inductive Biases","version":1},"reference_index":294,"source":"pdf_text","source_observed_at":"2026-08-12T20:23:11.334625Z"},"links":{"cited_paper":"/paper/1711.02520","citing_paper":"/paper/2411.09827"},"observation_digest":"sha256:5ad3f29977939dbd0951000daf382cb27fc60895b9d619713251122fd950485f","observation_id":"0f42f745-4e9a-400f-961e-9cf3f1de5ddc","resolution":{"observed_at":"2026-08-12T20:23:11.334625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.02520","last_updated":"2018-06-15T08:04:37Z","snapshot_observed_at":"2026-07-06T06:08:12.462084Z","submitted_at":"2017-11-07T15:10:39Z","title":"End-to-end learning for music audio tagging at scale","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.02520","snapshot_observed_at":"2026-08-12T18:02:17.876163Z","title":"Schmidt, Andreas F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.12058","last_updated":"2024-11-18T20:56:44Z","snapshot_observed_at":"2026-08-13T11:20:44.116201Z","submitted_at":"2024-11-18T20:56:44Z","title":"Vision Language Models Are Few-Shot Audio Spectrogram Classifiers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T18:02:17.876163Z"},"links":{"cited_paper":"/paper/1711.02520","citing_paper":"/paper/2411.12058"},"observation_digest":"sha256:bc7ad9968637496192af5aff2d99928e447743aaedd926cadcfda3ded05ad3ce","observation_id":"80d5344d-843b-4a97-938b-4092e8bf42ed","resolution":{"observed_at":"2026-08-12T18:02:17.876163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.02520","last_updated":"2018-06-15T08:04:37Z","snapshot_observed_at":"2026-07-06T06:08:12.462084Z","submitted_at":"2017-11-07T15:10:39Z","title":"End-to-end learning for music audio tagging at scale","version":4},"cited_work":{"arxiv_id":"1711.02520","doi":null,"metadata_source":"pith","pith_arxiv_id":"1711.02520","snapshot_observed_at":"2026-08-11T01:05:36.526806Z","title":"End-to-end learning for music audio tagging at scale","venue":"cs.SD","work_id":"cefda2b2-159d-41e8-9065-2fdbe6afb916","year":2017},"citing_paper":{"arxiv_id":"2412.18955","last_updated":"2024-12-25T18:06:44Z","snapshot_observed_at":"2026-08-11T18:34:04.173842Z","submitted_at":"2024-12-25T18:06:44Z","title":"Leave-One-EquiVariant: Alleviating invariance-related information loss in contrastive music representations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T01:05:36.142802Z"},"links":{"cited_paper":"/paper/1711.02520","citing_paper":"/paper/2412.18955"},"observation_digest":"sha256:d7e54194b2fdfcccb230dfc5331d831657906da81ee6814074e42c760057906b","observation_id":"172dd704-c55e-4cd5-a844-f4416438b873","resolution":{"observed_at":"2026-08-11T01:05:36.537014Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1711.02520/citation-record","integrity":"/paper/1711.02520/integrity","json":"/paper/1711.02520/citation-record.json","paper":"/paper/1711.02520"},"outbound":[],"paper":{"arxiv_id":"1711.02520","last_updated":"2018-06-15T08:04:37Z","latest_version":4,"primary_category":"cs.SD","snapshot_observed_at":"2026-07-06T06:08:12.462084Z","submitted_at":"2017-11-07T15:10:39Z","title":"End-to-end learning for music audio tagging at scale"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 4 inbound Pith citation observations for arXiv:1711.02520."}