{"as_of":"2026-08-09T05:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c028a471680f075d9efe46b6c681942ae846c536bdceceafc4e2945a0bff0a6c","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T22:41:17.365335Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.16305/citation-record","integrity":"/paper/2602.16305/integrity","json":"/paper/2602.16305/citation-record.json","paper":"/paper/2602.16305"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-02T22:41:16.642000Z","title":"Distilling the knowledge in a neural network.arXiv preprint arXiv:1503.02531,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.16305","last_updated":"2026-05-29T15:57:02Z","snapshot_observed_at":"2026-08-08T03:16:31.498203Z","submitted_at":"2026-02-18T09:37:20Z","title":"BAT: Better Audio Transformer Guided by Convex Gated Probing","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T22:41:16.642000Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2602.16305"},"observation_digest":"sha256:781d08126a7fa0231e5a884e03a10f53841dc5361d10c15af25a49a717efe701","observation_id":"906fbe31-597b-4837-86dc-343b74e9dc8a","resolution":{"observed_at":"2026-08-02T22:41:16.642000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-02T22:41:16.699188Z","title":"P., Hunt, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.16305","last_updated":"2026-05-29T15:57:02Z","snapshot_observed_at":"2026-08-08T03:16:31.498203Z","submitted_at":"2026-02-18T09:37:20Z","title":"BAT: Better Audio Transformer Guided by Convex Gated Probing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T22:41:16.699188Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2602.16305"},"observation_digest":"sha256:6f14aa32cb3894405f652e428d47cdb14e44bda409d936c03929d273a765212d","observation_id":"4a9fa353-b541-4e04-b809-66f2190659b2","resolution":{"observed_at":"2026-08-02T22:41:16.699188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.24901","last_updated":"2026-05-29T15:48:51Z","snapshot_observed_at":"2026-08-08T22:12:22.182176Z","submitted_at":"2025-09-29T15:11:18Z","title":"Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.24901","snapshot_observed_at":"2026-08-02T22:41:17.172433Z","title":"Unmute the patch tokens: Rethinking probing in multi-label audio classification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.16305","last_updated":"2026-05-29T15:57:02Z","snapshot_observed_at":"2026-08-08T03:16:31.498203Z","submitted_at":"2026-02-18T09:37:20Z","title":"BAT: Better Audio Transformer Guided by Convex Gated Probing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T22:41:17.172433Z"},"links":{"cited_paper":"/paper/2509.24901","citing_paper":"/paper/2602.16305"},"observation_digest":"sha256:f1d5833621b2670dcc7c3287c91035c2ad19cc0e012e5f36255d29f93acad590","observation_id":"6c12c591-c1b3-4fbe-ba14-1d56292205f6","resolution":{"observed_at":"2026-08-02T22:41:17.172433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03022","last_updated":"2022-05-29T17:51:53Z","snapshot_observed_at":"2026-08-08T22:27:15.105238Z","submitted_at":"2022-03-06T18:13:09Z","title":"HEAR: Holistic Evaluation of Audio Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.03022","snapshot_observed_at":"2026-08-02T22:41:17.282492Z","title":"R., Raj, B., Schuller, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.16305","last_updated":"2026-05-29T15:57:02Z","snapshot_observed_at":"2026-08-08T03:16:31.498203Z","submitted_at":"2026-02-18T09:37:20Z","title":"BAT: Better Audio Transformer Guided by Convex Gated Probing","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T22:41:17.282492Z"},"links":{"cited_paper":"/paper/2203.03022","citing_paper":"/paper/2602.16305"},"observation_digest":"sha256:c2389d0e109605088333eb4281f111ac5f1466ebfe5460d8659d825b0a17c41f","observation_id":"911ade0b-cbe0-4050-94a5-258388592c9e","resolution":{"observed_at":"2026-08-02T22:41:17.282492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.03209","last_updated":"2018-04-09T19:58:17Z","snapshot_observed_at":"2026-07-06T06:32:32.083176Z","submitted_at":"2018-04-09T19:58:17Z","title":"Speech Commands: A Dataset for Limited-Vocabulary Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.03209","snapshot_observed_at":"2026-08-02T22:41:17.365335Z","title":"Speech Commands: A Dataset for Limited- V ocabulary Speech Recognition.arXiv:1804.03209,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.16305","last_updated":"2026-05-29T15:57:02Z","snapshot_observed_at":"2026-08-08T03:16:31.498203Z","submitted_at":"2026-02-18T09:37:20Z","title":"BAT: Better Audio Transformer Guided by Convex Gated Probing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T22:41:17.365335Z"},"links":{"cited_paper":"/paper/1804.03209","citing_paper":"/paper/2602.16305"},"observation_digest":"sha256:633f876392d4506af12785e8dde51e39efa0fc7c682f802b94af5ff61b8996c7","observation_id":"7591f2fb-ff44-4857-9b48-7cce12f5db5c","resolution":{"observed_at":"2026-08-02T22:41:17.365335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:41:17.026841Z","title":"Beyond [CLS]: Exploring the true potential of masked image modeling representations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.16305","last_updated":"2026-05-29T15:57:02Z","snapshot_observed_at":"2026-08-08T03:16:31.498203Z","submitted_at":"2026-02-18T09:37:20Z","title":"BAT: Better Audio Transformer Guided by Convex Gated Probing","version":2},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-02T22:41:17.026841Z"},"links":{"citing_paper":"/paper/2602.16305"},"observation_digest":"sha256:5175799cd88141f2f27ad51f07a998f8a764e3fbc85e70c18d1331d8667124f4","observation_id":"38931a61-f864-4c0f-945c-0d0cd712723f","resolution":{"observed_at":"2026-08-02T22:41:17.026841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.06366","last_updated":"2022-10-03T11:47:10Z","snapshot_observed_at":"2026-08-04T18:14:09.239336Z","submitted_at":"2022-08-12T16:48:10Z","title":"BEiT v2: Masked Image Modeling with Vector-Quantized Visual Tokenizers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.06366","snapshot_observed_at":"2026-08-02T22:41:16.967166Z","title":"Beit v2: Masked image modeling with vector-quantized visual tokenizers.arXiv preprint arXiv:2208.06366,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.16305","last_updated":"2026-05-29T15:57:02Z","snapshot_observed_at":"2026-08-08T03:16:31.498203Z","submitted_at":"2026-02-18T09:37:20Z","title":"BAT: Better Audio Transformer Guided by Convex Gated Probing","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-02T22:41:16.967166Z"},"links":{"cited_paper":"/paper/2208.06366","citing_paper":"/paper/2602.16305"},"observation_digest":"sha256:cd212616c50cc8fa3fbd0edeab8de07e826a35a31056f88813d406bf2f68d13f","observation_id":"0affb7cc-401b-4e19-923e-e8b29075326d","resolution":{"observed_at":"2026-08-02T22:41:16.967166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.12260","last_updated":"2022-04-26T12:32:10Z","snapshot_observed_at":"2026-08-08T07:46:16.948389Z","submitted_at":"2022-04-26T12:32:10Z","title":"Masked Spectrogram Modeling using Masked Autoencoders for Learning General-purpose Audio Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.12260","snapshot_observed_at":"2026-08-02T22:41:16.765942Z","title":"Masked spectrogram modeling using masked autoencoders for learning general-purpose audio repre- sentation.arXiv:2204.12260,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.16305","last_updated":"2026-05-29T15:57:02Z","snapshot_observed_at":"2026-08-08T03:16:31.498203Z","submitted_at":"2026-02-18T09:37:20Z","title":"BAT: Better Audio Transformer Guided by Convex Gated Probing","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-02T22:41:16.765942Z"},"links":{"cited_paper":"/paper/2204.12260","citing_paper":"/paper/2602.16305"},"observation_digest":"sha256:2c762b320c8f8bb197d8427f44bc8dab0abf75f8451d88d19f027023455bfa63","observation_id":"6118d71f-d3c9-4214-a546-2444cf67ddfc","resolution":{"observed_at":"2026-08-02T22:41:16.765942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04906","last_updated":"2022-01-28T12:23:37Z","snapshot_observed_at":"2026-07-06T11:08:17.373935Z","submitted_at":"2021-05-11T09:53:21Z","title":"VICReg: Variance-Invariance-Covariance Regularization for Self-Supervised Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04906","snapshot_observed_at":"2026-08-02T22:41:16.534566Z","title":"Vicreg: Variance- invariance-covariance regularization for self-supervised learning.arXiv preprint arXiv:2105.04906,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.16305","last_updated":"2026-05-29T15:57:02Z","snapshot_observed_at":"2026-08-08T03:16:31.498203Z","submitted_at":"2026-02-18T09:37:20Z","title":"BAT: Better Audio Transformer Guided by Convex Gated Probing","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-02T22:41:16.534566Z"},"links":{"cited_paper":"/paper/2105.04906","citing_paper":"/paper/2602.16305"},"observation_digest":"sha256:0dcf15c5c5d4d475b5d54f29b33b0064100034619ffbc3af625258218eae6204","observation_id":"b924d19e-6e7e-4de3-aea6-4e6feabdab7f","resolution":{"observed_at":"2026-08-02T22:41:16.534566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14637","last_updated":"2024-09-23T00:31:39Z","snapshot_observed_at":"2026-07-06T19:19:37.350445Z","submitted_at":"2024-09-23T00:31:39Z","title":"Not Only the Last-Layer Features for Spurious Correlations: All Layer Deep Feature Reweighting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14637","snapshot_observed_at":"2026-08-02T22:41:16.594200Z","title":"W., Nanfack, G., and Belilovsky, E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.16305","last_updated":"2026-05-29T15:57:02Z","snapshot_observed_at":"2026-08-08T03:16:31.498203Z","submitted_at":"2026-02-18T09:37:20Z","title":"BAT: Better Audio Transformer Guided by Convex Gated Probing","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T22:41:16.594200Z"},"links":{"cited_paper":"/paper/2409.14637","citing_paper":"/paper/2602.16305"},"observation_digest":"sha256:0477418cefe9e1fc4051b55bd8d6a1d589acb017380856d0ef451260eacf502e","observation_id":"c5e7b028-b8c8-423f-9818-e31779d8b4e2","resolution":{"observed_at":"2026-08-02T22:41:16.594200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.01038","last_updated":"2019-04-01T18:05:02Z","snapshot_observed_at":"2026-08-06T00:26:50.886840Z","submitted_at":"2019-04-01T18:05:02Z","title":"fairseq: A Fast, Extensible Toolkit for Sequence Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.01038","snapshot_observed_at":"2026-08-02T22:41:16.873757Z","title":"fairseq: A fast, extensible toolkit for sequence modeling.arXiv:1904.01038,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2602.16305","last_updated":"2026-05-29T15:57:02Z","snapshot_observed_at":"2026-08-08T03:16:31.498203Z","submitted_at":"2026-02-18T09:37:20Z","title":"BAT: Better Audio Transformer Guided by Convex Gated Probing","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T22:41:16.873757Z"},"links":{"cited_paper":"/paper/1904.01038","citing_paper":"/paper/2602.16305"},"observation_digest":"sha256:74d7efad0bc5c99daaab155ccaceaa6415641eea34fa728f79a31816b8f2b0ab","observation_id":"8447544d-bb2f-4b48-85e1-77e672092be8","resolution":{"observed_at":"2026-08-02T22:41:16.873757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:41:17.084231Z","title":"Attention, please! revisiting attentive probing for masked image modeling.arXiv:2506.10178,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.16305","last_updated":"2026-05-29T15:57:02Z","snapshot_observed_at":"2026-08-08T03:16:31.498203Z","submitted_at":"2026-02-18T09:37:20Z","title":"BAT: Better Audio Transformer Guided by Convex Gated Probing","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T22:41:17.084231Z"},"links":{"citing_paper":"/paper/2602.16305"},"observation_digest":"sha256:128578eb46720ab343132f60b0529b9ae8287eb9dfd495a47dedc354efdc0fce","observation_id":"f5dc7a81-6efe-45dc-89ef-658468777dc8","resolution":{"observed_at":"2026-08-02T22:41:17.084231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.16305","last_updated":"2026-05-29T15:57:02Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-08T03:16:31.498203Z","submitted_at":"2026-02-18T09:37:20Z","title":"BAT: Better Audio Transformer Guided by Convex Gated Probing"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2602.16305."}