{"as_of":"2026-08-17T15:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9da3c4d179795a137e073dae7a1be867af920befcdb6869b47193b67d86090eb","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:55:44.823010Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.03464/citation-record","integrity":"/paper/2501.03464/integrity","json":"/paper/2501.03464/citation-record.json","paper":"/paper/2501.03464"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.354217Z","title":"Sound event detection: A tutorial,","venue":null,"work_id":"ecc2d1fd-254d-4925-913e-83e13da2ffbc","year":2021},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.701485Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:ea89324a8068a15bd5ebdb5fd3f65c87f339f92951c9dacfbfc55f65fb04d592","observation_id":"6325dd78-87eb-46b4-849f-3577b647ddb0","resolution":{"observed_at":"2026-08-10T21:55:45.361388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.335575Z","title":"Deep learning in music recommendation systems,","venue":null,"work_id":"21e682fc-fe44-4540-a8e5-13f9a039bae3","year":2019},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.706300Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:f3460667396e5b3af0654153add3a02b3c1e6772937622a89f025e2f1539c6d8","observation_id":"e8d7620d-e248-4380-903f-8897faad861f","resolution":{"observed_at":"2026-08-10T21:55:45.340990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.309349Z","title":"Deep spoken keyword spotting: An overview,","venue":null,"work_id":"7db7c255-39ce-4e45-9aed-a1cd4c8b3d38","year":2021},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.710946Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:de5e6817ca7b0c2808533188bb80e80598b2f803b26d9a2ef8732cc0165ec95a","observation_id":"55f08fcf-30d1-475e-b4bc-13443cccd571","resolution":{"observed_at":"2026-08-10T21:55:45.317985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.11154","last_updated":"2020-11-13T19:09:09Z","snapshot_observed_at":"2026-08-13T10:14:31.550038Z","submitted_at":"2020-07-22T01:31:44Z","title":"Rethinking CNN Models for Audio Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.11154","snapshot_observed_at":"2026-08-10T21:55:44.715285Z","title":"Rethinking cnn models for audio classification,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.715285Z"},"links":{"cited_paper":"/paper/2007.11154","citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:a2f0c771a0730adf80798d133dd524f3e0e101a13b70b6d13a7c41e48533d2d0","observation_id":"ae89e485-d290-4b1c-b068-07621e0f7c7b","resolution":{"observed_at":"2026-08-10T21:55:44.715285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01778","last_updated":"2021-07-08T20:16:28Z","snapshot_observed_at":"2026-08-16T18:33:54.408269Z","submitted_at":"2021-04-05T05:26:29Z","title":"AST: Audio Spectrogram Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01778","snapshot_observed_at":"2026-08-10T21:55:44.719966Z","title":"Ast: Audio spectrogram transformer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.719966Z"},"links":{"cited_paper":"/paper/2104.01778","citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:b90c9b62da1f1c899b0f1bc6b887c6215267c64697c5384568779dde7994eed9","observation_id":"8bab9c2e-488c-4f31-aa61-835f4f7b511c","resolution":{"observed_at":"2026-08-10T21:55:44.719966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.293071Z","title":"Clusterfomer,","venue":null,"work_id":"c413c226-cdaf-4b26-aa92-bdf61057be5f","year":2024},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.724245Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:2c2dea359a62804e2a41616a1faa580c90503f57d14e5f5865f5c0b44642ccdf","observation_id":"36e45f4b-c836-45ff-8fd8-68412a838374","resolution":{"observed_at":"2026-08-10T21:55:45.298682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.273805Z","title":"Hypergraph neural networks,","venue":null,"work_id":"1381fc04-fd7c-4152-9604-09e84568fe5b","year":2019},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.728346Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:be5e3e96e8bdfd5601cf38008b0c17dacb53297628341676ce64dab2667d1198","observation_id":"657868b8-6b35-4119-8828-f1c116485e82","resolution":{"observed_at":"2026-08-10T21:55:45.278446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:44.731981Z","title":"Vision hgnn: An image is more than a graph of nodes,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.731981Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:9897fc35571ee37b07f5bfdf2d9f3ca6396cf7aa06b0f64b3e613f87f3eb9796","observation_id":"2527155e-813a-46cf-a47e-ade6d9df8b66","resolution":{"observed_at":"2026-08-10T21:55:44.731981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.245084Z","title":"Everything is connected: Graph neural networks,","venue":null,"work_id":"07add9e9-72c0-4cb9-925d-29b3d9943f44","year":2023},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.735725Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:f1bea1711deee2101b463ed7fc85fbe840265805016ebda49ad27dff779746a8","observation_id":"cf5b7c73-2339-46eb-947c-540249751025","resolution":{"observed_at":"2026-08-10T21:55:45.250530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.226487Z","title":"Vision gnn: An image is worth graph of nodes,","venue":null,"work_id":"cf6bfb7f-174f-4d83-a313-b7416ce22464","year":2022},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.739672Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:9a33f120ff224c7bd8b67c2ad3e9abe9bf6c2f254e84c2566946cfb2b6d1765f","observation_id":"413ecf94-e412-40a2-a503-cd29f94beeb4","resolution":{"observed_at":"2026-08-10T21:55:45.231652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.204751Z","title":"Atgnn: Audio tagging graph neural network,","venue":null,"work_id":"51276100-8370-4b9e-b87a-3859cbb9a598","year":2024},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.743664Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:34dfc8df3790e3fe315479cfcdf40d52178e13e848ede79802ae8435f2053b74","observation_id":"7ad759b0-88b9-4134-86e9-7318da9d3896","resolution":{"observed_at":"2026-08-10T21:55:45.209363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.187810Z","title":"Cmt: Convolutional neural networks meet vision transformers,","venue":null,"work_id":"eb28745a-a5e8-4c77-92c9-0833139e46b3","year":2022},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.748149Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:dd33d22585a2065021879a72548f5764bb02913297249d5ca9469339b7a979c7","observation_id":"173befea-b864-49be-b000-f17ffac96d88","resolution":{"observed_at":"2026-08-10T21:55:45.193060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-08-13T19:48:28.322536Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-10T21:55:44.752143Z","title":"Gaussian error linear units (gelus),","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.752143Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:44dd8495dc5a0c096933b28fceed64f78c50d52ca9eb4fb5ac775320c2c7a99d","observation_id":"b69da150-041e-422f-a508-39a31f443ab2","resolution":{"observed_at":"2026-08-10T21:55:44.752143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.163565Z","title":"Orthogonal transformer,","venue":null,"work_id":"fd725d8d-4853-4fd8-8c61-8a9fe1f029ed","year":2022},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.756406Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:ff0265a28fe0dbc39782ae3b5230036c95ab8962184645298d25141331f9fe84","observation_id":"324f534c-6715-42b8-94f5-c5c002c1a6d8","resolution":{"observed_at":"2026-08-10T21:55:45.167870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.146468Z","title":"How do vision transformers work?,","venue":null,"work_id":"0f8a289e-2e9c-4ba3-80e9-45f414d76a12","year":2022},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.760167Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:934c8098193956599206c1e8f8ea853b0542fd73809e718bc3928c8ee88d4f30","observation_id":"9c34f8ae-0218-4d16-a678-9d2f21a54b15","resolution":{"observed_at":"2026-08-10T21:55:45.152758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.131593Z","title":"Srformer: Permuted self-attention for single image super-resolution,","venue":null,"work_id":"69044363-904b-417d-97a2-77cdf44bf7cd","year":2023},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.764081Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:cc8fcf94113093721ff295b45b4fc589edbfcdc3abbb3541577e8e62d6895004","observation_id":"c0c72d1e-def0-4d27-9dd2-61296b454557","resolution":{"observed_at":"2026-08-10T21:55:45.136937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.116752Z","title":"Audioset,","venue":null,"work_id":"0ef64a98-9d93-4079-8d7b-ce85dec40ffe","year":2017},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.768221Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:ee0e1c012d469dda457706dec6401ad34e07925f925ea5a189c19bf42794d4fc","observation_id":"18ab7291-cd5e-4ae6-8ef1-c72a7307e43b","resolution":{"observed_at":"2026-08-10T21:55:45.120995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.100406Z","title":null,"venue":null,"work_id":"784c528b-4e65-4b00-b6f0-38b5e49f6aa8","year":2021},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.772186Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:c0c82f6f1a68595f73293464d8fa8798e21fb40a8385ed957232e8fa2fffe6c2","observation_id":"6b471681-39e3-4c66-8e42-43a06c66660f","resolution":{"observed_at":"2026-08-10T21:55:45.107001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.083630Z","title":"Esc-50: Dataset for environmental sound classification,","venue":null,"work_id":"c92e1881-2b1c-4fd6-b1e4-145570e92a7b","year":2015},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.776136Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:4258060b28709d273c7d56e9e7240f95b690b89a358139e495a93fc8bbc84fd2","observation_id":"45310162-1495-4a37-942d-16bad4d8a98f","resolution":{"observed_at":"2026-08-10T21:55:45.088783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.064574Z","title":"PSLA: Improving audio tagging with pretraining, sampling, labeling, and aggregation,","venue":null,"work_id":"92483af2-417f-42dd-88c7-3fa02e38cf53","year":2021},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.780860Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:6009140d0923eba1f0176ed6c8bf8911a4e69adecd267b5561584f3149b55fa4","observation_id":"fd448187-d700-40a2-b395-e01277fb93cb","resolution":{"observed_at":"2026-08-10T21:55:45.070832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-08-08T10:28:19.597631Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-08-10T21:55:44.785607Z","title":"mixup: Beyond empirical risk minimization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.785607Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:96b6b105fd17ee015ea4be5a30700c41c387971a325383a6a0f701a1865dfbae","observation_id":"6a18f7b1-9544-40d6-955e-e625fff5297c","resolution":{"observed_at":"2026-08-10T21:55:44.785607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08779","last_updated":"2019-12-03T18:19:07Z","snapshot_observed_at":"2026-08-15T18:44:59.455586Z","submitted_at":"2019-04-18T17:53:38Z","title":"SpecAugment: A Simple Data Augmentation Method for Automatic Speech Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08779","snapshot_observed_at":"2026-08-10T21:55:44.790298Z","title":"Specaugment: A simple data augmentation method for automatic speech recognition,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.790298Z"},"links":{"cited_paper":"/paper/1904.08779","citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:22dead944a38e75cada6e95eac8ddbee086959a5fcd3d2a2b4b8170f28050acc","observation_id":"7c8d5a98-8fde-479c-baac-b39705c6c96b","resolution":{"observed_at":"2026-08-10T21:55:44.790298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.043303Z","title":"A deep residual network for large-scale acoustic scene analysis.,","venue":null,"work_id":"927c0bf7-bee0-4a5c-9a92-e9405bedd409","year":2019},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.796399Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:26763c1adab90a96ca7f03a437265fa28933b0a4db8457395a6a623df225905b","observation_id":"1c734d9e-c38c-49c4-8cfb-24514d8becdc","resolution":{"observed_at":"2026-08-10T21:55:45.048524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.021757Z","title":"Panns: Large-scale pretrained audio neural networks for audio pattern recognition,","venue":null,"work_id":"a1e76eca-c590-4e79-99db-2fd1504b1728","year":2020},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.800423Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:7df5309d31017ade1882404e0d18bf1c9a3d0a218bf6997b19ef855bc410ca05","observation_id":"a32afdfd-557b-49f9-a62f-10c52751d507","resolution":{"observed_at":"2026-08-10T21:55:45.027612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:45.000384Z","title":"Wav2clip: Learning robust audio representations from clip,","venue":null,"work_id":"11532d4a-2ac6-4a8b-84e6-7c49860bb5d9","year":2022},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.804265Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:644f4fbf7db9afa4ebf113f64667c6467d35de1cad30e855b5c55f696c292cdd","observation_id":"6b6313b2-6a26-457e-9874-b3fb74c443ab","resolution":{"observed_at":"2026-08-10T21:55:45.007148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.00335","last_updated":"2025-05-11T23:57:58Z","snapshot_observed_at":"2026-08-16T18:27:39.380785Z","submitted_at":"2021-05-01T19:38:30Z","title":"Audio Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.00335","snapshot_observed_at":"2026-08-10T21:55:44.808697Z","title":"Audio transformers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.808697Z"},"links":{"cited_paper":"/paper/2105.00335","citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:12eb961ed44f43924597e8c8cceac241b70d71fea9c5e8d749198cf6e4a9a257","observation_id":"6b0c9c7e-4c83-4f61-858e-6c261e875287","resolution":{"observed_at":"2026-08-10T21:55:44.808697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:44.814147Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.814147Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:b85d68ed7bb80bf0d7811a4a43ff1b1fad221d839e90ff0d53acb1a8d88a2cf6","observation_id":"510729f1-d569-4d93-9d28-5146d7af1fd5","resolution":{"observed_at":"2026-08-10T21:55:44.814147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:44.972635Z","title":null,"venue":null,"work_id":"dcad2a8e-b5a1-4784-af8e-c81b90504eee","year":2022},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.818155Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:b6050b3a6b9e348d083a91e1c550db56bbd1a6372aed74b1dd463439436f258d","observation_id":"f220a941-f7bb-4480-b009-0a99628dce3b","resolution":{"observed_at":"2026-08-10T21:55:44.977369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:55:44.955534Z","title":"ESC: Dataset for Environmental Sound Classification,","venue":null,"work_id":"ea3aedea-1085-4f00-9f6e-7a606d7f8a18","year":null},"citing_paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T21:55:44.823010Z"},"links":{"citing_paper":"/paper/2501.03464"},"observation_digest":"sha256:d4b796650f85c54f38079af9adf50d3028e65e18529fe89be91b248a39833416","observation_id":"16a140a1-6eb7-4f66-9761-11b1ddcdc4ae","resolution":{"observed_at":"2026-08-10T21:55:44.962245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.03464","last_updated":"2025-01-29T12:22:49Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-14T17:34:53.064751Z","submitted_at":"2025-01-07T01:45:39Z","title":"LHGNN: Local-Higher Order Graph Neural Networks For Audio Classification and Tagging"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2501.03464."}