{"as_of":"2026-08-22T21:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fa9de49d87d71ef6ab0ca2ed3b51328c5dfa92e44966521ea8b05e049ff221da","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T20:54:14.361479Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.08283/citation-record","integrity":"/paper/2509.08283/integrity","json":"/paper/2509.08283/citation-record.json","paper":"/paper/2509.08283"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:17.747022Z","title":"Attributing fake images to gans: Learning and analyzing gan finger- prints,","venue":null,"work_id":"770f28fb-1a8a-45e5-9f8d-a36d16710fec","year":2019},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:11.961226Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:4df64a571ed2053229540b562b4cc79b82944436a121dbf4cdc3508cca7da149","observation_id":"2e331da7-294e-4b4d-a050-f6412544241a","resolution":{"observed_at":"2026-08-04T20:54:17.801013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-04T20:54:12.012616Z","title":"Make-a-video: Text-to-video generation without text-video data,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:12.012616Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:453d2afab23c2f7e8e4209002149da19f76cf28cf7c1b7bac6543ca188fa7aa6","observation_id":"0e73e0e9-8cf2-425f-8773-b8707361d0fc","resolution":{"observed_at":"2026-08-04T20:54:12.012616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15352","last_updated":"2023-03-05T09:14:16Z","snapshot_observed_at":"2026-08-16T16:27:53.560021Z","submitted_at":"2022-09-30T10:17:05Z","title":"AudioGen: Textually Guided Audio Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15352","snapshot_observed_at":"2026-08-04T20:54:12.105923Z","title":"Audiogen: Textually guided audio generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:12.105923Z"},"links":{"cited_paper":"/paper/2209.15352","citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:27c8446e80916b16279058fb0a201188973e7cc18e40d0b4f2759cceac7a9c02","observation_id":"a4ad2945-d372-4a1a-bec9-ff1e605254a2","resolution":{"observed_at":"2026-08-04T20:54:12.105923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:17.624628Z","title":"Audioldm 2: Learning holistic audio generation with self-supervised pretraining,","venue":null,"work_id":"938c436e-f6f6-4d7d-b18b-85119795dcd6","year":2024},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:12.209672Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:eb75ed1a4d557d768997280d191aa6d3436543ccfd48a1201158d1993589278a","observation_id":"df198c1b-c884-4675-ba33-1b5c779f30e3","resolution":{"observed_at":"2026-08-04T20:54:17.674628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:12.269657Z","title":"Improving language understanding by generative pre-training,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:12.269657Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:d8774e0a562717e8c11127500a2d2d773be54000c2d7d9f579f3dbf732404e01","observation_id":"75de2e93-c2e8-4737-9d6e-a8f0414dd397","resolution":{"observed_at":"2026-08-04T20:54:12.269657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:17.449412Z","title":"Pre-trained language models for text generation: A sur- vey,","venue":null,"work_id":"bacaea24-bc08-4b59-843d-f4e7af144801","year":2024},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:12.330266Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:c78aa0ef88dd11d4318412fa8ea88721127518152c6e53b6fd55efa8fc6bc3ee","observation_id":"28a36ec7-b9a6-4453-8471-5e6856e5acb8","resolution":{"observed_at":"2026-08-04T20:54:17.492857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08778","last_updated":"2024-08-16T14:39:51Z","snapshot_observed_at":"2026-08-19T17:53:26.083785Z","submitted_at":"2024-08-16T14:39:51Z","title":"Watching the Generative AI Hype Bubble Deflate","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08778","snapshot_observed_at":"2026-08-04T20:54:12.395540Z","title":"Watching the generative ai hype bubble deflate,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:12.395540Z"},"links":{"cited_paper":"/paper/2408.08778","citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:ba86836125bc5a43691116efbe94b19b7aa012aa5a77d9f60c5deef359b00abb","observation_id":"6c07e52a-e2fb-45a3-b2b0-45bc8ad84434","resolution":{"observed_at":"2026-08-04T20:54:12.395540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14970","last_updated":"2023-08-29T01:50:01Z","snapshot_observed_at":"2026-08-20T12:29:57.127709Z","submitted_at":"2023-08-29T01:50:01Z","title":"Audio Deepfake Detection: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14970","snapshot_observed_at":"2026-08-04T20:54:12.490089Z","title":"Audio deepfake detection: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:12.490089Z"},"links":{"cited_paper":"/paper/2308.14970","citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:42a3143e8387944bd7f4494957f3dddf9a95b3795aaf86305fee7d56add9cd44","observation_id":"fe6bee83-f128-4250-9ae3-3124a616413e","resolution":{"observed_at":"2026-08-04T20:54:12.490089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:17.323617Z","title":"Asvspoof 2021: Towards spoofed and deepfake speech detection in the wild,","venue":null,"work_id":"818f5ee6-7103-467f-8c93-7849c192bd98","year":2021},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:12.563466Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:6009e5201ad708ba4a2f49d5ceddaabc16b6bcd6f25d20c180e1f867e4082fb3","observation_id":"08db94c4-4ee2-46f4-9f5f-a2979b7e76c7","resolution":{"observed_at":"2026-08-04T20:54:17.368904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13774","last_updated":"2023-05-23T07:42:52Z","snapshot_observed_at":"2026-08-20T03:00:07.655339Z","submitted_at":"2023-05-23T07:42:52Z","title":"ADD 2023: the Second Audio Deepfake Detection Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13774","snapshot_observed_at":"2026-08-04T20:54:12.611785Z","title":"Add 2023: The second audio deepfake detection challenge,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:12.611785Z"},"links":{"cited_paper":"/paper/2305.13774","citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:53c711e0f99e5aa1d795bbf03ab73b16b418cd35b66b465959fc3635336662fe","observation_id":"77c186f3-1dbe-40fb-a1a4-89c41ffe7b6d","resolution":{"observed_at":"2026-08-04T20:54:12.611785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:17.122394Z","title":"Deepfakes generation and detec- tion: State-of-the-art, open challenges, countermeasures, and way forward,","venue":null,"work_id":"550db67d-e4bb-4ad4-8db5-d8c6bcdf4f42","year":2023},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:12.700020Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:682627de92bea9f45ac5f8f1856d539677fcf4a43f305c1c08098ca6576e8818","observation_id":"048d2caa-d952-4c6c-b6f4-80f9a062bc43","resolution":{"observed_at":"2026-08-04T20:54:17.195514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:16.978863Z","title":"Deepfake generation and detection: Case study and challenges,","venue":null,"work_id":"6b153626-a8d5-4164-8f16-c319cdac2334","year":2023},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:12.757306Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:0e2635efd99a72206e3da81c33795fd4787ad1918cb4f14880456c2278772642","observation_id":"38f00c65-e214-49ae-b564-42fba6f27351","resolution":{"observed_at":"2026-08-04T20:54:17.039166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14080","last_updated":"2025-02-25T03:22:49Z","snapshot_observed_at":"2026-08-16T13:23:54.136991Z","submitted_at":"2024-08-26T08:02:57Z","title":"SONICS: Synthetic Or Not -- Identifying Counterfeit Songs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14080","snapshot_observed_at":"2026-08-04T20:54:12.790871Z","title":"Sonics: Synthetic or not–identifying counterfeit songs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:12.790871Z"},"links":{"cited_paper":"/paper/2408.14080","citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:951dc47ff99b0d32cce922350bec601fc95c7c143328ca37819a528837dc0027","observation_id":"ac4a16e0-ff30-4fdc-94ab-7ce5d257783b","resolution":{"observed_at":"2026-08-04T20:54:12.790871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05161","last_updated":"2023-07-11T10:37:57Z","snapshot_observed_at":"2026-08-16T15:17:10.296891Z","submitted_at":"2023-07-11T10:37:57Z","title":"On the Effectiveness of Speech Self-supervised Learning for Music","version":1},"cited_work":{"arxiv_id":"2307.05161","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.05161","snapshot_observed_at":"2026-08-04T20:54:14.625263Z","title":"On the Effectiveness of Speech Self-supervised Learning for Music","venue":"cs.SD","work_id":"8f31b8fa-dfee-4fd5-b1ac-68f6be87e19b","year":2023},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:12.868047Z"},"links":{"cited_paper":"/paper/2307.05161","citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:f75efb2fe43b4575d1fa28efe8bbd0aa594d5fd5e9cf3d90e16746b850c2cff7","observation_id":"b351a203-9717-45e2-97a2-c8355e86684a","resolution":{"observed_at":"2026-08-04T20:54:14.700414Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:16.814858Z","title":"Siamese network with wav2vec feature for spoofing speech detection.,","venue":null,"work_id":"44702219-9f6f-48a9-877c-696d97eac8e4","year":2021},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:12.922732Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:7ee30a19cdc19c8eba260edb7d3aa3266aeb5ee20143f61cdc239afa4990287e","observation_id":"bd1e1f02-0883-4b99-a170-ddee3c133788","resolution":{"observed_at":"2026-08-04T20:54:16.881385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.12233","last_updated":"2022-02-28T11:50:57Z","snapshot_observed_at":"2026-08-16T17:18:51.871221Z","submitted_at":"2022-02-24T17:55:00Z","title":"Automatic speaker verification spoofing and deepfake detection using wav2vec 2.0 and data augmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.12233","snapshot_observed_at":"2026-08-04T20:54:12.961511Z","title":"Automatic speaker verification spoofing 5 and deepfake detection using wav2vec 2.0 and data augmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:12.961511Z"},"links":{"cited_paper":"/paper/2202.12233","citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:657c960bb30cd3d89f07ef0b1c83adeede664b35e48fda8f505c522ef2a1663e","observation_id":"43468736-17cd-4c50-9703-1a7f1a35585e","resolution":{"observed_at":"2026-08-04T20:54:12.961511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05677","last_updated":"2021-07-12T18:28:50Z","snapshot_observed_at":"2026-08-16T18:10:33.845697Z","submitted_at":"2021-07-12T18:28:50Z","title":"Codified audio language modeling learns useful representations for music information retrieval","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05677","snapshot_observed_at":"2026-08-04T20:54:13.052289Z","title":"Codified audio language modeling learns useful representa- tions for music information retrieval,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.052289Z"},"links":{"cited_paper":"/paper/2107.05677","citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:a00cbc0ca14611b55d89b0dc31e9c5476fa902f5fa4a6b6b4f9d6e935d81f6fd","observation_id":"7d52f9b4-467b-4e6a-bef9-a1991bc0a7b9","resolution":{"observed_at":"2026-08-04T20:54:13.052289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:16.684101Z","title":"Music mixing style transfer: A contrastive learning approach to disentangle audio effects,","venue":null,"work_id":"01bf0165-b9e4-4362-bcde-c8c9079700e4","year":2023},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.128210Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:af9e2fb900053617664cb82e49417b954894a525b22ce8e007f6f6ce495051b8","observation_id":"0a017d0a-c521-4c10-a74d-9dcb82d20a94","resolution":{"observed_at":"2026-08-04T20:54:16.729015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:16.552043Z","title":"Mert: Acoustic music understanding model with large-scale self-supervised training,","venue":null,"work_id":"6004c54f-176e-4cbe-9e34-461b1fb45ea6","year":2024},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.197680Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:523b1ccccc48b837ab5ff607d8e4176a12ca9642b3751d68fd6eb8706c3c59a9","observation_id":"c02f4fc3-8e63-408b-869f-80e61d3d4ffb","resolution":{"observed_at":"2026-08-04T20:54:16.609206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:16.392044Z","title":"Wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":"c797d5a2-9811-420a-a6aa-dfea803a82b1","year":2020},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.247365Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:5293d239b51eab0bf189c422a252c33e81d277a81c201039544f3c6c0da568a9","observation_id":"28f4f479-3a00-4042-ac2f-460565d018ac","resolution":{"observed_at":"2026-08-04T20:54:16.449737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:16.236513Z","title":"Map-music2vec: A simple and effective baseline for self-supervised music audio representation learning,","venue":null,"work_id":"300e5350-8284-4750-8ed2-be65c207516b","year":null},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.303689Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:54ae022f21fb5dbd6422baec9cf9d4a73462094a02016d5261956207bc3893f3","observation_id":"c5738977-f774-4c38-a330-df25fee26c77","resolution":{"observed_at":"2026-08-04T20:54:16.284115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07725","last_updated":"2022-02-04T13:25:23Z","snapshot_observed_at":"2026-08-20T04:04:17.970440Z","submitted_at":"2021-11-15T12:52:50Z","title":"Investigating self-supervised front ends for speech spoofing countermeasures","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07725","snapshot_observed_at":"2026-08-04T20:54:13.332865Z","title":"Investigating self- supervised front ends for speech spoofing countermea- sures,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.332865Z"},"links":{"cited_paper":"/paper/2111.07725","citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:a390492d8b1ea8a9706e3ea33180568faba33603cf5b16efd26b54e5edc3519a","observation_id":"2af3fb36-5887-4a07-921e-b4127f3643ab","resolution":{"observed_at":"2026-08-04T20:54:13.332865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:16.123221Z","title":"Self-training and pre-training are comple- mentary for speech recognition,","venue":null,"work_id":"138a6412-f660-462d-a31f-12784db94173","year":2021},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.379835Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:877125724880096a2c8cbdd4833d0ab64a75da51c0d6392c0a16ba083982edf1","observation_id":"0a4e57f8-9759-42e2-8bf1-b11f759257db","resolution":{"observed_at":"2026-08-04T20:54:16.168916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:15.970960Z","title":"Data2vec: A general framework for self- supervised learning in speech, vision and language,","venue":null,"work_id":"3e6b997f-cb95-4b1e-8f69-54d33ce84bbb","year":2022},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.409211Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:c34d44a94e92f7ccb7cdae860e52fb35619b92669dadc3db7137eaa4d30431c7","observation_id":"b3b54215-ea32-4ef2-bf1f-db355e26bf3e","resolution":{"observed_at":"2026-08-04T20:54:16.019134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:15.811193Z","title":"Similarity matrix processing for music structure analysis,","venue":null,"work_id":"1b1a6178-9bea-4ec5-b6ff-3e1de5587197","year":2006},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.462978Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:76ab06d713529258d587887bbf214d75d32cc0941d13ed2ac0b47a0269a2d25c","observation_id":"049240b2-b96c-4fb0-b72b-50e393de1fe8","resolution":{"observed_at":"2026-08-04T20:54:15.874477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10684","last_updated":"2024-09-25T17:00:30Z","snapshot_observed_at":"2026-08-19T16:03:07.314243Z","submitted_at":"2024-09-16T19:31:39Z","title":"FakeMusicCaps: a Dataset for Detection and Attribution of Synthetic Music Generated via Text-to-Music Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10684","snapshot_observed_at":"2026-08-04T20:54:13.554642Z","title":"Fake- musiccaps: A dataset for detection and attribution of synthetic music generated via text-to-music models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.554642Z"},"links":{"cited_paper":"/paper/2409.10684","citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:e08d0425afad1c7a2221601826c4a91e307012ca7515f95383afa1d598a2001d","observation_id":"eb0b9533-a075-4f5b-84cb-a2fcb6690fd7","resolution":{"observed_at":"2026-08-04T20:54:13.554642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:13.620192Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.620192Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:de7a1e18589698161ec3e319fe97e15409ecdd192bf3dda7391be31e5db782dd","observation_id":"a8ef7dd4-0cd7-46df-8a26-cbfd43099216","resolution":{"observed_at":"2026-08-04T20:54:13.620192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:13.688609Z","title":"A convnet for the 2020s,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.688609Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:b4a8c725f8ab7e3faea01666d3306218f393019edc59ff072c8028371f2c3608","observation_id":"ce1b4dfb-d8a9-4c6c-ad04-f85270e07a8a","resolution":{"observed_at":"2026-08-04T20:54:13.688609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:15.623513Z","title":"Squeeze-and-excitation networks,","venue":null,"work_id":"71e15464-dc86-46c2-8435-ffe939e4948c","year":2018},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.714991Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:1e95a7a4dbf4966c3c4e7a2df05b87534adee2d2fdfb0a2d6af814497acfbdef","observation_id":"0b8894ee-e447-461c-a359-c334868f8166","resolution":{"observed_at":"2026-08-04T20:54:15.664277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-04T20:54:13.776883Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.776883Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:6ad15bf87a11fd229fdeede26f0f44fb0f06e8a1ada78f6039b98161b09ac7e4","observation_id":"7055eaad-2724-41db-8e09-7df04187b884","resolution":{"observed_at":"2026-08-04T20:54:13.776883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04861","last_updated":"2017-04-17T03:57:34Z","snapshot_observed_at":"2026-08-20T09:32:02.065929Z","submitted_at":"2017-04-17T03:57:34Z","title":"MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04861","snapshot_observed_at":"2026-08-04T20:54:13.833527Z","title":"Mobilenets: Efficient convolu- tional neural networks for mobile vision applications,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.833527Z"},"links":{"cited_paper":"/paper/1704.04861","citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:ad53aa270e0686c38742d76f4146f1799c223a94f7275a19eca3b5894879cc8c","observation_id":"d341f303-e687-449e-9c50-73e95fa82151","resolution":{"observed_at":"2026-08-04T20:54:13.833527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:15.473457Z","title":"Ef- ficientvit: Lightweight multi-scale attention for high- resolution dense prediction,","venue":null,"work_id":"1a949fee-a9de-48ee-86f0-23ada2ef44cf","year":2023},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.926608Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:b30aeb92aac19fbf1f08862cc2fa9a126b4bb2eb8d16057aa576cf89ea6763f2","observation_id":"d2549f06-306a-483e-bd07-8d90d1169c52","resolution":{"observed_at":"2026-08-04T20:54:15.514776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:13.990244Z","title":"Long short-term memory,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:13.990244Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:ce1577086c4003183722edbea17197f66a6076475fd5561cc18c3878bb2c8cda","observation_id":"24107dca-5956-4c25-aea4-f8db00cdbfe0","resolution":{"observed_at":"2026-08-04T20:54:13.990244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:15.307654Z","title":"Detection of ai-synthesized speech using cepstral & bispectral statistics,","venue":null,"work_id":"ffd88de8-6f96-4a90-889d-d316c423c394","year":2021},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:14.053463Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:a996654b8ae3456f0833da6f82e3164d85ad5d791e09ed2ca3b95c435539101e","observation_id":"c9efa575-0838-47c1-bca8-945dd2bf13e5","resolution":{"observed_at":"2026-08-04T20:54:15.375293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:15.198487Z","title":"Simple and controllable music gen- eration,","venue":null,"work_id":"8d15daf9-67be-4209-9190-7e68422d540d","year":2023},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:14.087217Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:8e04c497b69da73d4f970df4052442ba7a32ebdfd19c6f1e8ee9f1b5326e5f7f","observation_id":"f4a5fb22-a196-4985-9a12-774abaf97f49","resolution":{"observed_at":"2026-08-04T20:54:15.259571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:15.014960Z","title":"Musicldm: Enhanc- ing novelty in text-to-music generation using beat- synchronous mixup strategies,","venue":null,"work_id":"80ee657f-626f-42b2-8300-7ef5df59bfff","year":2024},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:14.152303Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:92a058cff4d2ebf82a1e130632fff80a9ae19b83b27eb2d8775225589303e5ba","observation_id":"7f47b8d8-9cc2-42e0-a3dd-19cbbefb9c21","resolution":{"observed_at":"2026-08-04T20:54:15.059429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:54:14.870381Z","title":"Stable audio open,","venue":null,"work_id":"98830d42-b22c-45ef-8c84-0c3f0a717940","year":2025},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:14.204942Z"},"links":{"citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:19a92c231e1518ca525496ee61d52e64b14d845b949a959edb8d185ace5a67e0","observation_id":"36f1c9e2-c06a-4c26-b4ba-eb2541beb104","resolution":{"observed_at":"2026-08-04T20:54:14.911449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08355","last_updated":"2024-06-03T07:56:23Z","snapshot_observed_at":"2026-08-16T14:43:20.569125Z","submitted_at":"2023-11-14T17:54:38Z","title":"Mustango: Toward Controllable Text-to-Music Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08355","snapshot_observed_at":"2026-08-04T20:54:14.265474Z","title":"Mustango: Toward controllable text-to-music generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:14.265474Z"},"links":{"cited_paper":"/paper/2311.08355","citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:1254267a21bbf5d091de26d1cfd52a2639ddd5e22184091249529da42b13fd4e","observation_id":"24ef680d-7125-4f95-ab00-09148a105fa6","resolution":{"observed_at":"2026-08-04T20:54:14.265474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21658","last_updated":"2024-07-31T14:59:17Z","snapshot_observed_at":"2026-08-16T13:29:30.923656Z","submitted_at":"2024-07-31T14:59:17Z","title":"Beat this! Accurate beat tracking without DBN postprocessing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21658","snapshot_observed_at":"2026-08-04T20:54:14.361479Z","title":"Beat this! ac- curate beat tracking without dbn postprocessing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T20:54:14.361479Z"},"links":{"cited_paper":"/paper/2407.21658","citing_paper":"/paper/2509.08283"},"observation_digest":"sha256:ad98d56b9c59134d9fe7a50c3130d3e1495f929bc8da2683807b5e464f705021","observation_id":"a8fa1292-3d44-471f-933f-6e8a9325e49a","resolution":{"observed_at":"2026-08-04T20:54:14.361479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.08283","last_updated":"2025-09-10T04:56:40Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-17T10:50:52.606453Z","submitted_at":"2025-09-10T04:56:40Z","title":"Segment Transformer: AI-Generated Music Detection via Music Structural Analysis"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":1,"verified_fuzzy":20},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2509.08283."}