{"as_of":"2026-08-13T16:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:01ce884bc332646bb5f3937954db257e9597721157dfc62ab84e464d0aa00175","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T20:29:54.414352Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.05694/citation-record","integrity":"/paper/2412.05694/integrity","json":"/paper/2412.05694/citation-record.json","paper":"/paper/2412.05694"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.973627Z","title":"In: Proceedings of the 20th ACM International Conference on Multimedia, pp","venue":null,"work_id":"01bab35a-7328-4d11-bf5a-4fb4e2701779","year":2012},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.238075Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:d60217195e32cc1e6918c2a4ed27320baa96646e3f09c507df5e0fec9558f026","observation_id":"7e885b16-e339-46bf-b04a-f3993a60a774","resolution":{"observed_at":"2026-08-11T20:29:54.977865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.961773Z","title":"Master’s thesis, Mississippi College (2018)","venue":null,"work_id":"e8f9256a-5578-4185-b48c-c063224f2e81","year":2018},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.242830Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:6bdb56c44cb47d382ea8e9ac56f37cb48f2f99af69ac7a7ba2f1666b701c1c44","observation_id":"af83a81e-9c80-403b-a626-d8cfdef8cb6a","resolution":{"observed_at":"2026-08-11T20:29:54.965797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.949165Z","title":"In: 2003 International Conference on Multimedia and Expo","venue":null,"work_id":"c333e255-b961-4228-9d3f-3ae40c83d2ce","year":2003},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.247055Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:58003662ee050510e181cf337b92d81b674f7df3eb5ae4836f7f1f3dd575fa94","observation_id":"fee8669e-174e-4a08-b8f9-08c7550cf94f","resolution":{"observed_at":"2026-08-11T20:29:54.953982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.935728Z","title":"In: IEEE Conference on Computer Vision and Pattern Recognition, vol","venue":null,"work_id":"bea13077-0277-48d3-95cd-bc7b9ad12a15","year":2001},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.251254Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:4beef5f242771803772731ebe2eacf2ad5fe99a3a3d8400ccad460d9ebb87ec8","observation_id":"9c9533b6-44f2-4f8e-9ec2-c1807f7389ac","resolution":{"observed_at":"2026-08-11T20:29:54.940239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.922568Z","title":"In: The Second International Workshop on Recognition, Analysis, and Tracking of Faces and Gestures in Real-Time Systems, pp","venue":null,"work_id":"682adcdf-9c3d-49e8-b641-319d80c72fd0","year":2001},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.255976Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:3c70ce5369449f3262c71f639b5f5c9c7067fbb58afbb2e8e2b211e01176fbee","observation_id":"899116bf-d8ae-487b-8e98-ecf9216358b5","resolution":{"observed_at":"2026-08-11T20:29:54.927644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.909862Z","title":"In: KES’2000","venue":null,"work_id":"664626a9-8558-4060-b5c4-bf2b3cd50ff7","year":2000},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.260089Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:4f469a227526f647abf3a7953dd749b0eabe480868da802a3e0b11f4a98f0b48","observation_id":"aefa0445-4656-4d33-86d4-ae9d5a13304a","resolution":{"observed_at":"2026-08-11T20:29:54.913879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.896833Z","title":"Image and Vision Computing 21(13-14), 1077–1086 (2003) 19","venue":null,"work_id":"9171e948-ded7-4b7c-a33e-a36d61fcca6a","year":2003},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.264927Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:7d8a15626ddc516c17d3f7e87f24f6093a128837c7486360682b5be14d1abb8c","observation_id":"7ac15913-8415-4ee3-9e49-8087aeb6c74f","resolution":{"observed_at":"2026-08-11T20:29:54.900651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.885025Z","title":"International Journal of Computer Vision 53, 71–92 (2003)","venue":null,"work_id":"68915346-3e28-4f5b-b2be-371a7f2b5b20","year":2003},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.268733Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:3dcd997bdf5264ba15a5fc1d3240554c06baf73eeb672897d00ac4e62ea1b5ae","observation_id":"7ec5e084-037c-4824-84a0-183ae45e1a63","resolution":{"observed_at":"2026-08-11T20:29:54.888905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.873329Z","title":"ACM (2023)","venue":null,"work_id":"2d6f468e-54ab-4ee8-8ae2-a3118ef4d2e3","year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.272567Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:eebde9dbc1032e2273c732b81ee5311299d5ecb55d40c63f5e7eb7e0333fe662","observation_id":"d8a42072-a7d5-4b61-8533-8101450b4f85","resolution":{"observed_at":"2026-08-11T20:29:54.877288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.860949Z","title":"In: Proceedings of the 28th ACM International Conference on Multimedia, pp","venue":null,"work_id":"c5d61f2c-7e17-41c5-9f3c-7916a277c64d","year":2020},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.276224Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:0317eae5e9171207bf1e5f631e274c9fd105c9e8c15577c3184bb86701243ae0","observation_id":"c32c673b-630a-4dd4-ac88-073849fa12c9","resolution":{"observed_at":"2026-08-11T20:29:54.865285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.848110Z","title":"In: Pro- ceedings of the IEEE Conference on Computer Vision and Pattern Recognition Workshops, pp","venue":null,"work_id":"0b3bfd8e-d022-4918-8a88-9075d2db6538","year":2018},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.280032Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:019ff2033f030da5633c44ce912c8a9fb546c440f4ffb8e0b1f7bf28954a97f7","observation_id":"92de68c1-81be-4ae7-bf3d-e8753c60d85f","resolution":{"observed_at":"2026-08-11T20:29:54.852786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.834548Z","title":"In: Proceedings of the 20th ACM International Conference on Multimedia, pp","venue":null,"work_id":"2dc2b84d-7f01-4bf7-893f-c83092450292","year":2012},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.283926Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:1aee4273edca60e01ba0cc93df2856b3f0985cf662f23646e385ca36d08656e3","observation_id":"7b44fbbd-cb41-4e07-be24-2659b9ba55cf","resolution":{"observed_at":"2026-08-11T20:29:54.839295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.820408Z","title":"In: Proceedings of the 25th ACM International Conference on Multimedia, pp","venue":null,"work_id":"57eb9dfa-1f22-4c17-bbff-5aeca8bd338c","year":2017},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.288238Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:48f4af9cd57b19f5e90f4fa7862a48265442337cf0b9ea049435362573bed568","observation_id":"129ce848-1d49-49bb-8bb6-d48b8f49b211","resolution":{"observed_at":"2026-08-11T20:29:54.824720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.807328Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence45(9), 10850–10869 (2023)","venue":null,"work_id":"d085be4a-7472-4820-8cbb-5b3ce7c39b4a","year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.292627Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:0e8534acf5af44e4f8753ee8637dab500323b699b656994011b3f057bfd9b4e4","observation_id":"00eecc1a-5602-4953-9d33-c5bae8142b0b","resolution":{"observed_at":"2026-08-11T20:29:54.811571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.793675Z","title":"In: Ranzato, M., Beygelzimer, A., Dauphin, Y., Liang, P.S., Wortman Vaughan, J","venue":null,"work_id":"a30a7b4d-5e7c-4b2b-940e-918b9d7aab8c","year":2021},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.297408Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:e0e225ba8b0f4ed475f6e75e2d605d232da45feeea8b19e9943bfc527da6ca22","observation_id":"5d95f13e-06f5-4dfd-9fc0-c792f8740592","resolution":{"observed_at":"2026-08-11T20:29:54.798261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.303267Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.303267Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:00bbc63a71a961617f460e1827364e5c6bdcd2b4d14c202b38e51b8b21ea1aab","observation_id":"5b923e0c-7104-41df-9900-92a9596b67a5","resolution":{"observed_at":"2026-08-11T20:29:54.303267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-11T20:29:54.307186Z","title":"arXiv preprint arXiv:2204.06125 1(2), 3 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.307186Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:4889a114e2f705bc3c9cb706125f620ee56de7fda6573ba782243e17f0408bbd","observation_id":"b43d4af1-4782-4cc5-b34b-334e09f8e94e","resolution":{"observed_at":"2026-08-11T20:29:54.307186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.07909","last_updated":"2024-11-08T06:19:33Z","snapshot_observed_at":"2026-08-13T12:24:54.284459Z","submitted_at":"2023-03-14T13:49:54Z","title":"Text-to-image Diffusion Models in Generative AI: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.07909","snapshot_observed_at":"2026-08-11T20:29:54.311343Z","title":"arXiv preprint arXiv:2303.07909 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.311343Z"},"links":{"cited_paper":"/paper/2303.07909","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:d5edb69e27471804165d01f66265f2d534c30c58bb1b19861e9a9ff7aded0818","observation_id":"2773e169-e9d7-4048-be4d-35a4990944d8","resolution":{"observed_at":"2026-08-11T20:29:54.311343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.770977Z","title":"In: International Conference on Machine Learning, 20 pp","venue":null,"work_id":"6d367cd3-5cc9-4f80-8c48-017dd1d2a602","year":2021},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.316057Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:8e4da442250f93e10968a99f7539fbcf8057dbc1814c22e4fdd98d4de1a1560b","observation_id":"0b23dc04-a9b3-4eca-98a9-3cac7c4b62f6","resolution":{"observed_at":"2026-08-11T20:29:54.775332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.00386","last_updated":"2022-03-01T12:11:32Z","snapshot_observed_at":"2026-08-12T08:47:54.218958Z","submitted_at":"2022-03-01T12:11:32Z","title":"CLIP-GEN: Language-Free Training of a Text-to-Image Generator with CLIP","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.00386","snapshot_observed_at":"2026-08-11T20:29:54.320641Z","title":"arXiv preprint arXiv:2203.00386 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.320641Z"},"links":{"cited_paper":"/paper/2203.00386","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:506810f3083e8ad2c70a59f19ec7acd8bf4f323307232438938bc29d5d628a2f","observation_id":"7c4614a6-cdc5-4e16-86ca-d30e5eb20a41","resolution":{"observed_at":"2026-08-11T20:29:54.320641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03502","last_updated":"2023-10-05T12:29:41Z","snapshot_observed_at":"2026-08-13T05:56:52.371488Z","submitted_at":"2023-10-05T12:29:41Z","title":"Kandinsky: an Improved Text-to-Image Synthesis with Image Prior and Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03502","snapshot_observed_at":"2026-08-11T20:29:54.325321Z","title":"arXiv preprint arXiv:2310.03502 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.325321Z"},"links":{"cited_paper":"/paper/2310.03502","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:1f8c10c8d8c9eaecc887c94781bf410aac29fa5c4fc27c2cf284dc351393af31","observation_id":"aee742a0-fa88-44c0-b47e-6898b4f601e4","resolution":{"observed_at":"2026-08-11T20:29:54.325321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.759448Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":"6e0e734f-cdf1-41a4-95ee-d290f79147f7","year":2024},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.330238Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:3bab69e38eb4f1ee079275f9e4a1dad85f75dd96d0477acdeaa9a4f687116dcb","observation_id":"b2f5246e-512d-483b-8a08-4d6d6d8a6c08","resolution":{"observed_at":"2026-08-11T20:29:54.763169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.747997Z","title":"Hugging Face","venue":null,"work_id":"cadc023f-4390-44b1-8810-199844bfaece","year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.334138Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:9127c39cb910d056b67b3e49457518cc44be0f348edcc8f00e11efb9a9b101f3","observation_id":"e737de1d-ee89-4318-bfbd-050ac49bee5e","resolution":{"observed_at":"2026-08-11T20:29:54.752134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10647","last_updated":"2024-09-14T08:38:20Z","snapshot_observed_at":"2026-08-13T05:48:11.091547Z","submitted_at":"2023-10-16T17:59:28Z","title":"A Survey on Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10647","snapshot_observed_at":"2026-08-11T20:29:54.339111Z","title":"arXiv preprint arXiv:2310.10647 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.339111Z"},"links":{"cited_paper":"/paper/2310.10647","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:df29a99efda05d2096c579172c2bb8006a76ed18df26dc5caba7935dab0a086b","observation_id":"6c2e3f56-952f-4a94-9a6c-3ad4f5b39a5b","resolution":{"observed_at":"2026-08-11T20:29:54.339111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.731382Z","title":"In: Advances in Neural Information Processing Systems vol","venue":null,"work_id":"096a1b79-eb88-41a8-82b4-18160e4d5aab","year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.344081Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:53166ad0244c2918999f24d30722be0d49a1449e84a549db0d31ab2e027d7772","observation_id":"2d207e72-3aa9-4abc-bdb2-c281e1f0dbf1","resolution":{"observed_at":"2026-08-11T20:29:54.736203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-11T20:29:54.348166Z","title":"arXiv preprint arXiv:2210.02303 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.348166Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:4a242ee3d492302d89b7206407b9910c07be5b5aaa1f2f0862e15ca858d68e6a","observation_id":"99a00a15-9d7c-4106-aaa8-a1b3503d465f","resolution":{"observed_at":"2026-08-11T20:29:54.348166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.719543Z","title":"In: Proceedings of the 12th Annual ACM International Conference on Multimedia, pp","venue":null,"work_id":"c4ae7b5d-8988-4b38-b3f7-d624c0dc71c9","year":2004},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.352456Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:64890f3cf35a826cd89e91ce346dff8755ab220fabca506e722ad1a9a9dd7b28","observation_id":"dc1d2b16-93fd-45a8-8ae0-f7515c84aaee","resolution":{"observed_at":"2026-08-11T20:29:54.723792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04001","last_updated":"2023-05-23T06:59:30Z","snapshot_observed_at":"2026-08-13T11:48:05.197922Z","submitted_at":"2023-05-06T10:26:56Z","title":"AADiff: Audio-Aligned Video Synthesis with Text-to-Image Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04001","snapshot_observed_at":"2026-08-11T20:29:54.356313Z","title":"arXiv preprint arXiv:2305.04001 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.356313Z"},"links":{"cited_paper":"/paper/2305.04001","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:f7e3a22bd3503ea5cf00cfb3ffc749585ae44125653823d68c203ccd7b0c0502","observation_id":"2fa31471-94e2-4c59-8004-4f6e7a7fa5b9","resolution":{"observed_at":"2026-08-11T20:29:54.356313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.06654","last_updated":"2019-09-14T18:52:47Z","snapshot_observed_at":"2026-07-06T08:21:47.986256Z","submitted_at":"2019-09-14T18:52:47Z","title":"musicnn: Pre-trained convolutional neural networks for music audio tagging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.06654","snapshot_observed_at":"2026-08-11T20:29:54.360572Z","title":"arXiv preprint arXiv:1909.06654 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.360572Z"},"links":{"cited_paper":"/paper/1909.06654","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:d37ca2f145902c692eaa6230b9a3374d89f4686dc8271e5bc15ecf98d4137c49","observation_id":"b618e5c1-cae3-4c1b-a007-95014eb3f470","resolution":{"observed_at":"2026-08-11T20:29:54.360572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.705472Z","title":"In: Proceedings of the 2021 International Joint Conference on Neural Networks (IJCNN), pp","venue":null,"work_id":"9d58ee26-3774-4961-ae1f-1c997365a8e0","year":2021},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.365152Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:676be72600f8ed3d51f1a7412609299a6aac67bcab39c3fddcdae93f47bbf876","observation_id":"19cb612a-a9f6-4efb-9e5d-34a91d1ea395","resolution":{"observed_at":"2026-08-11T20:29:54.709984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.692024Z","title":"In: Proceedings of the ICASSP 2022 IEEE International Confer- ence on Acoustics, Speech and Signal Processing (ICASSP), pp","venue":null,"work_id":"784ada2a-f11c-441b-b551-fb30974b6565","year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.369157Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:6d46915d6af3f84518ab3920805681d71ceebc22d7e2fbf54a61c68cccb3b75f","observation_id":"d4258680-51f0-4095-a5bd-c9235c28fc0f","resolution":{"observed_at":"2026-08-11T20:29:54.696376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16372","last_updated":"2023-07-31T02:32:02Z","snapshot_observed_at":"2026-08-13T10:44:31.553245Z","submitted_at":"2023-07-31T02:32:02Z","title":"LP-MusicCaps: LLM-Based Pseudo Music Captioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16372","snapshot_observed_at":"2026-08-11T20:29:54.373108Z","title":"arXiv preprint arXiv:2307.16372 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.373108Z"},"links":{"cited_paper":"/paper/2307.16372","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:50f96bad8449d737e83e51b34d53f08a89018c11290f2424914a1638ccb56348","observation_id":"ef2a7171-98f1-4fb8-842f-c7842861de31","resolution":{"observed_at":"2026-08-11T20:29:54.373108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08730","last_updated":"2024-04-02T13:35:59Z","snapshot_observed_at":"2026-08-13T10:12:38.804854Z","submitted_at":"2023-09-15T19:31:40Z","title":"MusiLingo: Bridging Music and Text with Pre-trained Language Models for Music Captioning and Query Response","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08730","snapshot_observed_at":"2026-08-11T20:29:54.378047Z","title":"arXiv preprint arXiv:2309.08730 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.378047Z"},"links":{"cited_paper":"/paper/2309.08730","citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:47dbaed3d921ff46aa581d3f46c69b55e91b6cc1256220cc7ac0229063c52a78","observation_id":"276e7626-7318-4f4d-b915-f444dc6148c9","resolution":{"observed_at":"2026-08-11T20:29:54.378047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.678624Z","title":"In: Advances in Neural Information Processing Systems vol","venue":null,"work_id":"c5592a16-a33f-4054-b491-cf0f6caafa53","year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.381890Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:0ee14f11072d9cb08e1c3083821137c917fb2971dac61166c4a7066e356fac1b","observation_id":"78265776-e333-4a2b-8aa0-97c6030443e1","resolution":{"observed_at":"2026-08-11T20:29:54.683057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.665483Z","title":"In: Advances in Neural Information Processing Systems vol","venue":null,"work_id":"f4d0dc5a-d88b-4fed-a910-00c63b43ca81","year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.385984Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:0a081b4f9e2fb07b74f1f184a612be6f3b501ec1a324eaef7216818bababdc09","observation_id":"e7b345f3-9c53-4ee7-80c3-a6ed581e2465","resolution":{"observed_at":"2026-08-11T20:29:54.669328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.653456Z","title":null,"venue":null,"work_id":"27367f58-8f2e-44d2-a5d2-1659f75bfef9","year":2024},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.390061Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:b041d21206b356e4e71679fc3f341d3f22a41035f39d376917bc2701db283b64","observation_id":"ff8d2097-71cf-4ea5-a0ce-84df90d36d68","resolution":{"observed_at":"2026-08-11T20:29:54.657418Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.638881Z","title":"US Patent App","venue":null,"work_id":"b070655a-4eaa-4a45-b2c6-592e8bdb9edd","year":2005},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.394449Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:9c5a0331f549db18b889fcfa569d86b0a5604eec5add02b0a9431678b4ec36a1","observation_id":"3ae55627-5675-4455-8328-6e6eca0669aa","resolution":{"observed_at":"2026-08-11T20:29:54.644545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.620985Z","title":"PhD thesis, Queen Mary, University of London (2001)","venue":null,"work_id":"3aa4bca5-7bb5-41a5-870e-7dcb16256710","year":2001},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.398693Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:94c13aac2d4d3799cb69396907d6a4c7f96c6f3c1358db3fc5c2d569e9dbb2aa","observation_id":"e0e55f76-cf4b-4890-8a0e-b0bc26b1fd3d","resolution":{"observed_at":"2026-08-11T20:29:54.626604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.605824Z","title":"GitHub repository","venue":null,"work_id":"5cbeb817-54b6-4077-b2c9-da94e9096539","year":2022},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.402443Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:289576777d4af7f937614d314e538dae11efdf67d6181e26dd68ad0fc645aba8","observation_id":"42f12d83-cd39-4f88-b570-1e2b3487a98e","resolution":{"observed_at":"2026-08-11T20:29:54.609991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.406442Z","title":"IEEE Transactions on Acoustics, Speech, and Signal Processing 26(1), 43–49 (1978)","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.406442Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:f89ffe99943c209ac642f95288a123d610aa1336467406b9133326a001900953","observation_id":"cc29fe55-d1fb-4b47-8680-ca61727c994f","resolution":{"observed_at":"2026-08-11T20:29:54.406442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.581656Z","title":"Revista Informatic˘ a Economic˘ a2(46), 94 (2008)","venue":null,"work_id":"3d4695ae-e30e-4b72-bbff-3f773123159d","year":2008},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.410227Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:d40e6691d2fbfa93b0ad3d7e6ea3a810e18b8f489014b8ea715d5de297d94e20","observation_id":"b54e1bb5-ffb8-47a6-be61-90414a15019a","resolution":{"observed_at":"2026-08-11T20:29:54.586059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:29:54.567139Z","title":"Intelligent Data Analysis 11(5), 561–580 (2007) 22","venue":null,"work_id":"1109a87a-69a7-4517-862f-ef4013c2ffe8","year":2007},"citing_paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T20:29:54.414352Z"},"links":{"citing_paper":"/paper/2412.05694"},"observation_digest":"sha256:c182beaf0d0bd74e9c1e836e25351260c61aab29773b3229bf5251972f7cf1b1","observation_id":"f2efd128-e32c-4650-b767-3c4fa763782e","resolution":{"observed_at":"2026-08-11T20:29:54.572306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.05694","last_updated":"2024-12-07T16:43:02Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-12T01:16:32.318451Z","submitted_at":"2024-12-07T16:43:02Z","title":"Combining Genre Classification and Harmonic-Percussive Features with Diffusion Models for Music-Video Generation"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2412.05694."}