{"as_of":"2026-08-10T22:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:86d5d8482ca049e116775768650c6233f103cf5595c5635bcba60c6a9d9e2b84","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T17:06:31.400313Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.02610/citation-record","integrity":"/paper/2502.02610/integrity","json":"/paper/2502.02610/citation-record.json","paper":"/paper/2502.02610"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.767126Z","title":"Queratogray sketch (eddiemauro-mix) - v1.0 | stable diffusion checkpoint | civitai,","venue":null,"work_id":"e1596a05-ae87-4de0-b73d-b50b6591a07e","year":2023},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.223798Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:a3fc612380b6bf6f99c48ed1a85f116e886ef16ab601793c9827086f7402b278","observation_id":"54810b53-3e71-4322-b595-2ec964189066","resolution":{"observed_at":"2026-08-09T17:06:32.770481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.758072Z","title":"Western animation diffusion - v1 | stable diffusion checkpoint | civitai,","venue":null,"work_id":"e84a8ed6-a5ee-4ae2-82f9-6e95ac882631","year":2023},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.228114Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:677a1c486b02c6c8e1f2e9cb3b95ca4a463f2f21ece11317237f210e70491c4e","observation_id":"f923cf1d-6de8-4432-bf3c-a244d8f45fd7","resolution":{"observed_at":"2026-08-09T17:06:32.761437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.748522Z","title":"Realistic vision v6.0 b1 - v6.0 b1 (vae): Stable diffusion checkpoint,","venue":null,"work_id":"3c97ad1a-e01b-4532-ba5b-50dbfbd89f66","year":2023},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.231796Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:0c634d421866aab6aabee2a2548af93b4e6d22708c66e60d3077765ba9e85809","observation_id":"20fe4a09-164e-47f7-a79b-f5f9e0c3d208","resolution":{"observed_at":"2026-08-09T17:06:32.751875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.739589Z","title":"Ai music video generator,","venue":null,"work_id":"81f1572b-49ea-46ed-8137-33a93e4d2b2f","year":2023},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.235517Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:7b25cc2f8f1c88cffaf34dcd5615e75708f9ba59e94ae53c8251fa59f4a3a095","observation_id":"9968a096-498a-435b-8973-4c5c5ced2323","resolution":{"observed_at":"2026-08-09T17:06:32.742728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.730873Z","title":"Kaiber ai product,","venue":null,"work_id":"61efe7ce-1a88-45f0-ab1a-60254197d619","year":2023},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.239023Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:323005ebf8093d09fc39eec2f3281b492d1ba8452259b9b0c87a915190df1c3b","observation_id":"5c0e79d6-119f-4dd7-a12e-3739ed03ea67","resolution":{"observed_at":"2026-08-09T17:06:32.734012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.12130","last_updated":"2020-07-23T16:57:44Z","snapshot_observed_at":"2026-08-04T05:15:47.161537Z","submitted_at":"2020-07-23T16:57:44Z","title":"Sound2Sight: Generating Visual Dynamics from Sound and Context","version":1},"cited_work":{"arxiv_id":"2007.12130","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.12130","snapshot_observed_at":"2026-08-09T17:06:32.467266Z","title":"Sound2Sight: Generating Visual Dynamics from Sound and Context","venue":"cs.CV","work_id":"4d9b466d-4c19-4601-bacd-d149b7629b92","year":2020},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.242539Z"},"links":{"cited_paper":"/paper/2007.12130","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:0e2aa9db072aa0c506db32cea8ad7f9fa068ca5922ecdea483d7b2376aac6773","observation_id":"9d10d7f1-6183-4895-91a7-f1490cc6b374","resolution":{"observed_at":"2026-08-09T17:06:32.471367Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.04509","last_updated":"2023-09-08T12:21:01Z","snapshot_observed_at":"2026-08-07T10:40:09.160909Z","submitted_at":"2023-09-08T12:21:01Z","title":"The Power of Sound (TPoS): Audio Reactive Video Generation with Stable Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.04509","snapshot_observed_at":"2026-08-09T17:06:31.246575Z","title":"The power of sound (tpos): Audio reactive video generation with stable diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.246575Z"},"links":{"cited_paper":"/paper/2309.04509","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:2d557a598ca8b2080cb3a51ca37995563dbf98f174f0d98e427b214d17f6c6f5","observation_id":"94b4c9e5-9855-4a51-a51b-f55a9aafe15f","resolution":{"observed_at":"2026-08-09T17:06:31.246575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09478","last_updated":"2023-03-24T12:13:52Z","snapshot_observed_at":"2026-07-06T14:32:25.907566Z","submitted_at":"2022-12-19T14:11:52Z","title":"MM-Diffusion: Learning Multi-Modal Diffusion Models for Joint Audio and Video Generation","version":2},"cited_work":{"arxiv_id":"2212.09478","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.09478","snapshot_observed_at":"2026-08-09T17:06:32.442628Z","title":"MM-Diffusion: Learning Multi-Modal Diffusion Models for Joint Audio and Video Generation","venue":"cs.CV","work_id":"10465afd-9658-4894-9334-99351ce3d7f2","year":2022},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.250336Z"},"links":{"cited_paper":"/paper/2212.09478","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:96d2ad1640c225a6a71e0dd6f668c84204cdf00ec04fc07271d8079e9fa9e1db","observation_id":"ee60c74e-13f5-4bbe-aa13-2eee62c4cb25","resolution":{"observed_at":"2026-08-09T17:06:32.446604Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.721692Z","title":"Music mood detection based on audio and lyrics with deep neural net,","venue":null,"work_id":"9cefba27-1572-40b7-b488-0774912d6969","year":2018},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.254094Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:a4909d3e949dcfc6a8ba6fccae77828246555f3687190d1f9e0dd47d9877df9c","observation_id":"8c7431e2-cba5-4ecd-ac1c-8f60dca21fe6","resolution":{"observed_at":"2026-08-09T17:06:32.725002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.429163Z","title":"Opensmile: The munich versatile and fast open-source audio feature extractor,","venue":null,"work_id":"8cfd00f9-f413-4ed8-a454-702c2894a17e","year":null},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.257405Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:ef318474aac287938ba98dca13c58dd7944ed9e8c72e57f58a26dbffd5d38579","observation_id":"32d7dd87-a7bf-4ebc-9a54-037e542fdd10","resolution":{"observed_at":"2026-08-09T17:06:32.432793Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10752","last_updated":"2022-04-13T11:38:44Z","snapshot_observed_at":"2026-07-06T12:20:47.369918Z","submitted_at":"2021-12-20T18:55:25Z","title":"High-Resolution Image Synthesis with Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10752","snapshot_observed_at":"2026-08-09T17:06:31.260726Z","title":"High-resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.260726Z"},"links":{"cited_paper":"/paper/2112.10752","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:1667ea90d0d5e612b015bad6536d44e978ff157a743854dd2dda10f39db92cd7","observation_id":"e3ee1b3a-8b59-492c-9057-da92c4373587","resolution":{"observed_at":"2026-08-09T17:06:31.260726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11487","last_updated":"2022-05-23T17:42:53Z","snapshot_observed_at":"2026-07-06T13:12:59.688989Z","submitted_at":"2022-05-23T17:42:53Z","title":"Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11487","snapshot_observed_at":"2026-08-09T17:06:31.264458Z","title":"Photorealistic text-to-image diffusion models with deep language understanding,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.264458Z"},"links":{"cited_paper":"/paper/2205.11487","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:5431d037fc7e1cd9f5e6300d36867cc9250b71cc44b75cc9ac381637acf05375","observation_id":"27e94898-55bd-4653-ab62-a123b19c759c","resolution":{"observed_at":"2026-08-09T17:06:31.264458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.13807","last_updated":"2022-05-02T19:35:26Z","snapshot_observed_at":"2026-07-06T13:04:53.433479Z","submitted_at":"2022-04-25T18:54:39Z","title":"A very preliminary analysis of DALL-E 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.13807","snapshot_observed_at":"2026-08-09T17:06:31.268010Z","title":"A very preliminary analysis of dall-e 2,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.268010Z"},"links":{"cited_paper":"/paper/2204.13807","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:3bf6bb2476aa5ef3436256f277bc53a96bd3a63357e7d4bc9a031759e2110ac7","observation_id":"c03b2745-718d-4b11-9f73-816712bb58a7","resolution":{"observed_at":"2026-08-09T17:06:31.268010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.712667Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis,","venue":null,"work_id":"707fd445-518a-49dc-a7e5-52576c5e3e49","year":null},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.271582Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:a252c046e18dae11948f6489bf0e3eadc2403172069c496e7c67c5e1542b1d60","observation_id":"663e9802-55d1-4e4e-9818-b6298b2f08fc","resolution":{"observed_at":"2026-08-09T17:06:32.715985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.703618Z","title":"Github - black-forest-labs/flux: Official inference repo for flux.1 models,","venue":null,"work_id":"cd9d554d-9935-4b43-8702-2b275b21ab4a","year":null},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.278403Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:e1183327fefb0500d3c7a1780bba2e32a4dbeeff04b5bad50601b4a63ad1031e","observation_id":"c62778da-ade0-4f3f-92fd-5b44ba0f5ce1","resolution":{"observed_at":"2026-08-09T17:06:32.707086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.685590Z","title":"Available: https://pika.art/","venue":null,"work_id":"086f1242-6e0e-4c77-8f28-1f0ba4efa831","year":null},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.285353Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:ee5101054437c56694f00a955e98aff1e4620a4065cf2662a52d1fd262d328fb","observation_id":"b86a0cca-4a3a-49ae-8779-ecd897d47fe3","resolution":{"observed_at":"2026-08-09T17:06:32.688684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.676552Z","title":"Luma dream machine","venue":null,"work_id":"20345738-b630-47e4-85c8-4f7240c720be","year":null},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.288866Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:efba70cda5803c6c53978b4436a7f76912247fd5f70144d3a258747a93740ab6","observation_id":"b646da03-ee04-44c8-a9b3-b0b8bd0585e7","resolution":{"observed_at":"2026-08-09T17:06:32.679686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.667493Z","title":"Runway research | introducing gen-3 alpha: A new frontier for video generation,","venue":null,"work_id":"18941c4f-ec1d-4bac-9767-9f372eb4663a","year":null},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.292135Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:151670eb09cb92387def1b6ea9fc7639d4bd8c9e3254e42869133e6682b89177","observation_id":"1110ae51-daef-4ce3-81c9-abea58c6a238","resolution":{"observed_at":"2026-08-09T17:06:32.670779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17177","last_updated":"2024-04-17T18:41:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T03:30:58Z","title":"Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17177","snapshot_observed_at":"2026-08-09T17:06:31.298764Z","title":"Sora: A review on background, technology, limitations, and opportunities of large vision models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.298764Z"},"links":{"cited_paper":"/paper/2402.17177","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:9a018e0e5843cc812bf2076b812aa8afc7de18b7d3b38fe9862146603a0e4595","observation_id":"55008935-3b9e-460d-973b-05177ead7601","resolution":{"observed_at":"2026-08-09T17:06:31.298764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09748","last_updated":"2023-03-02T09:06:55Z","snapshot_observed_at":"2026-07-06T14:32:37.317828Z","submitted_at":"2022-12-19T18:59:58Z","title":"Scalable Diffusion Models with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09748","snapshot_observed_at":"2026-08-09T17:06:31.302320Z","title":"Scalable diffusion models with transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.302320Z"},"links":{"cited_paper":"/paper/2212.09748","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:c1baaa1de6f840ca6217a48a2d3971b1f97a8a8adf9018b73bacd6a7a3339d66","observation_id":"bffd57ef-ba01-4b55-8257-ee732cf0816f","resolution":{"observed_at":"2026-08-09T17:06:31.302320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.658151Z","title":"Available: https://runwayml.com/research/introducing-gen-3-alpha","venue":null,"work_id":"b7c24c50-66f5-4131-b306-af235d74d32c","year":null},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.295486Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:7806c0247c7696663744004acf373e9038c03c9f51d84761dadf17c92fd7c8ee","observation_id":"1d2caaec-d69b-42dd-98d7-9f4ccfc663c3","resolution":{"observed_at":"2026-08-09T17:06:32.661903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.648742Z","title":"Open-sora/docs/report_03.md at main · hpcaitech/open-sora,","venue":null,"work_id":"50d54e2c-6f1f-4af2-9786-013c05e6053c","year":2024},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.309391Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:c7ca55bc343e30247d7cf0ea56f0d2af47669aadd78d7e90157b9c300040af00","observation_id":"3f01e43a-b91f-4d7b-81b7-a18678976571","resolution":{"observed_at":"2026-08-09T17:06:32.652044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.639356Z","title":"Captcha: using hard ai problems for security,","venue":null,"work_id":"bb8dd4d0-1e4c-4dca-a292-51ef9f230515","year":2003},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.312497Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:7f3ab0d289f886d9ae7d66c274b810b634038fcafbec83b31a1e4bd6cad2d2f7","observation_id":"e270dd8a-04f5-4fa6-a8f1-6e2de64c32cb","resolution":{"observed_at":"2026-08-09T17:06:32.642950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-09T17:06:31.305865Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.305865Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:db65e5783cc78eb19b6b6733c5d4451f61f5d2cca0c75fbcc8ff8f457ecb6d54","observation_id":"bae9faf4-d4ba-4461-8db6-6320d63db4b5","resolution":{"observed_at":"2026-08-09T17:06:31.305865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.629861Z","title":"Deep learning for deepfakes creation and detection: A survey,","venue":null,"work_id":"4ad2c836-d7fe-4574-b908-0d1ee3f7c2b4","year":null},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.319387Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:bbfc5b24a56d8395686c801e36c2a1cdb5a3c7f278b2d820bc81a7d6686d6ef3","observation_id":"dddad9cd-fdc9-46a2-bb30-31cb1f650eba","resolution":{"observed_at":"2026-08-09T17:06:32.633409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.620476Z","title":"celebrity stable diffusion ai models | civitai,","venue":null,"work_id":"a244334f-05e1-4785-8c89-56d58c12270c","year":2024},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.325985Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:d8632c46953bd3f32ae5f534ebc6979a16ee2e7a3cda196f5a9b7a6c569431e9","observation_id":"60b680a2-807d-42fd-a187-4e4ef2917a15","resolution":{"observed_at":"2026-08-09T17:06:32.623875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12108","last_updated":"2023-07-22T15:36:13Z","snapshot_observed_at":"2026-08-04T13:21:23.218659Z","submitted_at":"2023-07-22T15:36:13Z","title":"An Empirical Study & Evaluation of Modern CAPTCHAs","version":1},"cited_work":{"arxiv_id":"2307.12108","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.12108","snapshot_observed_at":"2026-08-09T17:06:32.072215Z","title":"An Empirical Study & Evaluation of Modern CAPTCHAs","venue":"cs.CR","work_id":"a2d53f0f-a38c-4cca-bb0b-f36bbe8f3157","year":2023},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.315781Z"},"links":{"cited_paper":"/paper/2307.12108","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:812fcc82b8b04292b36f6f78cba80d5dfce3fafe30883818c2187bf22aa20dc5","observation_id":"57f2bab1-dbc4-413b-b1e5-5ce9e79bb634","resolution":{"observed_at":"2026-08-09T17:06:32.076156Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.611026Z","title":"Benchmarking music emotion recognition sys- tems,","venue":null,"work_id":"1c823597-271c-496b-a84b-1979fa787bfc","year":2016},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.332735Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:a93af0573f49fd487826b53b208fb3601655f4097a8bcf0ca844766fa23b9155","observation_id":"e08e3b88-bd33-4a8b-93a0-c5acfd3767bd","resolution":{"observed_at":"2026-08-09T17:06:32.614404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.601264Z","title":"Hello gpt-4o,","venue":null,"work_id":"ad8c006f-4453-436e-b751-70fa417297b7","year":2024},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.335816Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:aff2c358c6ba1b1f675c1d922b2a1a7df02c9d156f692becc0d4964d7382404a","observation_id":"60d8f217-4326-4649-97d3-1c9a010995cf","resolution":{"observed_at":"2026-08-09T17:06:32.604663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.591514Z","title":"Make Your Art Move with Stable Diffusion Anima- tions — towardsdatascience.com,","venue":null,"work_id":"19f0ee75-6881-49c3-8ffe-6dadcc39b7d3","year":2023},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.339290Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:7b0894bd6c53b960ea112ee8e0b66d4bedf44551196158ebf28b394b39c401ca","observation_id":"5c7f53a3-27ea-436f-8280-94a76fb22f4f","resolution":{"observed_at":"2026-08-09T17:06:32.594994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04356","last_updated":"2022-12-06T18:46:04Z","snapshot_observed_at":"2026-07-06T14:28:21.844826Z","submitted_at":"2022-12-06T18:46:04Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04356","snapshot_observed_at":"2026-08-09T17:06:31.329295Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.329295Z"},"links":{"cited_paper":"/paper/2212.04356","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:126a33c29c94ea21793325c5552bf3e99029c75ea3320eb3ce54d80b7e094b77","observation_id":"d0a90cce-4323-417b-94d6-5ff980e2f47f","resolution":{"observed_at":"2026-08-09T17:06:31.329295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.571951Z","title":"Bmaltais/kohya_ss","venue":null,"work_id":"2a7d0ed0-5991-45e0-85c0-a1eb2cd83673","year":null},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.345594Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:2717530763c5308cb7e1fb81aa4cb1dfc6fd6e38cb2112d87ce86fa568f645e3","observation_id":"5eaa5273-833a-4ca0-892d-2d471e6c923a","resolution":{"observed_at":"2026-08-09T17:06:32.575215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.562147Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation,","venue":null,"work_id":"102cc5ce-0028-46cd-8eb7-49894efa93c9","year":2023},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.348771Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:08ce2f819e318d8a88993b74b308e30d80c9a3f39d5a04b97fed441e30c82177","observation_id":"443aa0f8-0796-425d-99fb-3793f0dd6d78","resolution":{"observed_at":"2026-08-09T17:06:32.565675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.552267Z","title":null,"venue":null,"work_id":"f1bdc629-1214-44b5-adc0-792a66ea2cfe","year":null},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.351985Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:8ae7b64a2a54aee5f0de302c95674fdfdf041497d33fa53781eb33f017d8564c","observation_id":"7227cad6-e8ff-4af2-a5ea-96b99cef5656","resolution":{"observed_at":"2026-08-09T17:06:32.555918Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.581744Z","title":"Available: https://civitai.com/","venue":null,"work_id":"6bdcdb35-57c4-4626-a09f-c8a69e1a5974","year":null},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.342401Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:9e410af998f4dddad60110748d3694ac2d3df71955b053b7ac3c829f6478c44a","observation_id":"c300af80-85bd-4fa9-87b1-39581ae900fd","resolution":{"observed_at":"2026-08-09T17:06:32.585090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:31.362044Z","title":"Lora: Low-rank adaptation of large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.362044Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:5f681279618892020d7cf130db39925ecc1620d3ddcde781ccc85fcf17374c71","observation_id":"c5b88706-6e8c-4873-a8dd-224e5a591f4d","resolution":{"observed_at":"2026-08-09T17:06:31.362044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.12242","last_updated":"2023-03-15T17:52:27Z","snapshot_observed_at":"2026-07-06T13:45:31.237782Z","submitted_at":"2022-08-25T17:45:49Z","title":"DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.12242","snapshot_observed_at":"2026-08-09T17:06:31.365054Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.365054Z"},"links":{"cited_paper":"/paper/2208.12242","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:8afcedfe2058729a053780301f7e6d6b7b2fe0393e44b4d7ab2fb3cb736bd471","observation_id":"94c7b934-af23-4b15-9a9a-72a2662187ea","resolution":{"observed_at":"2026-08-09T17:06:31.365054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.527525Z","title":"A brief introduction to opencv,","venue":null,"work_id":"04e0801b-cf26-4ffb-bfc7-a390d6c3c771","year":2012},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.368254Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:c091d802ee059355685ee652a735adf4015f77d7eefe309efb026585c33c8325","observation_id":"03af418c-090c-4739-8c7d-5a85b8247dce","resolution":{"observed_at":"2026-08-09T17:06:32.530853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.542815Z","title":null,"venue":null,"work_id":"c27d8c91-2261-4598-a984-dd97c95aaff6","year":null},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.355340Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:cb525e88e25ecd0823c377a487058e33f5f13acc0f80a0d38bc01dee77ca56e7","observation_id":"28745699-4f86-45cd-89df-c5f607b8a659","resolution":{"observed_at":"2026-08-09T17:06:32.546087Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08172","last_updated":"2019-06-14T05:49:22Z","snapshot_observed_at":"2026-08-05T19:15:35.517082Z","submitted_at":"2019-06-14T05:49:22Z","title":"MediaPipe: A Framework for Building Perception Pipelines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08172","snapshot_observed_at":"2026-08-09T17:06:31.358636Z","title":"Mediapipe: A framework for building perception pipelines,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.358636Z"},"links":{"cited_paper":"/paper/1906.08172","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:7cd58fb04e1c7bff9301f6c08a2dda71bc287852799c8b8fa046a7dde91be500","observation_id":"fe283ca7-b9b5-4227-a832-49cd00792938","resolution":{"observed_at":"2026-08-09T17:06:31.358636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/9259802","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:31.762267Z","title":"Lightface: A hybrid deep face recognition framework,","venue":null,"work_id":"cffa4130-31b9-4e10-a43d-a86b6e74919d","year":2020},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.378294Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:8c7883adb832e5423212c4419e78afa9d605d414fc0f5e9f2acf3269b7af041b","observation_id":"e7ceebde-8f91-48ae-bc8a-366af296a894","resolution":{"observed_at":"2026-08-09T17:06:31.768087Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.507817Z","title":"iperov/deepfacelive,","venue":null,"work_id":"ff792a00-473f-40ff-93a6-e4501bada85e","year":2022},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.381493Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:a4d906e5bfbd1a3676970bc5de7747b092cb24db293dd3a5b1224dd385b94fe9","observation_id":"d3aecb1a-8235-4f64-b92e-174fbb221fca","resolution":{"observed_at":"2026-08-09T17:06:32.511185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12073","last_updated":"2023-04-26T15:41:05Z","snapshot_observed_at":"2026-08-08T03:53:33.897991Z","submitted_at":"2023-01-28T03:10:33Z","title":"Towards Equitable Representation in Text-to-Image Synthesis Models with the Cross-Cultural Understanding Benchmark (CCUB) Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12073","snapshot_observed_at":"2026-08-09T17:06:31.384514Z","title":"Towards equitable representation in text-to-image synthesis models with the cross-cultural understanding benchmark (ccub) dataset,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.384514Z"},"links":{"cited_paper":"/paper/2301.12073","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:a2c78b8ffdf3997d786b8e52ffbe4eb28e41357871d4498d48e2e95932aeb47c","observation_id":"06baa603-4b99-41d1-839d-f664c8a688a5","resolution":{"observed_at":"2026-08-09T17:06:31.384514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.08092","last_updated":"2018-05-13T10:35:21Z","snapshot_observed_at":"2026-08-07T09:52:07.033191Z","submitted_at":"2017-10-23T05:26:32Z","title":"VGGFace2: A dataset for recognising faces across pose and age","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.08092","snapshot_observed_at":"2026-08-09T17:06:31.372035Z","title":"Vggface2: A dataset for recognising faces across pose and age,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.372035Z"},"links":{"cited_paper":"/paper/1710.08092","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:c9a977abe027ce5f9b196e50b9e87e3d9d630875e0e27a20908fd18c8758d98e","observation_id":"5de29dcb-c5f6-4b94-83e9-b6bf45f34dac","resolution":{"observed_at":"2026-08-09T17:06:31.372035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.517307Z","title":"A benchmark of facial recognition pipelines and co-usability performances of modules,","venue":null,"work_id":"e18e7470-1977-42b4-b801-81683a23a450","year":2024},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.375256Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:181a8e0dc6e370d2d39bc66192106b908abd0b23d5d45fe51f5b3ab592c186ca","observation_id":"4ff70d2e-1837-4029-9cae-57a66d9a46b1","resolution":{"observed_at":"2026-08-09T17:06:32.520961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04909","last_updated":"2025-09-14T11:39:23Z","snapshot_observed_at":"2026-07-06T18:58:43.349175Z","submitted_at":"2024-08-09T07:31:06Z","title":"Surveying the Landscape of Image Captioning Evaluation: A Comprehensive Taxonomy, Trends and Metrics Analysis","version":3},"cited_work":{"arxiv_id":"2408.04909","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.04909","snapshot_observed_at":"2026-08-09T17:06:31.616964Z","title":"Surveying the Landscape of Image Captioning Evaluation: A Comprehensive Taxonomy, Trends and Metrics Analysis","venue":"cs.CL","work_id":"11a9dfe0-46f4-40f3-86c6-fad1ed642e43","year":2024},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.393753Z"},"links":{"cited_paper":"/paper/2408.04909","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:de152594d3b364db8a080d32e8a8e0bea8a6a9025c6e85bf0efcbbb181361ca4","observation_id":"d7e0fd7d-df9a-4c98-9ba4-b048ac9f9665","resolution":{"observed_at":"2026-08-09T17:06:31.621196Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:31.599889Z","title":"Extracting predominant local pulse information from music recordings,","venue":null,"work_id":"1fbca438-91a1-4b63-a510-91f91ef6a6a8","year":2011},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.397241Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:56d9ab68479659153236a070bdf37188c6220921b6a04e05cfc2dab22b66a47d","observation_id":"8700d615-c507-42c4-b49f-b94b0abb3ba6","resolution":{"observed_at":"2026-08-09T17:06:31.605447Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.477654Z","title":"Librosa based assessment tool for music information re- trieval systems,","venue":null,"work_id":"460c8707-70b5-463b-97a5-b5f371196b28","year":2019},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.400313Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:5c79904a9b03aede3a9e9617742882a3b2f737c06737d8fd319383abb24519f3","observation_id":"51b82d9d-5281-4a43-a8c6-6ba16845c4e4","resolution":{"observed_at":"2026-08-09T17:06:32.481889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.498035Z","title":"Toonyou - beta 6: Stable diffusion checkpoint,","venue":null,"work_id":"297d3d14-7945-4254-89fa-f595dac9acc7","year":2023},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.387723Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:8dfbd6f3fcc0555069f4b21f5588942ffd356cbe43626dd1d2facf0be624503c","observation_id":"ffbc76e8-adc6-4473-bdf6-204c7b0a710c","resolution":{"observed_at":"2026-08-09T17:06:32.501426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.487882Z","title":"CLIPScore: A reference-free evaluation metric for image captioning,","venue":null,"work_id":"0b84e8b3-8a4e-4ec1-9978-55888b49010e","year":2021},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.390646Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:c645c1e03e52af294d29b0ab2d2714b5707ea7215654186be4e1a5396e5fe8fc","observation_id":"24dec293-4c43-4ca4-a120-cc9c35f2dcbf","resolution":{"observed_at":"2026-08-09T17:06:32.491425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.057359Z","title":"Available: http://dx.doi.org/10.1016/j.cviu.2022.103525","venue":null,"work_id":"7c411eed-8e17-42e9-99ff-2d3bf799910a","year":2022},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.322592Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:a61a38da058d5d35ac5fdc756f3cd8b74f37bc075adee3da86a824200632b142","observation_id":"1203b4bd-5a8c-4c0c-9f79-b5d6b10407ec","resolution":{"observed_at":"2026-08-09T17:06:32.060836Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-09T17:06:31.274899Z","title":"Available: https://arxiv.org/abs/2307.01952","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.274899Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:c9eeb40b5263b52fad4bcefa745731f6330600d19ac607803d1c08ebecb7c5bc","observation_id":"3f026843-5f33-424e-948b-0be63f4ed1de","resolution":{"observed_at":"2026-08-09T17:06:31.274899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:06:32.694410Z","title":"Available: https://github.com/black-forest-labs/flux","venue":null,"work_id":"3577fec2-bf36-4eca-8681-5af93bcc49d3","year":null},"citing_paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T17:06:31.281918Z"},"links":{"citing_paper":"/paper/2502.02610"},"observation_digest":"sha256:89eaf050538077c27d8a59f59ee9a58bbbfcc14d61571951cb7a6f1fb3ac48d2","observation_id":"d4c575e9-c1f6-4242-aca4-7eb186dd29e9","resolution":{"observed_at":"2026-08-09T17:06:32.697847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.02610","last_updated":"2025-02-03T01:25:47Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T16:58:53.946288Z","submitted_at":"2025-02-03T01:25:47Z","title":"Secure & Personalized Music-to-Video Generation via CHARCHA"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":8,"verified_fuzzy":29},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2502.02610."}