{"as_of":"2026-08-09T18:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f7207a1f89c4c7d3407ca9a9a2939446dfcc5b5164fcb166ca4394a52ec5cc5e","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:44:17.234857Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.01591/citation-record","integrity":"/paper/2506.01591/integrity","json":"/paper/2506.01591/citation-record.json","paper":"/paper/2506.01591"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.04226","last_updated":"2023-03-07T20:36:13Z","snapshot_observed_at":"2026-08-09T08:26:36.720121Z","submitted_at":"2023-03-07T20:36:13Z","title":"A Comprehensive Survey of AI-Generated Content (AIGC): A History of Generative AI from GAN to ChatGPT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04226","snapshot_observed_at":"2026-08-07T11:44:14.885064Z","title":"A comprehensive survey of ai-generated content (aigc): A history of generative ai from gan to chatgpt.arXiv preprint arXiv:2303.04226, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.885064Z"},"links":{"cited_paper":"/paper/2303.04226","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:f22ab9a05112a961578bfbef49a04cef793a383587c78aac5ee6551c2a582b8d","observation_id":"c1b45a53-fa21-447c-b667-d26fa4649800","resolution":{"observed_at":"2026-08-07T11:44:14.885064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.079707Z","title":"Diffusion models for impercepti- ble and transferable adversarial attack.IEEE Transactions on Pattern Analysis and Machine Intelligence, pages 1–17,","venue":null,"work_id":"87e789c9-5b69-41fe-a5cf-62eab2c6a521","year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.897655Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:0edd2636ac1da904d74ada1c87fffeec52c971c5b8a669851d48d383719a0288","observation_id":"e702784d-0ad2-4bcf-83aa-190fea22e5c8","resolution":{"observed_at":"2026-08-07T11:44:18.084741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.067795Z","title":"Hierarchical cross-modal talking face generation with dynamic pixel-wise loss","venue":null,"work_id":"9705e926-6741-4996-954b-ab6ee74fd59a","year":2019},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.911408Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:750590675cd027c202e0cb2dc084cf70281e3f32d4b5cb621b50797bdb7246dc","observation_id":"58cb324e-b326-4a98-b274-dd3e82ed5835","resolution":{"observed_at":"2026-08-07T11:44:18.072039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.056984Z","title":"Content-based unrestricted ad- versarial attack","venue":null,"work_id":"0e504e41-2f97-4d44-a843-01892d9d0eae","year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.931922Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:9330711786efdb11698c31e7c0c448da650d60bc91df8c590ea599c42b2c3693","observation_id":"fe6d5802-3643-45a2-ac95-b382abaf40a3","resolution":{"observed_at":"2026-08-07T11:44:18.060946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.045489Z","title":"Echomimic: Lifelike audio-driven portrait animations through editable landmark conditioning, 2024","venue":null,"work_id":"65c48093-39a3-454a-8e58-e835d8c2b814","year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.956565Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:364c897b17fdd051a33ea68a0e58f9d033efdeba40e0db6d3462289c349044af","observation_id":"5e9ffa5b-09e5-45b2-88d2-e5e621813af1","resolution":{"observed_at":"2026-08-07T11:44:18.049109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.033771Z","title":"Out of time: auto- mated lip sync in the wild","venue":null,"work_id":"a0e3bd28-22fe-4dc9-a744-cdb2dea7f235","year":2016},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.969349Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:837e827989899fc533c323823ad8eb46989b2eb4e2b934626f61ac49fa4e482d","observation_id":"2b9d9e62-d1f7-4fe6-b3f2-a55a6cdfb269","resolution":{"observed_at":"2026-08-07T11:44:18.038372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.021981Z","title":"You said that?BMVC, 2017","venue":null,"work_id":"713607a0-5d8b-4dca-89a8-c77fa34288a2","year":2017},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.980534Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:bca1e2ad50cbb5d654328ba2f037ddeb6f142566df2c81a80442b128e15b4db0","observation_id":"de99b4cf-0b7b-44e2-93a9-18cf9cd36070","resolution":{"observed_at":"2026-08-07T11:44:18.026304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07718","last_updated":"2024-10-14T13:35:17Z","snapshot_observed_at":"2026-08-05T03:23:39.587839Z","submitted_at":"2024-10-10T08:34:41Z","title":"Hallo2: Long-Duration and High-Resolution Audio-Driven Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07718","snapshot_observed_at":"2026-08-07T11:44:14.997364Z","title":"Hallo2: Long-duration and high-resolution audio-driven portrait im- age animation.arXiv preprint arXiv:2410.07718, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:14.997364Z"},"links":{"cited_paper":"/paper/2410.07718","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:4ef44dec02b87b87f0882ad377a97169d064ce01de3eb3cc39149a05d35070f5","observation_id":"a20423a8-e28c-4b29-acda-c0bfd3d5fe90","resolution":{"observed_at":"2026-08-07T11:44:14.997364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.010468Z","title":"On the detection of digital face manipulation","venue":null,"work_id":"a1c94254-ed1f-4d29-9ea4-8c774d74221a","year":2020},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.024369Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:ec6c080333da8edaccdf0296774c3009ac6d1eecfca84282e02cedad2c8291d8","observation_id":"7c74ef6c-c149-4968-b413-f023b69e6100","resolution":{"observed_at":"2026-08-07T11:44:18.014458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.998791Z","title":"Boosting adversarial at- tacks with momentum","venue":null,"work_id":"a84546bb-6d29-490b-8749-e247aceeb260","year":2018},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.040204Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:b81e1cccc8fb2cbe2e60a86afedcc1e8a00309828cc7ab405ab7dfd46d7982d1","observation_id":"d6850a48-7562-401b-bb00-e0e76a5e4166","resolution":{"observed_at":"2026-08-07T11:44:18.002904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.986795Z","title":"Evading defenses to transferable adversarial examples by translation-invariant attacks","venue":null,"work_id":"dcf34e4c-9922-428c-8588-5888b0f14f89","year":2019},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.054661Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:cad581075125f7d3b6217287e93045b13be252ae8c962ea6d94eafd120e0459d","observation_id":"7c5cfd35-6ef9-4092-81d4-9db3d4f54e2c","resolution":{"observed_at":"2026-08-07T11:44:17.991101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.974738Z","title":"Implicit generation and model- ing with energy based models","venue":null,"work_id":"ae52e302-f83a-4239-a2db-40b3fec770fb","year":2019},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.064228Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:c4ecad90dc8080acc68ab097e31d31820dfcc4606fca879f7ed25991149c0762","observation_id":"705943f7-22f2-4dd7-917d-75b64a38de26","resolution":{"observed_at":"2026-08-07T11:44:17.978715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:15.076857Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.076857Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:3b95af086b332d9c789b709a27fd6786d9d5f8641d66e19c20a724a3af432ba1","observation_id":"fa0de445-97b3-402c-8c9a-faa2b47082e1","resolution":{"observed_at":"2026-08-07T11:44:15.076857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.956442Z","title":"Navi- gation instruction generation with bev perception and large language models","venue":null,"work_id":"7cc13a32-03fc-482d-a811-14fe6c21f15c","year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.089874Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:361646e0f190f407df15f3364940b5f2d870623d422a705decbb271d651c8734","observation_id":"a5040ee2-50b6-4109-a6f5-9401e8858401","resolution":{"observed_at":"2026-08-07T11:44:17.960425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.945159Z","title":"Efficient emotional adaptation for audio-driven talking-head generation","venue":null,"work_id":"f4d58cc2-6a57-4aed-a549-ab18f6996698","year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.106415Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:38f5142bd6cb7688f79ad5abc8c7e8e2de4c6044734e6d91f00988c38d394e19","observation_id":"0b3ff085-ed5d-42b6-a9fe-ff2fb151370d","resolution":{"observed_at":"2026-08-07T11:44:17.949474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.933453Z","title":"Patch-wise attack for fooling deep neu- ral network","venue":null,"work_id":"52261a50-5862-4e46-9ce7-74fe335d228f","year":2020},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:15.124626Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:8f01a68f6a095894c89b26d11b3134ae1aa41a2c81c1a9c5987157f98ad9e452","observation_id":"f251cb74-3b20-41b5-95b1-4deaec9cc695","resolution":{"observed_at":"2026-08-07T11:44:17.937543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.316039Z","title":"Generative adversarial nets.Advances in neural information processing systems, 27, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.316039Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:3d873075f9c6309dd253173b0f8e5ec4ba763a00192de182758529c8d22d9273","observation_id":"ad1420cd-54d3-48de-8129-6e634c1f234b","resolution":{"observed_at":"2026-08-07T11:44:16.316039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-07T11:44:16.400248Z","title":"Explaining and harnessing adversarial examples.arXiv preprint arXiv:1412.6572, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.400248Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:64194ffc8a339883c5edf519c8c21dc2e67b95fe71fadac867f96503de3b70d8","observation_id":"9aa372c2-0652-4607-b677-36221f391387","resolution":{"observed_at":"2026-08-07T11:44:16.400248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.03263","last_updated":"2020-09-15T15:40:19Z","snapshot_observed_at":"2026-07-06T08:42:41.724791Z","submitted_at":"2019-12-06T18:00:36Z","title":"Your Classifier is Secretly an Energy Based Model and You Should Treat it Like One","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.03263","snapshot_observed_at":"2026-08-07T11:44:16.414421Z","title":"Your classifier is secretly an energy based model and you should treat it like one.arXiv preprint arXiv:1912.03263,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.414421Z"},"links":{"cited_paper":"/paper/1912.03263","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:25b03e89e28da961560168433db26fc5146f8b5fbe56e60046c71be4615ce1a3","observation_id":"30f1cf2b-3a8c-4cc9-8e8b-daee93b1f760","resolution":{"observed_at":"2026-08-07T11:44:16.414421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.914584Z","title":"Ad-nerf: Audio driven neural ra- diance fields for talking head synthesis","venue":null,"work_id":"6acd7a41-8cff-4cc2-a172-c324a54ee126","year":2021},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.432244Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:1a19a2f5941a2c0cea48dd9090296af3b9daeafa504142e8d1b3586c6407fb77","observation_id":"0d9594ef-201b-4a25-9c22-633340ea6eb0","resolution":{"observed_at":"2026-08-07T11:44:17.919481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.447667Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.447667Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:86d15bd2df04b0ae515662bc1304b8467f8198376dba4c9974e9f2837f121981","observation_id":"616d6604-bd6a-4ab7-a647-dc97af630f7a","resolution":{"observed_at":"2026-08-07T11:44:16.447667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.13525","last_updated":"2021-03-18T19:39:26Z","snapshot_observed_at":"2026-08-09T14:36:15.256747Z","submitted_at":"2020-05-27T17:53:36Z","title":"Stochastic Security: Adversarial Defense Using Long-Run Dynamics of Energy-Based Models","version":2},"cited_work":{"arxiv_id":"2005.13525","doi":null,"metadata_source":"pith","pith_arxiv_id":"2005.13525","snapshot_observed_at":"2026-08-07T11:44:17.425925Z","title":"Stochastic Security: Adversarial Defense Using Long-Run Dynamics of Energy-Based Models","venue":"stat.ML","work_id":"91e4ce03-84f2-44ea-a748-2b142c3c1464","year":2020},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.461422Z"},"links":{"cited_paper":"/paper/2005.13525","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:7b7cfc4afa2d9aac7ac24c1819a24bd489eac36636c982e69b3ebaade4ca53ae","observation_id":"5cc057fb-6d7b-4afc-a7ed-f8df2a774af4","resolution":{"observed_at":"2026-08-07T11:44:17.432135Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.473690Z","title":"Denoising dif- fusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.473690Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:78750debc21ce8ebcc1c4472c7bd0af791677b34f19c8aa37f83c4b4055731c2","observation_id":"d1e1e6d5-0b09-4ce2-bd5b-9701124bd491","resolution":{"observed_at":"2026-08-07T11:44:16.473690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.889624Z","title":"Animate anyone: Consistent and controllable image- to-video synthesis for character animation","venue":null,"work_id":"501af076-54eb-44bb-b245-c03f5e620d37","year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.490105Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:61756d0fefa521e8ab43d2885701dad593bb13944702b64f4d618ffd403d7549","observation_id":"f33b1acb-5b43-43d9-a82e-25d885ac8541","resolution":{"observed_at":"2026-08-07T11:44:17.894187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.876781Z","title":"Progressive growing of gans for improved quality, stability, and variation","venue":null,"work_id":"4b9e6c9c-37e5-4181-a8e3-04f1cd03bec4","year":2018},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.503410Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:f035d25ad79ec83b2dec57ff2e47266f4b29f05a598607d021eedd4377125d84","observation_id":"46f8a38a-b9a1-4204-b38d-f575191986a0","resolution":{"observed_at":"2026-08-07T11:44:17.881132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.865879Z","title":"Kingma and Max Welling","venue":null,"work_id":"7e8b2a86-30c9-4aa2-9bfb-352338f58c04","year":2014},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.517080Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:6af4979f33e731697dfc2cfe18a1b9ec76d055ae6ad9a8e2bbf1c1b01dceb129","observation_id":"a2906d9e-ccd9-4a6f-a8bb-962405e8903d","resolution":{"observed_at":"2026-08-07T11:44:17.869666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.853537Z","title":"Ad- versarial examples in the physical world","venue":null,"work_id":"926d5321-e739-4659-9c19-1769dd783d79","year":2018},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.529727Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:457dcd728e4fcaa3338a79f85c6baa871efb28ad378e2ada9d962ce4c38a8adc","observation_id":"faaf48a8-80e8-4edf-ba97-55fafbf0f5d5","resolution":{"observed_at":"2026-08-07T11:44:17.858079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.842496Z","title":"Unganable: Defending against gan- based face manipulation","venue":null,"work_id":"6ba5dec5-9d4c-4add-8c92-5acbba8a84de","year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.548010Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:9d550bd18f9a57d62ed468f79d4a5fa998ad5bbd70daeb2b1e5caaa36c6fb70b","observation_id":"0a8140fc-b773-4fd1-8ce6-a02184747951","resolution":{"observed_at":"2026-08-07T11:44:17.846501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12683","last_updated":"2023-05-22T03:43:34Z","snapshot_observed_at":"2026-07-06T15:30:26.626858Z","submitted_at":"2023-05-22T03:43:34Z","title":"Mist: Towards Improved Adversarial Examples for Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12683","snapshot_observed_at":"2026-08-07T11:44:16.566278Z","title":"Mist: Towards improved adversarial examples for diffusion models.arXiv preprint arXiv:2305.12683, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.566278Z"},"links":{"cited_paper":"/paper/2305.12683","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:228cb264274bf1c4cf62378d7b65da91793901fdb66daa413b1df8948c7bc169","observation_id":"c7689ee1-7283-4e48-95e8-940de6ddeb66","resolution":{"observed_at":"2026-08-07T11:44:16.566278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.830127Z","title":"Adversarial example does good: Preventing paint- ing imitation from diffusion models via adversarial exam- ples","venue":null,"work_id":"21d9775f-1c11-44ab-87c0-d18a0d4fb3b8","year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.582514Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:f327d3d632a1ee3ce90045862ab4e4142786979dd9f40d149bd0e885cc46c77f","observation_id":"93455dc4-a2f7-43d2-b84e-4bfb3e3d36d2","resolution":{"observed_at":"2026-08-07T11:44:17.835003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-07T11:44:16.598413Z","title":"Flow matching for generative mod- eling.arXiv preprint arXiv:2210.02747, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.598413Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:436823f8689da9401eeacf47efc796f7ee015f85858b31861caae66803c43afd","observation_id":"9777f747-7081-407c-9230-aa018439d71a","resolution":{"observed_at":"2026-08-07T11:44:16.598413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.614034Z","title":"Fre- quency domain model augmentation for adversarial attack","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.614034Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:a6c5b7cb57be658e4eeab9ca23332983f1b2323d06f91ca1a6eb37a351db1059","observation_id":"0233fc10-0b14-4dee-b0b9-6492fa28b5fa","resolution":{"observed_at":"2026-08-07T11:44:16.614034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T11:44:16.630330Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.630330Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:a2a3772e53bf0b065de36153af633354166d60e1ceb447459f712e34d0d41c11","observation_id":"0da7ab64-71a7-4354-9365-14800cd2eadf","resolution":{"observed_at":"2026-08-07T11:44:16.630330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.06083","last_updated":"2019-09-04T18:53:10Z","snapshot_observed_at":"2026-08-07T14:27:46.872660Z","submitted_at":"2017-06-19T17:53:11Z","title":"Towards Deep Learning Models Resistant to Adversarial Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.06083","snapshot_observed_at":"2026-08-07T11:44:16.651294Z","title":"Towards deep learning models resis- tant to adversarial attacks.arXiv preprint arXiv:1706.06083,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.651294Z"},"links":{"cited_paper":"/paper/1706.06083","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:406e95d4d1aed98184b969520c8666e924722d71e59e463841a190808e7765a6","observation_id":"0bf4b434-c216-4995-9729-7298c24e5377","resolution":{"observed_at":"2026-08-07T11:44:16.651294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.07460","last_updated":"2022-05-16T06:03:00Z","snapshot_observed_at":"2026-08-04T18:06:26.992880Z","submitted_at":"2022-05-16T06:03:00Z","title":"Diffusion Models for Adversarial Purification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.07460","snapshot_observed_at":"2026-08-07T11:44:16.664363Z","title":"Diffusion models for adversarial purification.arXiv preprint arXiv:2205.07460,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.664363Z"},"links":{"cited_paper":"/paper/2205.07460","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:ecda1608c9b3eca8ca9b87faa5495caf58c90b71ef1c5bc36df1f952497b0964","observation_id":"9ee559b8-3d80-4510-b798-bb89eb1da984","resolution":{"observed_at":"2026-08-07T11:44:16.664363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.811076Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"64af8713-5097-4594-b957-6c4d16871dcb","year":2022},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.679533Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:510471600d3cb5b649c8f96adfa2a407643e9e60dd7a3cc186afd37b5ba3d5e3","observation_id":"51bff52c-8466-452f-8488-0c631aa95457","resolution":{"observed_at":"2026-08-07T11:44:17.815511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.797847Z","title":"Faceforen- sics++: Learning to detect manipulated facial images","venue":null,"work_id":"67bbd23b-282c-44b6-92b7-578c066bda33","year":2019},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.691621Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:dde9dd3274e8d0093d124134cb37c5a67a1da9c7af3ca30271583895742289d6","observation_id":"420e11d0-9ab4-4e77-aa73-d057f1161c4b","resolution":{"observed_at":"2026-08-07T11:44:17.802803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.784946Z","title":"Dis- rupting deepfakes: Adversarial attacks against conditional image translation networks and facial manipulation systems","venue":null,"work_id":"4df24d35-6112-4a13-847d-ebf4dfdef7f1","year":2020},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.708468Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:98ff5d8119e0f2123ae870d7126695e30acdfd4562a96f2f52f812906a17c792","observation_id":"3e80ee74-f2fd-4975-bd6e-9c906504bded","resolution":{"observed_at":"2026-08-07T11:44:17.789480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.721635Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.721635Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:095a96a4a94f81aef77268e153891b66b25ba6391c1fd18230a9bc4baaee62b1","observation_id":"e9f26956-c31d-413a-92ad-bc1295eac3d6","resolution":{"observed_at":"2026-08-07T11:44:16.721635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06588","last_updated":"2023-02-13T18:38:42Z","snapshot_observed_at":"2026-07-06T14:51:22.788392Z","submitted_at":"2023-02-13T18:38:42Z","title":"Raising the Cost of Malicious AI-Powered Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06588","snapshot_observed_at":"2026-08-07T11:44:16.734736Z","title":"Raising the cost of malicious ai-powered image editing.arXiv preprint arXiv:2302.06588,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.734736Z"},"links":{"cited_paper":"/paper/2302.06588","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:1d2ced09cd33bae60e57b14774bd0ac1973380d95aa4c73e50f685d5866f9480","observation_id":"4545330a-ac10-4d15-b431-7702734848ab","resolution":{"observed_at":"2026-08-07T11:44:16.734736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.06605","last_updated":"2018-05-18T00:20:52Z","snapshot_observed_at":"2026-08-02T06:44:56.184651Z","submitted_at":"2018-05-17T05:38:55Z","title":"Defense-GAN: Protecting Classifiers Against Adversarial Attacks Using Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.06605","snapshot_observed_at":"2026-08-07T11:44:16.745038Z","title":"Defense-gan: protecting classifiers against adversarial attacks using generative models.arXiv preprint arXiv:1805.06605, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.745038Z"},"links":{"cited_paper":"/paper/1805.06605","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:783503874702ff4a4ca018801a8592ce271d3b779d3806a22582c24cfc3dde3f","observation_id":"71baf364-b631-4cdd-80a9-a6bf1307bfd2","resolution":{"observed_at":"2026-08-07T11:44:16.745038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02234","last_updated":"2023-04-07T20:33:57Z","snapshot_observed_at":"2026-07-06T15:12:22.395669Z","submitted_at":"2023-04-05T05:30:09Z","title":"JPEG Compressed Images Can Bypass Protections Against AI Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02234","snapshot_observed_at":"2026-08-07T11:44:16.763658Z","title":"Jpeg compressed images can bypass protections against ai editing.arXiv preprint arXiv:2304.02234, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.763658Z"},"links":{"cited_paper":"/paper/2304.02234","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:4118d7d6caa06d63245d8a32619ff40131797f0dc3d3076a5a7f6d07ef0634a2","observation_id":"a631c3f4-ed7e-4f69-99d1-516b6f00849c","resolution":{"observed_at":"2026-08-07T11:44:16.763658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.767678Z","title":"Difftalk: Crafting diffusion models for generalized audio-driven portraits animation","venue":null,"work_id":"1ec5b3c8-58a5-4e69-89dc-34aba4a219bf","year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.775066Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:c4ba9f19e077a83b54813ea4e9ba6ad73f2020a43639f53c151be99e2f03cf64","observation_id":"d1e1f296-d277-4679-8dcb-8c14109e2e87","resolution":{"observed_at":"2026-08-07T11:44:17.771977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.755130Z","title":"Detecting deep- fakes with self-blended images","venue":null,"work_id":"3c8b4309-32e7-43d5-a0ea-e359bdf63514","year":2022},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.790048Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:e0702bb42612d51d7eae8d29c7705074d2fba47515fd2dd306f453e29b60e76f","observation_id":"ee9f971b-3659-4da6-bac4-5c2b09363f28","resolution":{"observed_at":"2026-08-07T11:44:17.759419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-07T11:44:16.802766Z","title":"Denoising diffusion implicit models.arXiv preprint arXiv:2010.02502, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.802766Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:c06da09202c976cd6e29d8b164018050174da1c0a4362ac4ec0edda62a7e1bf0","observation_id":"7826b16f-f504-4aeb-9264-6410d8cf1143","resolution":{"observed_at":"2026-08-07T11:44:16.802766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.818247Z","title":"Generative modeling by esti- mating gradients of the data distribution.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.818247Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:e934391170414b44f7b6297524de43fe50919a03d6ebebfe85194c94eaec8630","observation_id":"fd6baa28-40e1-4588-a712-bc00a6088620","resolution":{"observed_at":"2026-08-07T11:44:16.818247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.10766","last_updated":"2018-05-21T05:26:01Z","snapshot_observed_at":"2026-08-04T05:51:55.347332Z","submitted_at":"2017-10-30T04:21:23Z","title":"PixelDefend: Leveraging Generative Models to Understand and Defend against Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.10766","snapshot_observed_at":"2026-08-07T11:44:16.832595Z","title":"Pixeldefend: Leveraging genera- tive models to understand and defend against adversarial ex- amples.arXiv preprint arXiv:1710.10766, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.832595Z"},"links":{"cited_paper":"/paper/1710.10766","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:f70f70e93355a9e27926b38014d38462b73167810dc76808999e4235e6d75105","observation_id":"e28e2ba4-6cfb-44ec-849b-83638bc3d98d","resolution":{"observed_at":"2026-08-07T11:44:16.832595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.737174Z","title":"Diffused heads: Diffusion models beat gans on talking-face genera- tion","venue":null,"work_id":"7107e1e6-e21e-4421-8aae-444dc486495a","year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.852844Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:77151278c9e08292197186d7fa3834a620321f75020f0b8828e9fc005e9a1539","observation_id":"c7d8a57a-8343-4f67-87ef-9fe21815a644","resolution":{"observed_at":"2026-08-07T11:44:17.741651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.724568Z","title":"Rethinking the up-sampling op- erations in cnn-based generative network for generalizable deepfake detection","venue":null,"work_id":"07776635-b08e-4d45-967f-1472e9a9dfd0","year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.874030Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:ff9f0544459ce14537affd92d5d0977307a2064e434613f27be8fff524e40213","observation_id":"cba54413-2f3e-4a61-a67e-10a52285b060","resolution":{"observed_at":"2026-08-07T11:44:17.729274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.890372Z","title":"Edtalk: Effi- cient disentanglement for emotional talking head synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.890372Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:51f44d73f0c01bc21cae45d3e4059d58d52c43aa67035a6043fe1dad76e0327f","observation_id":"aee0ff02-869a-414b-9273-33830ec2d131","resolution":{"observed_at":"2026-08-07T11:44:16.890372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17485","last_updated":"2024-08-08T03:48:38Z","snapshot_observed_at":"2026-07-06T17:36:11.854303Z","submitted_at":"2024-02-27T13:10:11Z","title":"EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17485","snapshot_observed_at":"2026-08-07T11:44:16.916279Z","title":"Emo: Emote portrait alive-generating expressive portrait videos with audio2video diffusion model under weak conditions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.916279Z"},"links":{"cited_paper":"/paper/2402.17485","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:415f80375de46860e6aa9c214e441fa69c9a4d7c8c20b17cc8763f3acdc5c5c4","observation_id":"ccf1a429-ef73-4c8b-b9d2-6d62c01ed81d","resolution":{"observed_at":"2026-08-07T11:44:16.916279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.934310Z","title":"Ex- ploring clip for assessing the look and feel of images","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.934310Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:650128cbef9115d29ebc3e67dbfe5944ffe3dc4f4dae48491fddfe23ee518d9e","observation_id":"a4e59370-1d50-453d-a54d-3b23d7857a45","resolution":{"observed_at":"2026-08-07T11:44:16.934310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.594069Z","title":"One-shot free-view neural talking-head synthesis for video conferenc- ing","venue":null,"work_id":"aa16ed4e-7961-4068-8d0f-982d4a0abda5","year":2021},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.948476Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:a33d6a10a0f9b7656b6ae497e6be96ab37a5cda1c35943a6351e15b1fa3d27b4","observation_id":"aa8fc364-08bf-4241-8544-7694cf8e495e","resolution":{"observed_at":"2026-08-07T11:44:17.597776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.582207Z","title":"Aniportrait: Audio-driven synthesis of photorealistic portrait animations,","venue":null,"work_id":"f1642d6b-64df-469a-95ac-872e21fb4b44","year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.967351Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:6adce8b518fb33044682d504a328b87e3e80a831d249c6be02165aaf1877501a","observation_id":"f7cf42ff-f0a2-4d7c-a59c-88ad8be42231","resolution":{"observed_at":"2026-08-07T11:44:17.586702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.570783Z","title":"Improving transferabil- ity of adversarial examples with input diversity","venue":null,"work_id":"edcb0d6b-f20c-40eb-8270-f61ec672b637","year":2019},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.982925Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:4e6250e131484fccca4546e33e08076627d22fd0d1a3972bafbd3e12ba3f4e10","observation_id":"0248316a-f22a-4822-9f5c-acd61dee426a","resolution":{"observed_at":"2026-08-07T11:44:17.575146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08801","last_updated":"2024-06-16T07:10:41Z","snapshot_observed_at":"2026-07-06T18:30:06.570612Z","submitted_at":"2024-06-13T04:33:20Z","title":"Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08801","snapshot_observed_at":"2026-08-07T11:44:16.996589Z","title":"Hallo: Hierarchical audio-driven vi- sual synthesis for portrait image animation.arXiv preprint arXiv:2406.08801, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.996589Z"},"links":{"cited_paper":"/paper/2406.08801","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:af05c3dc424ad2be4bca952c7f2ab29a149272586434797f5c66517c8a34e490","observation_id":"68bc8d76-28d7-45f1-b939-899835f93638","resolution":{"observed_at":"2026-08-07T11:44:16.996589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10667","last_updated":"2024-10-31T07:43:14Z","snapshot_observed_at":"2026-07-06T18:01:01.206270Z","submitted_at":"2024-04-16T15:43:22Z","title":"VASA-1: Lifelike Audio-Driven Talking Faces Generated in Real Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10667","snapshot_observed_at":"2026-08-07T11:44:17.012581Z","title":"Vasa-1: Lifelike audio-driven talking faces generated in real time.arXiv preprint arXiv:2404.10667,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.012581Z"},"links":{"cited_paper":"/paper/2404.10667","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:ee3d4d38a7058804a4e5eba4cc9defe3ba4cf971d6be57563b73c2857920ca17","observation_id":"34c8d122-35c8-4e90-b54e-9de8adf46913","resolution":{"observed_at":"2026-08-07T11:44:17.012581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13320","last_updated":"2024-05-02T02:25:39Z","snapshot_observed_at":"2026-08-06T00:14:34.275386Z","submitted_at":"2024-04-20T08:28:43Z","title":"Pixel is a Barrier: Diffusion Models Are More Adversarially Robust Than We Think","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13320","snapshot_observed_at":"2026-08-07T11:44:17.028592Z","title":"Pixel is a barrier: Diffusion models are more adversarially robust than we think.arXiv preprint arXiv:2404.13320, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.028592Z"},"links":{"cited_paper":"/paper/2404.13320","citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:903141204499db38e437695d3cb441957b6d64f2359d677fd67391e75339e061","observation_id":"be43f795-93c8-4783-bf3f-413cbd05f02c","resolution":{"observed_at":"2026-08-07T11:44:17.028592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.558980Z","title":"Toward effective protection against diffusion-based mimicry through score distillation","venue":null,"work_id":"073b7701-a06e-4e7d-9125-416916567652","year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.042481Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:7117d8dba1babe325f28142c356f65676814248c73b1e0991df2db89499351b9","observation_id":"82c62d8a-0a4b-40f7-b751-26db7d2abb62","resolution":{"observed_at":"2026-08-07T11:44:17.562933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.059795Z","title":"Ucf: Uncovering common features for generalizable deep- fake detection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.059795Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:cfbb46d4141a3de2c4525ebf5af90d715d649b6267824f4edd020d33a6bcd65a","observation_id":"8ee30736-b2af-404c-9d49-fb8e71f34f05","resolution":{"observed_at":"2026-08-07T11:44:17.059795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.075846Z","title":"Adversar- ial purification with score-based generative models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.075846Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:12c83aba1f93d697d0cfe1c55d5737dc1349dd3e73bf4a9bd0b7ecaca25fbd3a","observation_id":"59b276bb-6347-43e4-b175-2ae797c9f777","resolution":{"observed_at":"2026-08-07T11:44:17.075846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.536035Z","title":"Sadtalker: Learning realistic 3d motion coefficients for stylized audio- driven single image talking face animation","venue":null,"work_id":"2da3611c-4b48-4293-b936-33b170f8ebea","year":2023},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.091451Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:d8dcace87b6c16313c3adfbbadfb04f9dbbc7618081e6e151372c471d1cdbb0f","observation_id":"756afe75-60e3-4b00-a98c-9b2d5a66f7dd","resolution":{"observed_at":"2026-08-07T11:44:17.539411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.523816Z","title":"To- wards large yet imperceptible adversarial image perturba- tions with perceptual color distance","venue":null,"work_id":"0cc9a2d0-bea6-4201-a14a-ce5a4efa6b30","year":2020},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.115243Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:815e9f7bb4756bc2693891cd47b21ab62d8396a1f76eb252d030a2102679afa4","observation_id":"7ee583b4-6247-4430-b6f0-09e82a9087f2","resolution":{"observed_at":"2026-08-07T11:44:17.529436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.512711Z","title":null,"venue":null,"work_id":"f90b0c3a-6093-45f8-8d3b-fb22fc4e00c3","year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.136115Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:17d1fd3fc962b24911a2de9674c6b26f4194ae5bd64441060537bcb2de4cfcce","observation_id":"92a34921-f9a8-4a52-9c9f-c69149b0e033","resolution":{"observed_at":"2026-08-07T11:44:17.516457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.499676Z","title":"Talking face generation by adversarially disentan- gled audio-visual representation","venue":null,"work_id":"8080e48c-6426-4714-8b55-73783340ed49","year":2019},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.157059Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:fa673030d5e0d6f8899e60f0ae8801edcfbe9d12671488a3ebc759eefbc6de1b","observation_id":"873fd666-a798-4191-bc72-f0e9bcc2d460","resolution":{"observed_at":"2026-08-07T11:44:17.504373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.192505Z","title":"Pose-controllable talking face generation by implicitly modularized audio-visual rep- resentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.192505Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:0db58f4f9c0aa789ca279294cf73eb552de68ddb442a481a4114b3d6bae36f81","observation_id":"df532a95-c954-44e7-88da-6643a132f24c","resolution":{"observed_at":"2026-08-07T11:44:17.192505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.480966Z","title":"DiffAudio","venue":null,"work_id":"c6c423ee-e947-480f-a267-2508f4cddece","year":2020},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.234857Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:35d3595cdeb6f3a860e2852d6b9ce182856b2e8c2a282be569de69d224265af7","observation_id":"c0598462-9d37-4a45-b101-46000efbbea4","resolution":{"observed_at":"2026-08-07T11:44:17.485690Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:16.903319Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation","version":1},"reference_index":416,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:16.903319Z"},"links":{"citing_paper":"/paper/2506.01591"},"observation_digest":"sha256:cc798464de656c4ba661c599c5a15d5b023a1768e0cc1218c322fd646b903d30","observation_id":"572ab673-e3d8-4ce2-bc7a-7f73a6245cb5","resolution":{"observed_at":"2026-08-07T11:44:16.903319Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.01591","last_updated":"2025-06-02T12:26:46Z","latest_version":1,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-08T09:22:03.343433Z","submitted_at":"2025-06-02T12:26:46Z","title":"Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":31,"verified_exact":1,"verified_fuzzy":34},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:2506.01591."}