{"as_of":"2026-08-15T09:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e6f69fc39b4caf48490dd0f867909d9310b2f447e5ec71b990608701743356d9","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:47:51.995684Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.02278/citation-record","integrity":"/paper/2509.02278/integrity","json":"/paper/2509.02278/citation-record.json","paper":"/paper/2509.02278"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.277180Z","title":null,"venue":null,"work_id":"65f621f1-7c80-4dbf-9ca6-af7d272267ce","year":2019},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:46.667441Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:36cf3fd34269303b108aac80d745ab3f22d4334b9aaddb84e88f151be9aae704","observation_id":"5d794cb8-455f-4660-a93b-be07727ca0e0","resolution":{"observed_at":"2026-08-05T11:47:53.281630Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04369","last_updated":"2024-07-14T17:16:43Z","snapshot_observed_at":"2026-08-14T19:50:10.305656Z","submitted_at":"2023-12-07T15:40:36Z","title":"SingingHead: A Large-scale 4D Dataset for Singing Head Animation","version":3},"cited_work":{"arxiv_id":"2312.04369","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.04369","snapshot_observed_at":"2026-08-05T11:47:52.279807Z","title":"SingingHead: A Large-scale 4D Dataset for Singing Head Animation","venue":"cs.CV","work_id":"7f037751-0c41-48ab-b4b3-db00cc19c4ed","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:46.741404Z"},"links":{"cited_paper":"/paper/2312.04369","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:b1c2162705dec540a6bc8ac203504cfe464c4278d3f72c592ccdab7a573da369","observation_id":"b24a38fa-0396-4ad6-98c0-f71dd78a304a","resolution":{"observed_at":"2026-08-05T11:47:52.284791Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.262741Z","title":"Musicface: Music-driven expressive singing face synthesis,","venue":null,"work_id":"dbc69355-fc69-4280-bb23-7b6ab2c146e8","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:46.843881Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:8bd4a4bfae425dc0246ab296a3dc2fbd2955e35528f80b903552363d4d8bc1aa","observation_id":"748eadf3-e237-4202-878c-11c90441f8da","resolution":{"observed_at":"2026-08-05T11:47:53.267369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.248674Z","title":"Let’s chorus: Partner-aware hybrid song-driven 3d head animation,","venue":null,"work_id":"6e0514f8-a407-4396-a6ed-ad1677af5078","year":2025},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:46.917425Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:f3ad6177ff84fdcec831c098527bf42aa66b27f8959d5db602e356d649bc8b76","observation_id":"6e8be1b5-c660-402c-96f1-31744de153a8","resolution":{"observed_at":"2026-08-05T11:47:53.252967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.233314Z","title":"Emotional commu- nication in speech and music: The role of melodic and rhythmic contrasts,","venue":null,"work_id":"20cbd109-4afd-4c3f-ad76-ca1b28737436","year":2013},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.020857Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:8c66d743b4b0d67c35472ba9595db3dc39aebfc80c4caa8470fac5e5dc02f3ec","observation_id":"36c8f110-d2b4-4d17-8784-4f0dad6d4677","resolution":{"observed_at":"2026-08-05T11:47:53.237902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.219586Z","title":"Acoustic differences in the speaking and singing voice,","venue":null,"work_id":"a1d37b9e-5d35-4d57-a1c1-863aede843cd","year":2013},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.133745Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:090aa7e12ee3089e0dc06c546788141ba8c1a188f150e25a309a51c6ebc87a25","observation_id":"7718b787-9b42-4ac8-af27-5f3c19ae95b4","resolution":{"observed_at":"2026-08-05T11:47:53.223765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.205696Z","title":"Emotion in the singing voice—a deeperlook at acoustic features in the light ofautomatic classiﬁcation,","venue":null,"work_id":"5315ce81-da14-4b06-974c-0a4cf3284edf","year":2015},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.246697Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:e81f4ac308d3f6ee5ab1f6d12aef1cffcffc1ee4fdf2e3bbd5fb0d6f03e036b1","observation_id":"cbf3b9f9-e874-4f3f-86d2-617f4fcd3a52","resolution":{"observed_at":"2026-08-05T11:47:53.209898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.192160Z","title":"Common cues to emotion in the dynamic facial expressions of speech and song,","venue":null,"work_id":"4187e60c-6a37-41d2-8789-1b770453cf66","year":2015},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.322855Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:9552e083fae2615b295bebc163c56ecd99b58195276403817cca191c0473d065","observation_id":"3870d79d-6139-497b-b6c3-aa9752185cb3","resolution":{"observed_at":"2026-08-05T11:47:53.196170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.178458Z","title":"Occlusion-insensitive talking head video generation via facelet compensation,","venue":null,"work_id":"fe4f07a7-447c-4ddb-9a9c-c82ab84ce2cc","year":2025},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.439783Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:fa9034e59dd16d5a6fd0581efa1db7699527a6f8c92fef72a8026f9f554b9c08","observation_id":"2ff66d46-b7ff-4a63-a05b-28559bb0f61d","resolution":{"observed_at":"2026-08-05T11:47:53.182822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03430","last_updated":"2024-12-04T16:19:47Z","snapshot_observed_at":"2026-08-11T22:21:55.099774Z","submitted_at":"2024-12-04T16:19:47Z","title":"SINGER: Vivid Audio-driven Singing Video Generation with Multi-scale Spectral Diffusion Model","version":1},"cited_work":{"arxiv_id":"2412.03430","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03430","snapshot_observed_at":"2026-08-05T11:47:52.259298Z","title":"SINGER: Vivid Audio-driven Singing Video Generation with Multi-scale Spectral Diffusion Model","venue":"cs.CV","work_id":"9f882c6c-051d-4805-9df0-c4f1fdf7b78a","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.534590Z"},"links":{"cited_paper":"/paper/2412.03430","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:649d0359d90a33923ad21a44af81edc9e781bcdb07de9b891822bd978641bbb6","observation_id":"b1dae37c-e687-4d06-9f3e-5c93c144d6d0","resolution":{"observed_at":"2026-08-05T11:47:52.264043Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.164437Z","title":"X-portrait: Expressive portrait animation with hierarchical motion attention,","venue":null,"work_id":"45e38169-48eb-4f2e-88f6-a8f22d94afc8","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.664202Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:a9df8d8dab17cc931b272781304969e437533342ba52ddeefece6e89cec7782a","observation_id":"b058fcd2-d6f3-4a9e-8213-a7e9047744f2","resolution":{"observed_at":"2026-08-05T11:47:53.168944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.150281Z","title":"Faceformer: Speech-driven 3d facial animation with transformers,","venue":null,"work_id":"a4623431-ae0c-4cc1-b3a3-a86f1a136d76","year":2022},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.772329Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:0f895e90565173a30713b7183969b9d789c3a48ffd3b82fa81ec237897e41833","observation_id":"33cdf02a-b89b-4715-ab6f-cbb2d0a93f25","resolution":{"observed_at":"2026-08-05T11:47:53.154598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.135851Z","title":"Codetalker: Speech-driven 3d facial animation with discrete mo- tion prior,","venue":null,"work_id":"3e6ca04f-44ee-4d1c-89b0-f5fec05b418a","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:47.901411Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:0fdc9dd787a686dec0a7a2dc5b27603277dc832ccbaaa780d5cef3ed89e98749","observation_id":"25b0ed20-fa97-48a8-aeaf-47b0afd69145","resolution":{"observed_at":"2026-08-05T11:47:53.140162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.119837Z","title":"Facediffuser: Speech-driven 3d facial animation synthesis using diffusion,","venue":null,"work_id":"257d5d40-cc92-4d87-9bca-aba26aa35b6c","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.055282Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:386edd2e794b0aa33332f98ee97ae5f879b68c8f68694119ec8fae980f60b208","observation_id":"2655c60c-3d4f-4dc8-843d-a047bdf3271f","resolution":{"observed_at":"2026-08-05T11:47:53.124596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.104160Z","title":"Selftalk: A self-supervised commutative training diagram to comprehend 3d talking faces,","venue":null,"work_id":"620a0601-0cfc-40dc-987a-81656710a52e","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.218860Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:65c62bcf0f4dfcd40e881db72a862e3f1653420dc7143174bb3d001a534f07f0","observation_id":"8bebf398-0ced-4f58-8987-368eb6374b83","resolution":{"observed_at":"2026-08-05T11:47:53.108790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.088088Z","title":"Singing emotionally: a study of pre-production, production, and post- production facial expressions,","venue":null,"work_id":"2fbaf0b7-a75f-498a-855f-a168587c1658","year":2014},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.306972Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:ec1af821ce0baae7fa4c8a5be508000c16ee3a094742971496c52b8c6d8e58de","observation_id":"667a8fff-a2f2-4097-9867-15b3948077b2","resolution":{"observed_at":"2026-08-05T11:47:53.093217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.071946Z","title":"Jali: an animator-centric viseme model for expressive lip synchroniza- tion,","venue":null,"work_id":"8d7c4473-bf1a-4fb2-b5ac-b6f5330c129a","year":2016},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.436612Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:d358d2b89ddf04984c532507bb18e5a67b4db1705c8d61a6ec256e4ab645dce5","observation_id":"a36d1eb1-ce64-418c-87c4-3600638ba7d4","resolution":{"observed_at":"2026-08-05T11:47:53.077012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.054531Z","title":"A deep learning approach for generalized speech animation,","venue":null,"work_id":"6ec05645-edf1-482f-9bc7-0ae8800970da","year":2017},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.563632Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:16e9b8876ea6ff09ece54b5660829c74e5c8f0964fcfdfa2350a7e399520f59f","observation_id":"904fe5d9-ad5c-4864-835c-80b6780c4df8","resolution":{"observed_at":"2026-08-05T11:47:53.059327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.037425Z","title":"Dy- namic units of visual speech,","venue":null,"work_id":"9f4ab288-b597-42f6-854b-5e4022c52ab7","year":2012},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.607044Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:6a47d6868c7e2a1d8379b5b429e39f9473895dcbbf35aa164a8b07d5ab1aa2cd","observation_id":"6f4cdee0-a006-4a24-80e1-d57c3d3a3cf2","resolution":{"observed_at":"2026-08-05T11:47:53.043169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.019560Z","title":"A practical and conﬁgurable lip sync method for games,","venue":null,"work_id":"bbe58c9b-4e40-4593-a7b4-51d9711ddcb2","year":2013},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.664557Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:f87c480cdb09887705360bf330918872a1a1a112f5ff529e03257ade9314f3ee","observation_id":"c8395fc5-958d-416c-95a3-f0410bf8aadc","resolution":{"observed_at":"2026-08-05T11:47:53.027215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:53.003980Z","title":"Visemenet: Audio-driven animator-centric speech animation,","venue":null,"work_id":"fd86974a-4a70-4e5c-bc7b-6c6251671d97","year":2018},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.819132Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:1ccd30f932b84d7fd9371f693e1b62f110de8858125a5b5064dc8f9d70911a70","observation_id":"bfffccb0-f76c-4d25-b976-b2755e49c69c","resolution":{"observed_at":"2026-08-05T11:47:53.008433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.988331Z","title":"Capture, learning, and synthesis of 3d speaking styles,","venue":null,"work_id":"901affd6-8f94-4e96-8953-9715ac36bb02","year":2019},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:48.979461Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:a9cbd9968b2b3970b0738bfe209731021b08bedb5eb036b69431b8883b7e1db2","observation_id":"20bd65d0-84b1-4ce9-9909-40be054dd872","resolution":{"observed_at":"2026-08-05T11:47:52.993306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.972720Z","title":"Speech- driven 3d face animation with composite and regional facial movements,","venue":null,"work_id":"4c46a76e-1b1d-4b9c-aca1-0c40ecfb65ec","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.105294Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:518bdc21ccb7a342703dc7f35efc03f5b74c6e0758348ac558f62ffb914ee7ec","observation_id":"7b024a8d-1c76-4d8b-9356-5939be7ef2df","resolution":{"observed_at":"2026-08-05T11:47:52.977409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.957171Z","title":"Meshtalk: 3d face animation from speech using cross-modality disentanglement,","venue":null,"work_id":"d8123c3d-56ce-43a4-9ef8-8bb4e83cf09a","year":2021},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.180885Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:54f07c3218545f240dcb49999803d545008dd53bfc63babb09e8d9313e303223","observation_id":"eadf0f95-a5c4-418d-9678-30802fe9d33d","resolution":{"observed_at":"2026-08-05T11:47:52.961888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.941015Z","title":"Audio- driven facial animation by joint end-to-end learning of pose and emotion,","venue":null,"work_id":"0f445068-484f-4938-9583-9f7e7e9bfc66","year":2017},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.286985Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:746b3b94e7d0b75c1b98aace5b201b4f22b54b8e99c716c2732f2eef4d1a7d89","observation_id":"0d7c9330-5dea-42a2-aaa3-0003563e9cfa","resolution":{"observed_at":"2026-08-05T11:47:52.945498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.925895Z","title":"Emotional speech-driven animation with content- emotion disentanglement,","venue":null,"work_id":"9a4c7bd8-45ba-49c3-ae9a-64d3c61c0964","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.368881Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:85857abed054f3aaa92a3d8e697384f1c87fd97972f64dac7ab551bf8660026e","observation_id":"8f3b0589-ef95-4b13-8cb3-4398eff035c9","resolution":{"observed_at":"2026-08-05T11:47:52.930565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.908792Z","title":"Emotalk: Speech-driven emotional disentanglement for 3d face animation,","venue":null,"work_id":"e21f776d-bc3a-43d7-950a-be1ac0cd2b79","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.464912Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:c6c3e525ba2388512df67f5be5aadc2ab64e1440b95e7e1a5794c517a90fa7b3","observation_id":"c071ba47-f404-4585-947d-4a5e86ca25fd","resolution":{"observed_at":"2026-08-05T11:47:52.914387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.893492Z","title":"Mead: A large-scale audio-visual dataset for emotional talking-face generation,","venue":null,"work_id":"05a6577d-bdc7-478a-8d1e-c1ae94c721f5","year":2020},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.543243Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:34c5b7f4d9283b82a0ca372bfbd7ae1d7c52d5a458d644a0478e633c91dfee57","observation_id":"80883496-1681-4654-b7bc-750ef0b3bb57","resolution":{"observed_at":"2026-08-05T11:47:52.898184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.874481Z","title":"Ex- pressive 3d facial animation generation based on local-to-global latent diffusion,","venue":null,"work_id":"2271b22a-6c05-4b6b-a58f-ea83e13e0bc9","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.605424Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:9ebc4a296059c810aeae72d905381a6c2c35400ca1dc801d4ec87da15eaa815a","observation_id":"4552e344-ab86-45a4-a77a-cfcfb47e2e98","resolution":{"observed_at":"2026-08-05T11:47:52.879683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.856132Z","title":"Emoface: Audio-driven emotional 3d face animation,","venue":null,"work_id":"43755fd7-02cc-4074-b1a4-cd2b6ae75e08","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.682193Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:fd3dff06972d44c29537c854f7c7c4998ae00728b5ff146855badaa91b11dd26","observation_id":"e7cf192f-cf9c-4b80-9879-976301e87aa8","resolution":{"observed_at":"2026-08-05T11:47:52.860493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.841100Z","title":"Emovoca: Speech-driven emotional 3d talking heads,","venue":null,"work_id":"828bf8f4-8fe6-47cd-825e-e66933b486cd","year":2025},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.750128Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:0027a2ba8071d12c7b3164b7218c41fcc92c963d2a27aacfd0a4b88137ade7d5","observation_id":"d5f995dc-7f55-444d-b9b9-63fc3b563c83","resolution":{"observed_at":"2026-08-05T11:47:52.845880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.826319Z","title":"Learning diverse stochastic human-action generators by learning smooth latent transitions,","venue":null,"work_id":"0c9f8345-5e85-4ba6-ab58-b9bf6e905185","year":2020},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.849998Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:67045a6db95dc59d3bdc4fe3f1b2efa7d3d7c5c985bf1939c00ba0f74bfa64db","observation_id":"c42e93c3-167d-4d21-bb56-81ecb96f788e","resolution":{"observed_at":"2026-08-05T11:47:52.830766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.811759Z","title":"Action2motion: Conditioned generation of 3d human motions,","venue":null,"work_id":"7f2c6100-ebc5-4339-8bc2-4bbd9fb47c32","year":2020},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.898285Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:f9cb09df8e0c23e790861b733b89b6c594d2abe817a1800b63fab181f16a78a2","observation_id":"601a8519-f715-4303-b9b7-f534d7819dd5","resolution":{"observed_at":"2026-08-05T11:47:52.816099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.795867Z","title":"On human motion prediction using recurrent neural networks,","venue":null,"work_id":"55c420d4-9c23-4466-880b-3f10e9c8b5df","year":2017},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:49.967393Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:77414ace125f57071408ee9dc13519207cd65486828ee3a19a214ae427894854","observation_id":"ea27e6da-be67-4e88-b942-5764ef5bd1a8","resolution":{"observed_at":"2026-08-05T11:47:52.800459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.780404Z","title":"Action-conditioned 3d human motion synthesis with transformer vae,","venue":null,"work_id":"139b05b4-27ea-4aee-ada2-8e3c98d990d5","year":2021},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.047457Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:99f0451bb09d8b6e627ecd4ce16c0ae8bac9af5e450f017d0f344ffa3fe5e7e4","observation_id":"b466777a-1d5d-4297-aeef-0b5fb21cb5d4","resolution":{"observed_at":"2026-08-05T11:47:52.785050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.765207Z","title":"Temos: Generating diverse human motions from textual descriptions,","venue":null,"work_id":"dae95e16-2854-4ec9-972d-286fb861356b","year":2022},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.121210Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:fcbd7e85d1c13b2d0a9d860a9a9f5f962d5b8e11440235393c525341a8aacd3f","observation_id":"04f69daf-f380-44ef-836a-5b9cd0ff5c63","resolution":{"observed_at":"2026-08-05T11:47:52.770042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.749642Z","title":"Tm2d: Bimodality driven 3d dance generation via music-text integration,","venue":null,"work_id":"704e8b1a-4080-4644-a760-2e979610ecd6","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.203943Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:c3d6c8079e9fcc572a44f4975402f41c6c95ab8429979386ac17a8995887f284","observation_id":"c253c313-c7ce-441f-817c-7f9d24d4c23c","resolution":{"observed_at":"2026-08-05T11:47:52.754447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14916","last_updated":"2022-10-03T09:17:41Z","snapshot_observed_at":"2026-08-12T18:48:37.916493Z","submitted_at":"2022-09-29T16:27:53Z","title":"Human Motion Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14916","snapshot_observed_at":"2026-08-05T11:47:50.283740Z","title":"Human motion diffusion model,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.283740Z"},"links":{"cited_paper":"/paper/2209.14916","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:b17500e239ce695d932b0bc1ee987e606c115fcdce5876403a0dd174ed8a0f87","observation_id":"ab5f7798-4079-452c-820f-6aaa32a622ec","resolution":{"observed_at":"2026-08-05T11:47:50.283740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01418","last_updated":"2023-08-30T04:41:10Z","snapshot_observed_at":"2026-08-13T12:33:20.061197Z","submitted_at":"2023-03-02T17:09:27Z","title":"Human Motion Diffusion as a Generative Prior","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01418","snapshot_observed_at":"2026-08-05T11:47:50.317810Z","title":"Human motion diffusion as a generative prior,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.317810Z"},"links":{"cited_paper":"/paper/2303.01418","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:d345215da0dab8df9226c7e2dfb327fa045d422bf8ca8a91754a17116921cda9","observation_id":"eca335c4-c273-47d9-8cb4-4368a377ae4e","resolution":{"observed_at":"2026-08-05T11:47:50.317810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19686","last_updated":"2024-09-29T12:26:24Z","snapshot_observed_at":"2026-08-14T13:36:18.508388Z","submitted_at":"2024-09-29T12:26:24Z","title":"Text-driven Human Motion Generation with Motion Masked Diffusion Model","version":1},"cited_work":{"arxiv_id":"2409.19686","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.19686","snapshot_observed_at":"2026-08-05T11:47:52.203035Z","title":"Text-driven Human Motion Generation with Motion Masked Diffusion Model","venue":"cs.CV","work_id":"3de50b19-18bf-4e61-a3e7-1f0b771beb2a","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.421909Z"},"links":{"cited_paper":"/paper/2409.19686","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:5a7842ec5f60f9a8e031d46f95298a65b79189cb49e6e5c2c89a8fe59035e0ad","observation_id":"0b6197a0-99bb-4b67-a116-67de29bc3a1d","resolution":{"observed_at":"2026-08-05T11:47:52.209542Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.733467Z","title":"Motiondiffuse: Text-driven human motion generation with dif- fusion model,","venue":null,"work_id":"82a2ab73-9450-48da-a936-77f6dd213c2e","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.463655Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:ca6d2b72fb4a90ad518d7a605f41475f0c496e54fe165dd338ee6326d144f2a9","observation_id":"c46d0d54-fa8a-4ecd-a52a-cf25e46b370a","resolution":{"observed_at":"2026-08-05T11:47:52.738417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.00334","last_updated":"2024-08-11T10:01:03Z","snapshot_observed_at":"2026-08-13T12:11:47.438536Z","submitted_at":"2023-04-01T15:10:02Z","title":"TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.00334","snapshot_observed_at":"2026-08-05T11:47:50.527329Z","title":"Talkclip: Talking head generation with text-guided expressive speaking styles,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.527329Z"},"links":{"cited_paper":"/paper/2304.00334","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:67fbbf16e85ca67838f25fdaaf77bf3288c12d202d3ed598fe73fbb3c6f6955f","observation_id":"aafaaea3-8f20-4361-a88c-38dd72fe881e","resolution":{"observed_at":"2026-08-05T11:47:50.527329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.719182Z","title":"Avi-talking: Learning audio-visual instructions for expressive 3d talking face generation,","venue":null,"work_id":"8af0b04d-0815-46e3-81e1-df81781ee0d2","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.596143Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:a78d177b98ebccb213f874580bd11c41fcf5708e2d6897e5c7e3bf00d64b2d2c","observation_id":"c35e6c2c-41b7-4d18-b664-029ff60bca82","resolution":{"observed_at":"2026-08-05T11:47:52.723746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.704627Z","title":"Mmhead: Towards ﬁne-grained multi-modal 3d facial animation,","venue":null,"work_id":"a6debbc6-66ba-4cc2-be35-dab41c385b93","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.636304Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:408426c991c42ea9f02898d885f065c92832593e68e4a72c3e94d8c46ed975c1","observation_id":"346d843d-e105-4bd9-9567-f92e39f5cb2d","resolution":{"observed_at":"2026-08-05T11:47:52.709087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.690062Z","title":"The ryerson audio-visual database of emotional speech and song (ravdess): A dynamic, multimodal set of facial and vocal expressions in north american english,","venue":null,"work_id":"df0450be-9456-4851-9874-54adfa5edc5f","year":2018},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.702896Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:fa1311707a32093e363753c0f74d30d5a536b74bf9e08a01dd01a3299f4c1c93","observation_id":"474e3c73-ccca-4d0f-8ad3-ccd37dfbdfcc","resolution":{"observed_at":"2026-08-05T11:47:52.694724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.674196Z","title":"Song2face: Synthesizing singing facial animation from audio,","venue":null,"work_id":"74ba0f4f-4daa-4c75-9fdb-06f5023ea761","year":2020},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.770588Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:f6bbca858e63602719e435da96abf22e815f0f1ea9dcea36a6d7cf6b48504cd6","observation_id":"82736750-9980-4a13-bbb9-29591b4a39ca","resolution":{"observed_at":"2026-08-05T11:47:52.678717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:50.824866Z","title":"Learning a model of facial shape and expression from 4D scans,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.824866Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:582b11635dade2aa276e0b7ff9d41fa5c669f34e242cb81a400cd8a32758379a","observation_id":"ad71fe22-4b98-4145-8c67-4ab3d78a7cfc","resolution":{"observed_at":"2026-08-05T11:47:50.824866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.655420Z","title":"Emoca: Emotion driven monocular face capture and animation,","venue":null,"work_id":"367d91b2-6247-418c-856d-baff0783c59a","year":2022},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.901780Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:f1712de04fcec0bfeb38a4ba6e833d0ce3d4a4e7e6c86e1687dc22d8ded9647e","observation_id":"1d105886-e5e5-4cee-b22c-89d25eb570e2","resolution":{"observed_at":"2026-08-05T11:47:52.662545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.639885Z","title":"Learning an animatable detailed 3d face model from in-the-wild images,","venue":null,"work_id":"b14b8c24-d970-4586-a477-2e7f5d5e944a","year":2021},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:50.973331Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:11cb13a2a966dfec06f273bd2ee9490eb146800aacd70e8d2e47a2470939a352","observation_id":"c32a6011-465d-43db-9599-9663845c177e","resolution":{"observed_at":"2026-08-05T11:47:52.644486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.11094","last_updated":"2022-07-22T14:07:46Z","snapshot_observed_at":"2026-08-13T14:58:49.972947Z","submitted_at":"2022-07-22T14:07:46Z","title":"Visual Speech-Aware Perceptual 3D Facial Expression Reconstruction from Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.11094","snapshot_observed_at":"2026-08-05T11:47:51.041119Z","title":"Visual speech-aware perceptual 3d facial expression reconstruction from videos,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.041119Z"},"links":{"cited_paper":"/paper/2207.11094","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:4be489f3a6be359700cdefea8e1f9bdf856cfe2dc3f19a478b2e1b1726b0677c","observation_id":"3bb0b6b6-f777-46df-92da-1279ade4ce8e","resolution":{"observed_at":"2026-08-05T11:47:51.041119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.625453Z","title":"Facial action coding system,","venue":null,"work_id":"36fa3ebe-f1b4-4b36-b7f7-81cb43b9c665","year":1978},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.111669Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:4a1e6cf8dce303ed562d5cb478c035c196e84b1befe29c236bc15d5d42da5500","observation_id":"ac4b4073-2383-4d07-80cd-95d1b8790995","resolution":{"observed_at":"2026-08-05T11:47:52.630230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.608228Z","title":"Emotion recognition from singing voices using contemporary commercial music and classical styles,","venue":null,"work_id":"216247ec-0930-4723-9f2c-b44264debcd6","year":2019},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.197489Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:a7b66308606895aaa138cb7c7a98bcd57a71bb450409d984c2ca62714290ea3f","observation_id":"cbdb04b1-bf93-405e-baef-8c0c491226b2","resolution":{"observed_at":"2026-08-05T11:47:52.613884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.592436Z","title":"The expression of emotion in the singing voice: Acoustic patterns in vocal performance,","venue":null,"work_id":"376566cb-fbc6-4432-b309-a0df25034fb1","year":2017},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.309393Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:ad13c6088e77ffc472c26bb80a302af443dce2972be7b48d5aa71afa8a372d93","observation_id":"a1c3a6a0-1faa-4924-8e9e-dcf1ce7981d9","resolution":{"observed_at":"2026-08-05T11:47:52.597121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21315","last_updated":"2024-12-23T12:35:12Z","snapshot_observed_at":"2026-08-14T02:34:19.797625Z","submitted_at":"2024-07-31T03:53:14Z","title":"Beyond Silent Letters: Amplifying LLMs in Emotion Recognition with Vocal Nuances","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21315","snapshot_observed_at":"2026-08-05T11:47:51.385958Z","title":"Beyond silent letters: Amplifying llms in emotion recognition with vocal nuances,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.385958Z"},"links":{"cited_paper":"/paper/2407.21315","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:0a0ce44510726c6585f0b146bf9086a8c9fa96a70f9ad04203fca5a60a191b37","observation_id":"d2326d59-5d95-4bd5-8451-8b09c24fc493","resolution":{"observed_at":"2026-08-05T11:47:51.385958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.577326Z","title":"Retrieval- augmented generation for knowledge-intensive nlp tasks,","venue":null,"work_id":"398e83cf-2846-44cf-99b5-c99bf3e9ba6c","year":2020},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.463470Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:80764ac7aeb44f9a0c28d041e258eefe3c638f8776df9abc3aedb334c609b853","observation_id":"31c2dfe0-65ed-4a14-bef8-9903b894003a","resolution":{"observed_at":"2026-08-05T11:47:52.582097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.562189Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":"1758151e-5fe3-4187-a0a9-f86d1ea6710e","year":2022},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.573094Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:80d876e90cf4a085bd9830561d93b617d2271e5779f87767ab16e0700af0db3e","observation_id":"e98b8603-e568-4991-9391-9bd73eda833c","resolution":{"observed_at":"2026-08-05T11:47:52.566788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.547748Z","title":"Observer-based measure- ment of facial expression with the facial action coding system,","venue":null,"work_id":"1221eeb2-c2bf-415d-802d-13c04a154238","year":2007},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.619714Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:6ae7e5a2d5f640f3de690acac25c3f17f9bd57544948c116989b1810014d8645","observation_id":"363ec67b-5fb8-46c9-b984-2756e96d6762","resolution":{"observed_at":"2026-08-05T11:47:52.552240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.533191Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":"fc5e8eef-8f4d-4af5-a661-72bd8ab0fe8e","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.760314Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:459d3458033b6fb5ebf9e2b6dfc7bb3c8dc62d21aeb4d75d5d01b3a7d4f53abf","observation_id":"3e928711-3677-43aa-b608-6fc2449919ea","resolution":{"observed_at":"2026-08-05T11:47:52.538182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.518510Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":"236d25c7-15ab-4a74-97ce-101954f50d5e","year":2020},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.810043Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:680b8dc692034bdcf4b14207f2705d93da24a8888fd8fdb5df7f4f2bcc6322ad","observation_id":"d23142c2-096f-4196-86f2-4858e0d15ffa","resolution":{"observed_at":"2026-08-05T11:47:52.523349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.504085Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"207709b7-84eb-4f4d-8755-ca7def8d4d97","year":2021},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.895283Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:a50cff75b97fc56bdb0c52e1f718f4ef4f12f67ed34cecd28784bdef33c01137","observation_id":"b36928d7-50b1-42d8-bbf3-a700df727e22","resolution":{"observed_at":"2026-08-05T11:47:52.508463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.488539Z","title":"Scalable diffusion models with trans- formers,","venue":null,"work_id":"348ec36d-3867-485b-9230-e43d83b3a3b5","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.927815Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:e31be042b351f1394a4eb23921dde0e4ef8cd1cef2f19aaffc074c4b99b952f9","observation_id":"8d3d9e37-fcd3-459d-8c2f-f2a90f64b983","resolution":{"observed_at":"2026-08-05T11:47:52.493394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.474316Z","title":"Imitator: Personalized speech-driven 3d facial ani- mation,","venue":null,"work_id":"be08ebfc-3d46-48e1-a381-4e98985259b4","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.933031Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:3de7dbb3b9187d107385a13d04d5b8e50d9bdb8a83a9d2fe8826b9b40ae84fef","observation_id":"e3ea0edf-d88b-49c4-91e7-43bda0b33325","resolution":{"observed_at":"2026-08-05T11:47:52.478808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.459292Z","title":"Deeptalk: Dynamic emotion embedding for probabilistic speech- driven 3d face animation,","venue":null,"work_id":"679fecef-8592-4cb1-8861-8786846707fe","year":2025},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.937248Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:4e1c47166a6c3a12a692cc0fa94a79a95577caa9638a48809d5559c1cb54a92e","observation_id":"23658957-8630-4a5f-b552-1d9f6cf8b9af","resolution":{"observed_at":"2026-08-05T11:47:52.464085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-05T11:47:51.941596Z","title":"Gemini 2.5: Pushing the frontier with advanced reasoning, multimodal- ity , long context, and next generation agentic capabilities,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.941596Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:671fe24687e13c341e7a70eb050224b4362ce435c496af01cc26f1c086a9dea7","observation_id":"b535b4bf-0397-4e06-9378-8e7e898ee932","resolution":{"observed_at":"2026-08-05T11:47:51.941596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.444146Z","title":"Adan: Adaptive nesterov momentum algorithm for faster optimizing deep models,","venue":null,"work_id":"d96cfec5-2153-428b-b5fd-b76b271b8d3d","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.946111Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:405f3308041062e9d74ec554e5433e9553fa7e26aebe6d2e4569c396e7f2ec90","observation_id":"594a4d58-c742-4a8b-b239-2df0df806bba","resolution":{"observed_at":"2026-08-05T11:47:52.448970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.429932Z","title":"Beat-it: Beat-synchronized multi-condition 3d dance generation,","venue":null,"work_id":"7dff2512-e8df-45e4-ae4b-df40da55b811","year":2024},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.950326Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:fc676f720396ebd2517134adcaa329d138af509b10fbdf864d63dd7b6fe27f6f","observation_id":"7193862b-8bb6-4f01-aa85-35724bd897ee","resolution":{"observed_at":"2026-08-05T11:47:52.434330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.414628Z","title":"Bailando: 3d dance generation by actor-critic gpt with choreographic memory ,","venue":null,"work_id":"1491f80f-efae-4770-b3df-9322fea95ac7","year":2022},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.954781Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:83bd22c71d94e373370af579ef010f00a64c4418146ea97c064efc8c3991a22a","observation_id":"324e14b9-3d4e-4201-84ae-1695d7f9f033","resolution":{"observed_at":"2026-08-05T11:47:52.419743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.399875Z","title":"Edge: Editable dance gener- ation from music,","venue":null,"work_id":"9afc1b5f-ad95-4f8f-8b1b-18d5a8a448e2","year":2023},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.959709Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:6c9472510ececb3c9ba2fc17f24a3b6cd507875c26df869ab48671ebe19ce63d","observation_id":"550a664d-4914-4dea-aeff-bc3b2662363f","resolution":{"observed_at":"2026-08-05T11:47:52.404326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.385094Z","title":null,"venue":null,"work_id":"e2b55aca-a65e-47bc-80f6-ad5558946b3e","year":null},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.965817Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:e96d02dee21e76ace75835817cdfcc3eeefd2517d3d39b7fa98fbbad191546a6","observation_id":"d3e61615-14f9-499b-b6e0-b705fecf3366","resolution":{"observed_at":"2026-08-05T11:47:52.389265Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.369540Z","title":null,"venue":null,"work_id":"d024cfe3-3051-41b1-822b-a06e8e3941d5","year":null},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.971210Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:cad215635bc75466e2fbcb60b0ee7f84fcc0766152a782970f0c79bd50e87cbe","observation_id":"16827f71-affc-4773-8dfb-08607c4be09b","resolution":{"observed_at":"2026-08-05T11:47:52.374764Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.354304Z","title":null,"venue":null,"work_id":"8b2d0ab6-ab23-40e8-af41-c7c7a007954c","year":null},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.975408Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:33f643e58504c392176891c7d396c6ecc684885fc507b23889cf8a671aeeae74","observation_id":"42f21043-7771-49f1-86b2-cbf394332432","resolution":{"observed_at":"2026-08-05T11:47:52.359039Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.338816Z","title":"lower”, “furrow","venue":null,"work_id":"5d6392a7-2f97-4119-9ef1-e7180da8e7a7","year":null},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.979970Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:8500523e92fe4ccce9c9a51c5d87eb8ce0467c95ea1300ea5186678e86516dc3","observation_id":"ce5b041f-b2bd-4ac4-947a-1c616f21357a","resolution":{"observed_at":"2026-08-05T11:47:52.343335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.324065Z","title":null,"venue":null,"work_id":"c8fd2524-6bb1-4f60-9083-01a7b97cb555","year":null},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.985166Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:28bb4613a9137fbd95f083333880af04455ddf5b4a726241d358118c0c798a1e","observation_id":"10924845-49d3-4014-8451-9bbe39315ab3","resolution":{"observed_at":"2026-08-05T11:47:52.328345Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.309801Z","title":null,"venue":null,"work_id":"a23b73de-900b-4e8e-b4c2-6b0ebbbfe7f5","year":null},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.990150Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:0e27b8dcb25c9292941cc1af0e6d30b240b4ac28f33986d4a36662fca8c7106c","observation_id":"b2e062f8-701e-428f-9a0d-a0f6902836e6","resolution":{"observed_at":"2026-08-05T11:47:52.314091Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:47:52.295230Z","title":"score: 4,5,4","venue":null,"work_id":"4025f1de-3cde-4ba2-b317-f2ff61be3ed2","year":null},"citing_paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T11:47:51.995684Z"},"links":{"citing_paper":"/paper/2509.02278"},"observation_digest":"sha256:b2ef229e09a94dc53e15c577b3c35844c1dee016ac1ab4445dcb213b59f8862f","observation_id":"9a92d657-06e7-4b08-95f9-6cac92ac8ba7","resolution":{"observed_at":"2026-08-05T11:47:52.299983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.02278","last_updated":"2025-09-02T12:59:27Z","latest_version":1,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-14T19:49:39.284914Z","submitted_at":"2025-09-02T12:59:27Z","title":"Think2Sing: Orchestrating Structured Motion Subtitles for Singing-Driven 3D Head Animation"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":3,"verified_fuzzy":59},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 0 inbound Pith citation observations for arXiv:2509.02278."}