{"as_of":"2026-08-20T05:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a9f84081e72066a9c3be379fad43cd10e073da246e650294782fd5e22cdcc214","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:24:39.806529Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T22:46:51.954117Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T22:48:38.154699Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"cited_work":{"arxiv_id":"2508.12438","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.12438","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training Status-Model Type-Annotation Type-Representation Format","venue":null,"work_id":"9d35d0b8-67de-44fd-9fd6-78e0b41c445d","year":2025},"citing_paper":{"arxiv_id":"2512.11321","last_updated":"2026-05-12T04:50:53Z","snapshot_observed_at":"2026-08-10T21:23:14.950037Z","submitted_at":"2025-12-12T06:45:02Z","title":"KeyframeFace: Language-Driven Facial Animation via Semantic Keyframes","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-16T22:46:51.954117Z"},"links":{"cited_paper":"/paper/2508.12438","citing_paper":"/paper/2512.11321"},"observation_digest":"sha256:4379a9d19126dc3d9c5ded2790564d1c34ebbb33dd5ff9368e04e0acaa742b64","observation_id":"e78fe670-2602-45e0-9aea-0113f834cfb4","resolution":{"observed_at":"2026-05-16T22:48:38.156882Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.12438/citation-record","integrity":"/paper/2508.12438/integrity","json":"/paper/2508.12438/citation-record.json","paper":"/paper/2508.12438"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.617763Z","title":"https://www.metahuman.com/ en-US?lang=en-US","venue":null,"work_id":"da7621d1-bab2-4f78-860b-2394f640d8a6","year":2025},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.583922Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:b5ef9a40499abdf818549096cd81eac04b573d17b9b9e365b35374b351767d2b","observation_id":"7c4be775-75c7-4c92-9413-bbc7aace2a3d","resolution":{"observed_at":"2026-08-15T17:24:40.623548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T17:24:39.589474Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.589474Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:94cc9ee2972b4c003fd1e9a8578f4a3970e4c65372fd724d9e8ba46ec0d35a17","observation_id":"aa661dc9-8640-4eed-9135-580e7a2cfca4","resolution":{"observed_at":"2026-08-15T17:24:39.589474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.599719Z","title":"Detecting deep-fake videos from phoneme- viseme mismatches","venue":null,"work_id":"e49e59e3-eb82-4fc3-a673-c04c747c687b","year":2020},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.594637Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:46557742085ea5c2bad7429cf99aa6b6bf8da068539b2c2c5241aabddae71217","observation_id":"20825932-18cd-4390-8ac8-13eda5feeb96","resolution":{"observed_at":"2026-08-15T17:24:40.606013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.581688Z","title":"Claude 3","venue":null,"work_id":"e4183cf0-58c0-45a0-980c-77a5f2b38cd1","year":2024},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.599927Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:4276357c109394e67696d03f83039fe60f0db9b5bdf8083ffce84a8bc584a6d4","observation_id":"1d6c3876-0886-4ede-b753-3223ba06207f","resolution":{"observed_at":"2026-08-15T17:24:40.586945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.565535Z","title":"ARKit — apple developer documen- tation","venue":null,"work_id":"6c79595f-ca5c-4fd2-9cfa-aed300959d81","year":2025},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.604734Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:66b6e87975187ef13e625bc1091f5e5f1067b4350c106c11ea742d3e7e29e66e","observation_id":"2be64196-176d-4fda-8b93-e7cc7b5fba57","resolution":{"observed_at":"2026-08-15T17:24:40.570524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.549193Z","title":"Live link face","venue":null,"work_id":"f717506e-131f-4fc8-a0bb-961616bf9a1e","year":2025},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.609601Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:d7ae691e3f5785ff1af1148718fd43ebe77ef537cbc03911ae461886fa29691d","observation_id":"3f61061d-cb80-44f9-90c0-d35ec169e0b2","resolution":{"observed_at":"2026-08-15T17:24:40.554773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.533605Z","title":"A morphable model for the synthesis of 3d faces","venue":null,"work_id":"b3e6172d-8f37-467e-8959-ebba82b6e106","year":1999},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.614458Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:8739f615e56aafec282e134d325c9fcd32cdab914596e938b6e3a95ec08d4194","observation_id":"374a809f-e7f4-472c-bd72-801913f41794","resolution":{"observed_at":"2026-08-15T17:24:40.538599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.619850Z","title":"Align your latents: High-resolution video synthesis with la- tent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.619850Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:0c8355c4d7f30da0fa29abd25efd1dc356ad5361a351618628690580455a3728","observation_id":"5af7178e-41e2-40f2-b517-9bebed230943","resolution":{"observed_at":"2026-08-15T17:24:39.619850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.508835Z","title":null,"venue":null,"work_id":"34789e9d-8a8e-48ca-a1cc-a2d5bc0efbdf","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.624323Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:4c7913108cd1884a5cf7eea19456530b6fbce5aa7753f63d6354c8d39347503f","observation_id":"32018ff8-76c6-45d0-a839-54a197da9292","resolution":{"observed_at":"2026-08-15T17:24:40.513642Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.628970Z","title":"Lan- guage models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.628970Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:396b971115db5509023c2c12a9e72ab5f32bd388007c299da70ed1f80782a324","observation_id":"369448eb-595d-4565-adc7-08b15b6c1640","resolution":{"observed_at":"2026-08-15T17:24:39.628970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.479563Z","title":"4dfab: A large scale 4d database for facial ex- pression analysis and biometric applications","venue":null,"work_id":"74f3e174-6561-4fbf-938e-80052cd3c21c","year":2018},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.633417Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:e17555f195507ae111f99bbf581684f9fcb28a117f54f226dee23b2a4ce83010","observation_id":"52ea2eb7-b419-44ee-91b9-05d35abb1344","resolution":{"observed_at":"2026-08-15T17:24:40.485282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.461950Z","title":"A facs valid 3d dynamic action unit database with applications to 3d dynamic morphable facial modeling","venue":null,"work_id":"9b311875-cf89-4976-b094-2ec95836fbe4","year":2011},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.637973Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:e7183d8954011f29333a105d571687d90e3f3b99670bd413ac5cc8ba13570572","observation_id":"0d129c03-26f8-42d9-a373-acca0ff17a53","resolution":{"observed_at":"2026-08-15T17:24:40.467830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.444070Z","title":"Capture, learning, and synthesis of 3D speaking styles","venue":null,"work_id":"9384e24c-4af2-4348-971b-5fedad2318a9","year":2019},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.642685Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:43211f4bad3fa16fa1e453e3f48e76d89fd00002ba74eeaee365dbab58fce93e","observation_id":"02d36d20-d0ad-42ac-9422-e77fc94cd1f1","resolution":{"observed_at":"2026-08-15T17:24:40.449661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.647365Z","title":"3d morphable face models—past, present, and future","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.647365Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:e9644bcc5661b4f74316a718ae4b1bfc9ea57c99b55cfe1330856b40eda2a1ca","observation_id":"3f70d34e-c072-419e-89d8-50ada5c24bdc","resolution":{"observed_at":"2026-08-15T17:24:39.647365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.652048Z","title":"Facial action coding system","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.652048Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:ab897e7b0a484a300c6a3c22ff4d33959eb0416cfc5ed6baecedad2ab757e88f","observation_id":"e02dee8a-af16-4078-aa2e-67245b602bee","resolution":{"observed_at":"2026-08-15T17:24:39.652048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.406600Z","title":"Faceformer: Speech-driven 3d facial anima- tion with transformers","venue":null,"work_id":"4d8db0cd-6797-4d3a-9c18-3b4eaa802c91","year":2022},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.656547Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:e882b68832a91781bb7bc935f5e2eee1d18648ccce5ef25e567dab5dc6ebc399","observation_id":"3a6e9e1a-ae54-423b-a784-99f5f21c1066","resolution":{"observed_at":"2026-08-15T17:24:40.411715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.385851Z","title":"Text-based editing of talking-head video","venue":null,"work_id":"f64d4d61-4ae6-478b-8714-66b1a80dd837","year":2019},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.660989Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:524b48d50794af7c849fe4cd5ca5f7c63a7c719b29672e554ad5b0ebd99b2427","observation_id":"d5047f57-051e-4470-a494-db03972b66bd","resolution":{"observed_at":"2026-08-15T17:24:40.393140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.665528Z","title":"Bermano, Gal Chechik, and Daniel Cohen-Or","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.665528Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:1a61b4c65ef6dcf5f44241eaeb921262d258034f9823ae125004f249d20656a5","observation_id":"c9f61106-9ee8-4f94-87ad-71eee781bf28","resolution":{"observed_at":"2026-08-15T17:24:39.665528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.353138Z","title":"Gemini 2.5 technical overview","venue":null,"work_id":"b11cc1e5-9960-4290-88cb-cdd5e30a4e73","year":2025},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.669939Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:7fbb47361d5d837fccedfc7859545a531d675335ca6c08c3d2404e03d2f69a66","observation_id":"693c15f4-163c-411b-819c-9156cd7aa264","resolution":{"observed_at":"2026-08-15T17:24:40.360075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.336147Z","title":"Generating diverse and natural 3d human motions from text","venue":null,"work_id":"82cd511a-f37b-4be8-82e7-45186660a730","year":2022},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.674309Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:0d20e5906a2fc8fbfcc56890dfff968cadd712acc246e532ea6c1d3a329da953","observation_id":"ca274bbe-2834-45cf-805b-214549f14e57","resolution":{"observed_at":"2026-08-15T17:24:40.341526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.314160Z","title":"Momask: Generative masked model- ing of 3d human motions","venue":null,"work_id":"8ccdcb2b-b63e-426a-b67e-7215c4296f80","year":1900},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.678659Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:1daf2f650ed04bf8ad9bb3e8a05473b7dd5f2bff669a5c98ee874067145d7b37","observation_id":"caaadfcd-4fdb-4657-81d7-1f515865ee43","resolution":{"observed_at":"2026-08-15T17:24:40.323491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-08-10T05:21:27.485481Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-15T17:24:39.683536Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.683536Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:f6168601860da8d07d996e82d32fd76f355b24e281df7fcead10a3375eabb346","observation_id":"36650dbc-11ae-4797-80e2-cc81076f2d10","resolution":{"observed_at":"2026-08-15T17:24:39.683536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.297290Z","title":"Let’s face it: Influence of facial expressions on social presence in collaborative virtual real- ity","venue":null,"work_id":"aa25bdad-ef62-4d67-8e05-5299eca19ee3","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.688633Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:a9dc9c44d0f08417d2cd21178ee072cef2d973d60fae99837d76c6f80b132f9d","observation_id":"e198a876-8840-46ab-a819-5bf594707c08","resolution":{"observed_at":"2026-08-15T17:24:40.302791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.278598Z","title":"Fakeout: Leveraging out-of-domain self- supervision for multi-modal video deepfake detection","venue":null,"work_id":"cb55add8-ecc6-477c-8138-9e311c62a172","year":2022},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.693111Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:e67a9e98ded597febc937bcb4ad23158460e08399efbbb8be567478fdbb481ab","observation_id":"3622d02a-b49e-4548-98db-65c2a9bb7df1","resolution":{"observed_at":"2026-08-15T17:24:40.284789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.697315Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.697315Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:9883fa38a37a2a147dc326cc6cc562e69c063be4ff07817d0d5fa65fc7d59c7e","observation_id":"4f3087ba-22bf-4398-a0b4-3cce0bc8cb6b","resolution":{"observed_at":"2026-08-15T17:24:39.697315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.701674Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.701674Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:b056b08f5b774d6fa81e3e982fadbb151c214b293f6565ccb2278ce46130ffb3","observation_id":"508f0bb2-b890-4859-9322-ed130f62568d","resolution":{"observed_at":"2026-08-15T17:24:39.701674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.235968Z","title":"Latte: La- tent diffusion transformer for video generation.Transactions on Machine Learning Research, 2025","venue":null,"work_id":"601c2dfd-2546-4bc1-aee3-247a1d539552","year":2025},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.706102Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:e4800ab8e6283583cf5c5faa983b3149b99e2f54f49c71db43aaf304cee308c6","observation_id":"6c6e128e-98dd-475d-a20d-7e3ffe67e123","resolution":{"observed_at":"2026-08-15T17:24:40.241356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.217417Z","title":"The uncanny valley","venue":null,"work_id":"045da3d2-be4b-40af-b6c6-583ae5228f6c","year":1970},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.710371Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:2abd48f63f1eca42f47b03019d149e31b5ad18ae33943f04ae688a55c73cf083","observation_id":"00ab718e-1ea1-4db6-b7e7-f25a1590a902","resolution":{"observed_at":"2026-08-15T17:24:40.222817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.200100Z","title":"Emotalk: Speech-driven emotional disentanglement for 3d face anima- tion","venue":null,"work_id":"08c6d628-2fef-48a7-b709-167b8e94739a","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.714752Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:33fb19fbd76b393afa58989c808483ac5c7bb8fb8dbfa521ddf7aacf050fe236","observation_id":"048d5965-46d0-44b3-b1fa-ac19408d6d66","resolution":{"observed_at":"2026-08-15T17:24:40.205493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.180972Z","title":"Principi, S","venue":null,"work_id":"c43db2e1-26a5-4ab4-ac5b-44436e3e512c","year":null},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.719492Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:1e00fbd978b9a0e3cd04a779ca4e8bd16bf0246897bdf2868a0dee93640d8c18","observation_id":"d4af6ab0-bcc2-494d-9b56-99ef8ace2063","resolution":{"observed_at":"2026-08-15T17:24:40.186090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.163349Z","title":"Monkey see, monkey do: Harnessing self- attention in motion diffusion for zero-shot motion transfer","venue":null,"work_id":"cdc93921-65d9-4c92-aac3-5c694114b454","year":2024},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.723959Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:6ae79df941e711c4594bca939ea4234a252f3c39a6f82c119bee7cf63e34e617","observation_id":"ed2d99c2-714c-4301-a906-16c0ac07daf0","resolution":{"observed_at":"2026-08-15T17:24:40.169541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.147049Z","title":null,"venue":null,"work_id":"a8674fc4-3a8f-4e38-9d6a-21dff8fd49a1","year":2018},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.728621Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:20c4cf092c325fb3f40a39342ec529c19c480088f9f6328d7727fdb853b833ee","observation_id":"dd9eb7e4-0e5e-4fc6-bd55-839ad66dc8d2","resolution":{"observed_at":"2026-08-15T17:24:40.152003Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.733210Z","title":"High-resolution image syn- thesis with latent diffusion models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.733210Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:2ae94496c7584dcec4264acd1c75242564bc840e33adecc8a18c7bcb9b5b911e","observation_id":"09f52bc3-9065-4615-8a1e-d2c138dcf27b","resolution":{"observed_at":"2026-08-15T17:24:39.733210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.117216Z","title":"Deep image fingerprint: To- wards low budget synthetic image detection and model lin- eage analysis","venue":null,"work_id":"18626d2a-f645-447e-b036-766ffb612798","year":2024},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.737637Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:f8aa4cb56d3cd3b3232f4c2c80c12ba496184a9480c56d60f052d3b2d78ecb58","observation_id":"2a2a5447-b8ac-459a-9b32-f4ebbe7d813d","resolution":{"observed_at":"2026-08-15T17:24:40.123044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01469","last_updated":"2023-05-31T06:17:10Z","snapshot_observed_at":"2026-08-15T07:00:23.337991Z","submitted_at":"2023-03-02T18:30:16Z","title":"Consistency Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01469","snapshot_observed_at":"2026-08-15T17:24:39.742030Z","title":"Consistency models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.742030Z"},"links":{"cited_paper":"/paper/2303.01469","citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:ffd5e525d527c296cd3294edd6864fe7a11437e46c13686b1658a1f312a4518d","observation_id":"391a8c41-9ceb-43c3-9aff-263b8722f408","resolution":{"observed_at":"2026-08-15T17:24:39.742030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.100419Z","title":"Human motion diffu- sion model","venue":null,"work_id":"a13e61e6-effd-45e7-9be6-e375e037f63f","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.747272Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:d20a09b4a27576fe6b59e88859e47f81a4c814dd7eb84ffe9506fd63a354cad4","observation_id":"6a83f664-fb3c-468b-9c71-4ff05da3471e","resolution":{"observed_at":"2026-08-15T17:24:40.105496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.083433Z","title":"Imitator: Personalized speech-driven 3d facial animation","venue":null,"work_id":"d9df7f81-6de2-4b0c-a309-f9d8df339ece","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.752203Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:6bc6991fa171a574608a7b0818419c8f08939c72c5a1588a8ed427aaf6cfbf23","observation_id":"b42c9264-7cdf-479b-81e9-ea8af356fe63","resolution":{"observed_at":"2026-08-15T17:24:40.088867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.066626Z","title":"Audio2head: Audio-driven one-shot talking-head generation with natural head motion","venue":null,"work_id":"ed3f33ba-1baa-4b16-be28-c5c0de7920bb","year":2021},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.757222Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:ce746bd829812028ed9dcf74044ef64b048d299847670f5d4a0dbbfd00f6aeb1","observation_id":"9978eefb-6cd2-49a8-901a-52c3e707682f","resolution":{"observed_at":"2026-08-15T17:24:40.072129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09797","last_updated":"2023-12-13T11:34:54Z","snapshot_observed_at":"2026-08-20T02:28:18.243153Z","submitted_at":"2023-03-17T06:43:08Z","title":"MMFace4D: A Large-Scale Multi-Modal 4D Face Dataset for Audio-Driven 3D Face Animation","version":2},"cited_work":{"arxiv_id":"2303.09797","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.09797","snapshot_observed_at":"2026-08-15T17:24:39.866568Z","title":"MMFace4D: A Large-Scale Multi-Modal 4D Face Dataset for Audio-Driven 3D Face Animation","venue":"cs.CV","work_id":"f10c2126-1de0-4a6d-99db-a24b24cf66be","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.761754Z"},"links":{"cited_paper":"/paper/2303.09797","citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:05817f26f64f4e08465c73222207bb7f3b7d4da6b676d45d0d7bc6502ec2856f","observation_id":"120ddf16-4495-467a-a96d-20ca1e9d0c95","resolution":{"observed_at":"2026-08-15T17:24:39.873623Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.048264Z","title":"Mmhead: Towards fine-grained multi- modal 3d facial animation","venue":null,"work_id":"8678c58f-4ad5-43c1-b5c2-6ab30c229ab7","year":null},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.766623Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:7209234e00d40aa06f0e8a8cb25ae19cc42c5686c382471b9f3e62169fb1f25e","observation_id":"16d24a38-982a-4ab4-8b33-106b79efc7e5","resolution":{"observed_at":"2026-08-15T17:24:40.053833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.771514Z","title":"Codetalker: Speech-driven 3d facial animation with discrete motion prior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.771514Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:997788f7e6a173d9a9b368f812baca674a745ddda0091fefbd120da0d060a3cc","observation_id":"e51d1a18-c180-498f-80e9-05603c01c091","resolution":{"observed_at":"2026-08-15T17:24:39.771514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.020508Z","title":"Iterative text-based editing of talking-heads using neural retargeting","venue":null,"work_id":"385c6620-8b07-464b-8272-8b8b3e7a5dbb","year":2021},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.776286Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:e6fd3eebc83079d32105fc4d5f6f5ace951db3925e96180fe60cff375c51aa69","observation_id":"9c36d58a-4cd8-467e-87f3-3fb8874a7c86","resolution":{"observed_at":"2026-08-15T17:24:40.026251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:40.002740Z","title":"Generating holistic 3d human motion from speech","venue":null,"work_id":"54c61109-0edb-4b47-a5c8-09780e0780bd","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.781815Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:0df1b099ea7be24599bc31ac3f44f4108e4c9421dcbfac52ebcd007ff8a3b0f5","observation_id":"934a02f3-fdd7-4834-bb9a-a2574501e0db","resolution":{"observed_at":"2026-08-15T17:24:40.007911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13578","last_updated":"2023-12-21T05:03:18Z","snapshot_observed_at":"2026-08-18T10:22:53.196015Z","submitted_at":"2023-12-21T05:03:18Z","title":"DREAM-Talk: Diffusion-based Realistic Emotional Audio-driven Method for Single Image Talking Face Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13578","snapshot_observed_at":"2026-08-15T17:24:39.787022Z","title":"Dream-talk: Diffusion-based realistic emotional audio-driven method for single image talking face generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.787022Z"},"links":{"cited_paper":"/paper/2312.13578","citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:3cc9a0d13b78bae46012c4bb5a413ce087976527ea253f4158fbd86b4cef8781","observation_id":"43657689-dab9-45c3-aa1f-461a25f744a8","resolution":{"observed_at":"2026-08-15T17:24:39.787022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.986819Z","title":"Towards ai-driven sign language generation with non- manual markers","venue":null,"work_id":"3c087bb4-5019-4694-9d40-90fb60604483","year":2025},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.792270Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:1613917086ba3ac12e7fff35b8b78fb9f2707c0a4799e745e48fd27a24308c5d","observation_id":"1f74a76f-1c51-40b0-9141-5a40245a91c5","resolution":{"observed_at":"2026-08-15T17:24:39.991830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.970231Z","title":"T2m-gpt: Generating human motion from textual de- scriptions with discrete representations","venue":null,"work_id":"156faba9-4e0b-4794-b116-21bfec0c2a09","year":2023},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.797351Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:d4ffa8e0d868ec5e353000fdd65ce821083fabe7f7856489a1e81285f92c8371","observation_id":"943d152b-292c-43df-bdf8-6763f4395b1a","resolution":{"observed_at":"2026-08-15T17:24:39.975332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.952224Z","title":"Cohn, Shaun Cana- van, Michael Reale, Andy Horowitz, and Peng Liu","venue":null,"work_id":"a579f3ba-0624-4361-8422-365a638fe3c3","year":2013},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.801831Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:a2e7af08d2e62e65257c7b2ece8bad96996e858383ff19b2037d6ce0df05487a","observation_id":"3bc1c2b3-e65d-4b42-80ef-112c32500db7","resolution":{"observed_at":"2026-08-15T17:24:39.957835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:24:39.935181Z","title":"Multimodal spontaneous emotion corpus for human behavior analysis","venue":null,"work_id":"d119376d-2cd5-4fac-a04a-2371e4ae6834","year":2016},"citing_paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:39.806529Z"},"links":{"citing_paper":"/paper/2508.12438"},"observation_digest":"sha256:dbfa7004283758fb668abd99340c67de7f0f858d8ecd083af920aaaaf1d05060","observation_id":"994cef7d-fc61-4854-8fb7-8e2a2c7b2d9c","resolution":{"observed_at":"2026-08-15T17:24:39.940831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.12438","last_updated":"2025-08-17T17:10:13Z","latest_version":1,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-18T10:23:25.221148Z","submitted_at":"2025-08-17T17:10:13Z","title":"Express4D: Expressive, Friendly, and Extensible 4D Facial Motion Generation Benchmark"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":32},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2508.12438."}