{"as_of":"2026-08-19T09:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:61eea8acc383051fe2f34f4e0319f6261553344ce94a04dfd8a2ec489bc20760","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:04:23.253905Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T20:16:35.411267Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T20:18:13.199794Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"cited_work":{"arxiv_id":"2505.08293","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.08293","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M3g: Multi-granular gesture generator for audio- driven full-body human motion synthesis","venue":null,"work_id":"55b10ac6-be68-4c49-9757-4d6e235fbb77","year":2025},"citing_paper":{"arxiv_id":"2604.02908","last_updated":"2026-04-19T15:13:54Z","snapshot_observed_at":"2026-08-14T09:38:21.018074Z","submitted_at":"2026-04-03T09:26:28Z","title":"SentiAvatar: Towards Expressive and Interactive Digital Humans","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T20:16:35.411267Z"},"links":{"cited_paper":"/paper/2505.08293","citing_paper":"/paper/2604.02908"},"observation_digest":"sha256:8bc63edb7951d40dc4bf5fa671e71dfbbf191aa2a4c8fec2b2518a679cb31f91","observation_id":"d80f3ff5-feb6-49c2-b401-64e623f0587a","resolution":{"observed_at":"2026-05-13T20:18:13.201416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.08293/citation-record","integrity":"/paper/2505.08293/integrity","json":"/paper/2505.08293/citation-record.json","paper":"/paper/2505.08293"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.751927Z","title":"Language2pose: Natural language grounded pose forecasting","venue":null,"work_id":"95e8a762-591c-4d60-9576-2fb1b74b6e7f","year":2019},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.117720Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:38f60ed143ba2a54578c251ad79900ea877523e2b9637fad987f631e42108251","observation_id":"7b99a50e-a92c-47b8-82c8-24c2167e6f1d","resolution":{"observed_at":"2026-08-15T22:04:23.756682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.627179Z","title":"Acting the part: the role of gesture on avatar identity","venue":null,"work_id":"62783c4a-af14-4733-98e1-ab5c1171b167","year":2014},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.161386Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:974aec04ae3d2c864990ac0cf94253420f8e06b23b93a2d679694ade52387f13","observation_id":"702ab97c-a489-4763-9184-6dae7006789a","resolution":{"observed_at":"2026-08-15T22:04:23.632712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.170913Z","title":"Gen- erative adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.170913Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:1192bbd40214992dbe7b4adb83e65a9a71307e3b8fe17fbdce0c17f19772023e","observation_id":"df8fcb50-9e3d-4b76-8626-0c61ff728729","resolution":{"observed_at":"2026-08-15T22:04:23.170913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.586745Z","title":"Learning speech-driven 3d conversational gestures from video","venue":null,"work_id":"4553ee6a-3999-4ef2-9d72-f7a536804355","year":2021},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.175523Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:df20fc46026158bfd282d1c37618f2cdc50ddf29bbb796631e5873cecb2ad09c","observation_id":"abf5b29b-fe76-4e6c-8d07-f54508a7d553","resolution":{"observed_at":"2026-08-15T22:04:23.591347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.570300Z","title":"Robot behavior toolkit: generating effective social behaviors for robots","venue":null,"work_id":"644669bf-2b7b-49d3-93cf-16b0c762c036","year":2012},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.179949Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:07ba2dfd22b6f310f8fb347922020af2590431b629a52143234c355106cfb783","observation_id":"9ecfeed5-4d62-4411-be3f-7e9ea3583465","resolution":{"observed_at":"2026-08-15T22:04:23.575936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00374","last_updated":"2024-03-30T04:15:34Z","snapshot_observed_at":"2026-08-16T14:30:41.573330Z","submitted_at":"2023-12-31T02:25:41Z","title":"EMAGE: Towards Unified Holistic Co-Speech Gesture Generation via Expressive Masked Audio Gesture Modeling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00374","snapshot_observed_at":"2026-08-15T22:04:23.194255Z","title":"Emage: Towards unified holistic co-speech gesture generation via masked audio gesture modeling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.194255Z"},"links":{"cited_paper":"/paper/2401.00374","citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:ece228c6e4aa4e8fcf0f478a5a0ffcde6e1270b48b427fc5b53d67f7ac277163","observation_id":"0134c682-09ee-4403-a706-76612aeed0dd","resolution":{"observed_at":"2026-08-15T22:04:23.194255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.553917Z","title":"Studies on gesture expressivity for a virtual agent","venue":null,"work_id":"154a9373-b3b9-4573-8397-2b4e3f18ac7b","year":2009},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.198970Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:9acc63f282b567baec9b0f84d1ccda4d8d6664d3afa3198647e8d7ee8f74504f","observation_id":"32695434-596b-41bd-9fa6-b7779d46fc89","resolution":{"observed_at":"2026-08-15T22:04:23.558879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.520615Z","title":"Bailando: 3d dance generation by actor- critic gpt with choreographic memory","venue":null,"work_id":"0d1f3949-2c5f-44bb-bff6-be8d28309b8c","year":2022},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.207391Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:469ef2d82e008de96f0c3ccfeeb338273796fe6b3b4a586567036ecae618865d","observation_id":"4b14f714-a11f-4dbb-9c88-7b65550a5a80","resolution":{"observed_at":"2026-08-15T22:04:23.525701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.505114Z","title":"Body language in the brain: con- structing meaning from expressive movement","venue":null,"work_id":"c7734134-74c7-4218-be2d-6c9b66dd52c1","year":2015},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.211456Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:98cc65948f0718e3bb72def752c33a1dcead3d328e94c45c1f5b0adb825dbaab","observation_id":"aedb6075-5c3e-4d2d-83cb-0a6cd423e2b2","resolution":{"observed_at":"2026-08-15T22:04:23.509997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.465189Z","title":"The persona effect: how sub- stantial is it? In People and computers XIII: Proceedings of HCI’98, pages 53–66","venue":null,"work_id":"ea35b531-d3f5-40b6-89af-2e872766aa76","year":1998},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.223334Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:4b1a811029fa5031a2688df940b47500189c5bccca7f6e63fe0507121cf55280","observation_id":"ea6cff3e-bcc6-4027-bce6-d2381bb9babd","resolution":{"observed_at":"2026-08-15T22:04:23.470180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.431171Z","title":"Codetalker: Speech-driven 3d facial animation with dis- crete motion prior","venue":null,"work_id":"ec78224b-ae29-4de5-8f55-bd3557012ea3","year":2023},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.231360Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:5e27a918c4ec3ab6babd63e093b8de03642df3a461afce372a944ed2a61b102e","observation_id":"64196ece-092c-4c2b-8db6-7beb6d20745a","resolution":{"observed_at":"2026-08-15T22:04:23.436323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04919","last_updated":"2023-05-08T17:54:58Z","snapshot_observed_at":"2026-08-18T21:42:50.684554Z","submitted_at":"2023-05-08T17:54:58Z","title":"DiffuseStyleGesture: Stylized Audio-Driven Co-Speech Gesture Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04919","snapshot_observed_at":"2026-08-15T22:04:23.235359Z","title":"Diffusestylegesture: Stylized audio-driven co-speech gesture generation with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.235359Z"},"links":{"cited_paper":"/paper/2305.04919","citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:9823f3fc73c5bac79bed481940988980ada77946f90286888b907140b9bbb4c6","observation_id":"54ebb926-517b-478d-b5a6-7c60d6d91c50","resolution":{"observed_at":"2026-08-15T22:04:23.235359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.415523Z","title":"Gesture2vec: Clustering gestures us- ing representation learning methods for co-speech gesture generation","venue":null,"work_id":"e6b0b41a-5b05-465d-9222-191d196124c4","year":2022},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.240142Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:820f5a2b3e33e42f6f13ad2f9ce905556bc5c73a3144cd4276b9466ab347bc5e","observation_id":"9ff1f77b-f3cb-40d3-b156-0bdeae819043","resolution":{"observed_at":"2026-08-15T22:04:23.420663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.400015Z","title":"Generating holistic 3d human motion from speech","venue":null,"work_id":"27702474-cdf3-4a21-92e9-0266f3414c70","year":2023},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.244776Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:855f3701064a0958d6804be541d5f6a7e48ecaf758a6751a4bf618a085572cc6","observation_id":"74fc259e-2039-4730-a3fa-29bbba23b8a6","resolution":{"observed_at":"2026-08-15T22:04:23.404741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.384241Z","title":"Speech gesture generation from the trimodal context of text, audio, and speaker identity.ACM Transac- tions on Graphics (TOG), 39(6):1–16,","venue":null,"work_id":"b4edf3a4-da59-48d3-87e6-2a6b434bbb3a","year":2020},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.249385Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:9b2a6fe418565418a3dd1ea4428d658f4a943ff697d14fd545de36fcbeb75076","observation_id":"b18e85ff-ca40-4887-8683-f744a9e79e42","resolution":{"observed_at":"2026-08-15T22:04:23.389504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.366002Z","title":"Audio-driven neural gesture reenactment with video mo- tion graphs","venue":null,"work_id":"79885e7d-c55c-4e0d-b582-aad89e8a6ca4","year":2022},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.253905Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:a4714dbb9ede1bffeb92ff25c0cb37ad1bf5a13a7722d0e977c2394fed8d7891","observation_id":"02a1bb34-1142-4c9e-9732-badd213388d1","resolution":{"observed_at":"2026-08-15T22:04:23.372862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.449210Z","title":"Attention is all you need","venue":null,"work_id":"cb713397-d2d5-4064-98c3-002cd2e89574","year":2017},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":1998,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.227343Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:a7523bf25839afcbc95eade5c25f168562c05eae584f49d40fd523dc9be20485","observation_id":"711b30c9-ef57-40ad-809f-d518509e422a","resolution":{"observed_at":"2026-08-15T22:04:23.454825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03819","last_updated":"2019-03-05T16:46:19Z","snapshot_observed_at":"2026-08-13T07:34:17.550838Z","submitted_at":"2018-07-10T18:39:15Z","title":"Universal Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03819","snapshot_observed_at":"2026-08-15T22:04:23.152005Z","title":"Uni- versal transformers","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.152005Z"},"links":{"cited_paper":"/paper/1807.03819","citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:f3ffdea0aac3208344a4089d6775652a9c38423a4449bffe0ab16667f701bc68","observation_id":"f449bade-033b-4dd2-a7d9-2da903317a86","resolution":{"observed_at":"2026-08-15T22:04:23.152005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.536780Z","title":"Blendface: Re-designing iden- tity encoders for face-swapping","venue":null,"work_id":"ef8347f6-43c8-470d-b442-39a17b1fd1d6","year":2023},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.203398Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:d31f240b6a2c870bd2b7cc272aa4dbb3972b21d2348f3fec854a199b5f8580ba","observation_id":"17349ecf-8ab2-4538-b61c-cd3d8652b2f5","resolution":{"observed_at":"2026-08-15T22:04:23.541717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.219547Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.219547Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:1d698b7adb3d30fd7dd5b84e922369d6c2fdc1639f686557fccdde959a1b8cc6","observation_id":"b6e28f16-3115-4bcb-8775-38922a21f7cb","resolution":{"observed_at":"2026-08-15T22:04:23.219547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-15T22:04:23.184529Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.184529Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:1da0597586b57501973b03433f6867336ebafb28ebab040feafa5bf69b2e0cb2","observation_id":"0bf17828-d7da-4ded-b6bd-3d8ada30b506","resolution":{"observed_at":"2026-08-15T22:04:23.184529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05352","last_updated":"2021-11-03T08:38:19Z","snapshot_observed_at":"2026-08-16T17:51:33.157170Z","submitted_at":"2021-10-06T07:44:52Z","title":"All One Needs to Know about Metaverse: A Complete Survey on Technological Singularity, Virtual Ecosystem, and Research Agenda","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05352","snapshot_observed_at":"2026-08-15T22:04:23.189484Z","title":"All one needs to know about metaverse: A complete survey on technological singular- ity, virtual ecosystem, and research agenda","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.189484Z"},"links":{"cited_paper":"/paper/2110.05352","citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:e40003d859e70f80c900a338e5fdf3869f211aeb85319f81479d777ddd4d2001","observation_id":"ed61a40f-a591-45b9-a0fd-45ceab9583b4","resolution":{"observed_at":"2026-08-15T22:04:23.189484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.611892Z","title":"[Ginosar et al., 2019] Shiry Ginosar, Amir Bar, Gefen Ko- havi, Caroline Chan, Andrew Owens, and Jitendra Malik","venue":null,"work_id":"b36efea5-0bba-4495-97b5-76bc5cb10148","year":2019},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.166334Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:6efde67012a70a787dc4efc4eb3c9b880d564ccdcb0862d51784eac67be2561f","observation_id":"f2b20ad4-487d-4c73-ab00-e9010c6eb0b4","resolution":{"observed_at":"2026-08-15T22:04:23.616803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.490521Z","title":"Direct iterative closest point for real- time visual odometry","venue":null,"work_id":"e3916b7f-81ad-4e16-b9ca-c7eeb55155f2","year":2011},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.215406Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:148e1370c363c0008196d4583bf55908f9d19b30badd597b82f5ce8c2f224aa3","observation_id":"ddcc8ee0-d0a0-43f7-99d5-520c21532f10","resolution":{"observed_at":"2026-08-15T22:04:23.495248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.659464Z","title":"Beat: the behavior expression animation toolkit","venue":null,"work_id":"219ba84e-4925-46ba-aeec-1ae80eb9dca8","year":2001},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.147547Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:539a5d3cc456781d37b650c0f9d7dbeb2b7bd9705dba4314577c5581eab3bb62","observation_id":"27059b14-aa5d-4ab6-b225-1a897c16562a","resolution":{"observed_at":"2026-08-15T22:04:23.664462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.643786Z","title":"Faceformer: Speech- driven 3d facial animation with transformers","venue":null,"work_id":"53734e25-5131-4002-9017-2f8e63eff5aa","year":2022},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.156686Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:35bb6f41c5eed389402de8bc8f384407526ab2411f67291f637e4051d0504980","observation_id":"5dabbd47-119c-4302-8c68-0bf2a937a341","resolution":{"observed_at":"2026-08-15T22:04:23.648822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.738206Z","title":"No gestures left be- hind: Learning relationships between spoken language and freeform gestures","venue":null,"work_id":"e8fcce1a-3852-4257-9ed0-086b5dabbbe0","year":2020},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.122848Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:3762465e084c9a5998c243b9d1414813194db121665171c4fea2f869c6af7163","observation_id":"9e4c36da-b682-4c3a-ae9e-aeb002b63bdb","resolution":{"observed_at":"2026-08-15T22:04:23.742407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.723706Z","title":"Rhythmic gesticulator: Rhythm-aware co-speech gesture synthesis with hierarchi- cal neural embeddings","venue":null,"work_id":"a86c2096-9772-4c08-b6d5-e6f2e14854a1","year":2022},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.127791Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:5acea551b55abb146e5b9f9c195bf9beff35474b03b41321b9f49b122c763a71","observation_id":"14c3eb72-5885-403c-bf39-ca5efe739332","resolution":{"observed_at":"2026-08-15T22:04:23.728241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.675141Z","title":"Enriching word vec- tors with subword information","venue":null,"work_id":"4c63b16d-f958-460e-b289-c49ea1c2d849","year":2017},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.142191Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:5f64c413eabb23fd29b3ebb05a1d6a2d14a4e0f951b90cd9b694dd8cba78a24c","observation_id":"daa01f09-b451-4f06-a623-64adf6bbbfc5","resolution":{"observed_at":"2026-08-15T22:04:23.680076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.709165Z","title":"Gesturediffuclip: Gesture diffusion model with clip la- tents","venue":null,"work_id":"b6bcea48-2cee-4ae8-b9b5-df8610afbdd6","year":2023},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.132530Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:7e7517b65119a7893c3dc30013d8631c9bf0e7ae6e24b2588ac2f9fa71aaaed2","observation_id":"4d4cd8cd-b943-402a-a9e2-486c43a1c936","resolution":{"observed_at":"2026-08-15T22:04:23.714305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:04:23.692368Z","title":"Text2gestures: A transformer- based network for generating emotive body gestures for virtual agents","venue":null,"work_id":"2926038c-4bc4-4c2c-8d29-78254184a4d5","year":2021},"citing_paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T22:04:23.137491Z"},"links":{"citing_paper":"/paper/2505.08293"},"observation_digest":"sha256:1775de7bfd84670a99c62a46170bd8327ecdd83e88654d5047ec50af91e49f40","observation_id":"ed9b06cb-3cfe-4cac-a2a1-b18a7ab9f2c4","resolution":{"observed_at":"2026-08-15T22:04:23.698165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.08293","last_updated":"2025-05-19T14:01:45Z","latest_version":2,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-16T12:27:42.794005Z","submitted_at":"2025-05-13T07:16:58Z","title":"M3G: Multi-Granular Gesture Generator for Audio-Driven Full-Body Human Motion Synthesis"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 1 inbound Pith citation observation for arXiv:2505.08293."}