{"as_of":"2026-08-18T21:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:41025bb4c5b85849c274c7645f6d61495e39adbdfd008cc64fc149527d02d24a","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T09:09:04.273023Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2601.14788/citation-record","integrity":"/paper/2601.14788/integrity","json":"/paper/2601.14788/citation-record.json","paper":"/paper/2601.14788"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:08:58.175222Z","title":"In: Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:58.175222Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:40c5dba84e7578202d4cbebe5aaa5a63117bfd2289536129ac0a9b9c5098ba08","observation_id":"17ab800b-51b0-49e9-bdf7-d0fd68fba5eb","resolution":{"observed_at":"2026-08-03T09:08:58.175222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:08:58.228362Z","title":"In: Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:58.228362Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:8cfe33441a49461eaa7ef010a6e59d1e3bb402dd330f15aa3ec08173c3af061b","observation_id":"311c8dee-f51e-459a-b05c-5616a3a79289","resolution":{"observed_at":"2026-08-03T09:08:58.228362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:08:58.295225Z","title":"18 In: International Conference on Robotics and Automation (ICRA), pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:58.295225Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:d2821bada22b5e72a96fb69762e904461a0e31202f5b3d116624d8d1f1796f11","observation_id":"d476e65b-f7ef-4894-8bf8-23ef66a27559","resolution":{"observed_at":"2026-08-03T09:08:58.295225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:08:58.402947Z","title":"In: International Conference on Computer Graphics and Interactive Techniques (SIGGRAPH), pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:58.402947Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:2f8d3cbc8fc7d1887f62a0b04d8e6b18eaa8636bebd7b81d20d1185c138b588b","observation_id":"18b23550-a196-4770-b27c-69007e4c9518","resolution":{"observed_at":"2026-08-03T09:08:58.402947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:08:58.544064Z","title":"In: European Conference on Computer Vision (ECCV), pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:58.544064Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:b475601bcad0e1616caa5e97f56df3e449e6f5e57c37a0c295411adead20585b","observation_id":"4e239ea2-4c5e-4628-af17-a60108be714d","resolution":{"observed_at":"2026-08-03T09:08:58.544064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:08:58.612430Z","title":"International Journal of Computer Vision (IJCV), 1–21 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:58.612430Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:b07fcc02e9c1e78bee58a2cfed7dce85295e6e4d1d905d5c86a6d79d230575dc","observation_id":"c5c98119-443e-4536-a126-cef0aed611f8","resolution":{"observed_at":"2026-08-03T09:08:58.612430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:08:58.672024Z","title":"International Journal of Computer Vision (IJCV)133(5), 2910–2926 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:58.672024Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:5b540a2f7c50de6d51df7a18a4dd193f2c08c4d1687798c9d51548d2c661da1b","observation_id":"0f4c191d-4ef9-4f55-9f5e-1f0a8cb85c06","resolution":{"observed_at":"2026-08-03T09:08:58.672024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:08:58.819752Z","title":"In: Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:58.819752Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:ff5d639eae0109c86a628797bc5ca3d6a929cf8c8c0c16a33619a61ab2b704bf","observation_id":"064112f3-e15c-4554-8a76-866e55d9781b","resolution":{"observed_at":"2026-08-03T09:08:58.819752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:08:58.956412Z","title":"International Journal of Computer Vision (IJCV)134(1), 61 (2026) https://doi.org/10.1007/ s11263-025-02611-3","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:58.956412Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:755dae9fb4bfdc794e7b26262b5450ae93d0faa098c6f97fc8b56d5427bbbee1","observation_id":"4720c3af-5707-4f9a-8734-b1296af8a667","resolution":{"observed_at":"2026-08-03T09:08:58.956412Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.08877","last_updated":"2021-12-14T06:19:33Z","snapshot_observed_at":"2026-08-16T18:02:11.360736Z","submitted_at":"2021-08-19T18:58:02Z","title":"Sentence-T5: Scalable Sentence Encoders from Pre-trained Text-to-Text Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.08877","snapshot_observed_at":"2026-08-03T09:08:59.111513Z","title":"arXiv preprint arXiv:2108.08877 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:59.111513Z"},"links":{"cited_paper":"/paper/2108.08877","citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:3948097ed4471058b22b1cb7ef5a7baad5ad1da9502a40e0a3c210144fdb48ad","observation_id":"fb5d3ffa-206d-4768-9f4a-a63901abbd7b","resolution":{"observed_at":"2026-08-03T09:08:59.111513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:08:59.249555Z","title":"In: International Conference on Machine Learning (ICML), pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:59.249555Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:9721d4a97af11420f2d1cdc8a5ba35e64a22aac9d204d98401f34df767fe80c4","observation_id":"ec6876cc-d40b-4f09-85e4-14a74a8e2f21","resolution":{"observed_at":"2026-08-03T09:08:59.249555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-03T09:08:59.403020Z","title":"arXiv preprint arXiv:1910.01108 (2019)","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:59.403020Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:ed7ce9ecdf8b408f60834143cafbbb02fa8dfc79557d9ed924eeff638a5a6900","observation_id":"488e8274-12b4-47e0-a0b9-ced5d70d7ef0","resolution":{"observed_at":"2026-08-03T09:08:59.403020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:08:59.541739Z","title":"In: Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:59.541739Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:225cd3da9d2f47d217160616b15fd9a7c847beda80dc3d0712ccaf976d7ef63b","observation_id":"f80d8e0b-b7e6-449f-a597-c01de1dcb335","resolution":{"observed_at":"2026-08-03T09:08:59.541739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:08:59.636790Z","title":"In: Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:59.636790Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:3eab5022c05c3e1db2a988494e9b680c98128424d685bd42d02453f8db10bfd2","observation_id":"a56ab668-6240-433b-8025-6103f3ea06b0","resolution":{"observed_at":"2026-08-03T09:08:59.636790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:08:59.721747Z","title":"Advances in Neural Information Processing Systems (NeurIPS)36, 15497–15518 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:59.721747Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:9e1dd123d5038aead74f3c1cff86ef60125d49250d3b9ee42e7f64d5ac9f658e","observation_id":"1de6f50a-b7a5-4bbd-ba40-f5289ce3e59e","resolution":{"observed_at":"2026-08-03T09:08:59.721747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:08:59.848693Z","title":"In: International Conference on Computer Vision (ICCV), pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T09:08:59.848693Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:c8b628102374faf43c5c1eacf2ccbe9e5d765c7bcda1d72fcd500bf7a32fd4f3","observation_id":"5cbf57dc-1ad7-4115-bf43-a946ead04eda","resolution":{"observed_at":"2026-08-03T09:08:59.848693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:00.022642Z","title":"In: International Conference on Learning Representations (ICLR) (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:00.022642Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:dda5fb3c44bd7673d5f6031bca7f4946c2821179d75ce17fb1b5a00d69ee394a","observation_id":"fc7d7743-00a3-454a-a368-b78689cecb3d","resolution":{"observed_at":"2026-08-03T09:09:00.022642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:00.185966Z","title":"In: International Conference on 3D Vision (3DV), pp","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:00.185966Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:5f1775d80d37f59fad524f4c687da89a874ccf768ccadd6de3a4b47cd8056d77","observation_id":"846b57fb-0205-4977-ae29-6e8affad3fe9","resolution":{"observed_at":"2026-08-03T09:09:00.185966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:00.311999Z","title":"In: Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:00.311999Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:b2eaa6d691bb8a9049b1815b633b8fbbf11535d2218814329fd38947a71edaf3","observation_id":"4ca6fb52-9277-4c2c-9921-c2ee6301ff26","resolution":{"observed_at":"2026-08-03T09:09:00.311999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:00.453503Z","title":"Big data 4(4), 236–252 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:00.453503Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:a04e0ce203c8262db00ee01bbd2732ff3e368e7f581ccb0da0a07acc9f284368","observation_id":"62145321-d810-41de-af1e-af8c73098aac","resolution":{"observed_at":"2026-08-03T09:09:00.453503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14916","last_updated":"2022-10-03T09:17:41Z","snapshot_observed_at":"2026-08-12T18:48:37.916493Z","submitted_at":"2022-09-29T16:27:53Z","title":"Human Motion Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14916","snapshot_observed_at":"2026-08-03T09:09:00.532884Z","title":"arXiv preprint arXiv:2209.14916 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:00.532884Z"},"links":{"cited_paper":"/paper/2209.14916","citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:545659b0243523b819071a94cb849d58e262133897126249ac8bfc119d817fb7","observation_id":"cb0d1d90-8e79-4095-bef7-a803cb57a1bf","resolution":{"observed_at":"2026-08-03T09:09:00.532884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.15001","last_updated":"2022-08-31T17:58:54Z","snapshot_observed_at":"2026-08-16T16:35:36.335456Z","submitted_at":"2022-08-31T17:58:54Z","title":"MotionDiffuse: Text-Driven Human Motion Generation with Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.15001","snapshot_observed_at":"2026-08-03T09:09:00.691139Z","title":"arXiv preprint arXiv:2208.15001 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:00.691139Z"},"links":{"cited_paper":"/paper/2208.15001","citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:6e38838dd4a7b3143a206c864ccb448004e4e492de4094896f0666cbefd557e7","observation_id":"328e4f84-674a-432c-b7fe-ed3b71280676","resolution":{"observed_at":"2026-08-03T09:09:00.691139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:00.819542Z","title":"Advances in Neural Information Processing Systems (NeurIPS)36, 13981–13992 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:00.819542Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:f2077e91f970fb98dcd965e12c96d0574bc977c3f6881e36b3e56aac4438d92a","observation_id":"39328d56-16a0-4ece-a96e-0fb1bad6d3d7","resolution":{"observed_at":"2026-08-03T09:09:00.819542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13859","last_updated":"2025-05-12T06:31:17Z","snapshot_observed_at":"2026-08-16T12:49:08.585608Z","submitted_at":"2025-03-18T03:20:02Z","title":"Less is More: Improving Motion Diffusion Models with Sparse Keyframes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13859","snapshot_observed_at":"2026-08-03T09:09:00.966657Z","title":"arXiv preprint arXiv:2503.13859 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:00.966657Z"},"links":{"cited_paper":"/paper/2503.13859","citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:f4d5fd378f2e9dfa33572bf64ebae87faad50d4a03bc83de899b8cfd64759a31","observation_id":"f9b2c7cc-33bb-45d1-8031-8d5a6bf2e524","resolution":{"observed_at":"2026-08-03T09:09:00.966657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:01.067192Z","title":"In: European Conference on Computer Vision (ECCV), pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:01.067192Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:ec8f3b54af8f4743c77cd5f15396164c1f71969957dba2a7ff3df3ebea50ffae","observation_id":"07940e6a-6ca8-4bd1-a5e3-92ab62057a0d","resolution":{"observed_at":"2026-08-03T09:09:01.067192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:01.124029Z","title":"In: Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:01.124029Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:11da0604d80a9e405e9a24d183c305519bad6815df25bd69bd5d47ff81a03003","observation_id":"147665b6-93ea-43a4-bd04-b779ea5bebee","resolution":{"observed_at":"2026-08-03T09:09:01.124029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:01.207249Z","title":"In: Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:01.207249Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:95b97f901a79cc9f007c0b212c617856dd13126ee8340da25d5ebc8808eb031b","observation_id":"0a8f981f-d683-4365-9b15-0c4ffdcb357a","resolution":{"observed_at":"2026-08-03T09:09:01.207249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:01.287533Z","title":"In: Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:01.287533Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:ebb2bb83b35addc1fae9f3643e98c6faea0497518748a485837cdb5585f1a513","observation_id":"f95e74d2-579b-49b2-80bb-62440efb72de","resolution":{"observed_at":"2026-08-03T09:09:01.287533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:01.417217Z","title":"In: Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":null,"year":1900},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:01.417217Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:3462636aa8d1875b79350fe8480dca3c44eb9feb5de3228954930a0d198a66b0","observation_id":"f982a013-4c2b-46cc-b674-9cebe48b2f3c","resolution":{"observed_at":"2026-08-03T09:09:01.417217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:01.545842Z","title":"In: European Conference on Computer Vision (ECCV), pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:01.545842Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:f22c024ab0504a2993e2e5892af7f6c2702a1b6dc139069a46ca69ed25333e7b","observation_id":"0fc92fd1-22e7-4d6d-9cb7-fcb69fb93125","resolution":{"observed_at":"2026-08-03T09:09:01.545842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:01.654068Z","title":"Advances in Neural Information Processing Systems (NeurIPS)37, 130739–130763 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:01.654068Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:848f145082819efe367b8a0b8eb2cc697e113cdd1405b0d772a5e073b29322d7","observation_id":"26db746d-c033-4fc3-b391-12302ce59055","resolution":{"observed_at":"2026-08-03T09:09:01.654068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:01.724243Z","title":"In: International Conference on Acoustics, Speech and Signal Processing (ICASSP), pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:01.724243Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:914a243be882963d7117ac130e553177f8bbc742ccf471d1ce4906accc38d608","observation_id":"41b9625d-05ef-45fe-9d1e-b537b53fa201","resolution":{"observed_at":"2026-08-03T09:09:01.724243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:01.885147Z","title":"International Conference on Computer Vision (ICCV) (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:01.885147Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:c414bbe01ba64848989bdc43b75654e3ad437817181827cc0f849ba3ebfc9288","observation_id":"f81af926-e89a-483d-90b2-998dc676a862","resolution":{"observed_at":"2026-08-03T09:09:01.885147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:01.963726Z","title":"International Conference on Learning Representations (ICLR) (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:01.963726Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:297856f244554bbb2762815a8e2ad26e11eb7266830fe791dfddcf07eadb3758","observation_id":"dead7a99-aa1a-41a7-95c1-bfc8b2b32db0","resolution":{"observed_at":"2026-08-03T09:09:01.963726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:02.053706Z","title":"In: AAAI Conference on Artificial Intelligence (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:02.053706Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:9a34e9af78fc72f1e6bd0258672e6c8dea25878b4d42bbbccc62ed72a47c9296","observation_id":"c5258259-2c16-4245-b75c-b1c8ddb8b7bb","resolution":{"observed_at":"2026-08-03T09:09:02.053706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:02.164007Z","title":"In: International Conference on Computer Graphics and Interactive Techniques in Asia (SIGGRAPH Asia), pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:02.164007Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:96ab2a2bfab11514394f321b79fc47e7702aaa041f4382853c658a9fd2a234bc","observation_id":"0f9c900d-00d9-4d65-ac04-3eaf46242572","resolution":{"observed_at":"2026-08-03T09:09:02.164007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:02.229360Z","title":"Conference on Neural Information Processing Systems (NeurIPS) (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:02.229360Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:9b0ff3de0c8d01d33f3ed512ccfe4255ab32388afcb6504b0282a291adbf794f","observation_id":"5d34822b-bed4-4847-9e68-327ea367bf87","resolution":{"observed_at":"2026-08-03T09:09:02.229360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:02.397640Z","title":"International Journal of Computer Vision (IJCV)134(1), 29 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:02.397640Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:6887a028ceb392c2c2b2e2d2dc25c140d7c4b621578bf4be971101106c532558","observation_id":"5017eaee-d26f-420c-bba9-c76870711fc1","resolution":{"observed_at":"2026-08-03T09:09:02.397640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:02.464748Z","title":"In: European Conference on Computer Vision (ECCV), pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:02.464748Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:4a0fd20d92022026fd99599ef73dafe425299e8ee665041eedad4b7acc9a2add","observation_id":"c2297536-5362-4d2a-bad6-e01e7c850304","resolution":{"observed_at":"2026-08-03T09:09:02.464748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:02.552023Z","title":"In: Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:02.552023Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:24175b65c85fb30d8b4ea89f68b1ea1a9cce3b596d9053fccce5173560aef744","observation_id":"c2ed9d0a-5c37-4f3f-bafd-f9386dc799f8","resolution":{"observed_at":"2026-08-03T09:09:02.552023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:02.650190Z","title":"In: International Conference on Computer Vision (ICCV), pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:02.650190Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:1d60065c057be21c49f372db457a9b6b4b248c0125f4e7fcf897af0309cdb4d7","observation_id":"8f0b1b1c-d195-46b8-832c-40c15c3ab91f","resolution":{"observed_at":"2026-08-03T09:09:02.650190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:02.780668Z","title":"In: European Conference on Computer Vision (ECCV), pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:02.780668Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:c9c0c3d606e997cd9a1236117a1d48714abf29fb18275d70de221b966441f858","observation_id":"dc148498-69d5-4e21-9fab-2d07a2cdd0d6","resolution":{"observed_at":"2026-08-03T09:09:02.780668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:02.914168Z","title":"In: International Conference on Computer Vision (ICCV), pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:02.914168Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:b58236e339c7824eba3f6681021274e6ee19139e24567358b4660aee8babf66b","observation_id":"832c38ad-41b6-439d-90fc-ebff3ec81488","resolution":{"observed_at":"2026-08-03T09:09:02.914168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:03.061384Z","title":"Con- ference on Neural Information Processing Systems (NeurIPS)34, 8780–8794 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:03.061384Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:4567832c5d5b89cfca1b601a8afea50ebdfbe6c1932b4f0dd929471a3f3dfc21","observation_id":"05c8d7f4-eacb-49e9-b329-e221b49df8d2","resolution":{"observed_at":"2026-08-03T09:09:03.061384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-03T09:09:03.120051Z","title":"arXiv preprint arXiv:2207.12598 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:03.120051Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:ff495818e14816dc97f19b3ae977cb7179674376ec7e6b852aec910ecd8a57ee","observation_id":"22888dc3-78da-43a2-88c6-888dd6714e60","resolution":{"observed_at":"2026-08-03T09:09:03.120051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:03.164762Z","title":"Advances in Neural Information Processing Systems (NeurIPS)37, 52996–53021 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:03.164762Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:f1734c8776ed8ebbdc16d55c69ba02c8c63b68205f149af8370101b6fde2116d","observation_id":"5b89034e-918b-4fba-b066-7ec250b25201","resolution":{"observed_at":"2026-08-03T09:09:03.164762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-03T09:09:03.222850Z","title":"arXiv preprint arXiv:2112.10741 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:03.222850Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:0d296d3d5efa316db2faeba81ad98b6f6bfa8f4e9784829ff6a68d6d1d07f4f9","observation_id":"dd92d4ab-2c4f-4163-9920-124f6cabd0aa","resolution":{"observed_at":"2026-08-03T09:09:03.222850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:03.331418Z","title":"https://github.com/Stability-AI/sd3.5 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:03.331418Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:ed1cba3da0523bade88e28c97eb2e60f3d55bae51db4a98f775afe70cd233969","observation_id":"bdce3ce4-5830-4464-8d86-edd0e3017f0f","resolution":{"observed_at":"2026-08-03T09:09:03.331418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:03.480201Z","title":"In: European Conference on Computer Vision (ECCV), pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:03.480201Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:9e1102fad7ed0e8caea3e9fb0ceac795fdb66b9cb5d9867aedea81721b7fda91","observation_id":"d7e85bea-2246-432d-a29f-1af82948719a","resolution":{"observed_at":"2026-08-03T09:09:03.480201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:03.555332Z","title":"In: International Conference on Computer Vision, pp","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:03.555332Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:0eea8c38a66e3818582b377b44c88e883444aba32f4e2b9abe5599a9c11eddb4","observation_id":"b0656d50-e434-46a0-ba8e-723790da9d58","resolution":{"observed_at":"2026-08-03T09:09:03.555332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:03.636083Z","title":"International Conference on Multimedia (MM) (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:03.636083Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:0f09493be5a960b23919d361052c51a463662cfb7f02117fbca22cdd93445d5d","observation_id":"56ceb71c-e300-47bf-890e-ebeb1f2ae202","resolution":{"observed_at":"2026-08-03T09:09:03.636083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:03.712013Z","title":"In: International Conference on Learning Representations (ICLR) (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:03.712013Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:dcc2dbee5a9ce9dd77708ac7ed06fbec4621e310af36d129e1b57519e1d57a4e","observation_id":"070d133f-021d-4d5c-9be1-5b3c628ac353","resolution":{"observed_at":"2026-08-03T09:09:03.712013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01418","last_updated":"2023-08-30T04:41:10Z","snapshot_observed_at":"2026-08-16T15:51:18.051527Z","submitted_at":"2023-03-02T17:09:27Z","title":"Human Motion Diffusion as a Generative Prior","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01418","snapshot_observed_at":"2026-08-03T09:09:03.825801Z","title":"arXiv preprint arXiv:2303.01418 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:03.825801Z"},"links":{"cited_paper":"/paper/2303.01418","citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:00c80866d90bd6431a254d125a8af0305dd54efc105ebd6850423ebce8e12297","observation_id":"87382bb4-39cd-4bed-8ebe-5fc82d181d91","resolution":{"observed_at":"2026-08-03T09:09:03.825801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05098","last_updated":"2025-01-09T09:37:27Z","snapshot_observed_at":"2026-08-17T09:12:56.498039Z","submitted_at":"2025-01-09T09:37:27Z","title":"Motion-X++: A Large-Scale Multimodal 3D Whole-body Human Motion Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05098","snapshot_observed_at":"2026-08-03T09:09:04.017711Z","title":"arXiv preprint arXiv:2501.05098 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:04.017711Z"},"links":{"cited_paper":"/paper/2501.05098","citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:06773ff3c2a1987abc9b39be2513183a476ec748a399e63cf3729e8e36df5d90","observation_id":"44108868-7037-4463-a6ce-fff14b90d503","resolution":{"observed_at":"2026-08-03T09:09:04.017711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:04.128503Z","title":"International Journal of Computer Vision (IJCV)129(10), 2846–2864 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:04.128503Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:265307fc37dc4009c7d61b4504ceb8bffda5141b07f545353e1e7f5542661d5e","observation_id":"e313d68a-8b42-46d8-b4aa-c25d736b2f31","resolution":{"observed_at":"2026-08-03T09:09:04.128503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:04.214142Z","title":"International Journal of Computer Vision (IJCV)130(5), 1165–1180 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:04.214142Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:fbe41676b16543d1c4277d5a57f981feb76ee7e964a753e3690fbc418438e52a","observation_id":"bb3ab014-d94c-4116-8b5d-efab722c3a74","resolution":{"observed_at":"2026-08-03T09:09:04.214142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T09:09:04.273023Z","title":"International Journal of Computer Vision (IJCV)130(2), 363–383 (2022) 23","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T09:09:04.273023Z"},"links":{"citing_paper":"/paper/2601.14788"},"observation_digest":"sha256:4732429e9fed4edfb731c8f189725cfc08867eea61c64c66d8a9d0515e5c66c0","observation_id":"98e57dc9-1e90-40b6-8309-8124f480d870","resolution":{"observed_at":"2026-08-03T09:09:04.273023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2601.14788","last_updated":"2026-07-03T06:10:41Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T19:47:29.618558Z","submitted_at":"2026-01-21T09:11:45Z","title":"Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":56,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2601.14788."}