{"as_of":"2026-08-10T12:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4666853c82f34c902e1d471f84da5a88b79be623019d19422ae9386775e0caa2","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:53:22.927707Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.09411/citation-record","integrity":"/paper/2506.09411/integrity","json":"/paper/2506.09411/citation-record.json","paper":"/paper/2506.09411"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:15.800997Z","title":"Vivit: A video vision transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:15.800997Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:26a704620b7c30a15d20d91fa1e2bfa18123e6c1825efcdd1f3904e78611bc6d","observation_id":"2d494608-6357-4805-bee5-1da70c23b98f","resolution":{"observed_at":"2026-08-07T04:53:15.800997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:35.680809Z","title":"Is space-time attention all you need for video understanding? InICML, page 4, 2021","venue":null,"work_id":"b6c1a893-56b4-4b30-9643-29ab2fe9bee2","year":2021},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:15.885477Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:52ac9ca029b2354d269a266300f4098d6cb7413702cfeb231b956aee88483112","observation_id":"10c2c6f3-a56d-4dba-8edb-9813b3dcae91","resolution":{"observed_at":"2026-08-07T04:53:35.768521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:35.433605Z","title":"BEDLAM: A synthetic dataset of bodies ex- hibiting detailed lifelike animated motion","venue":null,"work_id":"83b7c38a-3050-44d2-ba3d-88ff50602d57","year":2023},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:15.963253Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:b03d27c37ee03b00a28b23833b1cf4c9d51455790fa5666f1402d73ecdef3cf1","observation_id":"7d1604fc-1218-4b34-b0dd-afb70d0441e4","resolution":{"observed_at":"2026-08-07T04:53:35.549393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:16.075035Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.075035Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:67e1c73c13bb1de36b156b70d9721a46b66b2ad0e5cff4f07a252a6cba44b865","observation_id":"fd93fc9b-31dd-4f87-8aa9-1e60f78d5bc4","resolution":{"observed_at":"2026-08-07T04:53:16.075035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:35.156714Z","title":"Why can’t i dance in the mall? learning to miti- gate scene bias in action recognition.Advances in Neural Information Processing Systems, 32, 2019","venue":null,"work_id":"b6ad80a8-5ae8-4b39-a94a-a36e6eebeee3","year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.152119Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:09738d4f13c85ddc02aba3798a5be279f97f0ebe06a0ed6215059abe848a6946","observation_id":"1b5ea51c-2aeb-46b3-8fc0-9a0bee1fe746","resolution":{"observed_at":"2026-08-07T04:53:35.295994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:34.879877Z","title":"Openmmlab pose estimation tool- box and benchmark.https://github.com/open- mmlab/mmpose, 2020","venue":null,"work_id":"4ccf5c88-d3a2-4c8a-a9bd-3731091049f2","year":2020},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.254419Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:3e8150d1d0a802d03c11f2da0310700e64a61d4597d4a62582c45cc4e77967fc","observation_id":"70a6ce1b-e316-4c7a-9d66-ddae05f0ca0d","resolution":{"observed_at":"2026-08-07T04:53:35.025821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:34.542576Z","title":"Toyota smarthome untrimmed: Real-world untrimmed videos for activity detection.IEEE Transactions on Pattern Analysis and Machine Intelligence, pages 1–1,","venue":null,"work_id":"82b03c38-b0eb-4f0b-93f6-4456a9eb4677","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.375150Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:e27243bfb1119de6dea56fedf7013e0c7196075bb7ed13a7e3da907319ddd634","observation_id":"aeb5ba77-67ed-499a-ab1a-dcfe1662f3a2","resolution":{"observed_at":"2026-08-07T04:53:34.692619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:34.303554Z","title":"Toyota smarthome: Real-world activities of daily living","venue":null,"work_id":"d34776a2-9457-4d83-b453-2dc8ab66a9fa","year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.479221Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:ce7c8c6cae04ef4b848034a6c1a1b085d961c141b8219ee6a73ef75d580368e4","observation_id":"7d2b98d2-1fbd-48e5-b470-1d3cb8ff925d","resolution":{"observed_at":"2026-08-07T04:53:34.393125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02464","last_updated":"2024-08-05T13:44:22Z","snapshot_observed_at":"2026-08-08T21:33:03.120586Z","submitted_at":"2024-08-05T13:44:22Z","title":"Fairness and Bias Mitigation in Computer Vision: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02464","snapshot_observed_at":"2026-08-07T04:53:16.573935Z","title":"Fairness and bias mitigation in com- puter vision: A survey.arXiv preprint arXiv:2408.02464,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.573935Z"},"links":{"cited_paper":"/paper/2408.02464","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:8d73ee1d8c6a53470002005788f4802b5b9e6bc31ef953eafd319fb0f48cbbc8","observation_id":"184c7d52-8770-4906-ac61-42454dfd0c53","resolution":{"observed_at":"2026-08-07T04:53:16.573935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T04:53:16.691812Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.691812Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:5d7384394afc359ed3427a7d4593deff4e66d7b7629b8ffff94b7c7bc8710560","observation_id":"b6c896d5-741d-4526-9906-866151c7f00e","resolution":{"observed_at":"2026-08-07T04:53:16.691812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:33.972897Z","title":"A survey on bias in visual datasets.Computer Vision and Image Understanding, 223: 103552, 2022","venue":null,"work_id":"3d72f1c4-482c-4e1e-bc95-9213488cdeb6","year":2022},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.792904Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:3da6d785bea2b72b95bbd2980d18435528a4d723befb52bca7c6613739aae308","observation_id":"dfa3d527-e99c-4c9a-ad61-47004e4c261a","resolution":{"observed_at":"2026-08-07T04:53:34.152460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:33.782507Z","title":"Pytorchvideo: A deep learning li- brary for video understanding","venue":null,"work_id":"bf354c97-7d74-4b76-a8b9-4cbd16a7e5d8","year":2021},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:16.896160Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:bb468c3f6846c324832dd5c541c99afaae4922ba34c6a1934ac2056ab84abbd8","observation_id":"c322d559-27c0-4122-ab87-8c8913307b39","resolution":{"observed_at":"2026-08-07T04:53:33.873916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:33.553725Z","title":"Slowfast networks for video recognition","venue":null,"work_id":"8d88641e-30c2-40ab-ae41-5c6afb3ea3b6","year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.049426Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:d1bff1a7c4909988d183a99b3cfe9b0e1d5f998e2ade950e1c5742a28458ecbb","observation_id":"1ef0a07f-9463-4705-b21c-e25ad6870c1d","resolution":{"observed_at":"2026-08-07T04:53:33.664025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:33.192659Z","title":"Black, and Timo Bolkart","venue":null,"work_id":"898a94a1-7e49-401c-b96a-ab07a6d1de78","year":2021},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.150341Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:0fa5a3ae521b7b55bb352edcdb69cc980baa5c6a3663529e51b8dd00358cd40d","observation_id":"f7f89402-51d8-4820-bb6e-15ee64a48e99","resolution":{"observed_at":"2026-08-07T04:53:33.359145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:32.955174Z","title":"The” something something” video database for learning and evaluating visual common sense","venue":null,"work_id":"9b5de5ca-81d2-49af-832c-0bc17a3f9a76","year":2017},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.312149Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:1909fa59f1e1aa7dab46a8bfb716b34c06b5d371df45b359567074a79018772a","observation_id":"e4159258-e25b-45c5-a6b6-02c24dea5733","resolution":{"observed_at":"2026-08-07T04:53:33.038434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:32.665639Z","title":"DensePose: Dense human pose estimation in the wild","venue":null,"work_id":"f06ce9f7-a6d0-46ce-89ee-caf40241073b","year":2018},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.404717Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:64de2f1ce4ba4241d937e01015185dec3982dd061c8ae738022dd89de36a3a23","observation_id":"8e603b0f-6e3f-4579-94d7-29e1a7c84c43","resolution":{"observed_at":"2026-08-07T04:53:32.839451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:32.470528Z","title":"Can spatiotemporal 3d cnns retrace the history of 2d cnns and im- agenet? InProceedings of the IEEE conference on Computer Vision and Pattern Recognition, pages 6546–6555, 2018","venue":null,"work_id":"378c957b-4187-4e73-af8e-5419595f2bc1","year":2018},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.515538Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:65babd728a5c4676f2935cecd34d62d3eefc20801935b74fba23716ce3c44f01","observation_id":"636a41a9-c26b-464f-9a9b-30f88950b9dd","resolution":{"observed_at":"2026-08-07T04:53:32.574049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:17.625297Z","title":"Animate anyone: Consistent and controllable image- to-video synthesis for character animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.625297Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:1b6e93ffcb19096a7674e3ac772fcc2937f1699da9bfb7217036ae905e227925","observation_id":"d241e6ae-e20b-4c63-9c89-1c1b875db6b3","resolution":{"observed_at":"2026-08-07T04:53:17.625297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:32.255633Z","title":"Eldersim: A synthetic data generation platform for human action recognition in eldercare applica- tions.IEEE Access, 11:9279–9294, 2021","venue":null,"work_id":"978ade78-b415-4ddd-b04a-fb2918f4fae1","year":2021},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.732553Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:48f60382184bbe4f2143dad06a7a918c8e2485baba0b337c301e10de2b1730de","observation_id":"9d001371-1a0e-426c-ab8d-a23a664f43ef","resolution":{"observed_at":"2026-08-07T04:53:32.358645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01830","last_updated":"2023-10-23T08:57:58Z","snapshot_observed_at":"2026-07-06T16:26:58.234941Z","submitted_at":"2023-10-03T06:55:19Z","title":"AI-Generated Images as Data Source: The Dawn of Synthetic Era","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01830","snapshot_observed_at":"2026-08-07T04:53:17.939598Z","title":"Ai-generated images as data sources: The dawn of synthetic era.arXiv preprint arXiv:2310.01830, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:17.939598Z"},"links":{"cited_paper":"/paper/2310.01830","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:71f4665b31a52d40b94ca4fb42fd2f93f652f63537f5f217524042a46335cdaf","observation_id":"fec7b537-1dfb-4aab-86f1-fe8520f35555","resolution":{"observed_at":"2026-08-07T04:53:17.939598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-07T04:53:18.046555Z","title":"Berg, Wan-Yen Lo, Piotr Doll ´ar, and Ross Girshick","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.046555Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:b983baae51bdb59e050b8921377b5c8ccc38287db82e0b843dc3e1627930165f","observation_id":"bcb29a00-d146-4746-b9c1-9a10e5e6336b","resolution":{"observed_at":"2026-08-07T04:53:18.046555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15648","last_updated":"2025-01-26T19:17:05Z","snapshot_observed_at":"2026-07-06T20:26:26.110538Z","submitted_at":"2025-01-26T19:17:05Z","title":"Can Pose Transfer Models Generate Realistic Human Motion?","version":1},"cited_work":{"arxiv_id":"2501.15648","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.15648","snapshot_observed_at":"2026-08-07T04:53:24.477756Z","title":"Can Pose Transfer Models Generate Realistic Human Motion?","venue":"cs.CV","work_id":"71152001-f5e9-4b7c-a3c1-2c86dde494a8","year":2025},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.204562Z"},"links":{"cited_paper":"/paper/2501.15648","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:2e52103777651ff0687c92b22474f4f65aae721983017faab3353cdcbebf9508","observation_id":"7d7b4efc-0f1f-466d-ba98-dad2b5d56c7d","resolution":{"observed_at":"2026-08-07T04:53:24.590306Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:32.030165Z","title":"Hmdb: a large video database for human motion recognition","venue":null,"work_id":"4522a92d-7843-4e90-ba93-9b90d1b1e162","year":2011},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.340268Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:73c14cba28d934b6043813ff10dae0b692d01c64318859d5070a7e7bc7be9783","observation_id":"27e27bc3-4988-4a28-ae83-a6129b9cd1ea","resolution":{"observed_at":"2026-08-07T04:53:32.132838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.09849","last_updated":"2020-08-22T14:34:55Z","snapshot_observed_at":"2026-08-09T07:00:04.580544Z","submitted_at":"2020-08-22T14:34:55Z","title":"Data augmentation techniques for the Video Question Answering task","version":1},"cited_work":{"arxiv_id":"2008.09849","doi":null,"metadata_source":"pith","pith_arxiv_id":"2008.09849","snapshot_observed_at":"2026-08-07T04:53:24.183094Z","title":"Data augmentation techniques for the Video Question Answering task","venue":"cs.CV","work_id":"576da932-c280-4997-b574-39386a397792","year":2020},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.448200Z"},"links":{"cited_paper":"/paper/2008.09849","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:7e74d8cbe7ee7de8d9249deacd3d846e4ab621d3155c921635553208dc49bc91","observation_id":"15879344-bc67-4959-8a19-dba8669c23e1","resolution":{"observed_at":"2026-08-07T04:53:24.311521Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04821","last_updated":"2023-12-05T20:40:59Z","snapshot_observed_at":"2026-07-06T14:28:40.789342Z","submitted_at":"2022-12-08T18:55:31Z","title":"PromptonomyViT: Multi-Task Prompt Learning Improves Video Transformers using Synthetic Scene Data","version":3},"cited_work":{"arxiv_id":"2212.04821","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.04821","snapshot_observed_at":"2026-08-07T04:53:23.925108Z","title":"PromptonomyViT: Multi-Task Prompt Learning Improves Video Transformers using Synthetic Scene Data","venue":"cs.CV","work_id":"d7fbed1e-7cd1-41a9-98fe-03fc5794d103","year":2022},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.646142Z"},"links":{"cited_paper":"/paper/2212.04821","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:3007c5f5f20376b3fb53aa8ee793f7fcf5811cb37a566930e97fe5598d22610d","observation_id":"07e75cc4-2f59-4594-9793-db5c4da4dbc9","resolution":{"observed_at":"2026-08-07T04:53:24.027766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:31.729688Z","title":"Liquid warping gan: A unified framework for human motion imitation, appearance transfer and novel view syn- thesis","venue":null,"work_id":"0a526347-6653-4816-bffb-36e2172457ee","year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.746986Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:40dc8480b4e6d1f050165a579499e4c0b98c310900c8606cbcfa573ad3182fb8","observation_id":"54910632-6705-469d-a650-2d7b75cb4ba8","resolution":{"observed_at":"2026-08-07T04:53:31.905763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:18.817233Z","title":"Smpl: A skinned multi- person linear model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.817233Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:ddbb8835ff9cc8d44eee0e917b64cc8c38411925097ba8cbf80758181ec80023","observation_id":"ba58e93e-bd89-4704-9ffb-84ec0229c869","resolution":{"observed_at":"2026-08-07T04:53:18.817233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:31.445270Z","title":"Self-supervised monocu- lar depth estimation on water scenes via specular reflection prior.Digital Signal Processing, 149:104496, 2024","venue":null,"work_id":"e937eef5-0e99-4eb3-9a2c-6446f9faed69","year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.915905Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:97598e814104ac358e2ad1ce8dae60418016cfacb8dc418c2e1c5c005fc31731","observation_id":"aefaa979-2136-419e-8309-0b3db097dd3c","resolution":{"observed_at":"2026-08-07T04:53:31.525194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:31.118354Z","title":"Pose guided person image genera- tion","venue":null,"work_id":"d338b57d-7fc8-4cec-9dee-d428aa5c4670","year":2017},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:18.955959Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:5e345de98c2f3dd627bd31da60252fd4f48b493e618a797ff47de52833b6af62","observation_id":"7d60ec4d-51e9-4ca3-bac8-ac4aa7ca594c","resolution":{"observed_at":"2026-08-07T04:53:31.278330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:30.919894Z","title":"Controllable person image syn- thesis with attribute-decomposed gan","venue":null,"work_id":"c5893657-fc1d-4174-b5bb-909b1ac182c6","year":2020},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.078731Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:c318071dc854240e0a47051b92178d49d9fc537ae0247739545d746dc45fc662","observation_id":"78bfe580-9d30-4ccd-b873-9357de54940f","resolution":{"observed_at":"2026-08-07T04:53:30.986649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:30.693052Z","title":"Ac- curate 3d hand pose estimation for whole-body 3d human mesh estimation, 2022","venue":null,"work_id":"cafb7838-2ac9-48f2-94ac-4ff64a002a8d","year":2022},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.148217Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:55201205372cee70431f6f139ec0b1bdbe4b2fac862de99e0c23f0c4011a12d7","observation_id":"046186a0-d53c-416c-8651-f39fb8a7c33a","resolution":{"observed_at":"2026-08-07T04:53:30.786519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:30.489525Z","title":"Expressive whole-body 3d gaussian avatar, 2024","venue":null,"work_id":"a0087180-70a7-4a64-bf36-1038993a39cc","year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.256477Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:67f853baf9b6994e88861831c27611c66b0248fc7e104c305b8fd18cd414fb48","observation_id":"9f47488c-dbd8-4d4c-8f05-426e73d9089b","resolution":{"observed_at":"2026-08-07T04:53:30.592166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:19.337630Z","title":"Pytorch: An im- perative style, high-performance deep learning library.Ad- vances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.337630Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:596266906bb663cda09efcf1938f6dcd945f9b3fad8433a16317fa3779a4c3ce","observation_id":"8ed114c7-e014-4b4b-b998-23438c7a81be","resolution":{"observed_at":"2026-08-07T04:53:19.337630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:30.225975Z","title":"Expressive body capture: 3D hands, face, and body from a single image","venue":null,"work_id":"b6c94658-2aed-41fa-b35a-fb6be2616ae6","year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.395716Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:64fea1062fd42b46425c7e32ab535c60c39b49cd1cbec6afed933a661e407353","observation_id":"e05cacf1-0373-4498-b32e-f5b7e4b6f606","resolution":{"observed_at":"2026-08-07T04:53:30.316906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:29.934519Z","title":null,"venue":null,"work_id":"203f608b-5efc-4a92-aa69-8bd352696b82","year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.466052Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:501d18ecf903075759ab72cbc8f92fd5175910fdaa81e741c3013ccad7ebe689","observation_id":"1ef29b67-bbb0-4b70-8d65-ef941d0afd61","resolution":{"observed_at":"2026-08-07T04:53:30.050318Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03638","last_updated":"2024-11-06T03:30:46Z","snapshot_observed_at":"2026-07-06T19:45:57.808548Z","submitted_at":"2024-11-06T03:30:46Z","title":"Adaptive Stereo Depth Estimation with Multi-Spectral Images Across All Lighting Conditions","version":1},"cited_work":{"arxiv_id":"2411.03638","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.03638","snapshot_observed_at":"2026-08-07T04:53:23.721623Z","title":"Adaptive Stereo Depth Estimation with Multi-Spectral Images Across All Lighting Conditions","venue":"cs.CV","work_id":"fbefc2c7-a9a6-4af1-aeaf-c10e210b0c3c","year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.573630Z"},"links":{"cited_paper":"/paper/2411.03638","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:9f256ea4057861fe3b2fdd3c670572e601af606a7e04504cc10ab76f4a6a443a","observation_id":"c9a13d72-09dd-43fd-967b-ae148bd5f7f7","resolution":{"observed_at":"2026-08-07T04:53:23.809914Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:29.748879Z","title":"Synthetic-to-real domain adaptation for action recognition: A dataset and baseline performances","venue":null,"work_id":"64558e72-bafb-4150-8a11-22e791c3f3f0","year":2023},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.631319Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:4c675f9ea6a58b11a488bf5cb3f43fb5f94d719cd9cfa71426c7dfcce27c943b","observation_id":"e86a0b66-7cf9-4a9f-b83a-47ca8b7ef8d4","resolution":{"observed_at":"2026-08-07T04:53:29.848743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.06777","last_updated":"2025-02-18T17:18:45Z","snapshot_observed_at":"2026-08-09T22:10:03.063185Z","submitted_at":"2022-02-14T14:58:05Z","title":"Multi-scale Attention Guided Pose Transfer","version":2},"cited_work":{"arxiv_id":"2202.06777","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.06777","snapshot_observed_at":"2026-08-07T04:53:23.441036Z","title":"Multi-scale Attention Guided Pose Transfer","venue":"cs.CV","work_id":"dce57ade-34b3-48af-9bc8-f7be432af49c","year":2022},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.687703Z"},"links":{"cited_paper":"/paper/2202.06777","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:82ad46f6c5043a6f78325b3c7a9ce4c384bf4573abcd3f5a7174e59f44f110da","observation_id":"b51cadf3-695a-4b66-95ba-c7a2552067a8","resolution":{"observed_at":"2026-08-07T04:53:23.581496Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:29.599563Z","title":"Doubletake: Geometry guided depth estimation","venue":null,"work_id":"d963348c-b9a3-4443-94b7-fa7845d45638","year":2025},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.756133Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:2b15008288c824c5cacce444c951d1d9c88256f999dfff4d1b11143cf4515719","observation_id":"28100d6a-8b91-4117-8a92-0a46ec6334d6","resolution":{"observed_at":"2026-08-07T04:53:29.656968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:29.400596Z","title":"SynthAct: Towards generalizable human action recognition based on synthetic data","venue":null,"work_id":"0afe2344-b78b-48f5-8187-94d871056642","year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.830166Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:6d12a0a0637da2699bb2e8ea66b96b05972b257ea9eabaab18ee1a3a97f1149d","observation_id":"5ad2142d-8307-4f46-b005-4872e1983950","resolution":{"observed_at":"2026-08-07T04:53:29.508871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:29.160151Z","title":"NTU RGB+D: A large scale dataset for 3d human activity analysis","venue":null,"work_id":"e410ef8a-9ad3-4f6f-8a90-1c3f49e184d0","year":2016},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.917590Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:c09369d1b16856e3bbc6d3bd8f035ec3f6a040dff38e1a7c82b227d98d3e109a","observation_id":"2095d12e-8f26-4083-9e18-f583f0b007a0","resolution":{"observed_at":"2026-08-07T04:53:29.300629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:28.907418Z","title":"Deformable gans for pose-based human image generation","venue":null,"work_id":"a3e2d73b-16b9-4fce-a6bd-db3446634be2","year":2018},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:19.976457Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:93d4bd6e0b1b1e88aedfd80ac586851556db54bb04cdee3d5f17065f24552d3f","observation_id":"0758f38e-3230-4db3-834f-434f7be656bc","resolution":{"observed_at":"2026-08-07T04:53:29.041994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-07T04:53:20.041116Z","title":"Ucf101: A dataset of 101 human actions classes from videos in the wild.ArXiv, abs/1212.0402, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.041116Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:cb3a54d19254f7204699c3ad75ba2a058f69cac68dbeca1be6dfcd5f9e36d36b","observation_id":"14d94331-b24e-4d80-9300-f96fd3ef221e","resolution":{"observed_at":"2026-08-07T04:53:20.041116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:28.639936Z","title":"Synthetic data generation: A hands-on guide in python, 2024","venue":null,"work_id":"f60d1b4c-8996-4cb3-b15a-c45fcadc3c0b","year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.130741Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:fc59d8994bb9a1968c9845c3de5c9e381a44e2bdfd644b677f9e3dd59b607321","observation_id":"ad96a035-0523-4bc7-8fe2-f9e29e92a5d5","resolution":{"observed_at":"2026-08-07T04:53:28.783131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:28.377596Z","title":"Videomae: Masked autoencoders are data-efficient learners for self-supervised video pre-training.Advances in neural information processing systems, 35:10078–10093, 2022","venue":null,"work_id":"3d61b026-e5e1-4bf3-836a-53946121a061","year":2022},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.186832Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:7fce410573959fe8810b78ccc0ed02b8344d8058acc2083e039361f21903908a","observation_id":"193274ff-4b36-4a66-a185-8ba1e7ce9f3c","resolution":{"observed_at":"2026-08-07T04:53:28.544041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:28.141146Z","title":"Synthetic humans for action recognition from un- seen viewpoints.International Journal of Computer Vision, 129(7):2264–2287, 2021","venue":null,"work_id":"dd57efbd-c086-4c56-839e-ea21127e554f","year":2021},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.270777Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:1cc4aad44d289eeaa397b2676c246dab39505f960f550b8ee97ace389ac47186","observation_id":"6cb50a43-0b14-4195-bafe-47c37f123ff2","resolution":{"observed_at":"2026-08-07T04:53:28.229294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00856","last_updated":"2021-11-02T03:02:33Z","snapshot_observed_at":"2026-07-06T12:04:06.076820Z","submitted_at":"2021-11-01T11:53:30Z","title":"Large-Scale Deep Learning Optimizations: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00856","snapshot_observed_at":"2026-08-07T04:53:20.356697Z","title":"Large-scale deep learning optimizations: A comprehensive survey.arXiv preprint arXiv:2111.00856, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.356697Z"},"links":{"cited_paper":"/paper/2111.00856","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:d9b81e109c4acd74980d758c4223f7e47f95e4b705196e0017c3ce943c6acd7b","observation_id":"a8705629-a2db-4191-ad28-ac4d97e1c1f4","resolution":{"observed_at":"2026-08-07T04:53:20.356697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04190","last_updated":"2024-03-07T03:38:44Z","snapshot_observed_at":"2026-07-06T17:40:45.750926Z","submitted_at":"2024-03-07T03:38:44Z","title":"Generative AI for Synthetic Data Generation: Methods, Challenges and the Future","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04190","snapshot_observed_at":"2026-08-07T04:53:20.493931Z","title":"Generative ai for synthetic data generation: Methods and applications.arXiv preprint arXiv:2403.04190, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.493931Z"},"links":{"cited_paper":"/paper/2403.04190","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:84e70566b2909c489cc095047c247330b920a8219c58d65b63c4b3632f2cc167","observation_id":"45262b81-68c7-4611-8a16-e524194a2c66","resolution":{"observed_at":"2026-08-07T04:53:20.493931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:20.648897Z","title":"Magicanimate: Temporally consistent human im- age animation using diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.648897Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:305f1f559251dd8ceae9e90209432139c856500b0fff68ad092fdec283ac6926","observation_id":"3870d04a-68e8-46e0-ac5e-00e2aa4d4399","resolution":{"observed_at":"2026-08-07T04:53:20.648897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:20.811889Z","title":"Depth any- thing v2, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.811889Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:f5e984ca1aa55d9e5496c4475297feecd40813ee51aabd727da7690db7a93de2","observation_id":"e39afa0a-7660-4c63-92c5-ab34c279277d","resolution":{"observed_at":"2026-08-07T04:53:20.811889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04790","last_updated":"2022-07-24T01:15:03Z","snapshot_observed_at":"2026-08-09T20:11:45.967011Z","submitted_at":"2022-06-09T23:04:52Z","title":"Learn2Augment: Learning to Composite Videos for Data Augmentation in Action Recognition","version":2},"cited_work":{"arxiv_id":"2206.04790","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.04790","snapshot_observed_at":"2026-08-07T04:53:23.091694Z","title":"Learn2Augment: Learning to Composite Videos for Data Augmentation in Action Recognition","venue":"cs.CV","work_id":"7fa848be-38f6-455b-8e98-290fe72ea8e0","year":2022},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:20.939523Z"},"links":{"cited_paper":"/paper/2206.04790","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:30b1b97caec320cd44d04ee91d7d8f075c886591ffaf7528c470e54308df4dc9","observation_id":"215fa646-1a50-4156-97aa-3ee59bcf0e08","resolution":{"observed_at":"2026-08-07T04:53:23.229798Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:27.905640Z","title":"Progressive pose attention transfer for person image generation","venue":null,"work_id":"debda128-33e4-48ca-948f-313c204ae220","year":2019},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.048316Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:bfdee33ea2a2089ff27fb29920b2444252f95e5ed89bcaf5a462d385cb13a3e8","observation_id":"6e251478-ce5e-4a1f-8305-bd49dc4516e6","resolution":{"observed_at":"2026-08-07T04:53:27.997647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14781","last_updated":"2024-06-01T08:27:23Z","snapshot_observed_at":"2026-07-06T17:48:41.389936Z","submitted_at":"2024-03-21T18:52:58Z","title":"Champ: Controllable and Consistent Human Image Animation with 3D Parametric Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14781","snapshot_observed_at":"2026-08-07T04:53:21.171337Z","title":"Champ: Controllable and consistent human image animation with 3d parametric guidance.arXiv preprint arXiv:2403.14781, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.171337Z"},"links":{"cited_paper":"/paper/2403.14781","citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:ad3b273e7cee5fe28cdc8b6011f126f9c8dfae842f099aea3a90c3af653c48b9","observation_id":"123f2de6-399d-4c99-bfb3-5d8cdd6ef1d9","resolution":{"observed_at":"2026-08-07T04:53:21.171337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:27.695795Z","title":null,"venue":null,"work_id":"56d9c1a2-771d-448a-b0ed-f5c734ba8b60","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.275316Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:ae653a40f919047c0cce67c1e28a4a3df8d87d58a07de54835e1295af58e2eb8","observation_id":"6677ac3c-5b66-4f47-ac24-e55ef1f7745d","resolution":{"observed_at":"2026-08-07T04:53:27.779717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:27.382013Z","title":null,"venue":null,"work_id":"98738d9f-ab8d-4439-a6ab-e7b05bf16a14","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.432906Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:dc466075c7c2e2359a0d15c39e1a4c1dbfb0bd3829f56ecf39f99b4ece0d1698","observation_id":"a8958da4-29ac-4563-942b-ef591607fcb7","resolution":{"observed_at":"2026-08-07T04:53:27.531378Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:27.166848Z","title":null,"venue":null,"work_id":"dc5384b1-7960-4076-8297-fa450beae2b9","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.539037Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:f30be143b88fda21cc62b4571a90559e0c1547c0d589dd33a808af297a57408f","observation_id":"944ac551-9b3e-4a43-8433-8460184f2f39","resolution":{"observed_at":"2026-08-07T04:53:27.282635Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:26.916108Z","title":"Importantly, the recording must meet the follow- ingcriteria: • Your whole body, head to feet, is visible in the video at all times","venue":null,"work_id":"d0f55d14-7fc7-4233-834d-f5cab07d0929","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.643159Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:233d60fd1601605863d931ed68e92154af186d48241a7cb1870223eb9c3fcaf5","observation_id":"a8105aa9-b3fb-4215-a401-dbef9c660515","resolution":{"observed_at":"2026-08-07T04:53:27.030409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:26.662340Z","title":"In particular, these subsets in- clude: Selected Action Classes: Toyota Smarthome","venue":null,"work_id":"076c95bd-424b-49a7-ae51-fe74e03eff2b","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.796496Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:dfaab0c585f27ab0e5b0d2dcabb287ca47824bfd93a46a258399bb8a1fbe3094","observation_id":"9bff57fc-ec94-4527-bfe4-0a067d98a501","resolution":{"observed_at":"2026-08-07T04:53:26.779442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:26.387107Z","title":null,"venue":null,"work_id":"fdf074cc-af88-4c6c-919d-c546afb9c346","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:21.918315Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:3e94f30c2277a0382a3f508c2c895c2b28408000949e6b147246f6526a096022","observation_id":"ae284ced-9fb8-45c5-963b-e65dd3589e0a","resolution":{"observed_at":"2026-08-07T04:53:26.519540Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:26.194439Z","title":null,"venue":null,"work_id":"023d24a2-71da-4041-842d-6c028c6c0b1f","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:22.049438Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:287c3183e8f99053be6b3c84c70200531fe3347066a1d44f33dfa20edf726be4","observation_id":"11340308-bfd3-42af-85bc-6c851d87b354","resolution":{"observed_at":"2026-08-07T04:53:26.281589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:25.986447Z","title":null,"venue":null,"work_id":"74dd4acf-73b2-419b-a7b3-93d9247c99b7","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:22.212634Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:34b9d1a261ea96020cba499b62ef2715c197eac481bdc015435f7945dd38a947","observation_id":"f353f64c-7b12-449e-ba51-856fae8df7ea","resolution":{"observed_at":"2026-08-07T04:53:26.097712Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:25.770733Z","title":null,"venue":null,"work_id":"bbfd6421-fb67-458d-9fe5-9b651fb5d78c","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:22.370248Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:57e74e6bde423bc207ef0de6bc3b0adc151597c55cc20b294745f944f9691e68","observation_id":"62671c16-0585-4093-ad01-bdcb38142d46","resolution":{"observed_at":"2026-08-07T04:53:25.861320Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:25.498687Z","title":null,"venue":null,"work_id":"7df84460-7eac-4d54-a74f-324efc9da05f","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:22.492572Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:8600b8376aa59eb42149b5c4b03d53b9cb141595598349ca47782af9540a1e73","observation_id":"bf136aca-2dd4-472b-9d42-b58421f53fe4","resolution":{"observed_at":"2026-08-07T04:53:25.628156Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:25.286467Z","title":null,"venue":null,"work_id":"a99deddb-4d20-48e1-901d-289ee82f1b49","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:22.662726Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:5b511202f980c49741898785d4fa840ecc648e8932598f0251345befbacce69f","observation_id":"5d39157b-e0dc-40de-802e-cdf641c64c96","resolution":{"observed_at":"2026-08-07T04:53:25.400568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:25.007632Z","title":"Our aim is to provide an intuition for the computational demands of this process and to explain the parameters we chose, which were largely constrained by our computing capacity","venue":null,"work_id":"ab3d7eb4-468b-4445-9b36-bb164cf6323c","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:22.775561Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:8120f37dc4c912a08cb6e8653d5381024f89e50cb682f55de88534fde369391f","observation_id":"ce778140-3aea-4b17-b346-c48668d372e8","resolution":{"observed_at":"2026-08-07T04:53:25.141005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:53:24.781985Z","title":null,"venue":null,"work_id":"dbee1dbe-f05f-477d-bca2-526591888336","year":null},"citing_paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:22.927707Z"},"links":{"citing_paper":"/paper/2506.09411"},"observation_digest":"sha256:de6824b73997f230927b21679715021a5eb5083481a8e317708c6ec0eb5593a7","observation_id":"a1f2e982-32b3-4275-8431-323d1a1a1c66","resolution":{"observed_at":"2026-08-07T04:53:24.871891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.09411","last_updated":"2025-06-11T05:52:39Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T16:26:11.700790Z","submitted_at":"2025-06-11T05:52:39Z","title":"Synthetic Human Action Video Data Generation with Pose Transfer"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":4,"unresolved":22,"verified_exact":6,"verified_fuzzy":34},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2506.09411."}