{"as_of":"2026-08-10T10:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:756e6aab80238290d8585193f0f2a24e29f750bb5b8c5f8445b686514d923a39","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:05:17.605587Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06590/citation-record","integrity":"/paper/2507.06590/integrity","json":"/paper/2507.06590/citation-record.json","paper":"/paper/2507.06590"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.755081Z","title":"Surface motion capture animation synthe- sis,","venue":null,"work_id":"21ee49e9-d953-4652-8f76-9b87abb41c7b","year":2018},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.030922Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:e29b82fc76f30ea19970f5aa211757073903434025a1c65b0ea98a6a7f5ca0cc","observation_id":"d7a20916-db73-465e-b05a-8f8024452bca","resolution":{"observed_at":"2026-08-06T19:05:18.758067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.745563Z","title":"Adaptive score alignment learning for continual perceptual quality assessment of 360-degree videos in virtual reality,","venue":null,"work_id":"11b61c31-f655-4ed2-821f-894b3a865221","year":2025},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.097349Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:fbe393b8e0b9db96b834ecf55c1bd4d22152c1dcf29a3281803a82b06dcebb2a","observation_id":"989ead4a-b701-49ca-a33f-0fec9379d60c","resolution":{"observed_at":"2026-08-06T19:05:18.748901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.736229Z","title":"Two-character motion analysis and synthesis,","venue":null,"work_id":"ac6b01f7-cc2d-49d5-b26c-4529d90cbf3f","year":2008},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.180649Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:f762f49906fa63b84026017e5e2e3833a8f385f93fed570d0f2ebd4b45e6002b","observation_id":"2db31901-9e63-4667-bfff-15b9784b8178","resolution":{"observed_at":"2026-08-06T19:05:18.739233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.726439Z","title":"Hierarchical graph convo- lutional networks for action quality assessment,","venue":null,"work_id":"32e21e69-3de0-4975-b363-4d77074da95a","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.272983Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:544aadbb908ab1c1ba0554b24cace94f81d0b9d8177516b36cfbd96d7b268d5e","observation_id":"bf35708c-4283-48c3-ae25-5c654fc382e3","resolution":{"observed_at":"2026-08-06T19:05:18.729957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.716882Z","title":"Combining recurrent neural networks and adversarial training for human motion synthesis and control,","venue":null,"work_id":"513a0e1e-37c3-4e85-8cfb-060756fe6404","year":2019},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.367394Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:06ddbd2513684a7c87c23c79296ea47b15ae8abd6b96880e6a8d23c9f0803f21","observation_id":"ba509069-8f57-4bbb-899e-a7ee71f88322","resolution":{"observed_at":"2026-08-06T19:05:18.720482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.706885Z","title":"Multi-task spatial- temporal graph auto-encoder for hand motion denoising,","venue":null,"work_id":"69a6be37-4d12-40c0-8cfc-24063c59d039","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.402658Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:97610511bb65aba20b2500c598f6797ce306e923781d9767cbda12f9bc1a6096","observation_id":"4a49d6cf-48ab-448e-ae36-6370bf421c07","resolution":{"observed_at":"2026-08-06T19:05:18.710887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.697649Z","title":"Temporally guided music-to-body-movement generation,","venue":null,"work_id":"b411bc0b-1d32-40e8-8171-d3a77e166d73","year":2020},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.494016Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:bae36cac797b2b48844ccacd4a648514fb19c8afd34d98ba84fc2fa8d11179a2","observation_id":"bfc4c8fa-c73c-477f-a3c2-8fb74499012e","resolution":{"observed_at":"2026-08-06T19:05:18.700778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.687827Z","title":"Ai choreographer: Music conditioned 3d dance generation with aist++,","venue":null,"work_id":"4ac5b5c0-0eaf-4e76-8f10-20c87b17b24d","year":2021},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.573804Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:3b82ea86e00674a5e584335f67cedf57d984601efcb57e6b504ac8274a1edca0","observation_id":"eda54066-0f6c-4ec9-ac90-9c4efc9b0a2b","resolution":{"observed_at":"2026-08-06T19:05:18.691613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.677881Z","title":"Self-supervised dance video synthesis conditioned on music,","venue":null,"work_id":"7086abeb-ca1f-46ae-98c9-f1596ae98128","year":2020},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.659462Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:0ae1ddbadbd91a4362dc9663cb0554c79da3a27f85fdad4ea92a80268d05f43a","observation_id":"12349d5a-7c6f-40c2-8fcc-d8d8d3583948","resolution":{"observed_at":"2026-08-06T19:05:18.681103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.667351Z","title":"Deepphase: Periodic autoencoders for learning motion phase manifolds,","venue":null,"work_id":"c47585d3-fa59-4171-9dcf-fb8409e04b73","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.745885Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:177c7d6eaf7ec75f79c8f3f22946ba7897fc5f63ea40fb68d8278a1d8554a608","observation_id":"9b121207-fa5a-440f-a0fa-9ea53d94c78a","resolution":{"observed_at":"2026-08-06T19:05:18.670930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.658015Z","title":"Edge: Editable dance generation from music,","venue":null,"work_id":"5549468a-c4b2-4fa7-bc9f-b52ea18b5816","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.818284Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:9f536f0ee423ed3ffa1b9fd67f8d1967ac051aa24b4bbdf7a018f60272d89bfb","observation_id":"f3e9f655-2f7e-40ab-baa3-e67580f2e3e9","resolution":{"observed_at":"2026-08-06T19:05:18.661127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.648838Z","title":"Rhythm is a dancer: Music-driven motion syn- thesis with global structure,","venue":null,"work_id":"66c5559f-de58-4223-b61c-bafb2daf8069","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.910346Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:65b93f52a840f8c44b8414a798a29417311d60a80f24a6923a5a867f2e26d573","observation_id":"d51e72a8-0353-4d66-9480-c3a54fbf1124","resolution":{"observed_at":"2026-08-06T19:05:18.652071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.638918Z","title":"Example-based automatic music-driven conventional dance motion synthesis,","venue":null,"work_id":"ee0b6503-307b-4213-a707-3359e73f315a","year":2011},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:11.966936Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:d0acaed111c19fe5c56be4a6962867670814d5546e1e50faf1edb663b729d663","observation_id":"c89d02d7-65b1-4496-8ac7-ec7f6c4891e8","resolution":{"observed_at":"2026-08-06T19:05:18.642128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.628814Z","title":"Action2motion: Conditioned generation of 3d human motions,","venue":null,"work_id":"68765936-64df-46ae-8e42-8ca4131292f8","year":2020},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.089034Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:ce681306e468025ad65745f38959ed59bb01668766e0f9978fbcca4e182393c5","observation_id":"3047e9d6-b12d-43ad-8837-de9a65d88c59","resolution":{"observed_at":"2026-08-06T19:05:18.632246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.619396Z","title":"Action-conditioned 3d human motion synthesis with transformer vae,","venue":null,"work_id":"ba795b1a-3838-4fa9-a99f-b4a0f4e01891","year":2021},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.215934Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:03c14ca3d263d2f5599f88e1eaf4eff621701b9f3bf35d664b796a922eb5d46c","observation_id":"6c5988ee-8ae5-40f7-80a5-e0c7c1ae6c54","resolution":{"observed_at":"2026-08-06T19:05:18.622630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.609103Z","title":"Implicit neural rep- resentations for variable length human motion generation,","venue":null,"work_id":"96771900-375d-49ff-abb4-55340b0d511e","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.338432Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:cae7934ad8c3f5c702373260c728f31cd980e591a362d84dff887344e206b400","observation_id":"905f2cac-4a89-472b-a7f8-f273c8c95987","resolution":{"observed_at":"2026-08-06T19:05:18.613066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.597540Z","title":"Action2video: Generating videos of human 3d actions,","venue":null,"work_id":"1b171298-58aa-43bd-a801-57ffc1f3547d","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.466698Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:80858fe6a78dca3db21109faac91a6bb21c9b94d45b00d0284c85b98e2d1eef4","observation_id":"2955bf3c-d855-497d-9985-66c2824ba61c","resolution":{"observed_at":"2026-08-06T19:05:18.600965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.585498Z","title":"Guided motion diffusion for controllable human motion synthesis,","venue":null,"work_id":"8605c7bc-276d-4cb0-a7eb-7bc1d04f5670","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.595553Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:ad7bc14080af3e0b6add415d145518caa9c76151fd1214eda74ad8edb221e7ca","observation_id":"b3f56236-41b6-4d95-b46f-9fc919e69a43","resolution":{"observed_at":"2026-08-06T19:05:18.589774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17135","last_updated":"2024-07-24T13:55:48Z","snapshot_observed_at":"2026-08-10T01:15:31.499395Z","submitted_at":"2023-11-28T18:54:16Z","title":"TLControl: Trajectory and Language Control for Human Motion Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17135","snapshot_observed_at":"2026-08-06T19:05:12.700317Z","title":"Tl- control: Trajectory and language control for human motion synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.700317Z"},"links":{"cited_paper":"/paper/2311.17135","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:afd0833caf34127e70c2bcc267c94b9dd7c58457f6ee55675825ea2aa4ac95f2","observation_id":"cfdfd965-ddf3-4213-857e-d1bbca967cef","resolution":{"observed_at":"2026-08-06T19:05:12.700317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01418","last_updated":"2023-08-30T04:41:10Z","snapshot_observed_at":"2026-08-04T22:38:03.106382Z","submitted_at":"2023-03-02T17:09:27Z","title":"Human Motion Diffusion as a Generative Prior","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01418","snapshot_observed_at":"2026-08-06T19:05:12.822597Z","title":"Human motion diffusion as a generative prior,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.822597Z"},"links":{"cited_paper":"/paper/2303.01418","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:b285a3f47e0e29b60169d059fe5e6fcdc74986c666332a0328ce4a6567ed0ca5","observation_id":"4a308fec-cf61-4d37-bb9e-b55a914adac6","resolution":{"observed_at":"2026-08-06T19:05:12.822597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.574202Z","title":"Generating diverse and natural 3d human motions from text,","venue":null,"work_id":"223d7c0a-8da7-4273-ae61-c15b36b7168d","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:12.976966Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:78450b13984ae6472ed893135d480fb884f4eb03290c8a927fb05b3add6ae206","observation_id":"7ddd2aa0-52c1-40a0-87e3-bbfb8ab27c33","resolution":{"observed_at":"2026-08-06T19:05:18.577862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.562756Z","title":"Temos: Generating diverse human motions from textual descriptions,","venue":null,"work_id":"23af4c7f-416d-4338-8adb-2638733c1828","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:13.129269Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:34ef8ff9962d60a0a86ed74753cb87cbaf9bdbca540008c2cb3850f46e39235f","observation_id":"459bfc4b-6787-4e80-83d5-14ace21c966f","resolution":{"observed_at":"2026-08-06T19:05:18.566466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.553060Z","title":"Human motion diffusion model,","venue":null,"work_id":"cb3ab87f-8b70-47d0-941d-b4ac95f14a62","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:13.312685Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:4cfd0a15c7be2eb62224d90a1e502f1110a412592d072777a01517a25af932e4","observation_id":"812fcb1b-e5ee-4816-8ace-b63c9271e1fa","resolution":{"observed_at":"2026-08-06T19:05:18.556409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.542296Z","title":"Executing your commands via motion diffusion in latent space,","venue":null,"work_id":"8e7ff511-1100-4e6d-9369-a9b0db2e1d10","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:13.487879Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:35705960f3e03ccaf3fab38debbc7ba8f2da2733c2fda2db98951148a6949f87","observation_id":"2ce66227-71d5-4717-b4c4-bc33b02dddf3","resolution":{"observed_at":"2026-08-06T19:05:18.546172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.530473Z","title":"Mo- tiondiffuse: Text-driven human motion generation with diffusion model,","venue":null,"work_id":"fbe196b2-6ba9-4999-883b-35cb9f55be86","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:13.663363Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:dd13f6f4dcd5a728e9a9235fdf80fe246d9c93e955338ff222ae045d4bc9242e","observation_id":"d9e15e84-6a23-463c-a334-519942a7f9d5","resolution":{"observed_at":"2026-08-06T19:05:18.534073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.520614Z","title":"A two-part transformer network for controllable motion synthesis,","venue":null,"work_id":"3cf28d25-94a7-4d69-b802-032006573120","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:13.861972Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:8f740fc2566cb10e036af37e22ba9d432b7318d04e1b3c10872b6387731aecea","observation_id":"03f0ff3b-83fd-4ea0-bad5-371e3b4b7870","resolution":{"observed_at":"2026-08-06T19:05:18.524141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.509857Z","title":"Generating animated videos of human activities from natural language descriptions,","venue":null,"work_id":"50e30bd2-3e28-4b90-9e19-1b636bfd6654","year":2018},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:14.064407Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:816290880c69c3b8392bc44307a0114edf1b9336a34eafe98e48d87272ffba90","observation_id":"79b3a158-ef91-4d24-b579-2de74e9cd714","resolution":{"observed_at":"2026-08-06T19:05:18.513074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.499314Z","title":"Language2pose: Natural language grounded pose forecasting,","venue":null,"work_id":"67ac9ab3-7aef-4d80-9330-e5d875f1e1d0","year":2019},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:14.312204Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:2b47f9228a4473c0c313732c5fee16792e2e6d537011826b1f58152a1867061b","observation_id":"81b94fb2-2fe7-4cc4-91ee-82947c68a9f5","resolution":{"observed_at":"2026-08-06T19:05:18.502831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.488247Z","title":"Synthesis of compositional animations from textual descriptions,","venue":null,"work_id":"85f76b53-4696-4120-b773-e155549ea32d","year":2021},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:14.529872Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:14f2123850e463e5bf12aa22ddf34f5971e10047fe64f8c000c7c4cb81e5616d","observation_id":"30d94ee8-48d9-4f6f-9f12-e56174e14ed0","resolution":{"observed_at":"2026-08-06T19:05:18.492278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.477458Z","title":"Text2gestures: A transformer-based network for generating emotive body gestures for virtual agents,","venue":null,"work_id":"203e04bf-9bce-4f44-aa88-b2500141c5f3","year":2021},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:14.667842Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:99ed45c837c90247131032086dffd666df74358ce73789e9a564bb792e9f2c0b","observation_id":"cffd4cc2-9f95-4c36-9894-85ce87ce5b29","resolution":{"observed_at":"2026-08-06T19:05:18.481263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.466792Z","title":"Tm2t: Stochastic and tokenized modeling for the reciprocal generation of 3d human motions and texts,","venue":null,"work_id":"04a3a868-5b9e-4c9e-a211-e61f5d42f454","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:14.757232Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:df84858b91fff72eb377fd72b6628b7f51de456a6058364bf0a36a414e571976","observation_id":"0a4fbdcd-8001-4a30-af6b-6f80629f6ef5","resolution":{"observed_at":"2026-08-06T19:05:18.470565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00063","last_updated":"2023-11-29T19:04:10Z","snapshot_observed_at":"2026-07-06T16:55:17.192399Z","submitted_at":"2023-11-29T19:04:10Z","title":"MoMask: Generative Masked Modeling of 3D Human Motions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00063","snapshot_observed_at":"2026-08-06T19:05:14.872481Z","title":"Momask: Generative masked modeling of 3d human motions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:14.872481Z"},"links":{"cited_paper":"/paper/2312.00063","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:6296c4bf223574fe1176c8b7e0044e7566f7b0f14648d8f20889da4bc69cbce1","observation_id":"5c8891ef-98e6-400a-9522-84f5a66999b2","resolution":{"observed_at":"2026-08-06T19:05:14.872481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.455337Z","title":"Generating human motion from textual descriptions with discrete representations,","venue":null,"work_id":"eb4ee896-c0ce-4007-9020-d8a48f79af01","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:14.957867Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:62f1c9ef7a7c58dc50e1346365f82e4af187ff6629bf2ae68c53b6695bd93664","observation_id":"0b83869b-b0c4-43f3-a883-65b1c71eb2dc","resolution":{"observed_at":"2026-08-06T19:05:18.459707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.444606Z","title":"Tm2d: Bimodality driven 3d dance generation via music-text integration,","venue":null,"work_id":"9d6e997c-01f1-4065-9549-86a179d1065b","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.014882Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:b3e4a531e42da5e7160bc4ad229cd2ba420b23704fb7a163d4ead8796873d5c3","observation_id":"00155982-36a2-4696-b483-99fba34f62cd","resolution":{"observed_at":"2026-08-06T19:05:18.448532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.432648Z","title":"Motiongpt: Human motion as a foreign language,","venue":null,"work_id":"445a6937-a865-4422-a0aa-28cc0d18ef69","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.102847Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:faec76f972955efd0307c560f59bc6292b8781f0cf4ad8570abbaa3c2e4cac62","observation_id":"aa26e5b6-907e-4434-b383-850aad09de10","resolution":{"observed_at":"2026-08-06T19:05:18.436418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.420757Z","title":"Fg-t2m: Fine- grained text-driven human motion generation via diffusion model,","venue":null,"work_id":"06d77a3a-b8a6-4d66-b14e-94e5c2960a37","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.201528Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:d2300e29c9344b35172145749c35bac0100a82905718fd41afcef50f7d3c1224","observation_id":"a53a58dd-722f-4265-a70e-63a46b52c6e4","resolution":{"observed_at":"2026-08-06T19:05:18.424329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.410682Z","title":"Human motion diffusion model,","venue":null,"work_id":"fdffd3a5-a7f8-41cc-889b-d210328e20fc","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.271245Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:2dedda123912bb41acd432fe67f2028c900feffd04c92d77515c81ee60085b2d","observation_id":"c32ee190-3a31-4fdb-be21-3cbf0f6f438f","resolution":{"observed_at":"2026-08-06T19:05:18.414309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.399852Z","title":"Flame: Free-form language-based motion synthesis&editing,","venue":null,"work_id":"dcd25c7a-4ceb-40d2-979a-f91c9d6354a6","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.382608Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:26e16785f6d7832217f3b8c51b127e71fe5f987966f1fe45d91f3378206bed8a","observation_id":"34013278-2e9d-4cc9-b670-b0e60c21d151","resolution":{"observed_at":"2026-08-06T19:05:18.403638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.343940Z","title":"Guess: Gradually enriching synthesis for text-driven human motion generation,","venue":null,"work_id":"5157787f-57a6-49d0-92bf-2c54a71ec7d7","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.466621Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:fda023c149f13bbce7158f4a3ec9efe3443662d4794d96c623a934891525ad2e","observation_id":"4d7f26d8-1651-4740-969d-ac6859a7ce55","resolution":{"observed_at":"2026-08-06T19:05:18.391969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01116","last_updated":"2023-04-03T16:29:00Z","snapshot_observed_at":"2026-07-06T15:11:32.429514Z","submitted_at":"2023-04-03T16:29:00Z","title":"ReMoDiffuse: Retrieval-Augmented Motion Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01116","snapshot_observed_at":"2026-08-06T19:05:15.554689Z","title":"Remodiffuse: Retrieval-augmented motion diffusion model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.554689Z"},"links":{"cited_paper":"/paper/2304.01116","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:a839166e95df1d5d6447aae84fe97476c866342a5388fc6805335b2345f97eba","observation_id":"8bc565f4-1bd0-4dd0-9820-45f703bfe01a","resolution":{"observed_at":"2026-08-06T19:05:15.554689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.103720Z","title":"The kit motion-language dataset,","venue":null,"work_id":"e01178f1-a479-4684-b3e9-974333d7a6b6","year":2016},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.665731Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:2959ac6a0333eef48bfddf77a4717eb493f8d53702522fd163bf2b86413a166f","observation_id":"845a39eb-a8a4-49dc-95f2-26ababc4d37a","resolution":{"observed_at":"2026-08-06T19:05:18.216750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:18.012793Z","title":"Attt2m: Text-driven hu- man motion generation with multi-perspective attention mechanism,","venue":null,"work_id":"d3c2869f-6d46-474d-87f4-eb1652e5f7f8","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.756167Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:e13d1b704d4cf3b734440f636abe566d9fb7747bfc1c76f6de3452c6c42a5083","observation_id":"c0a9ab5b-fc46-48df-8f14-d329907d9277","resolution":{"observed_at":"2026-08-06T19:05:18.090613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03596","last_updated":"2024-03-28T03:26:51Z","snapshot_observed_at":"2026-07-06T16:57:46.724781Z","submitted_at":"2023-12-06T16:35:59Z","title":"MMM: Generative Masked Motion Model","version":2},"cited_work":{"arxiv_id":"2312.03596","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.03596","snapshot_observed_at":"2026-08-06T19:05:17.712459Z","title":"MMM: Generative Masked Motion Model","venue":"cs.CV","work_id":"6a305628-7e5a-41d8-b3a6-c4a2c47f2782","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.847604Z"},"links":{"cited_paper":"/paper/2312.03596","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:85db0151a4e3313fbc0a35f4ca76c8e099596b4eccafc52d78ef60a3be253468","observation_id":"055f5fa3-5f19-4b89-a492-68e73ae5102a","resolution":{"observed_at":"2026-08-06T19:05:17.715917Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.977263Z","title":"Moconvq: Uni- fied physics-based motion control via scalable discrete representations,","venue":null,"work_id":"970587fb-1530-4bcc-9fb2-45627d643ea7","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:15.969431Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:8e73f8c57ddd37c84875e30b1df580d1aec8c82792c3ceb69c9db1c5cd9deb5d","observation_id":"a4e9c966-4bcd-4944-b874-7a483f1cdcbe","resolution":{"observed_at":"2026-08-06T19:05:17.984295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.963300Z","title":"Ase: Large- scale reusable adversarial skill embeddings for physically simulated characters,","venue":null,"work_id":"d8683346-7452-4062-a156-d573eec87bda","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.055440Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:7543caa88ad2e8a14d1102eb31250e7dbb1995e468413248de6b686b4301b4fd","observation_id":"b243e724-8277-4e80-93f9-753598e74f61","resolution":{"observed_at":"2026-08-06T19:05:17.967875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.951842Z","title":"Physdiff: Physics- guided human motion diffusion model,","venue":null,"work_id":"377656c8-b7a9-4d1b-a5ec-df9aeaca4d6b","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.121121Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:e5b17f4a8168e5b96450f915488c900b929a02149068eff38a1974dfd5c9697a","observation_id":"6d24086d-83a4-4ddf-bbcf-9c0a31518d10","resolution":{"observed_at":"2026-08-06T19:05:17.955358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.937904Z","title":"Posescript: Linking 3d human poses and natural language,","venue":null,"work_id":"57b2af83-a200-41c3-831e-90b18cd262eb","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.207010Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:e1c7bd422af77d7684e0065141ed30570321c623e233731013a46937407736d9","observation_id":"62d35948-5884-4b99-9db5-ac013c4f16ac","resolution":{"observed_at":"2026-08-06T19:05:17.943978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13900","last_updated":"2024-09-19T14:03:00Z","snapshot_observed_at":"2026-07-06T17:47:55.578224Z","submitted_at":"2024-03-20T18:11:10Z","title":"CoMo: Controllable Motion Generation through Language Guided Pose Code Editing","version":2},"cited_work":{"arxiv_id":"2403.13900","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.13900","snapshot_observed_at":"2026-08-06T19:05:17.698675Z","title":"CoMo: Controllable Motion Generation through Language Guided Pose Code Editing","venue":"cs.CV","work_id":"4d086da3-8478-40f2-badb-ae33738ff2cf","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.269616Z"},"links":{"cited_paper":"/paper/2403.13900","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:a852be92510d8decaf257d8d7c36f805262c07ac688b24c78a1e32dc9cd1bdc1","observation_id":"1d66729d-b5be-4962-b006-beb616118d49","resolution":{"observed_at":"2026-08-06T19:05:17.702272Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.922193Z","title":"Fg-t2m++: Llms-augmented fine-grained text driven human motion generation,","venue":null,"work_id":"10f3a0b1-e7b5-428c-bb0f-0840c3fbeef6","year":2025},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.347230Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:b3c89edc6aa1d8c785688e28899d7d20997f5f5ffb9599d127ce55fe84b45f75","observation_id":"1241cb61-694b-455c-82fd-f80a4eab5455","resolution":{"observed_at":"2026-08-06T19:05:17.928491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.909570Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":"4f17f785-8551-486d-9dc4-ecdae5952909","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.421532Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:437b100174f615ae3714c334d6c07325efd55c550e41aff9d3f6467b382afb59","observation_id":"56fbe260-2da6-4d82-8cf6-c244db4d3ba7","resolution":{"observed_at":"2026-08-06T19:05:17.914079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.898234Z","title":"Text-to-motion retrieval: Towards joint understanding of human motion data and natural language,","venue":null,"work_id":"1cde3d1e-5f6d-41a3-8748-d1664c7efc94","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.498594Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:82e6993d278306b2d6f2c3e308b845f58e49acfac804b1638dc9978b08a6a928","observation_id":"aefecad9-0e9f-42fb-ba65-deb36f6a3680","resolution":{"observed_at":"2026-08-06T19:05:17.903135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.883749Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"00bd4948-c50d-4978-9553-89108acd3704","year":2021},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.591242Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:eb852fe2961131e541663caabaf82288c11db861f4501733d5c0081a8ff07ed4","observation_id":"3baa55f0-78cb-4764-b955-e175319255f3","resolution":{"observed_at":"2026-08-06T19:05:17.889886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.869724Z","title":"Attention is all you need,","venue":null,"work_id":"ae64dd2f-6586-419c-b80b-7f41fd5743f5","year":2017},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.710754Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:0f587d32ecfdd38363d8d4b188d7702568c04e349a6947e4e8f6b383e5bc038a","observation_id":"ecdb8c73-efe0-4009-a52e-e80895690647","resolution":{"observed_at":"2026-08-06T19:05:17.873879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.857123Z","title":"TMR: Text-to-motion re- trieval using contrastive 3D human motion synthesis,","venue":null,"work_id":"a9d65e87-2406-413f-8729-970f6270246d","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.783339Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:bd623d66622d95dac1053ac3fb6401684df9e4f9ab4760cf1b0e7d45ef6e24af","observation_id":"428a3448-992a-4d3d-9319-d062f654bc37","resolution":{"observed_at":"2026-08-06T19:05:17.862185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.845392Z","title":"Fine-grained semantically aligned vision-language pre- training,","venue":null,"work_id":"a0ad1aff-8364-4c24-a120-e21211a01e00","year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.796067Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:8d28edaf9a936eafc050bb5088a96a1aeabb7ebd9b4c580a048bbad7b51478d7","observation_id":"d3f87205-782d-404c-8930-da7a0843bacc","resolution":{"observed_at":"2026-08-06T19:05:17.849199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.833537Z","title":"Random shap- ley forests: cooperative game-based random forests with consistency,","venue":null,"work_id":"576e0973-3ffa-4967-9238-54509d0093bd","year":2020},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.873276Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:7029d241de413a00ccf749c21b73420f84187f87578b26104d0e47dc52122aba","observation_id":"0042f53a-d7ec-4815-9d60-bf49c50a2c53","resolution":{"observed_at":"2026-08-06T19:05:17.836973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10049","last_updated":"2023-05-18T06:27:06Z","snapshot_observed_at":"2026-07-31T00:47:21.156357Z","submitted_at":"2023-05-17T08:42:53Z","title":"TG-VQA: Ternary Game of Video Question Answering","version":2},"cited_work":{"arxiv_id":"2305.10049","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.10049","snapshot_observed_at":"2026-08-06T19:05:17.684547Z","title":"TG-VQA: Ternary Game of Video Question Answering","venue":"cs.CV","work_id":"ef6978ae-4731-449c-bd9e-391d0f82f549","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:16.974524Z"},"links":{"cited_paper":"/paper/2305.10049","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:e82a0ab4638031c1dc52fc8e59d61e4d4d289bffef0fcc7adde2cba1ad920c69","observation_id":"f880c27c-27bd-4832-9f51-5ffb06b0122e","resolution":{"observed_at":"2026-08-06T19:05:17.688234Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.823647Z","title":"Weighted banzhaf power and inter- action indexes through weighted approximations of games,","venue":null,"work_id":"9d4a14f7-9129-457f-8460-95346c400f84","year":2011},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.084340Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:fd0c7e7265d40b877b4cf8862f969353a0023baa0c1901f8e5a583f2d5ec3ece","observation_id":"2a43ced9-e990-4c8c-bc27-4083c869b55f","resolution":{"observed_at":"2026-08-06T19:05:17.827384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.813380Z","title":"Video-text as game players: Hierarchical banzhaf interaction for cross- modal representation learning,","venue":null,"work_id":"e70b7eec-3380-4469-875b-595abbb3de49","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.209160Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:259838eb39b540ea45a5f0bde56138a4389c5bd08eac5016627577f6918a5734","observation_id":"ae19982a-ab71-498a-9aeb-6431fa57444b","resolution":{"observed_at":"2026-08-06T19:05:17.816932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.803422Z","title":"An axiomatic approach to the concept of interaction among players in cooperative games,","venue":null,"work_id":"79d0b582-c69d-4af8-94f3-5db0ff01f9e2","year":1999},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.363449Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:e9f686e55da319ed275fc85a8d0d53dcf19c836ce7871eb388560fbccd332c71","observation_id":"58dbcbc6-cc10-4f25-bf97-650d404c0aed","resolution":{"observed_at":"2026-08-06T19:05:17.806647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.793608Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":"ee749cfa-e9eb-42d6-816a-9812089bc048","year":2020},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.516014Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:b493b5635ffd25221d56a616b7b459946e88f137e5a3bfbc45e3162d7fdbd5d8","observation_id":"7573f23f-9cd8-4b31-a928-c4dcda7d8944","resolution":{"observed_at":"2026-08-06T19:05:17.797084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-06T19:05:17.587570Z","title":"Representation learning with contrastive predictive coding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.587570Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:42fc05a264f07c1533f15b21a1b940c352cf8c1489f25e40026259df9e904ccc","observation_id":"b185ea9e-390e-4ab8-9f77-09ffe117ec18","resolution":{"observed_at":"2026-08-06T19:05:17.587570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-06T19:05:17.591745Z","title":"Classifier-free diffusion guidance,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.591745Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:ddab0dd712a7177e856c111ce554fff860ab6afdfb6eb5e43c20cf8d06e25962","observation_id":"316c5d5d-1418-4c78-962a-65306ef9c8d5","resolution":{"observed_at":"2026-08-06T19:05:17.591745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.784064Z","title":"Efficient attention: Attention with linear complexities,","venue":null,"work_id":"700ee41b-f5ca-4b37-a84d-e0d3c7d2118c","year":2021},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.595479Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:602389e6ab1d0e2162645c429236788da7f391d2ad75b075886a71fdca4c64bb","observation_id":"c0a0af57-b7f5-478c-99b7-edf5c8dc5bc1","resolution":{"observed_at":"2026-08-06T19:05:17.787224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.774111Z","title":"Amass: Archive of motion capture as surface shapes,","venue":null,"work_id":"d831539d-de62-4f91-87a1-193c1a052889","year":2019},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.599083Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:d1c1ee71aeff2947b669470512d1f9d87122191017b544dd951585d888f850f2","observation_id":"14a29102-65e0-460b-9132-4c08196fd576","resolution":{"observed_at":"2026-08-06T19:05:17.777364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:17.763449Z","title":"Finemogen: Fine-grained spatio-temporal motion generation and editing,","venue":null,"work_id":"1542b7e6-ed2a-4632-acac-b875aa0db500","year":2024},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.602314Z"},"links":{"citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:a66d0f3f3430dd4d07078e5b6a5e2c7ee86bc8e01d22be42dbceec7a11a6ac94","observation_id":"56ec4982-1186-4300-bebd-055c22bf0d29","resolution":{"observed_at":"2026-08-06T19:05:17.767147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16468","last_updated":"2023-11-28T04:10:07Z","snapshot_observed_at":"2026-07-06T16:53:35.776613Z","submitted_at":"2023-11-28T04:10:07Z","title":"AvatarGPT: All-in-One Framework for Motion Understanding, Planning, Generation and Beyond","version":1},"cited_work":{"arxiv_id":"2311.16468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.16468","snapshot_observed_at":"2026-08-06T19:05:17.642636Z","title":"AvatarGPT: All-in-One Framework for Motion Understanding, Planning, Generation and Beyond","venue":"cs.CV","work_id":"3eecc231-47ea-4437-b402-7126f7797cc5","year":2023},"citing_paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:17.605587Z"},"links":{"cited_paper":"/paper/2311.16468","citing_paper":"/paper/2507.06590"},"observation_digest":"sha256:0bfc4fe2ad5a48205552bd8fe294ed05a7507fb45860097f864c8d73574d003e","observation_id":"ca5481eb-bacb-49ec-bf30-869238a627ac","resolution":{"observed_at":"2026-08-06T19:05:17.648713Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.06590","last_updated":"2025-07-09T06:51:36Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T01:15:55.610897Z","submitted_at":"2025-07-09T06:51:36Z","title":"MOST: Motion Diffusion Model for Rare Text via Temporal Clip Banzhaf Interaction"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":4,"verified_fuzzy":57},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2507.06590."}