{"as_of":"2026-08-16T21:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ed57f9c443ae15e3a5d64c31d3ce2336ef3749a7138a8364ebce2d458ebefcdc","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:20:00.434620Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.16310/citation-record","integrity":"/paper/2507.16310/integrity","json":"/paper/2507.16310/citation-record.json","paper":"/paper/2507.16310"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.997155Z","title":"Skeleton- aware networks for deep motion retargeting","venue":null,"work_id":"ca97b677-6f3d-40b9-a25d-7605681d079a","year":2020},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.035073Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:13d76cfc9326f6c65af37d2589fe74c8437acf2ca7d4b1662ec6eabc89984e16","observation_id":"bd3f0630-f9c5-47bc-a5dc-7011e145f12c","resolution":{"observed_at":"2026-08-06T15:20:02.002977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.05814","last_updated":"2022-10-15T21:18:49Z","snapshot_observed_at":"2026-08-16T17:35:30.763879Z","submitted_at":"2021-12-10T20:15:03Z","title":"Deep ViT Features as Dense Visual Descriptors","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.05814","snapshot_observed_at":"2026-08-06T15:20:00.044930Z","title":"Deep vit features as dense visual descriptors","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.044930Z"},"links":{"cited_paper":"/paper/2112.05814","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:cdb9033b41272ba2538c169d9cbafbe8be59a42272c21d61d99fdaece76b331b","observation_id":"bbb79a4f-d31c-4cea-b127-90f5b0070a05","resolution":{"observed_at":"2026-08-06T15:20:00.044930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-16T12:52:49.101262Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-06T15:20:00.053725Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.053725Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:5a29fce17d467d73cf009d4733027e86c6dc546647b5eb57d591acba8624cf3b","observation_id":"3765f2f8-c505-4dcc-b47a-c3e0e4fdc275","resolution":{"observed_at":"2026-08-06T15:20:00.053725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.976219Z","title":"Bookstein","venue":null,"work_id":"2accd161-b18a-4eb2-9386-3c540d8dc2d6","year":1989},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.060780Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:0d59fec7325797f950565188f0de55f32ba5a250947319f0116be27b967daa66","observation_id":"c5c0da4d-8b85-4af7-8ea5-0b2bc133f285","resolution":{"observed_at":"2026-08-06T15:20:01.982900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.952071Z","title":"Attend-and-excite: Attention-based se- mantic guidance for text-to-image diffusion models","venue":null,"work_id":"49892990-6a16-41af-b212-378eb03ac8e4","year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.068668Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:2aa1767247263f2c6212d908012eb3c40e5d6c3a4e8b10fed84d6df6aa333605","observation_id":"a3d4fbcb-e263-4b20-9db3-0319d63bc4dc","resolution":{"observed_at":"2026-08-06T15:20:01.961399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-13T01:39:12.659510Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-06T15:20:00.075763Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.075763Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:48ce8fca9a90fb0883fc6c178bacfbd701dc0eac3113428803cb9e7afeda8cb4","observation_id":"b4a1deb5-66ff-4975-b55a-97e8de553122","resolution":{"observed_at":"2026-08-06T15:20:00.075763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.932418Z","title":"Control-a-video: Controllable text-to-video generation with diffusion models","venue":null,"work_id":"32515abf-7dff-4ac2-93e7-41040b87a9ac","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.081517Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:7cb6cb4f2cb562bb7c1a159c5e7eceb9d37b519fcdd5929983f33089646249e6","observation_id":"f63ffb98-7d64-410c-bfbe-16d7100b6f21","resolution":{"observed_at":"2026-08-06T15:20:01.939107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.912375Z","title":"Online motion retar- getting","venue":null,"work_id":"3fe2a7ec-35ef-41fd-a66c-4cee844f4475","year":2000},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.087715Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:1dbccbb607778b58559cc9ff1e6e1006806865cd9afd4ade78276ff3b19695c0","observation_id":"80f40a3b-56f2-469f-8bd6-560cbae5b975","resolution":{"observed_at":"2026-08-06T15:20:01.917417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.888880Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":"370663ad-8e96-4dc4-9ec9-3e1a0ea669b0","year":2021},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.093650Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:5719127ee1c49246d572de12ad7c3460a9a4a99625a6834d8098bbb2672bb247","observation_id":"f3637c41-85f3-4dd9-93bb-68afc611a005","resolution":{"observed_at":"2026-08-06T15:20:01.896195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.866517Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":"4a89d569-44d4-4bf4-8512-be03ed9d077e","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.098732Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:3e3b5924590e0a970582cc282995df00cc654b4963e49e610c5df6cb293f64b5","observation_id":"dd51fc53-d32b-4b42-87d5-ee6c4997ed37","resolution":{"observed_at":"2026-08-06T15:20:01.874385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.847168Z","title":"Similarity distribution based member- ship inference attack on person re-identification","venue":null,"work_id":"8957ac21-ca89-41ad-b781-ec013c7e09bb","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.103868Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:f31035516f5db7432b7f680973d2a5993874e0191258ef312513f6bc24be36b5","observation_id":"7ca8d662-b9dc-47d9-833e-2f3802c6d00d","resolution":{"observed_at":"2026-08-06T15:20:01.852426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01414","last_updated":"2025-02-23T13:45:34Z","snapshot_observed_at":"2026-08-16T13:38:03.860850Z","submitted_at":"2024-07-01T16:05:18Z","title":"StyleShot: A Snapshot on Any Style","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01414","snapshot_observed_at":"2026-08-06T15:20:00.108959Z","title":"Styleshot: A snap- shot on any style","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.108959Z"},"links":{"cited_paper":"/paper/2407.01414","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:533a2f74eff7e73e10fb6b7638ced16efc16041066eddead12af40a417ead921","observation_id":"00315d3d-09bb-4bcb-aae7-ba39f5209432","resolution":{"observed_at":"2026-08-06T15:20:00.108959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00740","last_updated":"2025-03-02T05:35:57Z","snapshot_observed_at":"2026-08-16T12:53:55.350097Z","submitted_at":"2025-03-02T05:35:57Z","title":"FaceShot: Bring Any Character into Life","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00740","snapshot_observed_at":"2026-08-06T15:20:00.114303Z","title":"Faceshot: Bring any character into life","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.114303Z"},"links":{"cited_paper":"/paper/2503.00740","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:0ecb6a8e100a38ed649bd7838c0935fad32ea036320d942e966217e4e18b0ea4","observation_id":"6f5a178a-6c7f-4b63-83cd-686740e24cdf","resolution":{"observed_at":"2026-08-06T15:20:00.114303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.828596Z","title":"Retargetting motion to new characters","venue":null,"work_id":"f0835588-38ff-4123-8bb8-e34e0d59fbd6","year":1998},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.119910Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:be996f052b682cd15d5e379c007b41cffa0bb9c553032543b11d9bc32f9ab2ef","observation_id":"4b6d4663-bca3-42b1-a877-f42396614749","resolution":{"observed_at":"2026-08-06T15:20:01.833449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-12T14:50:50.360929Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-06T15:20:00.128643Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.128643Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:7c3df94bdb06702fb994a6ea5c14bb5b4a90231d587248c758b2d25d9fed53f2","observation_id":"ee2e4806-8d35-4198-8c92-8a8f9a00d846","resolution":{"observed_at":"2026-08-06T15:20:00.128643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.808257Z","title":"Sparsectrl: Adding sparse controls to text-to-video diffusion models","venue":null,"work_id":"c9adb38f-36a3-471d-84e2-f687b514f677","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.134905Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:e3e64154a9720695c3b1ca93ab23efc9698a69fc980549b2a8c1c7cd674a63e1","observation_id":"b64a74d0-bdc1-4f5d-bbe6-7621f4d9c3e7","resolution":{"observed_at":"2026-08-06T15:20:01.814918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.789144Z","title":"Photorealistic video generation with diffusion models","venue":null,"work_id":"715bd76a-6aea-4f9c-87c3-de1173412476","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.139194Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:d930c2bb2889d67f494c72d28e6ba0d1aacd5ab8e8b4ad7c8e84c41077c0c85f","observation_id":"125e4a45-7e06-40f3-9845-2973e86fd541","resolution":{"observed_at":"2026-08-06T15:20:01.794894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13221","last_updated":"2023-03-20T17:29:45Z","snapshot_observed_at":"2026-08-13T08:59:59.906684Z","submitted_at":"2022-11-23T18:58:39Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13221","snapshot_observed_at":"2026-08-06T15:20:00.144802Z","title":"Latent video diffusion models for high-fidelity long video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.144802Z"},"links":{"cited_paper":"/paper/2211.13221","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:fcd84e240acffc804f133aeb3c873e694368701fd0b083f5cedc944e992b1932","observation_id":"a272ca92-206b-4825-a0f6-816e15124bcc","resolution":{"observed_at":"2026-08-06T15:20:00.144802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.765510Z","title":"Unsupervised keypoints from pretrained diffusion models","venue":null,"work_id":"b3d9dffb-8169-4aca-84c3-78acffb974c1","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.150807Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:b8699a8eceeae6cd3f19a4b59191c213017b3cf6e5f25b56bd1f48ff6a2f3188","observation_id":"42ae0736-66b6-4bb6-af3d-7da4745ef585","resolution":{"observed_at":"2026-08-06T15:20:01.773003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:00.155759Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.155759Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:35ca6890b031778ff1f9cdaa3534b9173e6d90eb70384b9066259fdddfeefe6b","observation_id":"bccfff4d-bd01-4a5e-adea-5638e6143f3f","resolution":{"observed_at":"2026-08-06T15:20:00.155759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.731225Z","title":"Video dif- fusion models","venue":null,"work_id":"105298f6-a7c1-42a0-99a9-18f07b13d339","year":2022},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.160567Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:c8d848a51c21ad35ec8043049c436a2c576dfb8ae8cea4bb01e0076fd961c457","observation_id":"60bb89f4-9638-46d0-87dc-dceb46c55843","resolution":{"observed_at":"2026-08-06T15:20:01.736114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.712833Z","title":"Animate anyone: Consistent and controllable image- to-video synthesis for character animation","venue":null,"work_id":"85ec3866-067a-4fd2-8578-e58277e4e808","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.165029Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:dc5f9fb84ced282da3ab1b586df92bcbaa6d453adac552a67e491261a45d7ac6","observation_id":"0bf141dc-1044-4f58-8662-591fa87c33a6","resolution":{"observed_at":"2026-08-06T15:20:01.718859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.694772Z","title":"Pose-aware attention network for flexible mo- tion retargeting by body part","venue":null,"work_id":"85fe1143-8d69-4f52-a2bb-576498ea888e","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.170578Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:c627bc27c9cd06849f899cec2ee67a34ece903bd5b6a31622da6f6d6eb26fde7","observation_id":"75153607-6fe5-4e6c-a178-87eb711a6521","resolution":{"observed_at":"2026-08-06T15:20:01.700232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.677775Z","title":"Vmc: Video motion customization using temporal attention adap- tion for text-to-video diffusion models","venue":null,"work_id":"05a813f0-f4a8-44db-883d-83a72e1dba78","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.175383Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:c46bc8a0fea8842a7caced09b6c686cb9387f051b726d9c982d5fc67dc28d783","observation_id":"0612f6dc-78f7-4eec-8f1e-0c362d6ce645","resolution":{"observed_at":"2026-08-06T15:20:01.683105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.652895Z","title":"Text2performer: Text- driven human video generation","venue":null,"work_id":"bb1cca37-ee1d-4436-b6dd-85296a5de435","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.180158Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:6bc2937e771da8d34d069e0aa3084d5c13abaeab021185759f55d1ec79e5e9ee","observation_id":"5454983c-f25a-42d5-9a42-f5006acf298b","resolution":{"observed_at":"2026-08-06T15:20:01.658703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11831","last_updated":"2024-10-15T17:56:32Z","snapshot_observed_at":"2026-08-16T13:09:05.029047Z","submitted_at":"2024-10-15T17:56:32Z","title":"CoTracker3: Simpler and Better Point Tracking by Pseudo-Labelling Real Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11831","snapshot_observed_at":"2026-08-06T15:20:00.184671Z","title":"Co- tracker3: Simpler and better point tracking by pseudo- labelling real videos","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.184671Z"},"links":{"cited_paper":"/paper/2410.11831","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:7d0cd127ab49308c7af7bd64155d3bf8cb39e268a3a43c9e312cbd8058a27758","observation_id":"9b0387f6-38f9-4c9f-bffe-367900018389","resolution":{"observed_at":"2026-08-06T15:20:00.184671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.635309Z","title":"Text2video-zero: Text- to-image diffusion models are zero-shot video generators","venue":null,"work_id":"864cd593-12cb-46b0-8c6c-7fe5984a621f","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.190842Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:174954d248ee5e7782db739e1c1a7e2cef86f2e4253c2af115a709fae941723a","observation_id":"96ce2440-c0df-4aa0-853b-6d4e78e0f70d","resolution":{"observed_at":"2026-08-06T15:20:01.641074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.615856Z","title":"Berg, Wan-Yen Lo, Piotr Doll ´ar, and Ross B","venue":null,"work_id":"fcac5500-6a24-4f8e-940c-bd17902aa772","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.195923Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:c9810c37bf26cb19a2163fc5ae9cd9c93a5c09617c1cf6fe5e99a03aa3f8bb73","observation_id":"a5c0396c-d7f8-4478-a3c4-3818c23794b4","resolution":{"observed_at":"2026-08-06T15:20:01.620798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.597381Z","title":"Hunyuanvideo: A systematic framework for large video generative models, 2025","venue":null,"work_id":"e3509489-f2e9-458e-8528-28b8965c6d0c","year":2025},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.200418Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:8858d9eb4fce8f3ba20863a7d42c38386cf5f7dbaf8375035a51fe8cd9b159d4","observation_id":"87c6b038-176d-42d8-9319-be28e8131f70","resolution":{"observed_at":"2026-08-06T15:20:01.603380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.578431Z","title":"A hierarchical approach to interactive motion editing for human-like figures","venue":null,"work_id":"d74012c1-95f6-4226-99ea-6519157dcd6c","year":1999},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.205535Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:d88884b8ad0fc563ba90928f635ab0e7bc61d0056a8417c94d5eec551e46406b","observation_id":"17a0df18-f548-4ba2-b91a-164b2b4563b8","resolution":{"observed_at":"2026-08-06T15:20:01.583696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10836","last_updated":"2024-11-16T16:36:49Z","snapshot_observed_at":"2026-08-16T04:13:56.232586Z","submitted_at":"2024-11-16T16:36:49Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","version":1},"cited_work":{"arxiv_id":"2411.10836","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10836","snapshot_observed_at":"2026-08-06T15:20:00.775292Z","title":"AnimateAnything: Consistent and Controllable Animation for Video Generation","venue":"cs.CV","work_id":"02f416cb-d24f-44ad-b8b4-7ab1e8b84f01","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.210090Z"},"links":{"cited_paper":"/paper/2411.10836","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:696926af368aeca7032f2065784713a9f76422d19aad17fe5a93f7ff8322547d","observation_id":"1ca179f3-3f28-4ced-86d1-326e20dfe177","resolution":{"observed_at":"2026-08-06T15:20:00.783634Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00398","last_updated":"2023-09-07T08:11:01Z","snapshot_observed_at":"2026-08-16T15:04:02.343598Z","submitted_at":"2023-09-01T11:14:43Z","title":"VideoGen: A Reference-Guided Latent Diffusion Approach for High Definition Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00398","snapshot_observed_at":"2026-08-06T15:20:00.215127Z","title":"Videogen: A reference-guided latent diffusion ap- proach for high definition text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.215127Z"},"links":{"cited_paper":"/paper/2309.00398","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:cdb176bbb282080618b104a03b927549279bf2e9b6e2fcafbb7809832e1f17f9","observation_id":"bc71c382-163c-4713-8504-8f6343960edc","resolution":{"observed_at":"2026-08-06T15:20:00.215127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.562720Z","title":"Pmnet: Learning of disentangled pose and movement for unsuper- vised motion retargeting","venue":null,"work_id":"3e498628-8cc1-403a-a71f-05f07ad84dde","year":2019},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.220568Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:51e7b90e0c780eb6b02d0c824f6a74f824e1f858b0468ec216e54829b694683b","observation_id":"47e74b41-5ecd-4705-bc4d-1d99b272204d","resolution":{"observed_at":"2026-08-06T15:20:01.567353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05338","last_updated":"2024-10-22T04:22:16Z","snapshot_observed_at":"2026-08-16T13:44:59.124353Z","submitted_at":"2024-06-08T03:44:25Z","title":"MotionClone: Training-Free Motion Cloning for Controllable Video Generation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05338","snapshot_observed_at":"2026-08-06T15:20:00.225551Z","title":"Motionclone: Training-free motion cloning for controllable video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.225551Z"},"links":{"cited_paper":"/paper/2406.05338","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:5e673bcfa454b51521c66665060971d63bd3f32d398d22f74e6c897cf2c61972","observation_id":"9816a2a6-1b21-48f5-9a73-1213c3fb9f89","resolution":{"observed_at":"2026-08-06T15:20:00.225551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.542723Z","title":"Diffusion hyperfeatures: Search- ing through time and space for semantic correspondence","venue":null,"work_id":"7de08747-f7c3-43a0-a803-4e758f0f906e","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.230529Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:0fec06714d8cb6c04971a7590a048614dafb323c5368b15cfd355444c64cf986","observation_id":"cd2ce4a4-5a68-47aa-ac2b-562f7212e5a8","resolution":{"observed_at":"2026-08-06T15:20:01.547532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-13T10:28:06.516901Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-08-06T15:20:00.234807Z","title":"Latte: Latent diffusion transformer for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.234807Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:555972381616badbf8ff9f0e65e6486596bc1ba0ab5687a609757c157643a946","observation_id":"4640302b-5adb-4309-aa6a-1f0a89b6f369","resolution":{"observed_at":"2026-08-06T15:20:00.234807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.527161Z","title":"Follow your pose: Pose- guided text-to-video generation using pose-free videos","venue":null,"work_id":"3f2c295e-170f-4d85-9d89-99d855fb8b54","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.239489Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:a4395dd0e14d531579ba0840a1e4be5e07735b2ab61c312065da05f74feb0bce","observation_id":"099c95a2-c7c7-42a2-8971-61788b74dde9","resolution":{"observed_at":"2026-08-06T15:20:01.532016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.509545Z","title":"Follow-your-emoji: Fine-controllable and expressive freestyle portrait animation","venue":null,"work_id":"a8b0e5a0-5e98-49f3-8d65-73385ddd9bc7","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.243968Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:efc45ffd3d02da22a0d4c0009586fa62a59b346819dca181a9a0c7e2c33af0dc","observation_id":"3661260e-c930-43ed-bd48-925674816eeb","resolution":{"observed_at":"2026-08-06T15:20:01.515681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.489625Z","title":"Principal components analysis (pca)","venue":null,"work_id":"bacec1ab-bfc0-4d3c-bc28-d133d16050ea","year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.248448Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:bf420909a75df8ded27ec3a59d1064d2fd10d180ac043ae9f4c8c1af28f90ec1","observation_id":"f7213836-b34b-4162-aab4-2e59bbcd2397","resolution":{"observed_at":"2026-08-06T15:20:01.494785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.467785Z","title":"Conform: Contrast is all you need for high- fidelity text-to-image diffusion models","venue":null,"work_id":"d85db258-1b27-4c06-82c9-6befb88fbcea","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.253323Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:b69feb406fb2717a66298dfbb5beddeed06e4ea81debedeb12a62098edc60d01","observation_id":"dd6324d7-a7be-4fca-8e6e-2ac9249d92a5","resolution":{"observed_at":"2026-08-06T15:20:01.473280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05275","last_updated":"2024-12-06T18:59:12Z","snapshot_observed_at":"2026-08-16T13:00:27.131028Z","submitted_at":"2024-12-06T18:59:12Z","title":"MotionFlow: Attention-Driven Motion Transfer in Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05275","snapshot_observed_at":"2026-08-06T15:20:00.258863Z","title":"Motionflow: Attention-driven mo- tion transfer in video diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.258863Z"},"links":{"cited_paper":"/paper/2412.05275","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:73225522e46e9be51c0f1559e121bd40737ff3f336643d19056c8ad2300e3961","observation_id":"b42af1ad-ff3d-4459-a102-248ac4e33cf5","resolution":{"observed_at":"2026-08-06T15:20:00.258863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-06T15:20:00.263264Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models.arXiv preprint arXiv:2112.10741, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.263264Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:5bf4cc43bb5ecfc50cfcff421e260b1c2a5fa857a10384b9e35ca6bbc18dbbf7","observation_id":"03cc3d6e-efe7-44d5-9bff-29628e98aa63","resolution":{"observed_at":"2026-08-06T15:20:00.263264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.452536Z","title":"Mofa-video: Controllable image animation via generative motion field adaptions in frozen image-to-video diffusion model","venue":null,"work_id":"80c026bf-6ffe-40cc-83b7-cd0856dbe068","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.268132Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:999632f30a1114dff3d9009665907a06e9a02a039bf59d8788d34bd86afcafa0","observation_id":"1c6961a8-c10c-4728-bd38-1336bc6dc61d","resolution":{"observed_at":"2026-08-06T15:20:01.457454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T15:20:00.272267Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.272267Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:fb545282a615ff3152dfc12bbf654ab815806e359d28b21cd511774367767df0","observation_id":"9a1dda97-1d9c-47ed-991a-913af5de72b4","resolution":{"observed_at":"2026-08-06T15:20:00.272267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.436628Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"5531e708-7b41-4eae-b8ec-61c98f9161e3","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.277874Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:ce9652bbe4e9f431a112a1f8cce0c652f868de0556182270d11330cf45444fb8","observation_id":"7cc60a65-1226-4f93-883f-3feb91fdba2f","resolution":{"observed_at":"2026-08-06T15:20:01.441870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.417670Z","title":"The 2017 davis challenge on video object segmentation, 2018","venue":null,"work_id":"0abd287b-b8f9-4957-836b-6eb9610e7e64","year":2017},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.282677Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:4ed304f4b4327f19476f05501739681fa6c36c80e3f10192f41c10e04dac3d3d","observation_id":"8f647a4c-a3a4-4448-868a-afd755abeb86","resolution":{"observed_at":"2026-08-06T15:20:01.423627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.401022Z","title":null,"venue":null,"work_id":"9fab07b4-538d-4a8a-93c1-33429fafccf9","year":1999},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.295138Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:26bd866340b99ad32ab134ba15cf0312dfda6470e40ac75c3c2f35118ff37917","observation_id":"7b9eba82-639f-40b9-87b5-a861375515b4","resolution":{"observed_at":"2026-08-06T15:20:01.406644Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-06T15:20:00.299556Z","title":"Hierarchical text-conditional image gen- eration with clip latents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.299556Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:97f00ba55fe0c45765d50402ef75b33785c8c5392397e79931db76e7601a8487","observation_id":"85979e80-d5cc-47c2-b97d-db3d460e1576","resolution":{"observed_at":"2026-08-06T15:20:00.299556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.384464Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"31d54571-8921-4476-954f-502c7661381d","year":2022},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.304671Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:26cf4df8e49579523359567fe97d8455debabc294b1791328f304b6d721048ab","observation_id":"9a6cc2b0-8f54-4539-b099-67a35a830c05","resolution":{"observed_at":"2026-08-06T15:20:01.389241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.368075Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":"da295239-43a2-427f-979c-3ada1001ab5a","year":2015},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.309357Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:3e7fe9ffc6baff66dfa4e2a4572ee98895da3d9f0140c4c949b181a18869418f","observation_id":"631255fa-ae46-4b7e-af9d-e6dc394ddcf1","resolution":{"observed_at":"2026-08-06T15:20:01.372654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-06T15:20:00.313940Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.313940Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:4ff514776092ed281752686907fc1930ca47b41e549c8e95c19a1e72676817d8","observation_id":"fd5cf308-4131-4d5f-a5cb-b4cc5f1ea67b","resolution":{"observed_at":"2026-08-06T15:20:00.313940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-06T15:20:00.318893Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.318893Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:f929d9c99a69fc132bf7c85460acc601ad20fdd900dc690317b9f213061c04cb","observation_id":"6a2a90a0-5e7a-457a-a952-537bba1b62ae","resolution":{"observed_at":"2026-08-06T15:20:00.318893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.352869Z","title":"Emergent correspondence from image diffusion","venue":null,"work_id":"393d4833-56e2-4a7e-839f-2dcfcfdf894d","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.324418Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:00a51b71a73aa4b38c1d88a86c344f8388f431d7f708d19ac94209445384639f","observation_id":"1a274f71-a3d8-4550-a794-3dea28f4819d","resolution":{"observed_at":"2026-08-06T15:20:01.357396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.337549Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":"ce341182-f77a-4b9e-9058-b36aa7785b64","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.329518Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:0628a5d5d2c77d612342ee4a82d9425175c095c76e09cd4bced2993df710cc24","observation_id":"8d885f95-8c5b-4a96-a2fd-858d1475a3f9","resolution":{"observed_at":"2026-08-06T15:20:01.342158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.322870Z","title":"Neural kinematic networks for unsupervised motion retargetting","venue":null,"work_id":"ab6e05fb-bf0a-4acf-8d99-11251a01dd63","year":2018},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.334398Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:c2f270c5a6d3aedfd34f4facb29d8c34f3f26fe909f2f99a91a9c52b6dd72943","observation_id":"213f3258-3277-4e87-bb91-73d84b9355ec","resolution":{"observed_at":"2026-08-06T15:20:01.327598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.305943Z","title":"Contact-aware retargeting of skinned motion","venue":null,"work_id":"e310aba9-e2be-4b21-92f7-aab9e41eb3bc","year":2021},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.339495Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:c6f44fd86e106181f128dde0d36366613141135553535c362c9d06c44ea4a8b7","observation_id":"e7898b8e-f378-44a1-8952-968939d21c61","resolution":{"observed_at":"2026-08-06T15:20:01.311650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20193","last_updated":"2024-10-16T18:35:31Z","snapshot_observed_at":"2026-08-16T14:05:11.646157Z","submitted_at":"2024-03-29T14:14:22Z","title":"Motion Inversion for Video Customization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20193","snapshot_observed_at":"2026-08-06T15:20:00.344605Z","title":"Motion inversion for video customization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.344605Z"},"links":{"cited_paper":"/paper/2403.20193","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:64c1e11f110c1f5c5653245d1232eb022e8d1cc96e0327973cf9e54f547aae8d","observation_id":"d655b8ec-0be4-4d28-9db3-aec63df831f1","resolution":{"observed_at":"2026-08-06T15:20:00.344605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.288943Z","title":"Videocomposer: Compositional video synthesis with motion controllability","venue":null,"work_id":"1d582827-effe-488f-be6d-9a04baabf748","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.350372Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:be1b888916caf23cb74f79b99ff934f09dd17e7884c51a4bb7287386ed4a0f58","observation_id":"ce151277-351e-42b2-8c4a-feebeb2eb51b","resolution":{"observed_at":"2026-08-06T15:20:01.293816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.271668Z","title":"Lavie: High-quality video generation with cascaded latent diffusion models","venue":null,"work_id":"ec695c40-f72d-4b0b-b8e5-08618a12a903","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.355033Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:954cee4bc3827ffb92335d8867e448548c20e52b4cbac99aea5706bf51b80edd","observation_id":"b97df926-1564-4b93-b5ec-94fa936f9446","resolution":{"observed_at":"2026-08-06T15:20:01.277103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.254481Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":"9cb0d681-8957-4440-b04e-680e39847ec7","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.359626Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:cb4fa35532c151b34123a0ded77660ef5a7deab4c57b2621c9aa4b7a3a948d7c","observation_id":"9467d295-d430-46ac-8a13-a55028aea53c","resolution":{"observed_at":"2026-08-06T15:20:01.259539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.235510Z","title":"Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation","venue":null,"work_id":"ffc642fe-2a96-459f-a5f4-cb1ac25ab772","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.364434Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:b43aed0942ff15e1de58ce5d4628005ad7098d44101dc06b7832b69a3df4a78e","observation_id":"9b676962-85c2-4552-9d86-09929ab9099e","resolution":{"observed_at":"2026-08-06T15:20:01.242149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.162432Z","title":"Make-your-video: Cus- tomized video generation using textual and structural guid- ance","venue":null,"work_id":"0ce53d07-d1cd-41fd-9405-4be39a74f179","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.369118Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:899669dc1aa3bedc901fad63d42a7425c337751c157ed7c49c413724e58f903f","observation_id":"41bb9991-77dd-455c-b77a-0f6333293ae6","resolution":{"observed_at":"2026-08-06T15:20:01.182494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.102501Z","title":"Dynamicrafter: Animating open-domain images with video diffusion priors","venue":null,"work_id":"13dbbbda-1e7c-40d5-accc-a05ad72e927d","year":null},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.373675Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:ade9f790fc7461ac77b0ecfafc6070ae4518cec97d5ae3437fac3dc1882589e3","observation_id":"acef2303-f9b1-4659-8ac8-f676140604c9","resolution":{"observed_at":"2026-08-06T15:20:01.122156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.054183Z","title":"X- pose: Detecting any keypoints","venue":null,"work_id":"46279538-eba3-4c19-8055-d3135fe55789","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.378006Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:ed6558a0e6d18a83fd5b703559a5a8be0f228a953cbcc783636dea2a1fc2915f","observation_id":"c8dbdace-9513-4002-9b8e-61885c557148","resolution":{"observed_at":"2026-08-06T15:20:01.077922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-08-15T19:52:28.153954Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-06T15:20:00.386351Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.386351Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:1064b0e50696723fcc4e80fac6612c06e8f19fd29f29c756df0f0493e16b1a58","observation_id":"5e49d73f-48d0-4858-80f9-fcf86dfda42d","resolution":{"observed_at":"2026-08-06T15:20:00.386351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08089","last_updated":"2023-08-16T01:43:41Z","snapshot_observed_at":"2026-07-06T16:06:38.424057Z","submitted_at":"2023-08-16T01:43:41Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08089","snapshot_observed_at":"2026-08-06T15:20:00.390737Z","title":"Dragnuwa: Fine-grained control in video generation by integrating text, image, and trajectory","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.390737Z"},"links":{"cited_paper":"/paper/2308.08089","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:65d4cd0b5172b1e51591bcedc69380b52c948039b5aeee4f7fa61093a1c53bb9","observation_id":"a58c4096-0e3f-4d9b-b39d-ec4be06ecf6b","resolution":{"observed_at":"2026-08-06T15:20:00.390737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12346","last_updated":"2023-03-22T07:10:09Z","snapshot_observed_at":"2026-08-16T15:46:20.217004Z","submitted_at":"2023-03-22T07:10:09Z","title":"NUWA-XL: Diffusion over Diffusion for eXtremely Long Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12346","snapshot_observed_at":"2026-08-06T15:20:00.395492Z","title":"Nuwa-xl: Diffusion over diffusion for extremely long video generation.arXiv preprint arXiv:2303.12346, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.395492Z"},"links":{"cited_paper":"/paper/2303.12346","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:1e8b3f4bf540d2edd261416b443b4155cd583f33ce68406425389ba4327d71a1","observation_id":"7c602629-254a-4976-9277-a33ee6582be8","resolution":{"observed_at":"2026-08-06T15:20:00.395492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.033570Z","title":"Show-1: Marrying pixel and latent diffusion models for text-to-video generation","venue":null,"work_id":"6dc53674-019f-42d0-b228-62b01052f6ac","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.400011Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:8c1bbaccda5fd1480a7cfd33bc6bb7c8d2dfc2cd8b7586812476716808470832","observation_id":"101463d0-eacb-46e8-ab6a-3bf5a23cc740","resolution":{"observed_at":"2026-08-06T15:20:01.039251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:01.014448Z","title":"A tale of two features: Stable diffusion complements dino for zero-shot semantic correspondence","venue":null,"work_id":"c1d6af71-540a-48c3-af6e-f6554ee4fc89","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.404725Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:535c198db4f365a0f297c7b64d5b2f47ce36b93ca5775b8a5f2e7ee34a300dac","observation_id":"5f1597f4-8910-4b28-8a07-3750998dc4b8","resolution":{"observed_at":"2026-08-06T15:20:01.019928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:00.995020Z","title":"Skinned motion retargeting with residual per- ception of motion semantics & geometry","venue":null,"work_id":"1b6415dd-d779-4e0c-9bdf-ca1005650299","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.409011Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:4941c9d55991c668ddfd09a5bb5644f058304a5279279bfb01ff9a1d143d1bec","observation_id":"0452a693-10c4-4298-9558-92290baf9957","resolution":{"observed_at":"2026-08-06T15:20:01.000237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:00.973746Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":"21526058-01eb-409b-8878-504c2b4e6107","year":2023},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.413219Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:7e132688b576174e19fdc0b2beb00357718c58121e982ac4e2f965e946ed395a","observation_id":"4deeb550-89bf-472f-b7f1-74a6d09e75e8","resolution":{"observed_at":"2026-08-06T15:20:00.980701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07563","last_updated":"2025-01-13T18:53:08Z","snapshot_observed_at":"2026-08-15T10:37:02.636043Z","submitted_at":"2025-01-13T18:53:08Z","title":"Training-Free Motion-Guided Video Generation with Enhanced Temporal Consistency Using Motion Consistency Loss","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07563","snapshot_observed_at":"2026-08-06T15:20:00.418690Z","title":"Training-free motion-guided video generation with en- hanced temporal consistency using motion consistency loss","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.418690Z"},"links":{"cited_paper":"/paper/2501.07563","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:145802bbf76cc093d3193921c0dc2d16aaeb30777ca4076ef1cacd053c4036e6","observation_id":"19751861-2879-4d50-8411-6926c5b41537","resolution":{"observed_at":"2026-08-06T15:20:00.418690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:00.952980Z","title":"Motiondirector: Motion customization of text-to-video diffusion models","venue":null,"work_id":"88cb829d-cccb-4f75-b8ce-9cff146c71db","year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.423617Z"},"links":{"citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:e8a651b786e5255f78171914b75df76479c7d00f25cc20276c08a661d2c5297a","observation_id":"8304b2a7-a721-49fd-933c-63046789d9be","resolution":{"observed_at":"2026-08-06T15:20:00.960213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-06T15:20:00.429235Z","title":"Open-sora: Democratizing efficient video production for all","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.429235Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:e9cdd3f82251366bd4f30f07d338b158dd2ee129078832f2e814b8234c10083e","observation_id":"5e45d62c-902a-46f5-bd3f-3e36d91c1a4b","resolution":{"observed_at":"2026-08-06T15:20:00.429235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11018","last_updated":"2023-05-11T11:23:03Z","snapshot_observed_at":"2026-08-16T05:49:16.026825Z","submitted_at":"2022-11-20T16:40:31Z","title":"MagicVideo: Efficient Video Generation With Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11018","snapshot_observed_at":"2026-08-06T15:20:00.434620Z","title":"Magicvideo: Efficient video generation with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:00.434620Z"},"links":{"cited_paper":"/paper/2211.11018","citing_paper":"/paper/2507.16310"},"observation_digest":"sha256:25fb876d5bab2cbd7177e3f22b141e73ce9b0c29dd2b5c4ef4a77d24c3a62c75","observation_id":"2f856dd9-7dca-4503-b248-a55961661149","resolution":{"observed_at":"2026-08-06T15:20:00.434620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.16310","last_updated":"2025-07-22T07:51:05Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T00:37:06.142370Z","submitted_at":"2025-07-22T07:51:05Z","title":"MotionShot: Adaptive Motion Transfer across Arbitrary Objects for Text-to-Video Generation"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":1,"verified_fuzzy":48},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 0 inbound Pith citation observations for arXiv:2507.16310."}