{"as_of":"2026-08-21T22:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3e572284c94f43f8cdca522ef9cbc1f6151ebeeb725d4a8c16fc2cfa10e8c551","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:28:24.478104Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.12087/citation-record","integrity":"/paper/2508.12087/integrity","json":"/paper/2508.12087/citation-record.json","paper":"/paper/2508.12087"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.960610Z","title":"Generating human motion from textual descriptions with discrete representations","venue":null,"work_id":"489b396d-55c1-4c16-a1f0-bd7caa3e082e","year":2023},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.532563Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:a53dc0d95e5b5c44d00405b58ce306806444b484b43321000b6bb507185d5358","observation_id":"e73894f8-676c-49ce-831a-03466f719c19","resolution":{"observed_at":"2026-08-15T17:28:27.040304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:23.538020Z","title":"Motiondiffuse: Text-driven human motion generation with diffusion model.IEEE Transactions on Pattern Analysis and Machine Intelligence, 46(6):4115–4128, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.538020Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:208e749f553e0e325e6b9b839c632c84bc34adfd019fc2ebe8ec38a87f65400a","observation_id":"6c542fca-d31d-45f9-a0ce-fc9024bc2d58","resolution":{"observed_at":"2026-08-15T17:28:23.538020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.932380Z","title":"Motiongpt: Finetuned llms are general-purpose motion generators","venue":null,"work_id":"725fd65a-c828-4e9e-a519-8531ae118768","year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.541664Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:9ea170db813224fb90ca4c8f402fcaeadb0bb6208cc6590a94ec1dde6144757f","observation_id":"24fd7db9-405c-4516-ad52-802037930b20","resolution":{"observed_at":"2026-08-15T17:28:26.936597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.868696Z","title":"Motiongpt: Human motion as a foreign language.Proceedings of the NeurIPS, pages 20067–20079, 2023","venue":null,"work_id":"7b6874ff-1af2-44d8-bd18-ede5058c2a34","year":2023},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.545847Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:10c1d701b50c88a1dc983ece2f43fd7442ede1153010e7155c62258a0d4cd392","observation_id":"6c1f36c7-215e-4921-bff3-4fc072a80819","resolution":{"observed_at":"2026-08-15T17:28:26.917587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.794563Z","title":"Generating diverse and natural 3d human motions from text","venue":null,"work_id":"239eeb30-10da-4cd9-a8f5-847ad5ca390a","year":2022},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.550234Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:d3e663892a223ceb165188030fe8748fdd62a51bb872a3e50407de0bfba17380","observation_id":"fd08967b-c4a1-4ad3-b978-cedc6f54d976","resolution":{"observed_at":"2026-08-15T17:28:26.811120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.779783Z","title":"Remodiffuse: Retrieval-augmented motion diffusion model","venue":null,"work_id":"5bd211c9-7e61-43f6-956d-52e55aa20d88","year":2023},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.554423Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:f92cf3060ec02e0b638c89d90496c0881a34c214363b43df9ed1f2dda2784903","observation_id":"b9564780-1891-4cf5-8932-c16f77298378","resolution":{"observed_at":"2026-08-15T17:28:26.784349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06614","last_updated":"2024-08-13T03:57:35Z","snapshot_observed_at":"2026-08-20T05:17:10.279345Z","submitted_at":"2024-08-13T03:57:35Z","title":"ViMo: Generating Motions from Casual Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06614","snapshot_observed_at":"2026-08-15T17:28:23.558758Z","title":"Vimo: Generating motions from casual videos.arXiv preprint arXiv:2408.06614, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.558758Z"},"links":{"cited_paper":"/paper/2408.06614","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:5b9498aaa07f009e48ebeeff362e80f91adbd0c88b3af6ad2912fef3d797ab5b","observation_id":"1f5a2451-a74b-499a-92cd-4868cb613e91","resolution":{"observed_at":"2026-08-15T17:28:23.558758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.713735Z","title":"Neural discrete representation learning.Proceedings of the NeurIPS, 30, 2017","venue":null,"work_id":"0e8be4ec-3d21-4bea-b8c2-cb0076c96558","year":2017},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.585311Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:c09dc44828c97645fa142aa991eb085552ffc9562c39790e30dbd667328af253","observation_id":"54fd318f-306c-4c6f-89ac-5734561a5809","resolution":{"observed_at":"2026-08-15T17:28:26.760058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-17T03:25:04.404839Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-15T17:28:23.609661Z","title":"Phi-3 technical report: A highly capable language model locally on your phone.arXiv preprint arXiv:2404.14219, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.609661Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:b913087a055d6d92e1399d8da735c553815d9f16a09336ca89c68c8dcea743a3","observation_id":"996d6552-8567-4707-bbcd-8c5a1f2ae048","resolution":{"observed_at":"2026-08-15T17:28:23.609661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09418","last_updated":"2024-06-13T17:59:59Z","snapshot_observed_at":"2026-08-19T08:26:06.209110Z","submitted_at":"2024-06-13T17:59:59Z","title":"VideoGPT+: Integrating Image and Video Encoders for Enhanced Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09418","snapshot_observed_at":"2026-08-15T17:28:23.663659Z","title":"Videogpt+: Integrating image and video encoders for enhanced video understanding.arXiv preprint arXiv:2406.09418, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.663659Z"},"links":{"cited_paper":"/paper/2406.09418","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:b4ad84bba7679a34a1c9938695c6b870651ffadc0f555e32cc5f7bd8be08a5a4","observation_id":"1c1396f6-886b-4c45-ba4c-0377742957d2","resolution":{"observed_at":"2026-08-15T17:28:23.663659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.561234Z","title":"Motion-x: a large-scale 3d expressive whole-body human motion dataset","venue":null,"work_id":"408439a8-4afb-42b4-8deb-729c63751495","year":2023},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.668160Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:1c3d0f175e4ebf8267c6e1241b37aede7100313e02125d711076471ea046a9a0","observation_id":"bbdf5349-0aee-44ec-88f8-383caf4dd076","resolution":{"observed_at":"2026-08-15T17:28:26.643138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.546090Z","title":"Human motion generation: A survey.IEEE Transactions on Pattern Analysis and Machine Intelligence, 46(4):2430–2449, 2024","venue":null,"work_id":"11752d02-f60a-4d12-824c-886daeafa9c0","year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.672909Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:650fcfad52d0330bf59fbc63a882aab025dbe7f3ba725a1720ca4210eb47d934","observation_id":"414d2ce1-abdd-4971-8afe-abda4915c611","resolution":{"observed_at":"2026-08-15T17:28:26.549824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.531727Z","title":"Momask: Generative masked modeling of 3d human motions","venue":null,"work_id":"a3be55a6-e282-4a16-8fd7-43a682371b4c","year":1900},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.676589Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:7e56bc516aa4e667562cb146115df9173d85ee6cb62cf4270f0aa8e8f32344d8","observation_id":"8f5399af-d827-4827-b365-9b4a62ac675f","resolution":{"observed_at":"2026-08-15T17:28:26.537346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.337616Z","title":"Omg: Towards open-vocabulary motion generation via mixture of controllers","venue":null,"work_id":"52964e23-7389-43c4-b31a-bf12519ec158","year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.680303Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:a2142c9128573e823f0a09851b9e2e136bdb7ecd5542603fc4f6b065f692d294","observation_id":"f2a3b06a-cd40-4047-8eef-937921134cc2","resolution":{"observed_at":"2026-08-15T17:28:26.411433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.324579Z","title":"Motionclip: Exposing human motion generation to clip space","venue":null,"work_id":"1ca8c049-2197-4a4a-a22c-27127198ad26","year":2022},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.684078Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:209c97d0ca3304c080aefdea4febbb66ba72d568d23cc877b7f12cb0f886088d","observation_id":"d5edbc3a-64cf-40dd-b870-29112b64cb00","resolution":{"observed_at":"2026-08-15T17:28:26.328861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.311881Z","title":"Plan, posture and go: Towards open-vocabulary text-to-motion generation","venue":null,"work_id":"8ed21d71-62ed-4728-ac60-02e2784e71d4","year":2025},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.687686Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:9e5d4d6eb23fc3ed835404f1cb7d99baf05d1688c041a8789e25873890006c0e","observation_id":"ee635c18-cf9d-434b-8c33-10e6b26f17b3","resolution":{"observed_at":"2026-08-15T17:28:26.316326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04079","last_updated":"2024-11-06T17:57:43Z","snapshot_observed_at":"2026-08-16T13:02:21.918224Z","submitted_at":"2024-11-06T17:57:43Z","title":"Textual Decomposition Then Sub-motion-space Scattering for Open-Vocabulary Motion Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04079","snapshot_observed_at":"2026-08-15T17:28:23.690889Z","title":"Textual decomposition then sub-motion-space scattering for open-vocabulary motion generation.arXiv preprint arXiv:2411.04079, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.690889Z"},"links":{"cited_paper":"/paper/2411.04079","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:47b42e860d17bcc87495fa3ac863cbd4b81775dc7b5ec2bea0c173dd3b2a3516","observation_id":"23349fb3-582e-428f-b3cc-8f3584479b56","resolution":{"observed_at":"2026-08-15T17:28:23.690889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.151888Z","title":"Being comes from not-being: Open-vocabulary text-to-motion generation with wordless training","venue":null,"work_id":"429c56f2-1f25-4dc1-abf6-2a1172811e6b","year":2023},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.695106Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:cb3aeb6fdd4fec37031e14e40301c1b7befd21f584694d3edca4eb06be23e1d8","observation_id":"c69a274c-6c53-40b6-baec-b8e5a524ddbb","resolution":{"observed_at":"2026-08-15T17:28:26.251254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.090224Z","title":"Attention is all you need","venue":null,"work_id":"d066a14b-0889-41a4-a808-8605e535ff86","year":2017},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.698256Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:bc12842c139c0e5379b0c6ee116c1caefdac13497798c9d24f615ace89c4fd40","observation_id":"49d14313-9ed9-422a-a39e-db5d4a30e0e5","resolution":{"observed_at":"2026-08-15T17:28:26.094024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.077375Z","title":"Human motion diffusion model","venue":null,"work_id":"524a11b6-abbc-4dc6-bb90-272b9840b6c0","year":2023},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.703637Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:2e640f2408c620485fb8af4b2a27f7a8d30a4714e1cded3fdd432b26b5951a17","observation_id":"55d907ca-42ce-42ec-82d8-79d430b24fbe","resolution":{"observed_at":"2026-08-15T17:28:26.082171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:26.047275Z","title":"Denoising diffusion probabilistic models.Proceedings of the NeurIPS, pages 6840–6851, 2020","venue":null,"work_id":"76141f63-b19f-4333-bb6d-07a90316d47a","year":2020},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.707648Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:6a3d9030e0d2f7c94623af191e72a644317a6635b722b6516a19961bfd34dc4e","observation_id":"a1d2a04f-09ad-41bd-aa98-8bac47a14694","resolution":{"observed_at":"2026-08-15T17:28:26.067027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:25.994739Z","title":"Executing your commands via motion diffusion in latent space","venue":null,"work_id":"e3c05d1d-58b0-4585-92a6-a22295b8048d","year":2023},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.711558Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:8a2458ff77489c811c43484a1dba8889c43505b9f4cd9a1e36a49a0b62310621","observation_id":"bbcf4c41-00db-41a5-ac23-475d98354c28","resolution":{"observed_at":"2026-08-15T17:28:26.003855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:25.903670Z","title":"Openagi: When llm meets domain experts","venue":null,"work_id":"376765d5-06ab-45cf-85c8-b098c8e459b9","year":2023},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.715100Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:928e634f8177c0ab7aa4b5ecd16a75e205990dfee36b4b04289961e8c3e6d7c0","observation_id":"87b93e2b-94e3-429a-a673-34228f1edb2c","resolution":{"observed_at":"2026-08-15T17:28:25.979537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20340","last_updated":"2024-05-30T17:59:50Z","snapshot_observed_at":"2026-08-16T13:47:37.897675Z","submitted_at":"2024-05-30T17:59:50Z","title":"MotionLLM: Understanding Human Behaviors from Human Motions and Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20340","snapshot_observed_at":"2026-08-15T17:28:23.718787Z","title":"Motionllm: Understanding human behaviors from human motions and videos.arXiv preprint arXiv:2405.20340, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.718787Z"},"links":{"cited_paper":"/paper/2405.20340","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:e174ea09d729355b40322e3c54056eeee37c78cb463a9cac6abb70ce8d009d14","observation_id":"477a4049-0a54-4ecb-a95c-b4f2ffc42b0d","resolution":{"observed_at":"2026-08-15T17:28:23.718787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21747","last_updated":"2026-06-08T02:14:45Z","snapshot_observed_at":"2026-08-16T13:05:06.623461Z","submitted_at":"2024-10-29T05:25:34Z","title":"MotionGPT-2: A General-Purpose Motion-Language Model for Motion Generation and Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21747","snapshot_observed_at":"2026-08-15T17:28:23.735914Z","title":"Motiongpt-2: A general-purpose motion-language model for motion generation and understanding.arXiv preprint arXiv:2410.21747, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.735914Z"},"links":{"cited_paper":"/paper/2410.21747","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:2c318286a721067425fbdce756bfd0f15f983a1486cc872ffc9218fca65634d2","observation_id":"24438d48-8da1-444d-a31e-3f31b50e504f","resolution":{"observed_at":"2026-08-15T17:28:23.735914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13790","last_updated":"2024-10-17T17:31:24Z","snapshot_observed_at":"2026-08-16T13:08:19.384880Z","submitted_at":"2024-10-17T17:31:24Z","title":"MotionBank: A Large-scale Video Motion Benchmark with Disentangled Rule-based Annotations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13790","snapshot_observed_at":"2026-08-15T17:28:23.740893Z","title":"Motionbank: A large-scale video motion benchmark with disentangled rule-based annotations.arXiv preprint arXiv:2410.13790, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.740893Z"},"links":{"cited_paper":"/paper/2410.13790","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:52e8726b953c069ab019c912b0991efdc473a20e8e09e1b676d852512c6ce182","observation_id":"b4e47378-3adc-4f0d-8b8b-b98d49ed34d4","resolution":{"observed_at":"2026-08-15T17:28:23.740893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:25.849440Z","title":"Large motion model for unified multi-modal motion generation","venue":null,"work_id":"8801307d-7000-4aad-94d3-49ff9106e001","year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.744805Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:bcc8b99d201459137243b40e1d24851dac4be60a3df9d844d7006a6e64c8e004","observation_id":"58ae76ab-d18c-4e7a-99b7-d6760a7bf46c","resolution":{"observed_at":"2026-08-15T17:28:25.853897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:25.835775Z","title":"The action similarity labeling challenge.IEEE Transactions on Pattern Analysis and Machine Intelligence, 34(3):615–621, 2011","venue":null,"work_id":"766b68e8-e2cd-4a7b-b0d6-4bf1d8c61a1c","year":2011},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.750194Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:3464fd2d0eeee54a320b1388e4b21aa4716de6aa3b67e2aa48ef18c9e356ec6d","observation_id":"56ccab24-08ba-4035-9b6c-9bb2b8c91f12","resolution":{"observed_at":"2026-08-15T17:28:25.840358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:25.692407Z","title":"Hmdb: a large video database for human motion recognition","venue":null,"work_id":"e5b752e1-e490-413f-a974-ddaf54f5500c","year":2011},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.776027Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:f499d73a3f0b764d06df7ff9ddababd6a1f10a8694db288465c74be413ca3754","observation_id":"3bf0070f-5787-41b6-b8c8-e553195aadeb","resolution":{"observed_at":"2026-08-15T17:28:25.773488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-20T22:03:51.775198Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-15T17:28:23.886937Z","title":"The kinetics human action video dataset.arXiv preprint arXiv:1705.06950, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.886937Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:973ad48a4d87640cde711c32a959e26ba36f943508d49fbf93d3335f44783983","observation_id":"ea1e783b-f946-4c58-b002-ff0eb4ea13f5","resolution":{"observed_at":"2026-08-15T17:28:23.886937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:25.679714Z","title":"From actemes to action: A strongly-supervised representa- tion for detailed action understanding","venue":null,"work_id":"4d5a77e8-ea0c-481a-8fcd-810e7122e751","year":2013},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:23.994749Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:e84cbeb3612f877bb95a96ce96c22428c5cf1e0b4109897347d07aa4c79c2bd8","observation_id":"e3f2fec4-6502-49b6-b2b0-7fa62ef09818","resolution":{"observed_at":"2026-08-15T17:28:25.683892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-16T21:21:44.768787Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-15T17:28:24.003224Z","title":"UCF101: A dataset of 101 human actions classes from videos in the wild.CoRR, abs/1212.0402, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.003224Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:3668807c9f4e0be7308949a48bef49757c0b87563b702ef5dd5e0795c1d2f7bd","observation_id":"d7de81a6-7e0a-4086-9960-f9b733e1fbcb","resolution":{"observed_at":"2026-08-15T17:28:24.003224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:25.562383Z","title":"Ntu rgb+ d: A large scale dataset for 3d human activity analysis","venue":null,"work_id":"e1a72af3-9f4a-4ca7-9b49-2e909b130fc7","year":2016},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.007952Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:24f44717cc4c05e18e04ab40f5c57abb5860caac570fa4bbe0bb2e7800ac2393","observation_id":"934a2ca7-2b78-43d5-a63f-28820b649266","resolution":{"observed_at":"2026-08-15T17:28:25.617224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-15T17:28:24.012456Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.012456Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:495d420844ef3704ef6b2a19414ab4be257fcd40ca2571c85d8f609b02ea1ed4","observation_id":"1659a3f3-b1fe-4d51-b5ea-8d695c08fc17","resolution":{"observed_at":"2026-08-15T17:28:24.012456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15111","last_updated":"2025-01-25T07:26:37Z","snapshot_observed_at":"2026-08-18T05:01:23.171038Z","submitted_at":"2025-01-25T07:26:37Z","title":"HumanOmni: A Large Vision-Speech Language Model for Human-Centric Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15111","snapshot_observed_at":"2026-08-15T17:28:24.016809Z","title":"Humanomni: A large vision-speech language model for human-centric video understanding.arXiv preprint arXiv:2501.15111, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.016809Z"},"links":{"cited_paper":"/paper/2501.15111","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:a9c20ead78db47030cebaec8a2060c94a1e0f2cca9ee3b7f995ee82bdc214845","observation_id":"c4ad3f4d-1bc9-4903-8217-e8c010c4c8f0","resolution":{"observed_at":"2026-08-15T17:28:24.016809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:25.550289Z","title":"Alphapose: Whole-body regional multi-person pose estimation and tracking in real-time.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(6):7157–7173, 2022","venue":null,"work_id":"b697330e-d452-48e5-8a0a-0e87a963f72e","year":2022},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.020849Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:4cc6ccf00007ab62e34c0ff689c0d65a3cffa1a98e966f8bfc4b0da173a13f94","observation_id":"7dc1aeb1-7874-4149-99ac-093d99c6639f","resolution":{"observed_at":"2026-08-15T17:28:25.554751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:25.473215Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"92091843-3fc3-42b0-84a2-9fdc692b8c92","year":2021},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.024575Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:f1f08bb3b5e8301778ef7cf0e946862cc955e01101dc516904654465302bb504","observation_id":"3659b86a-bd31-47aa-8eae-12faa3492dbc","resolution":{"observed_at":"2026-08-15T17:28:25.538037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:25.373337Z","title":"Motionbert: A unified perspective on learning human motion representations","venue":null,"work_id":"45394431-6e93-43f1-a7db-a76f1ae3987d","year":2023},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.028207Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:4fef31333e3df8b8f45c9792dfe274365dc0350d4ae18ef7e1fb6a5496afff99","observation_id":"b60d3890-a815-47ae-8a63-893c2b4fbf65","resolution":{"observed_at":"2026-08-15T17:28:25.384774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03191","last_updated":"2022-12-07T12:20:55Z","snapshot_observed_at":"2026-08-19T18:30:11.337554Z","submitted_at":"2022-12-06T18:09:49Z","title":"InternVideo: General Video Foundation Models via Generative and Discriminative Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03191","snapshot_observed_at":"2026-08-15T17:28:24.032141Z","title":"Internvideo: General video foundation models via generative and discriminative learning.arXiv preprint arXiv:2212.03191, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.032141Z"},"links":{"cited_paper":"/paper/2212.03191","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:c84dbd004b2320db26b3f0a5f3d76d1d602fd958326542547c6bd832e344bcfb","observation_id":"265c0833-da7f-4141-a283-83f08945555d","resolution":{"observed_at":"2026-08-15T17:28:24.032141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:25.360441Z","title":"Clip4clip: An empirical study of clip for end to end video clip retrieval and captioning.Neurocomputing, 508:293–304, 2022","venue":null,"work_id":"a8391d74-2d18-4b97-aad7-dfcec30f89fe","year":2022},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.179759Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:84f6e7589d5b99969ff8def3d475ff8f2abc4e045b5983a1651612e99134a916","observation_id":"5ade095b-5019-4343-b5c3-5404701bda3d","resolution":{"observed_at":"2026-08-15T17:28:25.365888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:25.142013Z","title":"Exploring text-to-motion generation with human preference","venue":null,"work_id":"31af9b08-f88b-4940-8e69-e55be144ccc2","year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.209754Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:77de9d9be372163031b8ac74b23b962362e5fa66496de2dfcd2f95d7b9e8b24b","observation_id":"b26bc8a2-39e7-4df3-ae92-73527e977d62","resolution":{"observed_at":"2026-08-15T17:28:25.254216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03803","last_updated":"2024-05-06T19:19:20Z","snapshot_observed_at":"2026-08-17T19:17:02.158655Z","submitted_at":"2024-05-06T19:19:20Z","title":"MoDiPO: text-to-motion alignment via AI-feedback-driven Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03803","snapshot_observed_at":"2026-08-15T17:28:24.214742Z","title":"Modipo: text-to-motion alignment via ai-feedback-driven direct preference optimization.arXiv preprint arXiv:2405.03803, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.214742Z"},"links":{"cited_paper":"/paper/2405.03803","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:0e8df977f4d2870e4487733537ad8a91963e40a796d900b459bdf796a6f50cfc","observation_id":"bdd12df4-7fc6-408f-9a15-519302bb92ef","resolution":{"observed_at":"2026-08-15T17:28:24.214742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:25.120910Z","title":"Direct preference optimization: your language model is secretly a reward model","venue":null,"work_id":"214eb880-3a3b-4f34-975e-48317adaf775","year":2023},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.218945Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:380d3583a371295fbb8dbc562165a4a951cfc8379a23acd1aa91860d1d5ccdc0","observation_id":"a74b9e68-1b52-4ce4-a666-01b84e245f89","resolution":{"observed_at":"2026-08-15T17:28:25.130777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01258","last_updated":"2024-04-02T12:47:49Z","snapshot_observed_at":"2026-08-21T06:38:59.055217Z","submitted_at":"2024-04-01T17:28:16Z","title":"Direct Preference Optimization of Video Large Multimodal Models from Language Model Reward","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01258","snapshot_observed_at":"2026-08-15T17:28:24.223101Z","title":"Direct preference optimization of video large multimodal models from language model reward.arXiv preprint arXiv:2404.01258, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.223101Z"},"links":{"cited_paper":"/paper/2404.01258","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:b9ee12825a8a4e3abbcfce434be849b97031288e3c824e85e216bcc6bd277ece","observation_id":"b0ab2962-a2a3-4969-8be5-802d978872db","resolution":{"observed_at":"2026-08-15T17:28:24.223101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-20T11:47:17.477107Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-15T17:28:24.227243Z","title":"Lora: Low-rank adaptation of large language models.arXiv preprint arXiv:2106.09685, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.227243Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:255e73d6a3dc224f2f085ae7e380edd0eed9e2393e23118bff95d574775a06fa","observation_id":"5470d96f-b13d-4e6a-b625-5f7f9d113cb4","resolution":{"observed_at":"2026-08-15T17:28:24.227243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02358","last_updated":"2025-07-22T13:47:07Z","snapshot_observed_at":"2026-08-18T15:54:47.779413Z","submitted_at":"2025-02-04T14:43:26Z","title":"MotionLab: Unified Human Motion Generation and Editing via the Motion-Condition-Motion Paradigm","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02358","snapshot_observed_at":"2026-08-15T17:28:24.231311Z","title":"Motionlab: Unified human motion generation and editing via the motion-condition-motion paradigm.arXiv preprint arXiv:2502.02358, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.231311Z"},"links":{"cited_paper":"/paper/2502.02358","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:03be9b5460d7d223cc2cbd9c885a975913c69ea311856c1c037a7941f7de4144","observation_id":"1c6a8a48-bcac-4cf0-b983-30e84de13cec","resolution":{"observed_at":"2026-08-15T17:28:24.231311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:25.107991Z","title":"Motionlcm: Real- time controllable motion generation via latent consistency model","venue":null,"work_id":"ae265d7e-3ca4-4856-821a-16fcddaa9fa4","year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.235552Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:771d2c27ceed92a238a8fab33bb8e3cff4db39547723a94ad51101aaed71a407","observation_id":"e5d7f021-0a42-4754-a3f2-ac2c6f301f04","resolution":{"observed_at":"2026-08-15T17:28:25.111760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:25.090216Z","title":"Motionclr: Motion generation and training-free editing via understanding attention mechanisms.arXiv e-prints, pages arXiv–2410, 2024","venue":null,"work_id":"de58c113-ef75-4f9f-988f-ebe9c70b4096","year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.239141Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:7c3320349e1f46e761c07c3d5d49eeb66f1540f481b950b0f309f04f88cea06a","observation_id":"59bd8c89-6e90-48ee-8202-822caee55047","resolution":{"observed_at":"2026-08-15T17:28:25.096886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:24.243102Z","title":"Bipo: Bidirec- tional partial occlusion network for text-to-motion synthesis.arXiv preprint arXiv:2412.00112, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.243102Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:8904e3678921e5a2b0a1353098350080143c6e0f42f645be9d17cc9be53eb85d","observation_id":"81ab0483-9bb2-4539-b943-710844e0a058","resolution":{"observed_at":"2026-08-15T17:28:24.243102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:24.934180Z","title":"Stablemofusion: Towards robust and efficient diffusion-based motion generation framework","venue":null,"work_id":"5f6c2d8e-2043-4762-a4a6-0a6eb6adf9f7","year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.246180Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:2403fbe7b1744a385ceb0704a136cfb9ad450b0de6de7ecac7c43611a37d59a6","observation_id":"a7bc765b-ad41-4b88-b56c-914ef18f3ac4","resolution":{"observed_at":"2026-08-15T17:28:25.026577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:24.899268Z","title":"Mogents: Motion generation based on spatial-temporal joint modeling.Proceedings of the NeurIPS, pages 130739–130763, 2024","venue":null,"work_id":"883c60c4-3866-4e51-bd25-6204eeae2785","year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.250065Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:61ea9bb2f7522d52f95f34e3a21d82fa11e5f752ecec0413d19ca746e89ed33e","observation_id":"f8d7b1ee-20c1-4b11-bf77-e2f9279fba9e","resolution":{"observed_at":"2026-08-15T17:28:24.903676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:24.886004Z","title":"LaMP: Language-motion pretraining for motion generation, retrieval, and captioning","venue":null,"work_id":"4ef86b21-d719-4e7f-8d97-130c39a7f685","year":2025},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.253728Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:3c5dae11f2a770708b257f12921881636015cbc62e6218e3a609265ff0a04fb9","observation_id":"ef8c3217-492c-4bf0-9fcb-4eaf6c335cf7","resolution":{"observed_at":"2026-08-15T17:28:24.890477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17013","last_updated":"2024-10-06T13:46:47Z","snapshot_observed_at":"2026-08-19T05:43:23.017360Z","submitted_at":"2024-05-27T09:57:51Z","title":"Motion-Agent: A Conversational Framework for Human Motion Generation with LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17013","snapshot_observed_at":"2026-08-15T17:28:24.257359Z","title":"Motion-agent: A conversational framework for human motion generation with llms.arXiv preprint arXiv:2405.17013, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.257359Z"},"links":{"cited_paper":"/paper/2405.17013","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:5d82aeb75a0dee81f84549e186f50ba0e5f32323bc044e554d6c73b8196210c6","observation_id":"6611ea53-ce71-430d-baa1-5e0072ea51be","resolution":{"observed_at":"2026-08-15T17:28:24.257359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03311","last_updated":"2025-05-30T12:53:31Z","snapshot_observed_at":"2026-08-16T13:12:38.584650Z","submitted_at":"2024-10-04T10:48:54Z","title":"Scaling Large Motion Models with Million-Level Human Motions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03311","snapshot_observed_at":"2026-08-15T17:28:24.292408Z","title":"Quo vadis, motion generation? from large language models to large motion models.arXiv preprint arXiv:2410.03311, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.292408Z"},"links":{"cited_paper":"/paper/2410.03311","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:2e3510ad79b027f86a6d9436f30ec36d0787241e84169b635fcb5a821a39428c","observation_id":"a8fb658b-02e2-47de-96fd-cc03d6709936","resolution":{"observed_at":"2026-08-15T17:28:24.292408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14559","last_updated":"2024-12-19T06:22:19Z","snapshot_observed_at":"2026-08-18T20:14:51.456327Z","submitted_at":"2024-12-19T06:22:19Z","title":"ScaMo: Exploring the Scaling Law in Autoregressive Motion Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14559","snapshot_observed_at":"2026-08-15T17:28:24.345896Z","title":"Scamo: Exploring the scaling law in autoregressive motion generation model.arXiv preprint arXiv:2412.14559, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.345896Z"},"links":{"cited_paper":"/paper/2412.14559","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:5ff0801ae300ee5655b4beac710321af385aec8b9ffd5431063bceaa806ff47b","observation_id":"2127f474-9eea-4589-8e8e-7887d920db70","resolution":{"observed_at":"2026-08-15T17:28:24.345896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:24.873536Z","title":"Avatargpt: All-in-one framework for motion understanding planning generation and beyond","venue":null,"work_id":"488620a4-2ee3-45ee-ab08-c54e364a9efd","year":2024},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.436596Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:49d7c521a748ee8dd7ed0258c4f94a3c4ddd549ae8fa97831810c9d8eef9097f","observation_id":"016a70af-37cd-42d0-8171-45c5c730fd49","resolution":{"observed_at":"2026-08-15T17:28:24.877661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:28:24.854813Z","title":"Internvideo2: Scaling foundation models for multimodal video understanding","venue":null,"work_id":"b8f26a16-572e-40f5-97d6-b1437a3512c6","year":2025},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.471985Z"},"links":{"citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:3a19907b1052e964fbd49426de6597ac7ea3bc8098593e94f3df97b5a628b985","observation_id":"4595dd2c-da89-4cde-a573-2497056c73bf","resolution":{"observed_at":"2026-08-15T17:28:24.865532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-08-13T19:48:28.322536Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-15T17:28:24.478104Z","title":"Please describe the person’s actions in the video using a single sentence that contains a series of verbs","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T17:28:24.478104Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2508.12087"},"observation_digest":"sha256:091c3a7fce58a918a1148b13c759df06cf4b99f67c7ebaed9821a82c933530f4","observation_id":"bdda8fd7-6c08-4ffa-a704-bd04fb79b14b","resolution":{"observed_at":"2026-08-15T17:28:24.478104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.12087","last_updated":"2025-09-07T04:05:16Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-19T13:09:28.493334Z","submitted_at":"2025-08-16T15:50:26Z","title":"MAPF-World: Action World Model for Multi-Agent Path Finding"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":36},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2508.12087."}