{"as_of":"2026-08-18T01:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd9675ca20b50a18fa1dbcd4178fe71fd154ea7e7ed0dc947e9a31ef6484cdcc","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:30:08.666034Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T12:31:22.605420Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-09T12:31:22.996104Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"cited_work":{"arxiv_id":"2505.01182","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.01182","snapshot_observed_at":"2026-08-09T12:31:22.996104Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","venue":"cs.CV","work_id":"c83e427f-6e92-4cda-a05e-b56a05521cc0","year":2025},"citing_paper":{"arxiv_id":"2502.02358","last_updated":"2025-07-22T13:47:07Z","snapshot_observed_at":"2026-08-17T04:43:13.939941Z","submitted_at":"2025-02-04T14:43:26Z","title":"MotionLab: Unified Human Motion Generation and Editing via the Motion-Condition-Motion Paradigm","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T12:31:22.605420Z"},"links":{"cited_paper":"/paper/2505.01182","citing_paper":"/paper/2502.02358"},"observation_digest":"sha256:e27920a6542c5fe44f8fd26e7854690664f9cf04fcdcc4f5a60c3e5ab725aea9","observation_id":"c5fd513e-8e1d-4682-82d2-a1e2526fe9a9","resolution":{"observed_at":"2026-08-09T12:31:22.999369Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.01182/citation-record","integrity":"/paper/2505.01182/integrity","json":"/paper/2505.01182/citation-record.json","paper":"/paper/2505.01182"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2209.14916","last_updated":"2022-10-03T09:17:41Z","snapshot_observed_at":"2026-08-12T18:48:37.916493Z","submitted_at":"2022-09-29T16:27:53Z","title":"Human Motion Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14916","snapshot_observed_at":"2026-08-16T04:30:08.570066Z","title":"Human motion diffusion model,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.570066Z"},"links":{"cited_paper":"/paper/2209.14916","citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:17a4bc875ae8349ac78f0757628a8c730476ba0dac3f1aa9579fc2b3cbd1b825","observation_id":"fd3315f5-7378-4237-9702-28c649bd874a","resolution":{"observed_at":"2026-08-16T04:30:08.570066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.15001","last_updated":"2022-08-31T17:58:54Z","snapshot_observed_at":"2026-08-16T16:35:36.335456Z","submitted_at":"2022-08-31T17:58:54Z","title":"MotionDiffuse: Text-Driven Human Motion Generation with Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.15001","snapshot_observed_at":"2026-08-16T04:30:08.575943Z","title":"Motiondiffuse: Text-driven human mo- tion generation with diffusion model,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.575943Z"},"links":{"cited_paper":"/paper/2208.15001","citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:e1556e91d1431343923218b1adb434dbf1484aa8b1dddd56bf7b71a560ecae86","observation_id":"d0d205bb-2b98-4fad-9b65-1ae2d76af6f2","resolution":{"observed_at":"2026-08-16T04:30:08.575943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:30:09.041180Z","title":"Humanise: Language-conditioned human motion generation in 3d scenes,","venue":null,"work_id":"35124ada-7c44-4ba0-b229-4d57a4d178e8","year":2022},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.581072Z"},"links":{"citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:12b595fb40e6a909987f6e829d718d4f60ee69a795a4fd3ebec1edd1b648d94b","observation_id":"e2ea81fd-e9af-45f8-b9f9-c37363aa2b04","resolution":{"observed_at":"2026-08-16T04:30:09.050825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:30:09.024427Z","title":"Unified human-scene interaction via prompted chain-of-contacts,","venue":null,"work_id":"02482eeb-f065-40b0-8ad8-0c6df1a574b4","year":2024},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.585863Z"},"links":{"citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:757cd6c7a25a2471b251a528ed4da3b5895e4c9dd3e3b2f5b87e339637a28992","observation_id":"8c4601ae-b98f-4d31-a7b3-8f030b49eda6","resolution":{"observed_at":"2026-08-16T04:30:09.029927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:30:09.008509Z","title":"Scaling up dynamic human-scene interaction modeling,","venue":null,"work_id":"17120f5c-9897-4072-a394-cf95018274bd","year":2024},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.590267Z"},"links":{"citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:fc624c27d51fffdba2741482306b775dba25b098f8f7841b58adddcb67490778","observation_id":"716d6ba9-50fc-4aa4-9f34-680d1962ae0b","resolution":{"observed_at":"2026-08-16T04:30:09.013724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18036","last_updated":"2024-03-26T18:41:07Z","snapshot_observed_at":"2026-08-17T09:20:10.675786Z","submitted_at":"2024-03-26T18:41:07Z","title":"Move as You Say, Interact as You Can: Language-guided Human Motion Generation with Scene Affordance","version":1},"cited_work":{"arxiv_id":"2403.18036","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.18036","snapshot_observed_at":"2026-08-16T04:30:08.809874Z","title":"Move as You Say, Interact as You Can: Language-guided Human Motion Generation with Scene Affordance","venue":"cs.CV","work_id":"23022bec-0573-4323-91bc-07240417ba14","year":2024},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.594698Z"},"links":{"cited_paper":"/paper/2403.18036","citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:885ededd1169e3c36b7f94bf67f164309b3b064d908576cb7bbed24d9eb1c914","observation_id":"a6ba2fe0-1bc6-47c8-9548-322343ba007e","resolution":{"observed_at":"2026-08-16T04:30:08.815613Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:30:08.991778Z","title":"Stochastic scene-aware motion prediction,","venue":null,"work_id":"ece9d33c-7ffa-4422-8fae-85f982fec731","year":2021},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.599749Z"},"links":{"citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:0542c432bb0f6ea6af5a8e956f6c5a90309d051e3d1786edd4d50c3ad74b5f78","observation_id":"bfc4b223-1e06-47bd-b239-88653af3e64f","resolution":{"observed_at":"2026-08-16T04:30:08.996801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12411","last_updated":"2023-08-21T09:07:07Z","snapshot_observed_at":"2026-08-17T09:20:07.305811Z","submitted_at":"2023-05-21T09:22:24Z","title":"Synthesizing Diverse Human Motions in 3D Indoor Scenes","version":3},"cited_work":{"arxiv_id":"2305.12411","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.12411","snapshot_observed_at":"2026-08-16T04:30:08.784353Z","title":"Synthesizing Diverse Human Motions in 3D Indoor Scenes","venue":"cs.CV","work_id":"b7035c04-e48a-49d1-859c-05ba1318bfea","year":2023},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.603907Z"},"links":{"cited_paper":"/paper/2305.12411","citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:63a7d08ee0ff6447f3f2fe91476ae14b9f4ebd8147fb9760fcfac66c4293bfd0","observation_id":"1f00d3aa-c95e-4fcf-9c2e-b1767874bcec","resolution":{"observed_at":"2026-08-16T04:30:08.791477Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:30:08.976255Z","title":"Generating diverse and natural 3d human motions from text,","venue":null,"work_id":"5ee095b5-c4af-4f97-afb9-4158d205a86b","year":2022},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.608284Z"},"links":{"citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:2bdbd4a1cf72c7e0694e8adbc941a0434e8c36fb94e0a3dc937b512a928ded7c","observation_id":"3c318909-9016-4e78-afa6-f8a1662c8f94","resolution":{"observed_at":"2026-08-16T04:30:08.981152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:30:08.960483Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":"409ca364-aace-4ec3-9c53-08807656457a","year":2022},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.612499Z"},"links":{"citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:a2b32e436d69e489cbb0dd5645932f5eb39f1cc30cdb0d6fc4afa59f667ca2fe","observation_id":"34bee9e1-2f46-464a-a823-4e68cbf7a68e","resolution":{"observed_at":"2026-08-16T04:30:08.965539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:30:08.943076Z","title":"Visual language maps for robot navigation,","venue":null,"work_id":"0d011559-e5a3-4162-8d8f-5c8216ec2b80","year":2023},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.616570Z"},"links":{"citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:9819817f30441105ae480a8dfa4c1531f8bf3f1eb9ff4843ab46d58747a01461","observation_id":"ed01635c-9c89-4851-9623-d37211f2dabd","resolution":{"observed_at":"2026-08-16T04:30:08.949133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:30:08.924821Z","title":"Tabllm: Few-shot classification of tabular data with large language models,","venue":null,"work_id":"9e07db8f-df0b-4d88-be3e-f52d84b062ea","year":2023},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.621528Z"},"links":{"citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:57518be1bc680fe898d0d47f7b01aaa3f096153a8a680d61d280d2ba3eb2d413","observation_id":"518fd29e-d7ad-4995-890a-159f650a59bf","resolution":{"observed_at":"2026-08-16T04:30:08.930160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:30:08.907470Z","title":"Language models are few-shot learners,","venue":null,"work_id":"fcb339f7-2038-444e-a6ba-336e99cc1b39","year":1901},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.626397Z"},"links":{"citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:6e4012c685aa7ee454d346f2d5d20a717f27a45521de8df8fbc8bfe390fdadb0","observation_id":"54c274b1-f1b8-4b45-8ca3-0c7afa4a38ba","resolution":{"observed_at":"2026-08-16T04:30:08.913206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14687","last_updated":"2024-05-20T04:23:45Z","snapshot_observed_at":"2026-08-14T03:13:28.801183Z","submitted_at":"2022-09-29T11:12:27Z","title":"Diffusion Posterior Sampling for General Noisy Inverse Problems","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14687","snapshot_observed_at":"2026-08-16T04:30:08.631348Z","title":"Diffusion posterior sampling for general noisy inverse problems,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.631348Z"},"links":{"cited_paper":"/paper/2209.14687","citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:284c455f047af40b2afb7e9d84a0e8378a827ea97f11778042edd4f2593aa0e4","observation_id":"13398b34-1b1b-4fac-b1c3-1585fe712cc9","resolution":{"observed_at":"2026-08-16T04:30:08.631348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:30:08.891548Z","title":"Ex- pressive body capture: 3D hands, face, and body from a single image,","venue":null,"work_id":"c237a7a7-dd70-4331-b0a2-184108e209de","year":2019},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.636071Z"},"links":{"citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:4dfe5e44e3a8e884a04dbe785933adcead446e6ede8fd3e61fda005490c5793d","observation_id":"a0b71c18-cd0e-425b-96f2-c47bad26a9f0","resolution":{"observed_at":"2026-08-16T04:30:08.896164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10107","last_updated":"2024-07-19T09:38:18Z","snapshot_observed_at":"2026-08-16T14:09:33.296449Z","submitted_at":"2024-03-15T08:51:15Z","title":"Enhancing Human-Centered Dynamic Scene Understanding via Multiple LLMs Collaborated Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10107","snapshot_observed_at":"2026-08-16T04:30:08.641750Z","title":"Enhancing human-centered dynamic scene understanding via multiple llms collab- orated reasoning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.641750Z"},"links":{"cited_paper":"/paper/2403.10107","citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:6d50c98456b0c61dc3a2c412a701e76e1f36c531dbdb97874322ac470f3fbfde","observation_id":"5fff4d97-50ce-4ba3-95bf-fee379698b1d","resolution":{"observed_at":"2026-08-16T04:30:08.641750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:30:08.875543Z","title":"Recognize anything: A strong image tagging model,","venue":null,"work_id":"3c407e39-9c6f-41d8-b52a-53153ed64135","year":2024},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.646732Z"},"links":{"citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:e26f6c67ff26edb182891bd7a73baa58ac9d628031868df7f85c0c4e42731e55","observation_id":"812ac5f0-b8c7-4317-81ad-978ac90dc382","resolution":{"observed_at":"2026-08-16T04:30:08.880240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00616","last_updated":"2024-08-12T16:58:33Z","snapshot_observed_at":"2026-08-16T15:03:56.654719Z","submitted_at":"2023-09-01T17:59:56Z","title":"OpenIns3D: Snap and Lookup for 3D Open-vocabulary Instance Segmentation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00616","snapshot_observed_at":"2026-08-16T04:30:08.651493Z","title":"Openins3d: Snap and lookup for 3d open-vocabulary instance segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.651493Z"},"links":{"cited_paper":"/paper/2309.00616","citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:abf8c537c0dc5241cae099017dd9aeeac9839b02078da359e16b83cb68e85759","observation_id":"62d47bc0-47f7-4715-8099-4fe9dddd01e4","resolution":{"observed_at":"2026-08-16T04:30:08.651493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T04:30:08.656276Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.656276Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:80fb4f75efe893baf8633f8005171c82fc94096418a61d11197ae66adbfc8015","observation_id":"a5d525c9-f8b4-408e-9cd7-326d0be5b0b8","resolution":{"observed_at":"2026-08-16T04:30:08.656276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08580","last_updated":"2024-04-14T22:23:18Z","snapshot_observed_at":"2026-08-16T14:52:35.066513Z","submitted_at":"2023-10-12T17:59:38Z","title":"OmniControl: Control Any Joint at Any Time for Human Motion Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08580","snapshot_observed_at":"2026-08-16T04:30:08.661146Z","title":"Omnicontrol: Control any joint at any time for human motion generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.661146Z"},"links":{"cited_paper":"/paper/2310.08580","citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:5712c15146fbb771942189a66f733004753c064f993b4909622fb9e142243ac2","observation_id":"4c17d583-9859-4e26-b80b-34b2c3a4d773","resolution":{"observed_at":"2026-08-16T04:30:08.661146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T04:30:08.860104Z","title":"Resolving 3D human pose ambiguities with 3D scene con- straints,","venue":null,"work_id":"e4e261cc-900d-41be-8932-1ea684ed1738","year":2019},"citing_paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T04:30:08.666034Z"},"links":{"citing_paper":"/paper/2505.01182"},"observation_digest":"sha256:493033d34047247282334cc7e470a55ab1bcb73ff4c38c722c6700b0e74502df","observation_id":"b30f74f7-eded-4866-ae67-14fd6d5e0003","resolution":{"observed_at":"2026-08-16T04:30:08.864474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.01182","last_updated":"2025-05-05T05:14:20Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T13:04:49.007332Z","submitted_at":"2025-05-02T10:50:04Z","title":"TSTMotion: Training-free Scene-aware Text-to-motion Generation"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":2,"verified_fuzzy":12},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 1 inbound Pith citation observation for arXiv:2505.01182."}