{"as_of":"2026-08-11T01:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e16e0976aa7c1a663af47cd012ec759fbedc98f26f2660104287059714a8646b","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:50:57.511667Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.09880/citation-record","integrity":"/paper/2507.09880/integrity","json":"/paper/2507.09880/citation-record.json","paper":"/paper/2507.09880"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.200419Z","title":"Satr: Zero-shot semantic segmentation of 3d shapes","venue":null,"work_id":"ff436ca8-d375-4923-ba7e-8114f11d6d36","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.460134Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:bf7498212333b0e15405c13e9bed0694a22604b082bdd30e95e949f25f5d54a3","observation_id":"2c79de8e-7811-4397-8338-a93c0416e0fa","resolution":{"observed_at":"2026-08-06T17:51:00.203379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.192264Z","title":"CloSe: A 3D clothing segmentation dataset and model","venue":null,"work_id":"358fd99e-d3e9-45a7-b8cd-7c5a6f598be1","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.512779Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:8414e304e0a17a9dc8a2df1946e64a780948f6125f43c935a8f202784d6c2786","observation_id":"4f822105-8fa5-4284-8094-c9af841523ec","resolution":{"observed_at":"2026-08-06T17:51:00.195196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.183718Z","title":"Cloth3d: clothed 3d humans","venue":null,"work_id":"6ad54a35-f80a-4b90-9662-629b5724d0c9","year":2020},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.575040Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:5d67640646ca24bffef08eb8e702c7c6eb58deeec41c54cc66c050d2db0bde01","observation_id":"db419e4c-f0cb-4d38-8cdb-208c83d4778a","resolution":{"observed_at":"2026-08-06T17:51:00.186760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.174718Z","title":"Bedlam: A syn- thetic dataset of bodies exhibiting detailed lifelike animated motion","venue":null,"work_id":"4a39226c-5b91-4b78-ab9b-9b1d77a1f74d","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.631732Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:806401252d76c9c92c77fd0f7a089dfde7f9fa448aa1c65ea6ff127da416da38","observation_id":"88634c70-5064-4ba3-a72d-dae97d0fa37d","resolution":{"observed_at":"2026-08-06T17:51:00.178329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.165370Z","title":"Humman: Multi-modal 4d human dataset for versatile sensing and modeling","venue":null,"work_id":"88c75c8b-c5cc-4e88-8bb6-2b0d13fe7c88","year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.671765Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:a4e98a915f6552c5eea08b68ed17dc8ebd397221c72f0b4242f0d0d0ecad9a46","observation_id":"0828cac7-da62-41ed-ad7e-d9eeb71f625d","resolution":{"observed_at":"2026-08-06T17:51:00.169043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.155856Z","title":"Tightcap: 3d human shape capture with clothing tightness field","venue":null,"work_id":"01814f5a-4d68-4a3d-b073-909b94cc65a4","year":2021},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.721616Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:755c4d7a13e71e183bb61024e39c03ffbc5ab78a295fdc48d1915e1389c111ba","observation_id":"6c8f1de8-ef8f-4e7d-a8eb-839590a42726","resolution":{"observed_at":"2026-08-06T17:51:00.159465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.147335Z","title":"Decoupling zero-shot semantic segmentation","venue":null,"work_id":"ab1c6f3b-55dd-4e19-b3ff-629a3df14787","year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.763998Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:23b464873a20605a13c692f1fc2734192bf8ba9b302619837e0742474635a4f5","observation_id":"f249864c-39d3-422a-830b-1d3507fbd996","resolution":{"observed_at":"2026-08-06T17:51:00.150416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.137564Z","title":"Scaling open-vocabulary image segmentation with image-level labels","venue":null,"work_id":"6f69c5a1-f796-41cd-8c8a-edaec48d7ea4","year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.811858Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:7960f03b038ca4dcd737631484586c4c586102ae3d50624ee3fe21b368127fdd","observation_id":"196ddc8d-1809-480d-9fcd-a4871ae8e14d","resolution":{"observed_at":"2026-08-06T17:51:00.141665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.128635Z","title":"Graphonomy: Universal human parsing via graph transfer learning","venue":null,"work_id":"f7897e44-1bb5-4d3b-ae86-8b9351bad91e","year":2019},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.868087Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:0b2ac2b57cf9bd67a08f4896ecb133d45d693eadd1499f4f2ff5fae5dd27baf4","observation_id":"6e6012ee-62be-4f62-a66d-2accc3d4e61e","resolution":{"observed_at":"2026-08-06T17:51:00.131954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.118510Z","title":"Drape: Dressing any person","venue":null,"work_id":"c44e13df-9f2b-4436-9cc9-aed3d3de2afc","year":2012},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.914056Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:77ddbeb178d17bbed7dbc7a387aac841fb0ef77fc9fed69440cf986695f3c74e","observation_id":"3ea92ba1-9442-4e9e-972b-5eef680cb6b2","resolution":{"observed_at":"2026-08-06T17:51:00.122518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.108962Z","title":"On using pointnet architecture for human body segmentation","venue":null,"work_id":"f9ceb0ed-29c8-4009-9377-e3581a3cfb72","year":2019},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:51.972834Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:de5c0c91bfe92bada32c7d2e294048d1854f11113cdb05c8484db5d11d0af941","observation_id":"13a2de3f-e3d5-4afd-b2d1-6bfa2ecb823b","resolution":{"observed_at":"2026-08-06T17:51:00.111983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.099628Z","title":"Scaling up visual and vision-language representation learning with noisy text supervision","venue":null,"work_id":"0c77ad6d-8590-4273-b2d2-16447ab8f34c","year":2021},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.004117Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:942c08ad4738b425053fee1ee20f927a15c763ec2b7ea3d38e77a779d1ebde2f","observation_id":"7a6a7e2b-5a16-470c-b41f-ef6a60f42af0","resolution":{"observed_at":"2026-08-06T17:51:00.103366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.089646Z","title":"Collaborative vision-text representation optimizing for open-vocabulary segmen- tation","venue":null,"work_id":"795b62cb-e7de-49e9-92d6-57a664e72a9b","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.112765Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:b9f05eb0dbe04d8460b9be2f3d0136aebcdb0b7c11190a4b319b4b7ab7337e82","observation_id":"a4480e1e-eb9a-4ef1-b6fb-896f64d4a68f","resolution":{"observed_at":"2026-08-06T17:51:00.093118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.080017Z","title":"Sharp: Shape-aware reconstruction of people in loose clothing","venue":null,"work_id":"b328aef5-cd60-4593-8ec2-4e5e4fdd2420","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.254340Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:cb7c1a88abf7c998fccf71f3e399417e8e24ee4a70c5730fdb01b9ff0559e2f0","observation_id":"2f22b7f8-8743-4e28-91ee-3335ae6c97cd","resolution":{"observed_at":"2026-08-06T17:51:00.083932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:52.393601Z","title":"Panoptic studio: A massively multiview system for social motion capture","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.393601Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:9b07c9983d721f44dc6794315a00a88df5944a2796e0207a9da6b7e781ec02b4","observation_id":"ed8edc67-693a-4ff8-974e-65e80b6be7db","resolution":{"observed_at":"2026-08-06T17:50:52.393601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.066160Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":"fb055a73-63e4-4580-82a4-63cda50753f1","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.509785Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:20659b391e4c9658945e947339d1008967db00d80f76bdf11e898fefcd507d9f","observation_id":"3f4ccc78-6b2f-407d-a700-71ac3216cbf3","resolution":{"observed_at":"2026-08-06T17:51:00.069131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.057074Z","title":"Seg- ment anything","venue":null,"work_id":"10944c64-1253-481f-80ec-9d74b7ec5592","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.623449Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:03418826e348aa7a108fe6ce9ce88e14c7fdace0336ec81fce2d6f37e43266fd","observation_id":"c3b74b17-d313-4268-bf50-db3edc7ffc84","resolution":{"observed_at":"2026-08-06T17:51:00.060752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.048559Z","title":"Language-driven semantic segmentation","venue":null,"work_id":"f2b99822-813f-49e7-aec2-68caac346a4c","year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.731998Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:6b3d4bcdaa7bddf5f7a3228c32b8fcde9c646fb515911e7e50be95c8c2871ad3","observation_id":"f35d2bfd-2763-40c8-93ee-3a44fd79ab92","resolution":{"observed_at":"2026-08-06T17:51:00.051550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:52.874715Z","title":"Grounded language-image pre-training","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.874715Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:38e3129a8c6ea51a749da7969dae59de5676d7fcefd58a727736e7bac4a95a69","observation_id":"072c1ee0-ad73-47ac-bed0-a63285e3d746","resolution":{"observed_at":"2026-08-06T17:50:52.874715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.034852Z","title":"Open-vocabulary semantic seg- mentation with mask-adapted clip","venue":null,"work_id":"44642d18-7226-4980-ab0c-548b785018ad","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:52.961117Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:c59aa8feb3e0b0a44f610c9c8a3aa6d2ff311aa75db7be80805646478ba0c60b","observation_id":"a7ab5bf6-a1ad-4852-9e63-aac77954c4e9","resolution":{"observed_at":"2026-08-06T17:51:00.037738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.026344Z","title":"Partslip: Low-shot part segmentation for 3d point clouds via pretrained image- language models","venue":null,"work_id":"7efedd6c-6e2b-4732-a5d9-75ad198042e2","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.050398Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:96bb618dc1c39217a04065e7d77b012acf2467c75811929f143c5165053c06af","observation_id":"0230f9c1-b4bc-4cec-886f-3100b73fa80d","resolution":{"observed_at":"2026-08-06T17:51:00.029284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.018350Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":"1aa26fa2-be5f-4bd4-b966-98756fba23d1","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.125523Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:ed896883f56e1d48c602a4c2b23475bcf00d2125ceb3b0685f12eef04a07d001","observation_id":"c11611dd-2def-4013-a462-091315d6ae41","resolution":{"observed_at":"2026-08-06T17:51:00.021201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:51:00.010559Z","title":null,"venue":null,"work_id":"80d3e1c3-cebf-453c-8171-5caaeb7e0698","year":2015},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.181272Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:cbd276fe6df2f262cf7955ea2b2ee980a37cdc4bbc0105965aa236c4cf58cdf6","observation_id":"676f5f6c-4e03-4bb4-9270-1e94a8fe7527","resolution":{"observed_at":"2026-08-06T17:51:00.013344Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:53.270207Z","title":"Dynamic 3d gaussians: Tracking by persistent dynamic view synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.270207Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:9d4a3c7c1c85bd96c9e1fecbabb0fd85b7e02be5dcbaf45a8c023cbbaefe7786","observation_id":"2ef6f70e-f17b-4231-bcd0-90fcee363f37","resolution":{"observed_at":"2026-08-06T17:50:53.270207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13550","last_updated":"2025-03-28T04:36:55Z","snapshot_observed_at":"2026-07-06T19:53:21.444233Z","submitted_at":"2024-11-20T18:59:01Z","title":"Find Any Part in 3D","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13550","snapshot_observed_at":"2026-08-06T17:50:53.354726Z","title":"Find any part in 3d","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.354726Z"},"links":{"cited_paper":"/paper/2411.13550","citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:a7a2c39675ecfb6de8b5888b29bc21986fe4b8f825bdaf6db627a92071da436e","observation_id":"cfe10cad-e0ad-4536-b6e0-f4edef48df69","resolution":{"observed_at":"2026-08-06T17:50:53.354726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.996242Z","title":"Gim3d: A 3d dataset for garment segmentation","venue":null,"work_id":"b4c36118-44bf-4d59-852d-84e0d7a850b0","year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.424875Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:549b36cfbdda12360b87e3feb862be24f95b615e2bfa70ae28f337734f921334","observation_id":"d7617597-149c-484a-8a25-d484abb0bd24","resolution":{"observed_at":"2026-08-06T17:50:59.999111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.986738Z","title":"Gim3d plus: A labeled 3d dataset to design data-driven solutions for dressed humans","venue":null,"work_id":"ad443f12-2cb7-4f88-934e-61d5d94202c1","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.437337Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:c9d96a5ad09c327e0fbeae71b263ee305f8715be451847ed80668c4265ca9868","observation_id":"46328877-c7f8-47e0-a62f-a19f12e297ad","resolution":{"observed_at":"2026-08-06T17:50:59.989589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.976989Z","title":"Open3dis: Open-vocabulary 3d instance segmentation with 2d mask guidance","venue":null,"work_id":"c49f1a56-aa68-4a88-bb86-c68838953608","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.567231Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:57d87b74cdbb28c4e135a57330901554f4008d5e94e79cb3594145a4abead262","observation_id":"29f81ef1-5581-488f-ae54-7fdd62b15b5c","resolution":{"observed_at":"2026-08-06T17:50:59.980303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:53.711045Z","title":"Clothcap: Seam- less 4d clothing capture and retargeting","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.711045Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:5841d6e37c495f763d94ddd8875a55ce1e8a8c3ffd4b2a67de9524f9dd579ba1","observation_id":"f9cf4a70-018b-408b-8968-403a583d9675","resolution":{"observed_at":"2026-08-06T17:50:53.711045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.967693Z","title":"3dpeople: Modeling the geometry of dressed humans","venue":null,"work_id":"a2fa04d4-bfd9-478e-91fa-9a45ef6eaa06","year":2019},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:53.846776Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:3b0b896cf643d49f7b6acd7b8717cb21f66b53d81ecde34d4522bbcf72b61c31","observation_id":"44f3bc1c-6177-4b60-9205-9831990143cc","resolution":{"observed_at":"2026-08-06T17:50:59.970917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.958844Z","title":"Pointnet: Deep learn- ing on point sets for 3d classification and segmentation","venue":null,"work_id":"1a1f23f9-2c0d-44e2-b82b-ed0d297a98b8","year":2017},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:54.015587Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:45dba583d8c6f4e76b74958187728c616f8ad22c662b5225fbbc305cd30d7315","observation_id":"f0cc671e-bcc9-4c7b-8fd7-a861093428b4","resolution":{"observed_at":"2026-08-06T17:50:59.961700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.949522Z","title":"Pointnet++: Deep hier- archical feature learning on point sets in a metric space.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":"05ab0fb8-ffce-4b2c-bc39-23952656a542","year":2017},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:54.129526Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:3fd80e6c0f16a11cdee7c7e0dd7cc06f05de556cbedd23b9dbbb25a4ce4f1a68","observation_id":"556f39a4-ef83-401a-aae3-a0da9cf26c2d","resolution":{"observed_at":"2026-08-06T17:50:59.952514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:54.273510Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:54.273510Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:ae34941b88d04c64ce3248edfc1cea7e0c9724c32a507854fe6070f5ccbc3048","observation_id":"9994fde3-33ba-4882-a03b-81776989f172","resolution":{"observed_at":"2026-08-06T17:50:54.273510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-06T17:50:54.418338Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:54.418338Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:5f55f4a33bb139ba03188dd4bbbbdb6c7b5af1d6c130e52c4b9fe721e80aa655","observation_id":"5b06be5b-4760-4e53-b89d-b25b34921be0","resolution":{"observed_at":"2026-08-06T17:50:54.418338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.894493Z","title":"Diffusionnet: Discretization agnostic learning on surfaces","venue":null,"work_id":"8c0f08d3-9c19-42d5-bc20-d5d8c4fd42ac","year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:54.628538Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:a649f99c6054391c50cbdc9d78b9a1ff6109fe34f2b33aa2da5a4ecce2e2b772","observation_id":"671f5f06-44e2-446b-9d28-4d2e2ae4eff3","resolution":{"observed_at":"2026-08-06T17:50:59.936190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.631579Z","title":"X-avatar: Expressive human avatars","venue":null,"work_id":"be2164f6-84e9-408d-a494-1a0e549a2c0e","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:54.815056Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:46276355f9e6632585feef5a10ff98ada8fc276ba10ebef5724d6ea8c760b8ee","observation_id":"dadc746d-bcbd-4c08-9cf7-a635235182c5","resolution":{"observed_at":"2026-08-06T17:50:59.770559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.491967Z","title":"Language embed- ded 3d gaussians for open-vocabulary scene understanding","venue":null,"work_id":"fbc8c0a8-72a2-4d12-b6dd-8fca55ac860d","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:54.943716Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:50203fe2583476b7eef453bfb26552dbeea46fc5b6a43ecd9be962316101476b","observation_id":"0056e02f-e2a0-4b23-bfb6-c8bc9cdbd0d7","resolution":{"observed_at":"2026-08-06T17:50:59.554681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.229326Z","title":"Alpha-clip: A clip model focusing on wherever you want","venue":null,"work_id":"8582c7b0-648d-49ec-988e-e1c3fd4464de","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:55.086219Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:3786cb62882b1d2fdcdea4e9995635b78bfcf96d3b2a310923aabf1b92634f71","observation_id":"21dccfb2-d0fe-42c1-ae59-ce20000a6399","resolution":{"observed_at":"2026-08-06T17:50:59.354930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19782","last_updated":"2025-02-27T05:47:05Z","snapshot_observed_at":"2026-08-09T03:42:45.568819Z","submitted_at":"2025-02-27T05:47:05Z","title":"Open-Vocabulary Semantic Part Segmentation of 3D Human","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19782","snapshot_observed_at":"2026-08-06T17:50:55.291691Z","title":"Open-vocabulary semantic part segmentation of 3d human","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:55.291691Z"},"links":{"cited_paper":"/paper/2502.19782","citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:7df957ed353b2fc0fcbca874113e56070465e7f1519806c1e5bba763afee6574","observation_id":"c0b8a48a-972e-4551-8e1b-d3fde75cf4a8","resolution":{"observed_at":"2026-08-06T17:50:55.291691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13631","last_updated":"2023-10-29T14:04:25Z","snapshot_observed_at":"2026-08-05T15:00:57.933479Z","submitted_at":"2023-06-23T17:36:44Z","title":"OpenMask3D: Open-Vocabulary 3D Instance Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13631","snapshot_observed_at":"2026-08-06T17:50:55.494164Z","title":"Openmask3d: Open-vocabulary 3d instance segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:55.494164Z"},"links":{"cited_paper":"/paper/2306.13631","citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:76d2dbad9c17de51b3504d8825612078221361018a0efc58f6b356cb2b871d77","observation_id":"3c0a0a16-0a34-4cb6-a2f9-06561ad2f77e","resolution":{"observed_at":"2026-08-06T17:50:55.494164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:55.648449Z","title":"Raft: Recurrent all-pairs field transforms for optical flow","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:55.648449Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:79a0a6c60e5899e20475103362ba0fb03ba9a4bdc31da552d2df7e8c5190cf6a","observation_id":"d6d6b93f-4a6d-410b-82ae-0e11febc781e","resolution":{"observed_at":"2026-08-06T17:50:55.648449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:59.107137Z","title":"Training pointnet for human point cloud segmentation with 3d meshes","venue":null,"work_id":"c97704cc-4900-4523-a250-fedda349996f","year":2021},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:55.793500Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:e727e035435ea60930935d0eadf545c5d315e6e2721579f51155c8bfb6d069fc","observation_id":"a6928442-e950-4ad2-a5ba-b42ff8266476","resolution":{"observed_at":"2026-08-06T17:50:59.179500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:58.945461Z","title":"4d-dress: A 4d dataset of real-world human clothing with semantic annotations","venue":null,"work_id":"8235eaa7-fadd-4525-8d49-25ba54267b46","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:56.001698Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:fc5f61d630c0206ff02afc79899cbe63daf46f1eed23608b6597ea227081d796","observation_id":"f1309973-7f61-4cb5-a295-84f7313d3422","resolution":{"observed_at":"2026-08-06T17:50:59.022634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:58.772945Z","title":"Point transformer v3: Simpler faster stronger","venue":null,"work_id":"88c3fa08-0c8a-45c4-825a-6153e2b97883","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:56.193223Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:5f29ea0fdcf9e22d1c3a2d5270b7ef6bb6ae3ede07203b072379a0a0c75f4070","observation_id":"f88bfc5f-f934-4cc8-9ca7-386767f40ab3","resolution":{"observed_at":"2026-08-06T17:50:58.882442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:58.613935Z","title":"Owlii dynamic human mesh sequence dataset","venue":null,"work_id":"bd817f5a-c01c-40fe-b054-d47032bc7a4f","year":2017},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:56.402933Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:cdc6a9d1d7acf51bb0e29f3e2265b2f950e06e94815824d1c36943a9c7c2cac8","observation_id":"1d9bc7c3-6b58-48ab-876e-e6610b009572","resolution":{"observed_at":"2026-08-06T17:50:58.680700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:58.486021Z","title":"Maskclustering: View consensus based mask graph clustering for open-vocabulary 3d instance segmentation","venue":null,"work_id":"ee9371c5-c97a-4fd2-9889-12efcc16a824","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:56.556531Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:d77011bea15dcd556bfec5395c8e2dd31014216748ab85d4bd4b55aa1fa3ceaa","observation_id":"06fca95b-91bf-4ae2-aa0c-fa32d336e83d","resolution":{"observed_at":"2026-08-06T17:50:58.564510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:58.383929Z","title":"Function4d: Real-time human volumetric capture from very sparse consumer rgbd sensors","venue":null,"work_id":"5413b988-f26d-4032-a2fc-dfdc7e362492","year":2021},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:56.722934Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:df4221a69064bbccf626d6af1ba902b50b3d0037b4b53a7c46c88c489a9fee35","observation_id":"d34dde30-9d5c-4176-9e96-9299ff85016f","resolution":{"observed_at":"2026-08-06T17:50:58.432785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:56.882521Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:56.882521Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:55c348297bac55277365cf9b33386b3a083e8e239065abf6bd21b49ec4132fab","observation_id":"721c34cd-ec02-4947-96ee-7ba09cb7fc58","resolution":{"observed_at":"2026-08-06T17:50:56.882521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:58.244206Z","title":"Black, and Gerard Pons-Moll","venue":null,"work_id":"259b5cf2-1fb6-43b7-85d8-f1f21b6cd173","year":2017},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:57.052427Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:ee230eec2b183b42db146d00b48b146e9a2f4d24304d7d9b5105900cfb207aa3","observation_id":"1fcad798-6ff7-4519-9cdf-b1fe013a18da","resolution":{"observed_at":"2026-08-06T17:50:58.312943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:57.129829Z","title":"Dreamlip: Language-image pre-training with long captions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:57.129829Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:31a1ef34a426fed8126123cba9c0a81dd1f540de867c48b98c9f9faca9ab546c","observation_id":"7d3154e4-d944-4d4a-82a2-0a967dd9d2ab","resolution":{"observed_at":"2026-08-06T17:50:57.129829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:58.113833Z","title":"Structured local radiance fields for human avatar modeling","venue":null,"work_id":"3ee9e538-909f-4edb-ab34-463e10d0dadd","year":2022},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:57.218509Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:c06990ce54723deb265fbe7449f27a5b894d3cc52e8a18fd743a630db19066a6","observation_id":"20f5d254-dd32-4248-b0a1-bd4cf19bf3f8","resolution":{"observed_at":"2026-08-06T17:50:58.175931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:57.961946Z","title":"Meshsegmenter: Zero-shot mesh semantic segmentation via texture synthesis","venue":null,"work_id":"0552a51d-2de9-4193-bed4-333dc7bd1dcb","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:57.286502Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:2826754f8fd0cf11244dd607faf92dc630b5ac86788ca05f35771d625894906b","observation_id":"371e72d2-600c-4b41-9b48-0c438bf4f12d","resolution":{"observed_at":"2026-08-06T17:50:58.027730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03015","last_updated":"2023-12-05T01:33:04Z","snapshot_observed_at":"2026-08-10T21:09:12.813464Z","submitted_at":"2023-12-05T01:33:04Z","title":"PartSLIP++: Enhancing Low-Shot 3D Part Segmentation via Multi-View Instance Segmentation and Maximum Likelihood Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03015","snapshot_observed_at":"2026-08-06T17:50:57.346539Z","title":"Part- slip++: Enhancing low-shot 3d part segmentation via multi-view instance segmentation and maximum likelihood estimation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:57.346539Z"},"links":{"cited_paper":"/paper/2312.03015","citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:a10ba1909b9cf57e2166fe4aea1945d3413ebb993c3e843f1691bf96d35547d3","observation_id":"5a010451-e3d8-444c-90bc-160beb3f0b07","resolution":{"observed_at":"2026-08-06T17:50:57.346539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:57.785529Z","title":"Open-vocabulary 3d semantic segmenta- tion with text-to-image diffusion models","venue":null,"work_id":"d809d6cb-3289-410a-8927-9f8e010fa8b1","year":2024},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:57.413491Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:340a06c8b21a89ccbf66ecc12d1de87e8b0ad6c100ddcf9be934d9fdc0791be7","observation_id":"8dd2f6d1-97d3-4398-a626-8a52dec14a95","resolution":{"observed_at":"2026-08-06T17:50:57.868416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:50:57.643180Z","title":"Cloth4d: A dataset for clothed hu- man reconstruction","venue":null,"work_id":"c3817066-6810-4b18-9047-e4c665f5a281","year":2023},"citing_paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T17:50:57.511667Z"},"links":{"citing_paper":"/paper/2507.09880"},"observation_digest":"sha256:2c102e6aa9eef5684bbed2c866bdc81cfabec3b768d12d646004fc53c9244a69","observation_id":"589122ea-b856-44d6-8848-19cd56b2285a","resolution":{"observed_at":"2026-08-06T17:50:57.695755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.09880","last_updated":"2025-07-26T02:39:46Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T02:43:31.221245Z","submitted_at":"2025-07-14T03:35:06Z","title":"OpenHuman4D: Open-Vocabulary 4D Human Parsing"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":41},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 0 inbound Pith citation observations for arXiv:2507.09880."}