{"as_of":"2026-08-10T20:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0df92788afb4116d170dc2611bb1cb3238d7d03fb285509cce09822d8c439e94","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:54:45.097397Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.12336/citation-record","integrity":"/paper/2507.12336/integrity","json":"/paper/2507.12336/citation-record.json","paper":"/paper/2507.12336"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.817837Z","title":"Label-efficient se- mantic segmentation with diffusion models","venue":null,"work_id":"41b4e279-d0f1-40cd-a2e0-d56c3c943e74","year":2022},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.760926Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:8f00f42d12c27eda4ba94626e26e74241b8dfaefd4af95ad88bd4140dba4e540","observation_id":"600bfaa6-b442-4876-b188-23f368edbdb0","resolution":{"observed_at":"2026-08-06T16:54:45.821306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.809699Z","title":"unsupervised-disentagling.https : / / github","venue":null,"work_id":"2b29cf21-7a04-4bba-b428-6af068d37fe8","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.826904Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:404bbb088addeb90b2eb88e307d4cf0d244b12e8ad0079850a55226383af08b7","observation_id":"a56347aa-ee60-4cfe-a49f-09c435b1d548","resolution":{"observed_at":"2026-08-06T16:54:45.812603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.800557Z","title":"3d pictorial structures for multiple view articulated pose es- timation","venue":null,"work_id":"e4f4d9b3-eb3f-4d30-ba49-a48601d4589f","year":2013},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.873751Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:f996a4c4446f1ae782d868eeb403ad8d79bab4b25580490be2c5532c12f9d9ce","observation_id":"91fc554c-e12d-47e1-8737-607aab04a9e1","resolution":{"observed_at":"2026-08-06T16:54:45.803870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.790467Z","title":"Unsupervised 3d pose estimation with geometric self- supervision","venue":null,"work_id":"8ec8ee24-a370-4807-a035-ccf922126153","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.878514Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:e3e577201beec00ddbf9bc05bfd96f376517ae1eaedb47274c745e2ae1eac490","observation_id":"844f2d6b-c060-4905-b83e-0fe415daca2a","resolution":{"observed_at":"2026-08-06T16:54:45.793536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.782403Z","title":"Unsupervised part discovery from con- trastive reconstruction.NeurIPS, 34:28104–28118, 2021","venue":null,"work_id":"2d97d598-0458-4899-bd39-0763b327ff93","year":2021},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.882482Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:5b31bccd9b80922753c38d14db04108948e545a05d27ce8b48fb32444050fa11","observation_id":"36052c8f-7577-41da-90af-15ae7011cc7a","resolution":{"observed_at":"2026-08-06T16:54:45.785091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.774910Z","title":"Google scanned objects: A high- quality dataset of 3d scanned household items","venue":null,"work_id":"839a26e8-00cc-402a-bb3b-166a66b359cd","year":2022},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.885869Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:b95f48110ae604ed76f2e8aaccb8f85ab4445caa4d43380bde01612f3dc404e4","observation_id":"f2481b3a-a529-4c92-a5c4-b80712ff44ea","resolution":{"observed_at":"2026-08-06T16:54:45.777881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.766168Z","title":"Can 3d pose be learned from 2d projections alone? InECCV, pages 78–94, 2018","venue":null,"work_id":"0e583dc0-8240-436c-be5c-b01b59b39ecc","year":2018},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.889276Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:bf4d93fc8e89e06ac05522390a484463eab857b5303e962fe61ab002a1c656d8","observation_id":"eab28200-bd8d-4084-b56f-1daa753bfe09","resolution":{"observed_at":"2026-08-06T16:54:45.769369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.757553Z","title":"Gaussian frosting: Ed- itable complex radiance fields with real-time rendering","venue":null,"work_id":"da123999-ecee-44fb-9863-0d0c4a1a7ec3","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.893051Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:da85b6358abb37663317e923c097e922f09ab1ad2923695a1efe2847d94e5030","observation_id":"d54cf6fb-050b-4094-bc2c-d6e0767d7f6e","resolution":{"observed_at":"2026-08-06T16:54:45.760380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.749862Z","title":"Deepfly3d, a deep learning-based approach for 3d limb and appendage tracking in tethered, adultDrosophila.eLife, 8:e48571, 2019","venue":null,"work_id":"2c49afd2-ca8f-4c1f-84de-e66342a10bd5","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.896205Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:53369732e63def624b8dbbb08f2771d86819f98acc2aa511af054c53ea9979ed","observation_id":"274b67db-543d-4ca7-8106-dffbacf5e12f","resolution":{"observed_at":"2026-08-06T16:54:45.752957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.740896Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"f230099d-a618-4381-bc4f-9dbaa002a377","year":2016},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.898886Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:4f76f9a888b76d513744882bf950905de75ec9860558ff479aa8001877283076","observation_id":"1ead2554-ee4f-412b-80e3-650632d95b52","resolution":{"observed_at":"2026-08-06T16:54:45.743940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.15812","last_updated":"2024-10-13T19:57:19Z","snapshot_observed_at":"2026-08-09T16:09:22.294530Z","submitted_at":"2021-03-29T17:59:10Z","title":"LatentKeypointGAN: Controlling Images via Latent Keypoints","version":5},"cited_work":{"arxiv_id":"2103.15812","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.15812","snapshot_observed_at":"2026-08-06T16:54:45.144350Z","title":"LatentKeypointGAN: Controlling Images via Latent Keypoints","venue":"cs.CV","work_id":"4ca2a991-d48d-4d3e-9c00-43b20986b705","year":2021},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.901429Z"},"links":{"cited_paper":"/paper/2103.15812","citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:46fbe15ba0c06c4db7c761a5332449a5cc2daa723f8c676da22727c7c0fe8317","observation_id":"54fcd3e8-dae4-4f71-9f6a-b035b3d21d77","resolution":{"observed_at":"2026-08-06T16:54:45.150662Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.733017Z","title":"Autolink: Self-supervised learning of human skeletons and object out- lines by linking keypoints.NeurIPS, 35:36123–36141, 2022","venue":null,"work_id":"30233abc-3e87-4e11-b7c8-2c408b8a5264","year":2022},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.905205Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:0d8406f9f9c6c9dc4a6d8f610bc84b545c3b1a7b60a96a72e840670b41aee4d3","observation_id":"df32b6d1-7749-4d63-935c-ba7b7946fa91","resolution":{"observed_at":"2026-08-06T16:54:45.736161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.722511Z","title":"Ganseg: Learning to segment by unsupervised hierarchical image generation","venue":null,"work_id":"b28c963b-be15-4db7-95b5-6a8d89ad91c6","year":2022},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.908585Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:b8209047389fcc1be0dbb685ca8436987facf26bd8629c2481e330e9d1951da2","observation_id":"5a3d6d6d-2511-482e-a719-4ee8c0424311","resolution":{"observed_at":"2026-08-06T16:54:45.726236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.713158Z","title":"Unsupervised semantic correspondence using stable diffu- sion.NeurIPS, 36:8266–8279, 2023","venue":null,"work_id":"d3df90f7-6168-4904-a46d-c7b63b298995","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.911971Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:b4c41976d5c94d1658779cbcf6aabc1c1d83ae571da1592407cf412e723a1310","observation_id":"41567217-3815-41f1-abcf-cdb86b6d935e","resolution":{"observed_at":"2026-08-06T16:54:45.717283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.703018Z","title":"Unsupervised keypoints from pretrained diffusion models","venue":null,"work_id":"e8364f40-30bb-4541-adcc-caf993408519","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.915205Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:3487f441e1c3b774bcc79c606ca481a8f7d906106f595cfbf4d61344dfab693c","observation_id":"a3577097-3702-4626-ab48-dae2db58132e","resolution":{"observed_at":"2026-08-06T16:54:45.706991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.695405Z","title":"Unsupervised 3d keypoint discovery with multi-view geom- etry","venue":null,"work_id":"dcc2f29e-26b4-472a-842e-b5f5830c54fa","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.918245Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:b2c041a4c200db23e05b6ae0382003ac15313756efeec61613680e39de9ac7b8","observation_id":"f9798236-834f-4033-ae46-13253b24ec01","resolution":{"observed_at":"2026-08-06T16:54:45.698498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.686154Z","title":"Scops: Self-supervised co-part segmentation","venue":null,"work_id":"d8669053-ea00-4fec-8667-90a3ef1f670a","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.921165Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:febfa751ca3ebc8e9a8dfefe19752457c0e38e483ec5648426a4b73243f992e0","observation_id":"b574b38b-5442-4500-a556-c6deb4c01004","resolution":{"observed_at":"2026-08-06T16:54:45.688999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.678565Z","title":null,"venue":null,"work_id":"828ec624-0208-4c3d-8ea3-6ed0570084f7","year":2013},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.923837Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:450c3379ee04a4533dc0a201e54d32f88cfcc44fea1aed0ba2406969d38fc9e7","observation_id":"aa31817a-d1a5-4f58-ac3f-be68e8a61804","resolution":{"observed_at":"2026-08-06T16:54:45.681249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.668983Z","title":"Weakly- supervised 3d human pose learning via multi-view images in the wild","venue":null,"work_id":"3935d736-0b6c-4611-8e60-38faf65f4c11","year":2020},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.926823Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:f1e2be7c03702b43cb0b7c0865ff0dd3dd59ad4b0ecf1caf7cb1c863131c00a7","observation_id":"9854f9a4-1bd3-4070-b1e1-687b91c1a027","resolution":{"observed_at":"2026-08-06T16:54:45.671955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.659946Z","title":"Learnable triangulation of human pose","venue":null,"work_id":"279be3f4-f2db-47c2-a52e-09ef307fa641","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.929591Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:890a94a5c23485971bc5311de461b24e9c025650095ab4dc4554026dc6fc99ff","observation_id":"eeff1846-3b49-4258-aa67-3b7605f73bb8","resolution":{"observed_at":"2026-08-06T16:54:45.662666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.652064Z","title":"Unsupervised learning of object landmarks through conditional image generation.NeurIPS, 31, 2018","venue":null,"work_id":"2502e023-b39d-4e64-b49c-f4574b11ef26","year":2018},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.933136Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:0da745a7480ac45ad32c537a17e4da89d4de8760a1f88b833ee86462838fd8e1","observation_id":"5a892b0b-fe1a-46f5-8c9f-17e71e718d30","resolution":{"observed_at":"2026-08-06T16:54:45.655513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.643721Z","title":"Rupp, Evyn S","venue":null,"work_id":"68f96a26-867d-42f1-b0af-fd4efcc85213","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.936293Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:88c0f30525de9e7b01c3eb4a3aba825f77be6c21f9c8db6654b7abc8c085e644","observation_id":"b0af075e-7ea8-4dde-8586-d9e0d531db5e","resolution":{"observed_at":"2026-08-06T16:54:45.646736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.635681Z","title":"3d gaussian splatting for real-time radiance field rendering.ACM TOG, 42(4), 2023","venue":null,"work_id":"393182bc-4799-4975-a687-72f24d088932","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.939791Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:6e42448675e1a1d5b6cb8d504de043adadb3160ac287c2a1b337bff7ff280883","observation_id":"efa7cf98-ac30-4166-8a1f-21216d781585","resolution":{"observed_at":"2026-08-06T16:54:45.638824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.625850Z","title":"Novel dataset for fine-grained image categorization","venue":null,"work_id":"0f65bb0a-4d6b-4c97-b839-41350962ede1","year":2011},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.942428Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:e05fb219f99fc253877e94c81f742ee56014afff0aca238bcf1c276a169d7284","observation_id":"bf304c4c-30c0-4511-9546-e7a1702d92a6","resolution":{"observed_at":"2026-08-06T16:54:45.628923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.616641Z","title":"Unsupervised keypoint learning for guiding class- conditional video prediction.NeurIPS, 32, 2019","venue":null,"work_id":"0a0399d0-fd0e-4660-a181-f85f2c49ea6e","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.945601Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:64b9a33a23b2a2610c5dda5335836b718244297863a60f791a5c4092869e9277","observation_id":"1eb1494a-687d-41c8-96cd-e95cb775958e","resolution":{"observed_at":"2026-08-06T16:54:45.619585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.607117Z","title":"Self- supervised learning of 3d human pose using multi-view ge- ometry","venue":null,"work_id":"c0e62dec-3085-40ef-a80d-b18b3fcfeaa1","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.948158Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:8c4f1d5920b6c8a06eed0d5688a1fbf76c031c3a6c4921034638610d29c76493","observation_id":"64b70b43-a181-47af-ab8a-1c8d0bcb164c","resolution":{"observed_at":"2026-08-06T16:54:45.610119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.597326Z","title":"Eschernet: A generative model for scalable view synthesis","venue":null,"work_id":"5ea29bd6-b9ea-410a-8496-6e41bbf2ad35","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.951318Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:daa9c17d7dd715ba4296d97e94803f46c50852e80d8d13671840e771dbf5f549","observation_id":"b384d3b2-7602-4b12-9d02-c96c35418558","resolution":{"observed_at":"2026-08-06T16:54:45.600074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.589104Z","title":"Unsupervised learning of object keypoints for perception and control.NeurIPS, 32, 2019","venue":null,"work_id":"11a63cc6-1738-4f0f-bb97-a0551b4a64d3","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.954067Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:406b9d2c7d5e0529ed2d4ce0b5801da1068ab74d40c6d34fe229a491242e263a","observation_id":"34e5675b-3c36-4e2a-8d34-fb4c18478d80","resolution":{"observed_at":"2026-08-06T16:54:45.591908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.580622Z","title":"Self-supervised 3d human pose estimation via part guided novel image synthesis","venue":null,"work_id":"cb59b6bf-df1d-475c-81d9-4ad4de8ec73d","year":2020},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.957370Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:b07ff8d7efa57a6eab526e560b05c8a51837ad2f9d5580d49db3bd7992b80bee","observation_id":"18f04a20-a92e-49ac-ad3a-a723f861d62d","resolution":{"observed_at":"2026-08-06T16:54:45.583844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.570790Z","title":"Kinematic-structure-preserved representation for unsuper- vised 3d human pose estimation","venue":null,"work_id":"53a079d9-5e04-43f0-9153-73679ec0e8bf","year":2020},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.960444Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:d32392b8a6167b076978ff3db523626a213efa699070bda51a300ddbaad2372f","observation_id":"596efd4c-4baf-4a88-9453-df52a74ee341","resolution":{"observed_at":"2026-08-06T16:54:45.574338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.561197Z","title":"3d human pose estimation from monocular images with deep convolutional neural net- work","venue":null,"work_id":"bd447a35-97ab-4bf7-b2e5-86503c286faa","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.963133Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:970ffac1eb8500494da41c8169baa7dc6fa02389ea036bee9762f44a0886f77c","observation_id":"f6b4721b-20ae-4a63-b5bd-41a08743730c","resolution":{"observed_at":"2026-08-06T16:54:45.564747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.551835Z","title":"Geometry-driven self- supervised method for 3d human pose estimation","venue":null,"work_id":"7257f056-c7eb-4c05-9bbb-ebb4e18909a2","year":2020},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.966162Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:d8b0aa2202f666716848707a0a73fd12b1a20236bedf888f0fa8c9a005811178","observation_id":"ffb7d838-3b25-4dd6-987b-e4f091692e68","resolution":{"observed_at":"2026-08-06T16:54:45.556078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.540666Z","title":"Multiple view geometry transformers for 3d human pose estimation","venue":null,"work_id":"cfdaf475-08f5-4504-900f-bf735a9f7ec4","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.968704Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:30ca5652e9b1ea2a68855a80809456c651a0041eff5a1cc51e6f1f19c275ea98","observation_id":"60ac9225-19b1-4ff3-a237-9ea90428a6f9","resolution":{"observed_at":"2026-08-06T16:54:45.544885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:44.971852Z","title":"Syncdreamer: Gen- erating multiview-consistent images from a single-view im- age","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.971852Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:6e70494b523fef6eb79769f6005fc60af7b6cf75db6944abdad48f226352a1fb","observation_id":"b31fc2c3-a719-425e-bfbb-40cad54f7603","resolution":{"observed_at":"2026-08-06T16:54:44.971852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.527184Z","title":"Unsupervised part-based disentangling of object shape and appearance","venue":null,"work_id":"e30744a1-4a2e-4658-87fe-89e8f2759592","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.974996Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:f20d1500179cadc36ef2d5314dd22b4fba93ac69e19f20128b17700d63fc136a","observation_id":"44385957-820a-4f83-9afe-8ae671b128d8","resolution":{"observed_at":"2026-08-06T16:54:45.530317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.516905Z","title":"Diffusion hyperfeatures: Search- ing through time and space for semantic correspondence","venue":null,"work_id":"74f93e35-550d-4c96-ba52-9d8438e5dfe4","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.977622Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:ddc185225327ba10384e8b5d609218a8f25428ba53a0faf9274e73f6a5169c92","observation_id":"a02c7071-d310-4259-9103-fbfb83de62b7","resolution":{"observed_at":"2026-08-06T16:54:45.520619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.507110Z","title":"A simple yet effective baseline for 3d human pose estimation","venue":null,"work_id":"bdc96f8d-3d68-4628-8f83-d5411efee2ff","year":2017},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.980222Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:cb601fc4132e37645247a99a246d5e16165f17910c491cfa3bc4fc8a6ebaabe3","observation_id":"bac6a18f-d167-46db-9317-bd4a6c637c5e","resolution":{"observed_at":"2026-08-06T16:54:45.510939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.495874Z","title":"Unsupervised learning of object structure and dynamics from videos","venue":null,"work_id":"08188045-c801-4806-8045-b4d2472e84f1","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.983110Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:0501dc862c19298fabfb3c8eed755ff9c231fd922066affbfda0070bd34e6cc4","observation_id":"851966a6-239e-484d-811a-587075e8182b","resolution":{"observed_at":"2026-08-06T16:54:45.498967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.483862Z","title":"V2v-posenet: V oxel-to-voxel prediction network for accu- rate 3d hand and human pose estimation from a single depth map","venue":null,"work_id":"fac72af7-928d-4656-862a-4e6612e6150c","year":2018},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.985454Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:3665e0f2de7fb111955d311641ac3570381ccf8daec4baba957df7f860e305bc","observation_id":"aabd093f-9add-42f7-93f7-dfbc8f90c007","resolution":{"observed_at":"2026-08-06T16:54:45.488856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.473679Z","title":"Emerdiff: Emerging pixel-level semantic knowledge in diffusion models","venue":null,"work_id":"7cc69520-6a5e-405a-9b0c-66834b381435","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.988472Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:c5583167959bc158924f6f33425d37362f8b08b731a9d6c1d8b1ea7928924079","observation_id":"5d368dd7-c1c1-4293-9745-3a5e693f3059","resolution":{"observed_at":"2026-08-06T16:54:45.477544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-09T18:02:17.307812Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T16:54:44.990978Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.990978Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:c42cdd354ae87bb5e0ab03d568093c5da5b8ca918ba44bddd9fc8481d185cc1f","observation_id":"2fc7eda0-fcd4-4d5e-b824-d2aeed2388c2","resolution":{"observed_at":"2026-08-06T16:54:44.990978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.463938Z","title":"3d human pose estimation using convolutional neural networks with 2d pose information","venue":null,"work_id":"138675af-171c-403b-8f2f-82cf5195fb35","year":2016},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.994325Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:0e598e8245232fb35b513a980d4cb61ca2656778f9fa6c66047bfcccc7cc6728","observation_id":"c140a581-430a-4590-8f19-5aaea3705803","resolution":{"observed_at":"2026-08-06T16:54:45.467251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.454557Z","title":"Harvesting multiple views for marker-less 3d human pose annotations","venue":null,"work_id":"a3d02c5b-7044-4fc8-b968-3fe6f1feb6b4","year":2017},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:44.997756Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:3fc6298353d57825ff733937901d8aa46ba9f6bc8560765e95aac2160e1ada3a","observation_id":"9413047f-9248-43e3-8bcd-d1bdd27af813","resolution":{"observed_at":"2026-08-06T16:54:45.458527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.444690Z","title":"Perazzi, J","venue":null,"work_id":"719fd8c8-575a-400c-a1d7-bf82de44de85","year":2016},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.000829Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:1d0b1eb7d8bfc34b48bec2adf33741b11181250c7101764d4a3914a9704b7d28","observation_id":"d20b204d-0601-490f-9645-811e857ce7fa","resolution":{"observed_at":"2026-08-06T16:54:45.448240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.436061Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"077a1e44-1e71-4c01-8049-dd5804e07308","year":2021},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.003364Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:42930d62aa0bae6ec38af09f6f0357fd58fc10d55281045771517d1a9e03f810","observation_id":"591942a7-0a4f-4386-bdae-7d4055fd426f","resolution":{"observed_at":"2026-08-06T16:54:45.439671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.006445Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.006445Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:d676898942b3579f56a9e0c8185d8963e1703846eb190c8ea2cb48f13b43013b","observation_id":"a825af59-3fb4-4662-8f2b-2519804d65a3","resolution":{"observed_at":"2026-08-06T16:54:45.006445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.422232Z","title":"Black, and Silvia Zuffi","venue":null,"work_id":"68fa7a06-359e-42b5-9e76-0ef4c2076918","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.009363Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:2c07d3fbe6ad140d26de48bab0fb28b52afcc5b3e2c53e74006452126845f0d9","observation_id":"49e0a8df-5db6-4515-a4a2-5529c1aa9de2","resolution":{"observed_at":"2026-08-06T16:54:45.425397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.011770Z","title":"3d human pose estimation: A review of the literature and analysis of covariates.Computer Vision and Image Understanding, 152:1–20, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.011770Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:88a723828b534fc36e6e72746e6df14c102e7a785ac2da973174454172f34e0d","observation_id":"e2a1e5e6-d668-49cf-8c5b-8a509a03daa3","resolution":{"observed_at":"2026-08-06T16:54:45.011770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.409426Z","title":"Animating arbitrary objects via deep motion transfer","venue":null,"work_id":"0d74e9c2-4a23-43b9-9cb2-16ab6a666339","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.014128Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:2951d127d3a64d1d50cf916d1cfae5f70532a26ab56d7fe60e14387547f27a5a","observation_id":"bfd79a7b-ec8e-4569-bd22-c4267b321098","resolution":{"observed_at":"2026-08-06T16:54:45.412315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.400260Z","title":"First order motion model for image animation.NeurIPS, 32, 2019","venue":null,"work_id":"2e58e02e-ce76-4634-a699-0219dbb57081","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.016754Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:eadbd62f2a59b2a3acb374bacc60c8e452c16ad4e3e07a84f54b61c079abc733","observation_id":"ab4ec296-3e85-44a8-9d18-062f15d1e648","resolution":{"observed_at":"2026-08-06T16:54:45.402908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.392106Z","title":"Motion- supervised co-part segmentation","venue":null,"work_id":"0a7931c7-577b-49c2-8f18-96a3331b1c82","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.019617Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:cb3c94b8fc94d2338870e13c4a5a5f7fefd5234e4bf8589f24f2d899af59f7f9","observation_id":"c15a96c3-6bb5-4934-8f5e-c54fc4e6ffe3","resolution":{"observed_at":"2026-08-06T16:54:45.395884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.382583Z","title":"Self-supervised 3d human pose estimation from a single image","venue":null,"work_id":"8c9a1795-72bd-4e79-b93c-688ce7453e3c","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.022288Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:20c5f78a259c15910c9d3989d5ab43eeee6a7489d542d789756b6215b33eb9bc","observation_id":"f68c458b-6e67-4a63-85cc-7b439dfe5e7a","resolution":{"observed_at":"2026-08-06T16:54:45.385782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.372757Z","title":"Self-supervised keypoint discovery in behavioral videos","venue":null,"work_id":"49706c84-cdad-4469-ac69-beb1231cde11","year":2022},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.025133Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:58d8e9122c98ea7efe861b58b1aa43c5d86ddf3970f1fe16a0ab6c74e414f9ca","observation_id":"721cdcb6-2295-44d5-94ff-c8ea84630cdd","resolution":{"observed_at":"2026-08-06T16:54:45.376627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.362714Z","title":"Bkind-3d: Self-supervised 3d keypoint discovery from multi-view videos","venue":null,"work_id":"7fd5e64f-82d9-4332-a657-2457f9e69f6b","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.028152Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:6bfef5fabda34c9ce8a2283654c156df15d93334b57349703ad0da5ab1b1fdb6","observation_id":"af504f8a-a416-4dc5-ac2d-b05a1440762b","resolution":{"observed_at":"2026-08-06T16:54:45.366527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.353833Z","title":"Integral human pose regression","venue":null,"work_id":"6c1540a5-f827-4d38-9834-e49d824b36d4","year":2018},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.030867Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:12fe83797e8e503888d5a15ee6cde0176cd9a8dea0f158029ee022dcf761be0e","observation_id":"7fd008ec-ee94-4201-bc65-ca409eb9c00e","resolution":{"observed_at":"2026-08-06T16:54:45.357250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.342807Z","title":"Discovery of latent 3d key- points via end-to-end geometric reasoning.NeurIPS, 31,","venue":null,"work_id":"7a93cc57-c2f6-49b9-8d89-cd14e3531b32","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.033297Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:c6cfbea0af7ecbacedc74265fba8be3b444fb4dc148bb2809c7d11ebd83218d1","observation_id":"dd104d49-819d-40c9-b5a7-54dabd0288ce","resolution":{"observed_at":"2026-08-06T16:54:45.347170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.332498Z","title":"Emergent correspondence from image diffusion.NeurIPS, 36:1363–1389, 2023","venue":null,"work_id":"984e880d-2b61-4e75-8814-3b8866a64ebd","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.036297Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:34bacb8e50075f110ee71b7d6a250bfeccf2b02c1365aded3d2f2ae461bebcbe","observation_id":"bc2fa0d7-8a49-4765-a0a7-7f66070dba6d","resolution":{"observed_at":"2026-08-06T16:54:45.336175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.321553Z","title":"Unsu- pervised learning of object landmarks by factorized spatial embeddings","venue":null,"work_id":"c8eaa7b4-d1a2-4256-a4dc-b027594b594d","year":2017},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.039548Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:30c71f9482dc5abdc520ff896279af804561f0587fa0635646962be8982e582f","observation_id":"91656dec-4012-4137-bfd8-cf67df1e2c2c","resolution":{"observed_at":"2026-08-06T16:54:45.325428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.311932Z","title":"Metapose: Fast 3d pose from multiple views without 3d supervision","venue":null,"work_id":"fb9abc86-16b6-4687-b7d9-ebebae897224","year":2022},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.042211Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:c5f20cb1009c6fa96c40400de9aa5ace8f4c8cfdc4a57f6d0b3c8c955bce6e32","observation_id":"b89a981e-d746-4314-9e97-fa5e25161cec","resolution":{"observed_at":"2026-08-06T16:54:45.315232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.301980Z","title":"Sv3d: Novel multi-view syn- thesis and 3d generation from a single image using latent video diffusion","venue":null,"work_id":"59648c19-6fa2-4f76-a1b6-dfbcd5f49905","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.046203Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:4e816fc4cd8388f1cb116b108b763404e1861783589caf56a032ebc459815a8d","observation_id":"63e342aa-fc6a-4d00-b68b-f8d2a812d9c0","resolution":{"observed_at":"2026-08-06T16:54:45.305541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.292140Z","title":"The caltech-ucsd birds-200-2011 dataset","venue":null,"work_id":"849f5f2d-6407-4129-892e-d7f4c8769181","year":2011},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.049716Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:20581e2398c70c16540180c54ef6d33c15067083508280ab7d83ac29073431c9","observation_id":"1a125d26-3771-4533-8778-936fc61b7d64","resolution":{"observed_at":"2026-08-06T16:54:45.295937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.281144Z","title":"Repnet: Weakly super- vised training of an adversarial reprojection network for 3d human pose estimation","venue":null,"work_id":"b2c5bd64-b91c-4c90-8f13-a55a1e98940c","year":2019},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.052432Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:e3de28d4f7c37501949de3cc9672a3a1814272e244a42e380a49bf610b1fbef2","observation_id":"b26de1b1-02ce-42f6-b951-c5c034c9a3ec","resolution":{"observed_at":"2026-08-06T16:54:45.284901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.270993Z","title":"Canonpose: Self-supervised monoc- ular 3d human pose estimation in the wild","venue":null,"work_id":"2fb8a60c-27c9-43b2-a6b0-dc0c2826ecc4","year":2021},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.055865Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:f57959fafaf0b4c161f102decad1009658dcf02be805e0c6c673283026e10aba","observation_id":"a8848561-c257-4137-9cf7-467a52a70ac0","resolution":{"observed_at":"2026-08-06T16:54:45.274565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.260546Z","title":"Ele- pose: Unsupervised 3d human pose estimation by predict- ing camera elevation and learning normalizing flows on 2d poses","venue":null,"work_id":"4f93cbd0-a905-4d86-b45f-9bce6b6f04c0","year":2022},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.059156Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:53d1da7375e1b83025ee2c77139f3a51b5428f5e65714e5dfc7400c14bf06481","observation_id":"affb6c32-f5ef-43b0-a070-4e6fa3ecb18f","resolution":{"observed_at":"2026-08-06T16:54:45.264644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02201","last_updated":"2023-12-02T20:41:27Z","snapshot_observed_at":"2026-08-10T05:09:57.293983Z","submitted_at":"2023-12-02T20:41:27Z","title":"ImageDream: Image-Prompt Multi-view Diffusion for 3D Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02201","snapshot_observed_at":"2026-08-06T16:54:45.062047Z","title":"Imagedream: Image-prompt multi-view diffusion for 3d generation.arXiv preprint arXiv:2312.02201, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.062047Z"},"links":{"cited_paper":"/paper/2312.02201","citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:279da9faa05c46496f45307949574cd45acf19c853530bef8b6669820d4a385b","observation_id":"3e1064d6-d90e-4dc1-922a-104f28967448","resolution":{"observed_at":"2026-08-06T16:54:45.062047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.249982Z","title":"Open-vocabulary panop- tic segmentation with text-to-image diffusion models","venue":null,"work_id":"b44d88b0-0e6d-43a3-a99d-466cd32ac31c","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.065262Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:f84ef36ac5f110690b194c24fea0c3cdf7fe8ec2b7c809970c5b7a8da7acb256","observation_id":"5264f4eb-6b99-4a26-a353-f153729a5b9a","resolution":{"observed_at":"2026-08-06T16:54:45.253973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.240910Z","title":"Diffusion model as repre- sentation learner","venue":null,"work_id":"be91bff6-414f-41bd-b412-512a653c4c58","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.068499Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:6bd6df8b0b9cb5140a68cd280ba4ed5333a6638103ce373a6868a094865fc492","observation_id":"dfac2994-69da-4bce-bfc3-04f362a99600","resolution":{"observed_at":"2026-08-06T16:54:45.244528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.233070Z","title":"Mask-as-supervision: Lever- aging unified mask information for unsupervised 3d pose es- timation","venue":null,"work_id":"375aec11-3e3d-41f3-b273-00c9258c46db","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.072751Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:24f6ac10094ec3aa14bc7fcd039b6e7fbe913a629bd8b60ae76e46e37e8327e6","observation_id":"29c4137e-caed-40cd-867d-6b3a125643b8","resolution":{"observed_at":"2026-08-06T16:54:45.235942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.223256Z","title":"Ap-10k: A benchmark for animal pose esti- mation in the wild","venue":null,"work_id":"f84ff903-76e8-4529-bf36-6191f8eec7e9","year":2021},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.076116Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:f49f9cc1a5560a8dd5386979dfaa1a8866cbaa1a11742ff2974b15c33241c26f","observation_id":"95d7ff62-6b01-49aa-a068-6ea0996e394b","resolution":{"observed_at":"2026-08-06T16:54:45.226919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.214818Z","title":"Exploring diffusion time-steps for unsupervised representation learning","venue":null,"work_id":"02bee228-9e39-4b6a-aadc-2b028f33b08b","year":2024},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.078911Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:5c479b99a5a05fbb9803d9204b0ee5637601b61cef9fdc84d4bdcbcc254ba370","observation_id":"da73eaae-1110-43d0-880a-181b3d0f5292","resolution":{"observed_at":"2026-08-06T16:54:45.217885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.204207Z","title":"A tale of two features: Stable diffusion complements dino for zero-shot semantic correspondence.NeurIPS, 36: 45533–45547, 2023","venue":null,"work_id":"ce414bf3-9726-415f-ae3f-a3458c44b013","year":2023},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.081650Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:ae6e1a106df06535ad9a90f4eb2e8e9f832a6c03983a0dcab2c58f4249c358ad","observation_id":"f50187fe-0b96-432e-a1f1-37d3aee1b44b","resolution":{"observed_at":"2026-08-06T16:54:45.208565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.193623Z","title":"Unsupervised discovery of object land- marks as structural representations","venue":null,"work_id":"538c6fdc-73af-44e0-a514-9d07114cb137","year":2018},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.085492Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:9f5a2200f85b96327be5f9afcdc35b3d9f06aa35f91c3cdaf67decd6ec6b3963","observation_id":"23496463-1b56-4a9b-bf2e-fc177785679f","resolution":{"observed_at":"2026-08-06T16:54:45.197348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.182375Z","title":"Triangulation residual loss for data- efficient 3d pose estimation.NeurIPS, 36:12721–12732,","venue":null,"work_id":"b439a603-262a-498b-8fb2-80c755632c53","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.089326Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:a6c6bb518ccfef22dc3e2061b68385f13c0c6a1fa42a53088885a7696550e233","observation_id":"30a528b8-8bd1-460d-8a10-b837aee164a8","resolution":{"observed_at":"2026-08-06T16:54:45.186324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.171217Z","title":"Towards 3d human pose estimation in the wild: a weakly-supervised approach","venue":null,"work_id":"257414da-2b1c-4a64-ab06-5dc665777b28","year":null},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.092531Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:de41a080a0510fc80eaf0517b1546d2d380b71bc78b818b93b04fc042aa00aca","observation_id":"e2d1843b-cbfa-4061-ab6d-ec5267190eb6","resolution":{"observed_at":"2026-08-06T16:54:45.174846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:54:45.160194Z","title":"CUB-200-2011 comparison Baseline reproduction.Most unsupervised 2D keypoint methods [12, 13, 15, 35] report their performance on the CUB-align protocol introduced in [35]","venue":null,"work_id":"6824921d-7446-4d74-b25c-ecd9dcc215a5","year":2011},"citing_paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T16:54:45.097397Z"},"links":{"citing_paper":"/paper/2507.12336"},"observation_digest":"sha256:42913abdfa12776275f9a400dd8bd232f6fb70b2a5c18d2d11d9948de5f18872","observation_id":"200838d0-504f-40ff-9c51-7f73371f357f","resolution":{"observed_at":"2026-08-06T16:54:45.164341Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.12336","last_updated":"2026-06-04T17:18:26Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T05:10:13.645568Z","submitted_at":"2025-07-16T15:29:07Z","title":"Unsupervised Monocular 3D Keypoint Discovery from Multi-View Diffusion Priors"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":1,"verified_fuzzy":67},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 0 inbound Pith citation observations for arXiv:2507.12336."}