{"as_of":"2026-08-14T02:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:98a82602a199b0dd3dab5012ee3e0d87b36021f16abb4ed5ae56828c249c3ed9","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T17:00:01.746477Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.13026/citation-record","integrity":"/paper/2411.13026/integrity","json":"/paper/2411.13026/citation-record.json","paper":"/paper/2411.13026"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.794963Z","title":"2d human pose estimation: New benchmark and state of the art analysis","venue":null,"work_id":"fe6ca964-0254-4ba1-a166-3d21c8ce3d2b","year":2014},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.485939Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:8a5eb153bcdf6e74caa3ddd5b441562b8741e37cb6821d60e1dceafbc6f1d205","observation_id":"bff5faa3-981e-411b-9117-64f7fa25ae4b","resolution":{"observed_at":"2026-08-12T17:00:02.800271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.779251Z","title":"Who left the dogs out?: 3D animal reconstruction with expectation maximization in the loop","venue":null,"work_id":"550b141c-ac62-4e6d-b2d3-02c51934934e","year":2020},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.491289Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:f70ff084e0fb3ebf5fe24b89edc51b4799de0b4ee816bc275ed1c1ffd1acbe8e","observation_id":"d0c9799a-ef5a-4388-9fb7-e6343ae1cf57","resolution":{"observed_at":"2026-08-12T17:00:02.784406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19160","last_updated":"2024-07-16T06:12:46Z","snapshot_observed_at":"2026-08-13T00:43:17.973885Z","submitted_at":"2024-03-28T06:05:14Z","title":"Within the Dynamic Context: Inertia-aware 3D Human Modeling with Pose Sequence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19160","snapshot_observed_at":"2026-08-12T17:00:01.496432Z","title":"Within the dynamic con- text: Inertia-aware 3d human modeling with pose sequence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.496432Z"},"links":{"cited_paper":"/paper/2403.19160","citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:251570762d119d0110835fad21a7482c7bbdd10907e063ca6a3c4830b9a51ed4","observation_id":"dadeb7d8-b4b6-41a5-8f9c-3a99664e5b74","resolution":{"observed_at":"2026-08-12T17:00:01.496432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16796","last_updated":"2024-03-06T02:19:38Z","snapshot_observed_at":"2026-08-13T04:09:49.605174Z","submitted_at":"2024-02-26T18:09:24Z","title":"Expressive Whole-Body Control for Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16796","snapshot_observed_at":"2026-08-12T17:00:01.502337Z","title":"Expressive whole-body con- trol for humanoid robots","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.502337Z"},"links":{"cited_paper":"/paper/2402.16796","citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:45573f85668506356c2f4dea7aa4db4a50360e2c199e4ff22750aff3ec1ad783","observation_id":"59737890-0a0c-4eff-ad30-ee955798d69f","resolution":{"observed_at":"2026-08-12T17:00:01.502337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:01.507771Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.507771Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:a6031108fb8076bb02301ec7a3875883df187515722d20f8d842e5d09772c661","observation_id":"58a2de69-c687-43d3-92df-d6777cdc58cb","resolution":{"observed_at":"2026-08-12T17:00:01.507771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.753202Z","title":"Unsupervised learning of disentangled representations from video","venue":null,"work_id":"fbf73625-db3a-4364-9e68-22f56a5a4adc","year":2017},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.512708Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:528def3eb7717c8254ebef54122f1eeecce1d8884b6b341ff99e519e176dff5c","observation_id":"a4522915-8683-4e6b-aec3-2c8f14c52db9","resolution":{"observed_at":"2026-08-12T17:00:02.758692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:01.517956Z","title":"3d human reconstruction in the wild with synthetic data using generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.517956Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:9ace3979beb11b4955df876abd232fd69c957e30d0750f8095d9cbde44a07a58","observation_id":"8fcffdf0-eeea-44cc-94a4-6da3c67248df","resolution":{"observed_at":"2026-08-12T17:00:01.517956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.736013Z","title":"Multiple choice learning: Learning to produce multiple structured outputs","venue":null,"work_id":"0bff8ab8-ae33-450d-a3f7-4a21b356fdd7","year":2012},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.523251Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:db09ec4ad7fea8289d733f9f6b3d0eb1027ab97573e68cdfce32ae8e3cf0f7ad","observation_id":"a20524ca-1471-425d-9e50-a906c9fe41b7","resolution":{"observed_at":"2026-08-12T17:00:02.741548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.716746Z","title":"Inductive representation learning on large graphs","venue":null,"work_id":"821e0f3b-bb28-4964-836f-0b7f48ddc857","year":2017},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.528597Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:4bdc3b6a4986fcf6a043e568ca84124432e5290a76a4f77fa7cd0594bb7a6ca8","observation_id":"808fcb13-0e6e-4e78-bb54-1b1c595e940f","resolution":{"observed_at":"2026-08-12T17:00:02.721887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.700105Z","title":"Multiple view ge- ometry in computer vision","venue":null,"work_id":"851e8fc6-d5fd-4e69-aba1-3599dd369ef6","year":null},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.533510Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:79b570fc67ee3b84d9c4c99b79ce44274d21c08950e698d3133f1ebdbb55944e","observation_id":"75283b92-461c-47bc-bb4c-cda3ed329425","resolution":{"observed_at":"2026-08-12T17:00:02.705277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:01.538186Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.538186Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:83e8d0e3f6dfb303666a42e7e8237fccaf2f16f0c83902bf0647522a33115d48","observation_id":"2444cab9-ad25-4e6f-a94a-c4b7be7adc6c","resolution":{"observed_at":"2026-08-12T17:00:01.538186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.665244Z","title":"Autolink: Self-supervised learning of human skeletons and object out- lines by linking keypoints","venue":null,"work_id":"c7089350-6883-45c8-a134-79b3b8af50ca","year":2022},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.542999Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:438e8f2208b98e8d9998db1e8b7541884a782696057361de0fcda618eb3f7555","observation_id":"24f234fa-3483-4107-81fe-ade700bd5636","resolution":{"observed_at":"2026-08-12T17:00:02.674304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.640785Z","title":"Unsupervised 3d keypoint es- timation with multi-view geometry","venue":null,"work_id":"48e9c47f-aeab-4353-9d57-5e696c8818f4","year":2024},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.547980Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:b553393f841c78cf436e4a53d4de11d355363273402f92f1a3acd37922471813","observation_id":"ec06fb4f-9137-4ce8-beac-e745085b1c87","resolution":{"observed_at":"2026-08-12T17:00:02.648038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.619829Z","title":"Temporal representation learning on monocular videos for 3d human pose estimation","venue":null,"work_id":"fb76aeba-1af8-420c-a131-408c963e93e4","year":null},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.552667Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:ec8506b0c7f3a6ddfb09b7d9472ea6a0478759579819f0f8cfcb0203c067bad7","observation_id":"30e460b4-6a8b-4b02-98e1-98f03e93bc48","resolution":{"observed_at":"2026-08-12T17:00:02.627549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.603850Z","title":null,"venue":null,"work_id":"24973017-58fe-4804-930a-ae5df4d4379f","year":2013},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.557372Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:bb80b2bbf8df50937d733faaaaf2def9b7c13f9282f7578c42d2ed3c9880fa0e","observation_id":"b395c36e-5992-4eda-b0a4-c5f5fa0eec9b","resolution":{"observed_at":"2026-08-12T17:00:02.608651Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.587609Z","title":"Learning high fi- delity depths of dressed humans by watching social media dance videos","venue":null,"work_id":"ea6a1fc2-b001-4c4d-9e5c-4d69898cfdef","year":2021},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.562129Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:ffdd18b493b8f1a04cd45f01ca883fd368922160932459bc1ee5c8e0d270ef6c","observation_id":"9e130914-f2a8-4b32-b17d-9acb53b0d0ed","resolution":{"observed_at":"2026-08-12T17:00:02.592770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.571031Z","title":"Unsupervised learning of object landmarks through conditional image generation","venue":null,"work_id":"2dd82dd6-2c5d-450a-a880-573692b659eb","year":2018},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.566409Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:523d48283d4367f8cb57ed93c09c47c7fcd01eec85b22993842af1cf5567acfc","observation_id":"ff7f2e40-e4e0-483b-b968-9b3b4c98fcf3","resolution":{"observed_at":"2026-08-12T17:00:02.576185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-12T17:00:01.571088Z","title":"Adam: A method for stochastic opti- mization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.571088Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:26a483f0e3ef79074653501a8355fa74036b22116086db0e62d972313cffd7c2","observation_id":"db5cda0b-969f-4036-89b8-4e2022bd1c74","resolution":{"observed_at":"2026-08-12T17:00:01.571088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.02907","last_updated":"2017-02-22T09:55:36Z","snapshot_observed_at":"2026-08-13T11:38:10.906031Z","submitted_at":"2016-09-09T19:48:41Z","title":"Semi-Supervised Classification with Graph Convolutional Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.02907","snapshot_observed_at":"2026-08-12T17:00:01.575804Z","title":"Semi-supervised classi- fication with graph convolutional networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.575804Z"},"links":{"cited_paper":"/paper/1609.02907","citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:aa3779e6e51896616a113fe5c68eecb343b48b27fc5e20b994876a3ee074f3ab","observation_id":"8caf5813-60ca-47c1-924a-68367edffddf","resolution":{"observed_at":"2026-08-12T17:00:01.575804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.553495Z","title":"Self-supervised 3d human pose estimation via part guided novel image synthesis","venue":null,"work_id":"bd3ad624-8b44-48a7-9ffe-1fefffb5fae3","year":2020},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.581579Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:8a211d8c63399c9fe8f58d1efddaf17d88b087159e36b4539bf219d3b79cec52","observation_id":"173b0ec1-e0c8-4264-9653-63e3f9930f14","resolution":{"observed_at":"2026-08-12T17:00:02.559740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.535256Z","title":"Kinematic-structure-preserved representation for unsupervised 3d human pose estimation","venue":null,"work_id":"ecfb960c-f7e7-427a-98e2-4aded4b0ca6f","year":2020},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.586407Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:41b29841961181b32d5e1d1276ff02c4f72a6ab48131028ef51fe2e0ad877214","observation_id":"6c87904a-b96b-41de-84fa-9d0b6fac7515","resolution":{"observed_at":"2026-08-12T17:00:02.540793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.516629Z","title":"Stochastic multiple choice learning for training diverse deep ensembles","venue":null,"work_id":"57bb97fa-7dd3-4599-8b8d-3724e8aa2966","year":2016},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.591327Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:4ab244f1327b0d06e7f069f25a597dc32c7a6c258fd9cc48934caa526947d798","observation_id":"329689f6-4d82-46a4-9d34-36402474604e","resolution":{"observed_at":"2026-08-12T17:00:02.522172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.499915Z","title":"Human pose regression with residual log-likelihood estimation","venue":null,"work_id":"d17cb444-9c6b-47e4-be39-f2bb45bf67d6","year":2021},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.596425Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:26d8c9aa0c857c3a84144388fbcec577050d7cc626e0707e85f47e1fd52cea92","observation_id":"a72c38cd-299a-4054-a8b5-060858a58f01","resolution":{"observed_at":"2026-08-12T17:00:02.504954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.483409Z","title":"Mhformer: Multi-hypothesis transformer for 3d human pose estimation","venue":null,"work_id":"6e572e7c-f075-4d5c-9a24-81da449e330c","year":2022},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.601080Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:78a8826e32b2b4488fb6cf7944049b29fb76e81cd5502946550925cc8fbf7e98","observation_id":"bc8baba1-f91f-40c5-8467-40eb9056e527","resolution":{"observed_at":"2026-08-12T17:00:02.489108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.466521Z","title":"Smpl: A skinned multi- person linear model","venue":null,"work_id":"e96046f8-b4ca-4a4d-9dda-7a49c76cc341","year":2023},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.605641Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:b05965653b380e07cc913fdb7f0027fb14671a07c206a0ddca023d21b4af6e01","observation_id":"edf63595-42fa-4bdd-8093-81f5186c4597","resolution":{"observed_at":"2026-08-12T17:00:02.472126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.448625Z","title":"Perpetual humanoid control for real-time simulated avatars","venue":null,"work_id":"f9e103cb-655c-4c3a-b7d7-9fb4d420e7c2","year":2023},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.610346Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:caf6320a9e7b1c197f755ab61fd4902b3845a7e2cc3c475f03d81c6b9cb75ef6","observation_id":"550af59a-83e1-431d-9eeb-6d79b51d6caf","resolution":{"observed_at":"2026-08-12T17:00:02.453900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.431075Z","title":"Least squares genera- tive adversarial networks","venue":null,"work_id":"dfa3e346-2fb3-4875-b696-d84860c8842c","year":null},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.616184Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:9ac615f2aa93c807c00331faf052d0843b90e4688c93c3018f4a647c848c1931","observation_id":"1b0eecfb-0218-4f35-9388-148f41beb45b","resolution":{"observed_at":"2026-08-12T17:00:02.436700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.414231Z","title":"Monocular 3d human pose estimation in the wild using improved cnn supervision","venue":null,"work_id":"fa07b601-5269-46df-8df3-ea941c3461ec","year":2017},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.621486Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:3d348603bcd50391f84b5b3c28c03a9b462b9791caa214cabc44aaf35d3d2c65","observation_id":"2d907827-1bea-4ada-8f88-dc85d556fd2f","resolution":{"observed_at":"2026-08-12T17:00:02.419224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.397773Z","title":"Agora: Avatars in geography optimized for regression analysis","venue":null,"work_id":"7bfc86d8-435b-4c64-82a1-52b3debc2ca9","year":2021},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.626360Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:f44875f2ede75a7b27a14bc287ed23f90c64ab8ebeb474c5d7b643043dafbb29","observation_id":"9dccc083-fc82-4756-9b88-e2bcb6b06b36","resolution":{"observed_at":"2026-08-12T17:00:02.403131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.382212Z","title":"Learning to estimate 3d human pose and shape from a single color image","venue":null,"work_id":"87242149-5120-41ee-abdf-9310dd2bc19c","year":2018},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.631305Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:2d467730ee0086a5f455a5dd7e3228b0a6b45446d36ff17d9fee9b17ef836307","observation_id":"2ac7aa5b-933b-4c77-ae32-be1657b27595","resolution":{"observed_at":"2026-08-12T17:00:02.387303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.365776Z","title":"Improving 2d human pose estimation in rare camera views with synthetic data","venue":null,"work_id":"7fa1553c-769c-412a-a22d-a9dd7fc7e336","year":2024},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.636802Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:840a04b1aef426274604c7db6bfd25d759a5e7e37bcba9c67d101aeb11c79d9e","observation_id":"1bb1f286-febc-4b67-bab5-a9ddc4174d64","resolution":{"observed_at":"2026-08-12T17:00:02.371419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.347986Z","title":"Neural scene decomposi- tion for multi-person motion capture","venue":null,"work_id":"51ff25e8-6e70-4809-a8e9-72da16984e68","year":2019},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.641849Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:666950be6ec3835cff10fe0208f233b4537fde217db76f5033f48068264b9000","observation_id":"33c06245-8d34-4a82-b5be-8085cf219310","resolution":{"observed_at":"2026-08-12T17:00:02.354316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.330260Z","title":"Barc: Learning to regress 3d dog shape from images by exploiting breed information","venue":null,"work_id":"150ca6cb-f25d-46d2-835c-7719d1a054f4","year":2022},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.646602Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:b35e1c605fa37020ecd1363a980e49800a089e3b4cb17522980c97d1ac28fadc","observation_id":"abbec9a5-f981-48a1-af99-6512b93599da","resolution":{"observed_at":"2026-08-12T17:00:02.336202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.310183Z","title":"Unsu- pervised human pose estimation through transforming shape templates","venue":null,"work_id":"3d34cc25-08a0-4e89-8af8-dbcdd5735adc","year":2021},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.651645Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:c6d37d8338adbb00504ea0b8ba959f37bc9043ff79fef86c92e2fce3e20a193c","observation_id":"a1a9ac40-d169-428f-968b-8d8b6b3b1498","resolution":{"observed_at":"2026-08-12T17:00:02.315977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.291307Z","title":"Syn- thetic training for accurate 3d human pose and shape esti- mation in the wild","venue":null,"work_id":"eb83cf94-5715-4c68-8c6f-aa7420a9f30a","year":2020},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.656722Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:d1478f02464eecd724f0a743c895bdda9c7a108bd2e9dfa4e8fc8f5d277b6b5c","observation_id":"3013a507-9d63-45a9-a3d5-a6ce2e3fb441","resolution":{"observed_at":"2026-08-12T17:00:02.297563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.272238Z","title":"Ntu rgb+ d: A large scale dataset for 3d human activity anal- ysis","venue":null,"work_id":"fccf7302-2824-4445-8bb4-413482927e63","year":2016},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.662277Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:077331b2aa5d72ac48c46af288501c88770f88a3e5c6bffa0c1ac130187f29f1","observation_id":"83788190-25f3-4dda-aa9e-9cafbb44a3e5","resolution":{"observed_at":"2026-08-12T17:00:02.278559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.252259Z","title":"Skeleton-based action recognition with directed graph neu- ral networks","venue":null,"work_id":"ffb2f589-d055-4307-bc90-d925dc947d65","year":null},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.667313Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:d86534c7c85ba41c85f7ef1d47173c5ff4cae8343397e594a310f7be6dead92e","observation_id":"514f3480-72ad-4adf-956c-2eb2f2ef6c0a","resolution":{"observed_at":"2026-08-12T17:00:02.259252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.233643Z","title":"Two- stream adaptive graph convolutional networks for skeleton- based action recognition","venue":null,"work_id":"3318d182-332c-4bbd-a8a1-f549e57b843b","year":2019},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.672277Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:2311bb5dde4059112d6f3a2b48bc491eb448d3174d7b52d2e634130ed06eccd9","observation_id":"866f0b6d-9b11-4ec8-9f5f-63af2539f316","resolution":{"observed_at":"2026-08-12T17:00:02.239107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.214723Z","title":"Self-supervised 3d human pose estimation from a single image","venue":null,"work_id":"9def5c1c-5eb8-42d4-b848-c29d3d2eb048","year":2023},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.677204Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:d75d33a6d30c2cbf05d2d6853cec341bd3345f7c6e4c98ddf94ec7b6265ef697","observation_id":"d4784db7-386e-4951-b114-f0ef9dd65cca","resolution":{"observed_at":"2026-08-12T17:00:02.220512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.197608Z","title":"Selfpose3d: Self-supervised multi-person multi-view 3d pose estimation","venue":null,"work_id":"d55e669a-0fbb-436b-beb3-ba2c4a271d3a","year":2024},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.681970Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:7c5a0b0958cf5d055b92c3c86bc49182e1e10431fa5d1f46324e27c9bf7735e8","observation_id":"d374647f-aace-4329-b5ea-e3caf59b4cf2","resolution":{"observed_at":"2026-08-12T17:00:02.203068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.181315Z","title":"Bkind-3d: Self-supervised 3d keypoint discovery from multi-view videos","venue":null,"work_id":"04e847df-0eff-4749-bb47-4b5e49803d1c","year":2023},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.686655Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:8c8d6fb821449a6538dd7d74147d12e8789013c7ea0bbf5d49c122b604497124","observation_id":"955ce771-5707-448a-9744-ae96eb634d2f","resolution":{"observed_at":"2026-08-12T17:00:02.186419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.164251Z","title":"Integral human pose regression","venue":null,"work_id":"a5d3d70e-178b-4923-9d53-e297c2416f71","year":null},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.691361Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:2a50204f9a04baca41c0a3c1519984d44c38015875f7ee84b043d5645c3a1cc8","observation_id":"def57bea-47d8-47ae-b86d-5a1169e2de34","resolution":{"observed_at":"2026-08-12T17:00:02.169726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.145196Z","title":"Discovery of latent 3d key- points via end-to-end geometric reasoning.Advances in Neu- ral Information Processing Systems, 31, 2018","venue":null,"work_id":"671fdb3e-304d-433a-866d-4873b1c8b63d","year":2018},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.696556Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:acd2cdb008334181c3e15b52a502b49a71b0d9125b94d7a33e898729c660aaff","observation_id":"89543014-e2c3-4a7d-bef5-088625c71475","resolution":{"observed_at":"2026-08-12T17:00:02.151686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:01.701544Z","title":"Visualizing data using t-sne","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.701544Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:0447e8bad3f01ec5c8d845d174bd4348167c739dd58b56f3eb11506356fba2d4","observation_id":"a0520ec3-856e-4277-96bb-98c724b0db9c","resolution":{"observed_at":"2026-08-12T17:00:01.701544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.111527Z","title":"Learning from synthetic humans","venue":null,"work_id":"7c062fb1-e3e1-4cfb-a55e-022e39f7e9c8","year":2017},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.706744Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:6f1728f132a30a81ad21b1f2e536e5b4fad96170276c732596188b5f9c9b28f0","observation_id":"ad8d656f-3810-491b-99b7-95847e0cc404","resolution":{"observed_at":"2026-08-12T17:00:02.117785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.095026Z","title":"Recovering accurate 3d human pose in the wild using imus and a moving camera","venue":null,"work_id":"2a96b3f8-fa64-4ad7-b528-cd296482c9a5","year":2018},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.711756Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:6750f34f95cf00bfd511e4bbf642b78ff515717933fae14c6ad0e628794ab979","observation_id":"89030cab-412f-41a4-af8e-f2a2c5e2a95f","resolution":{"observed_at":"2026-08-12T17:00:02.100373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.076951Z","title":"Canonpose: Self-supervised monocu- lar 3d human pose estimation in the wild","venue":null,"work_id":"dd5feebe-59c2-4cee-beed-ea7a78eaa708","year":2021},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.716866Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:4589ce2f3760ca09d150d557ec3ee7d602bf6f132c17e0bce0491136ad0f0c40","observation_id":"7b594fc8-b900-474d-810c-ee61ed35c235","resolution":{"observed_at":"2026-08-12T17:00:02.083499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:01.721455Z","title":"Spatial tempo- ral graph convolutional networks for skeleton-based action recognition","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.721455Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:e7ca618bcccd66056ce7c9243860e332a35dec2e2e37d49aae72e4ee37eba6e2","observation_id":"830599c6-a8d4-4498-a096-86c76ffd2c64","resolution":{"observed_at":"2026-08-12T17:00:01.721455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.046639Z","title":"Mask as supervi- sion: Leveraging unified mask information for unsupervised 3d pose estimation","venue":null,"work_id":"2c5ea0ea-cc4a-4266-9c0a-d3d58d009ac1","year":2024},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.726412Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:1a1d19408454a872ebf159b3cffc52caaf711368722c4892561e436ca35037aa","observation_id":"8d055f8d-c958-414f-a36c-aec572b87760","resolution":{"observed_at":"2026-08-12T17:00:02.052232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.029137Z","title":"Synbody: Synthetic dataset with layered human models for 3d human perception and modeling","venue":null,"work_id":"ebab94bc-1a2d-45c2-8a36-612944c16c57","year":2023},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.731281Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:0e50cef66ec13141a2a12803b1fb940df84dbdc5d0a890ab4a748b9e142b4d0b","observation_id":"c33cf3b9-4ba6-4107-8b78-d90be1562ddf","resolution":{"observed_at":"2026-08-12T17:00:02.034666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:02.011456Z","title":"Towards alleviating the mod- eling ambiguity of unsupervised monocular 3d human pose estimation","venue":null,"work_id":"e7efba45-f8b0-466e-89e8-053eebefdbfc","year":2021},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.736357Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:4f59b758ac98e6339d5031b3d656c859faef1e10f046fb07e84102a9738cef4d","observation_id":"53a8dbf3-e428-4aa5-8174-d5f60e2458e9","resolution":{"observed_at":"2026-08-12T17:00:02.016747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:01.991097Z","title":"Unsupervised discovery of object land- marks as structural representations","venue":null,"work_id":"edb42f71-c4bb-4801-a743-b6b52e77c748","year":2018},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.741538Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:fba757e79f4cd7d8f8b0d39a605438a1c9839756a2ad67cf0286f672df27dce5","observation_id":"dce61f32-588a-4a85-9217-0af2244802ff","resolution":{"observed_at":"2026-08-12T17:00:01.998374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:00:01.972673Z","title":null,"venue":null,"work_id":"cd4887a2-19d8-4265-9d31-34a62c027db1","year":2017},"citing_paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T17:00:01.746477Z"},"links":{"citing_paper":"/paper/2411.13026"},"observation_digest":"sha256:89346e2e4b677f6c147bf860ba12984d30f2a6dac1feaed4bb9bc0743073652e","observation_id":"293758f8-831c-4173-a459-41b391b33c00","resolution":{"observed_at":"2026-08-12T17:00:01.979023Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.13026","last_updated":"2024-11-20T04:18:11Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T11:46:36.443058Z","submitted_at":"2024-11-20T04:18:11Z","title":"X as Supervision: Contending with Depth Ambiguity in Unsupervised Monocular 3D Pose Estimation"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":42},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2411.13026."}