{"as_of":"2026-08-10T08:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cdc83fe17ede16d741c3b6975a7b77dc97171213e4287039848a15235e88edc3","coverage":[{"denominator":113,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T11:39:18.653009Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T14:17:55.627411Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T10:38:17.806373Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07785","snapshot_observed_at":"2026-08-08T14:17:55.627411Z","title":"Pippo: High-resolution multi-view humans from a single image","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.06957","last_updated":"2025-08-03T14:14:09Z","snapshot_observed_at":"2026-08-08T23:17:10.153437Z","submitted_at":"2025-02-10T19:00:39Z","title":"GAS: Generative Avatar Synthesis from a Single Image","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T14:17:55.627411Z"},"links":{"cited_paper":"/paper/2502.07785","citing_paper":"/paper/2502.06957"},"observation_digest":"sha256:419049f49baecf4ebf05f9d600cd111e3d27b7f35ead5f7c55e8b881f42c5205","observation_id":"09e4368c-8dba-499f-869d-fbb49080acfb","resolution":{"observed_at":"2026-08-08T14:17:55.627411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"cited_work":{"arxiv_id":"2502.07785","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.07785","snapshot_observed_at":"2026-08-06T10:38:17.806373Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","venue":"cs.CV","work_id":"a78ce70b-e1de-4799-87a5-5b1327941538","year":2025},"citing_paper":{"arxiv_id":"2507.23597","last_updated":"2025-08-09T13:29:22Z","snapshot_observed_at":"2026-08-10T05:46:49.909024Z","submitted_at":"2025-07-31T14:36:24Z","title":"MoGA: 3D Generative Avatar Prior for Monocular Gaussian Avatar Reconstruction","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T10:38:14.578378Z"},"links":{"cited_paper":"/paper/2502.07785","citing_paper":"/paper/2507.23597"},"observation_digest":"sha256:02e2aa4fc08c93b058f7feb72a1f8e9cc6b8000cb18fad7d5c9071387deb171c","observation_id":"ed919425-6f99-4f04-94ce-8230d2f3e75d","resolution":{"observed_at":"2026-08-06T10:38:17.811181Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.07785/citation-record","integrity":"/paper/2502.07785/integrity","json":"/paper/2502.07785/citation-record.json","paper":"/paper/2502.07785"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.174870Z","title":"Ogras, and Linjie Luo","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.174870Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:c9aeb4744bff7a98201129264daa78de3fde833319523ce961a8557676932f0e","observation_id":"f4cdd103-6ded-46cd-a773-221e622c4ba2","resolution":{"observed_at":"2026-08-08T11:39:18.174870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09192","last_updated":"2022-03-17T09:29:50Z","snapshot_observed_at":"2026-08-07T23:55:35.716165Z","submitted_at":"2022-03-17T09:29:50Z","title":"Entropy-based Attention Regularization Frees Unintended Bias Mitigation from Lists","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.09192","snapshot_observed_at":"2026-08-08T11:39:18.179814Z","title":"Entropy-based attention regularization frees unintended bias mitigation from lists, 2022.https://arxiv.org/abs/2203.09192","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.179814Z"},"links":{"cited_paper":"/paper/2203.09192","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:6fd3e825028d73c8f56dce1585dc2dc8ceb4af04052bda4490fe6196fae5062f","observation_id":"d6ca83d7-41ea-4099-b207-742d1dd77522","resolution":{"observed_at":"2026-08-08T11:39:18.179814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.184842Z","title":"Driving-signal aware full-body avatars.ACM Transactions on Graphics (TOG), 40(4):1–17, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.184842Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:a72f27f11f276d25d66998fb6f2baaf46cf25a9e566603a8596679c96b6c1d6d","observation_id":"376a8f53-eb9d-4670-91f7-bce6f8de17d8","resolution":{"observed_at":"2026-08-08T11:39:18.184842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-08T11:39:18.189540Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control.arXiv preprint arXiv:2407.12781, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.189540Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:00fa32337b76260379d57e098af21b94838444060dff986b0b6aee96b379355a","observation_id":"c36baef5-1b36-4f6a-9d79-db0f9ccc87b6","resolution":{"observed_at":"2026-08-08T11:39:18.189540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-08T11:39:18.194547Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.194547Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:9494afbfb95b97578edbe4f40d11122377a580d5173bc7d3be7d801d2d89961e","observation_id":"8632d3a9-ec6f-4632-bdff-5372e6f37e31","resolution":{"observed_at":"2026-08-08T11:39:18.194547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.199839Z","title":"Parkhi, and Andrew Zisserman","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.199839Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:b4325a7fbe3f5e3753ff20b1613b7c04a47df6c1e157a86c8dcf2508a2de7478","observation_id":"c75a6613-44c4-4f0e-9b36-659b77574fb8","resolution":{"observed_at":"2026-08-08T11:39:18.199839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.205937Z","title":"Chan, Connor Z","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.205937Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:69125c8e171c8d2c604fdf075f6bcb5143c68be78269df3d49d8c6fc2a467c2f","observation_id":"d0e7c27e-34c2-4df1-b8d6-8f99d7ffc7ea","resolution":{"observed_at":"2026-08-08T11:39:18.205937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13681","last_updated":"2023-09-04T23:02:18Z","snapshot_observed_at":"2026-07-06T15:20:25.388057Z","submitted_at":"2023-04-26T16:54:10Z","title":"Ray Conditioning: Trading Photo-consistency for Photo-realism in Multi-view Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13681","snapshot_observed_at":"2026-08-08T11:39:18.210477Z","title":"Ray conditioning: Trading photo-consistency for photo-realism in multi-view image generation.arXiv preprint arXiv:2304.13681, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.210477Z"},"links":{"cited_paper":"/paper/2304.13681","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:6c4490454a12899a4024a9df2bba007b428f3a1f9620c7704911e04a808c99ca","observation_id":"5742db56-c1f0-40f9-99c3-98cc7433d955","resolution":{"observed_at":"2026-08-08T11:39:18.210477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.215785Z","title":"Fantasia3d: Disentangling geometry and appearance for high-quality text-to-3d content creation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.215785Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:1bc0254422b54fe00cf79601d5770844926ee80a280c9cb294e5e18c81f79bb8","observation_id":"30ff2afe-d8fb-4ea1-848e-1d8026f48bc8","resolution":{"observed_at":"2026-08-08T11:39:18.215785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.10972","last_updated":"2023-05-21T07:07:55Z","snapshot_observed_at":"2026-08-08T02:32:31.177380Z","submitted_at":"2023-01-26T07:37:22Z","title":"On the Importance of Noise Scheduling for Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.10972","snapshot_observed_at":"2026-08-08T11:39:18.220531Z","title":"On the importance of noise scheduling for diffusion models.arXiv preprint arXiv:2301.10972, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.220531Z"},"links":{"cited_paper":"/paper/2301.10972","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:018400ed907e3abc42d4231b140107a3db9b1b73f2275161092b9be6ab163e6a","observation_id":"06277f73-2f67-452b-ab90-b4ee42161db0","resolution":{"observed_at":"2026-08-08T11:39:18.220531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10173","last_updated":"2023-09-30T06:24:23Z","snapshot_observed_at":"2026-08-03T20:15:36.452177Z","submitted_at":"2023-07-19T17:58:03Z","title":"DNA-Rendering: A Diverse Neural Actor Repository for High-Fidelity Human-centric Rendering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10173","snapshot_observed_at":"2026-08-08T11:39:18.225568Z","title":"Dna-rendering: A diverse neural actor repository for high-fidelity human-centric rendering.arXiv preprint, arXiv:2307.10173, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.225568Z"},"links":{"cited_paper":"/paper/2307.10173","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:2240910bd142d7c9ba64f5b7036c99f6e8d7c22008d3dc3d84e3a7321be67f17","observation_id":"19bcf228-97ed-4f10-9fb7-eb43921214cf","resolution":{"observed_at":"2026-08-08T11:39:18.225568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.230780Z","title":"Vision transformers need registers, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.230780Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:cb038bc7ca87ae05d94cd74604087b2ef8a159ad4f0489fdc78a4ddcfc191163","observation_id":"74315524-3282-4acf-b25d-388b8a329ead","resolution":{"observed_at":"2026-08-08T11:39:18.230780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.235047Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.235047Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:3ca547f3ac71b98ba7f1d5890ee633eeeab59817d275a45a03da7dd067ad96f7","observation_id":"8fde4733-334d-4716-984b-e01defda62e1","resolution":{"observed_at":"2026-08-08T11:39:18.235047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.240221Z","title":"Nerdi: Single-view nerf synthesis with language-guided diffusion as general image priors","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.240221Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:ad1785cf9f3900a0550e59f6b36dd5d2643185bfaa871ff69898061370a9a58d","observation_id":"12c316eb-3758-4b40-b72a-6de6932bad62","resolution":{"observed_at":"2026-08-08T11:39:18.240221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.244743Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.244743Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:00e5022a4e73399cba1d0c154a262bfd59f4658f4fbe6a6aeee88c9a4a87e05a","observation_id":"ac6e0fd4-ea18-488c-bfd7-4c55e199bb1a","resolution":{"observed_at":"2026-08-08T11:39:18.244743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.249718Z","title":"Superpoint: Self-supervised interest point detection and description","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.249718Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:bd26e4e5e99bb26fcf1731cea3fd8ceb948ec2fa2f15d5d8d5fd1b8123d52493","observation_id":"be8d9f1a-6506-4afb-b127-e57b2781e405","resolution":{"observed_at":"2026-08-08T11:39:18.249718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.255257Z","title":"Megaportraits: One-shot megapixel neural head avatars","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.255257Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:d4f8507f361b4626e03bbd7d4418a89dc66e59d74ef003e4182604fa374867b9","observation_id":"54c95c8f-7279-48f8-85f7-62ef0c5c01c6","resolution":{"observed_at":"2026-08-08T11:39:18.255257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.260967Z","title":"Emoportraits: Emotion-enhanced multimodal one-shot head avatars","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.260967Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:5b01653a67e66d424f24966242263edfd2f402def82346008f360e4d8720c471","observation_id":"10279f2e-8101-481d-96d2-fe4beb65267f","resolution":{"observed_at":"2026-08-08T11:39:18.260967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.266453Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.266453Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:e79c2f1689f7031fec25e1c92bbd72484fc16d046bcbb68058fbdc2b0d1d9368","observation_id":"8964a9e0-0227-4011-ac67-2d33a33436ce","resolution":{"observed_at":"2026-08-08T11:39:18.266453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.271216Z","title":"Scenescape: Text-driven consistent scene generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.271216Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:35bead5f654103ed2e2467e2fdff155b552e4116f9b2764bcd6b7b759a3f5539","observation_id":"6fac8c2e-7899-41e1-bedb-d7cb8577415a","resolution":{"observed_at":"2026-08-08T11:39:18.271216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.275609Z","title":"Multiresolution tree networks for 3d point cloud processing","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.275609Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:5f73e08dfa1f4b72a29dc35662d686716b95b1278e85ff02adce44c827b18c4e","observation_id":"ff200a16-dc16-4b66-86d4-2ec702f93c10","resolution":{"observed_at":"2026-08-08T11:39:18.275609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10314","last_updated":"2024-05-16T17:59:05Z","snapshot_observed_at":"2026-07-06T18:15:24.541427Z","submitted_at":"2024-05-16T17:59:05Z","title":"CAT3D: Create Anything in 3D with Multi-View Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10314","snapshot_observed_at":"2026-08-08T11:39:18.280139Z","title":"Cat3d: Create anything in 3d with multi-view diffusion models.arXiv preprint arXiv:2405.10314, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.280139Z"},"links":{"cited_paper":"/paper/2405.10314","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:5cca8c38167c52d1f29d283149c77401fb4138fdeadb529b4597f031f014b2bf","observation_id":"58f3285a-06ef-403c-8e75-b417e5996354","resolution":{"observed_at":"2026-08-08T11:39:18.280139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.03348","last_updated":"2017-10-09T23:21:34Z","snapshot_observed_at":"2026-07-06T06:03:25.270202Z","submitted_at":"2017-10-09T23:21:34Z","title":"What does Attention in Neural Machine Translation Pay Attention to?","version":1},"cited_work":{"arxiv_id":"1710.03348","doi":null,"metadata_source":"pith","pith_arxiv_id":"1710.03348","snapshot_observed_at":"2026-08-08T11:39:19.047214Z","title":"What does Attention in Neural Machine Translation Pay Attention to?","venue":"cs.CL","work_id":"566b250b-3681-4bd5-a876-86eee9666554","year":2017},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.284784Z"},"links":{"cited_paper":"/paper/1710.03348","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:4902bcdb07fd1c8da96d1826bb75f301522d36e2546611dd61f9d52069c8ced4","observation_id":"bc51b82f-1002-454c-af67-0a15d6db45a1","resolution":{"observed_at":"2026-08-08T11:39:19.052262Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.289668Z","title":"Diffportrait3d: Controllable diffusion for zero-shot portrait view synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.289668Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:d3af24bbfd0f2109eed5a678a2badcb7106771a1d0ebf95d8c965f5801a01bc9","observation_id":"3aa4e4f1-6aa0-45b4-adf8-8a0b7e9ab1e2","resolution":{"observed_at":"2026-08-08T11:39:18.289668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.294318Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.294318Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:ead34b086e5f90383ea7820d65cf05887942ccf44b5ab8c726ba138ac497fd68","observation_id":"f7b44ba6-1f45-4f05-be25-bef5b8382a6f","resolution":{"observed_at":"2026-08-08T11:39:18.294318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.298783Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.298783Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:fffbbf19d55b87abb3c533484c91f830fa984ea71566ecc36a511b7753896a72","observation_id":"ebe9e3df-928a-40e4-9ad4-2c97f52e4bd6","resolution":{"observed_at":"2026-08-08T11:39:18.298783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-08-08T11:39:18.303668Z","title":"Cameractrl: Enabling camera control for text-to-video generation.arXiv preprint arXiv:2404.02101, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.303668Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:e087fb11368c52927389f2ca7ba1dced453e9abfb6511b75bd8fe660864d0f39","observation_id":"732142c2-1b9b-4bef-9a98-13e6f6f6a3ca","resolution":{"observed_at":"2026-08-08T11:39:18.303668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.308509Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.308509Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:43bc0f78f8321127875bca974ba748503ecf8cc86e006b12211ac10a8e4cfd31","observation_id":"0eebcf66-7500-4eb5-82cb-6fe2493365e0","resolution":{"observed_at":"2026-08-08T11:39:18.308509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.313247Z","title":"Sith: Single-view textured human reconstruction with image-conditioned diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.313247Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:014211fa8d2a440124ae1be2fda44164c4064a2c05bdba1aa9df4919d49f5087","observation_id":"c2ea5505-dbcb-4980-b74c-c4d2a33cadf2","resolution":{"observed_at":"2026-08-08T11:39:18.313247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.317575Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.317575Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:0430df02efc97e2bdb13fa224930d328a707c83073449205eff9315563b0965c","observation_id":"d40a0e3f-a4af-4c54-94ea-dc6c8ae84644","resolution":{"observed_at":"2026-08-08T11:39:18.317575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.322017Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.322017Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:ccfebe4aa4bfc239627ed699ddb0faf75f07ee9e91edc517fe8ef83201a3a789","observation_id":"2702712a-19bc-4396-bf06-ea07d3307201","resolution":{"observed_at":"2026-08-08T11:39:18.322017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03632","last_updated":"2024-12-04T18:48:20Z","snapshot_observed_at":"2026-08-08T15:31:21.670732Z","submitted_at":"2024-12-04T18:48:20Z","title":"MV-Adapter: Multi-view Consistent Image Generation Made Easy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03632","snapshot_observed_at":"2026-08-08T11:39:18.327077Z","title":"Mv-adapter: Multi-view consistent image generation made easy.arXiv preprint arXiv:2412.03632, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.327077Z"},"links":{"cited_paper":"/paper/2412.03632","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:0590d4ea419096206a7173681e7db54dd91826c79b96e8e047cfa98bbe65e07b","observation_id":"ddf70acc-cbc0-40fa-87c3-19b00b792ff6","resolution":{"observed_at":"2026-08-08T11:39:18.327077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.331574Z","title":"Epidiff: Enhancing multi-view synthesis via localized epipolar-constrained diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.331574Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:1480f2a1abc2f6a22e8c6d1b5d53704ca836fda8bd9ac76253895218b5aa356b","observation_id":"b2ce8559-60a2-4d61-a410-3b99aac409b8","resolution":{"observed_at":"2026-08-08T11:39:18.331574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3592415.https://doi.org/10.1145/3592415","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.749661Z","title":"Humanrf: High-fidelity neural radiance fields for humans in motion.ACM Transactions on Graphics (TOG), 42(4):1–12, 2023","venue":null,"work_id":"7ee4d59b-df4b-43fa-8827-25c75189e026","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.337306Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:4044d4995704f049af344c6bbb80ff4fc4c5343110aaebd5c75f35472dff95b4","observation_id":"34904e17-c84c-48c1-b8ef-bb804731cee3","resolution":{"observed_at":"2026-08-08T11:39:18.757197Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08645","last_updated":"2023-10-26T09:16:25Z","snapshot_observed_at":"2026-08-03T22:51:10.296465Z","submitted_at":"2023-06-14T17:23:07Z","title":"Training-free Diffusion Model Adaptation for Variable-Sized Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":"2306.08645","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.08645","snapshot_observed_at":"2026-08-08T11:39:18.991106Z","title":"Training-free Diffusion Model Adaptation for Variable-Sized Text-to-Image Synthesis","venue":"cs.CV","work_id":"8fb1de6f-91ab-4cad-8fc4-0944692f6e61","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.342411Z"},"links":{"cited_paper":"/paper/2306.08645","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:88855116ce195a68797450419651c5a7403bc8f0b2cd0833e1ec6c897f640f08","observation_id":"f229cded-d37d-4ef7-912c-7835d4ce877b","resolution":{"observed_at":"2026-08-08T11:39:18.996655Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.347330Z","title":"invs: Repurposing diffusion inpainters for novel view synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.347330Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:4bf70d387028de18e42cde75e3075408202b39a50a21b8f322bda77cfcf63436","observation_id":"e7cba2ce-2f42-4878-b4d8-ce65098ee2f0","resolution":{"observed_at":"2026-08-08T11:39:18.347330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.352082Z","title":"Spad: Spatially aware multi-view diffusers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.352082Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:234742fcf1b6a7e12db75ef6411be5dc52ed8d5246d61780166baf18858d88a1","observation_id":"1f11f78e-e4d3-4075-80e8-433668c055bb","resolution":{"observed_at":"2026-08-08T11:39:18.352082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.356487Z","title":"A style-based generator architecture for generative adversarial networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.356487Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:5549dd9d379bffd2c2b691b728ba8d2195055dec031c2e14adebe9124b408885","observation_id":"f155ec3e-5f8b-48cd-9a80-332d54872e88","resolution":{"observed_at":"2026-08-08T11:39:18.356487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.361270Z","title":"Sapiens: Foundation for human vision models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.361270Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:658e385b13b3a14c23976b2a52fdeabb007f1e479259f7f070beaeaac25fc5ca","observation_id":"753fbaaf-8b3a-497f-8d82-8f0192c9bcdc","resolution":{"observed_at":"2026-08-08T11:39:18.361270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.366006Z","title":"Nersemble: Multi-view radiance field reconstruction of human heads.ACM Transactions on Graphics (TOG), 42(4):1–14, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.366006Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:a833c54c404a5de029fd3e3a14f9f3a8600f168a9c68f589ba4cf85ab8a34271","observation_id":"7fb75d56-920a-4d03-88a3-19e5cb5ee929","resolution":{"observed_at":"2026-08-08T11:39:18.366006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.370581Z","title":"Flux model, 2024.https://github.com/black-forest-labs/flux","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.370581Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:98b85721f4dae09f4825dd3325f43364cac4739d388d903adf4a045a99655020","observation_id":"bc2226cb-aea5-4af2-83ed-cbfe03b3d17c","resolution":{"observed_at":"2026-08-08T11:39:18.370581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.375146Z","title":"Grounding image matching in 3d with mast3r, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.375146Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:cca83646fc992de230a96bb2232087a0539380e900b9e768d16f574457ada02b","observation_id":"9d903ab2-ada5-4e62-bfc8-4ca8ed324db7","resolution":{"observed_at":"2026-08-08T11:39:18.375146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.379867Z","title":"Spherehead: Stable 3d full-head synthesis with spherical tri-plane representation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.379867Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:95bf786b51e00462f69f090a5c5bfb506c935195e3b58c891657bf0b9302bc37","observation_id":"65eb1f75-1792-42e1-8159-24a1cd180c9f","resolution":{"observed_at":"2026-08-08T11:39:18.379867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11616","last_updated":"2024-11-27T15:01:08Z","snapshot_observed_at":"2026-07-06T18:16:24.847459Z","submitted_at":"2024-05-19T17:13:16Z","title":"Era3D: High-Resolution Multiview Diffusion using Efficient Row-wise Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11616","snapshot_observed_at":"2026-08-08T11:39:18.384576Z","title":"Era3d: High-resolution multiview diffusion using efficient row-wise attention, 2024.https://arxiv.org/abs/2405.11616","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.384576Z"},"links":{"cited_paper":"/paper/2405.11616","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:90286612e60caad3f710c15384e24e7795fe4caa1fba4ca8fa0f7a3ea3611299","observation_id":"69818b8f-949d-4462-9ef9-022eacafbcbb","resolution":{"observed_at":"2026-08-08T11:39:18.384576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.389534Z","title":"Magic3d: High-resolution text-to-3d content creation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.389534Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:869bd7dd911b74879355fea98acc3d162096e2d1f11f67bc785012787d3ae406","observation_id":"7f15eaaa-1270-437f-9da0-d0e21b3ba814","resolution":{"observed_at":"2026-08-08T11:39:18.389534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.393937Z","title":"Coco-gan: Generation by parts via conditional coordinating","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.393937Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:1b87659f613bfb0cdcc42d307aaf84bb24a298cb5f2938d60ff12e381333a174","observation_id":"4e426518-4b7c-4b91-9194-4387cc0a17ed","resolution":{"observed_at":"2026-08-08T11:39:18.393937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.904417Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":"030c6895-3a55-4ddb-921a-0bb47452ac14","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.398900Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:9079cdb9e53a3cdb0e489f9b11dbe3d0a964efa5fe6988bf8aef78c5b5d74306","observation_id":"7e3b217f-b58b-4ab5-bd69-3478ec13de2a","resolution":{"observed_at":"2026-08-08T11:39:19.910443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15008","last_updated":"2023-11-08T16:50:08Z","snapshot_observed_at":"2026-07-06T16:37:16.106127Z","submitted_at":"2023-10-23T15:02:23Z","title":"Wonder3D: Single Image to 3D using Cross-Domain Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15008","snapshot_observed_at":"2026-08-08T11:39:18.403302Z","title":"Wonder3d: Single image to 3d using cross-domain diffusion, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.403302Z"},"links":{"cited_paper":"/paper/2310.15008","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:b02732ccc7d278513e8a3c96154f51ff257705cf6b156fed7711ace635995fe3","observation_id":"4d622ab0-bc69-4bb8-8e33-cc79196e74fd","resolution":{"observed_at":"2026-08-08T11:39:18.403302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.408296Z","title":"Jewett, Simon Venshtain, Christopher Heilman, Yueh-Tung Chen, Sidi Fu, Mohamed Ezzeldin A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.408296Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:08e4f39dca25119c0d6e7fe6a473c9264bb8504d9c6027f52d83c3ac078bc896","observation_id":"6f900abd-98dc-4ebf-8d76-73eddf0a16cb","resolution":{"observed_at":"2026-08-08T11:39:18.408296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.880470Z","title":"Diffrf: Rendering-guided 3d radiance field diffusion","venue":null,"work_id":"99405b1f-8f0d-49f5-8881-65e9479d7bd7","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.412984Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:3bce526200cbff9b2ba414cc609cf40fe2751d3bfefd03c3fa87a6c6f39a0dec","observation_id":"7cac0cfa-98c9-4287-a360-7b84cb5470e5","resolution":{"observed_at":"2026-08-08T11:39:19.885383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.417762Z","title":"Multidiff: Consistent novel view synthesis from a single image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.417762Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:982017bb501f9dc6099762df87a3df8e7a9f4abb46526fa3fd5897b8b0721fbc","observation_id":"e6dd232d-6931-435f-ad22-c14584e5ce17","resolution":{"observed_at":"2026-08-08T11:39:18.417762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-09T18:02:17.307812Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-08T11:39:18.422541Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.422541Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:39a2c365e490675ca729956904f1a53a71beb387e3232f02534c718f56235c71","observation_id":"7c1328be-89bb-49c3-97d1-18d32bfc1635","resolution":{"observed_at":"2026-08-08T11:39:18.422541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.855554Z","title":"RenderMe-360: Large digital asset library and benchmark towards high-fidelity head avatars","venue":null,"work_id":"007b622f-140c-4a24-8546-4f79ad868208","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.427321Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:8a22a4cf1ac31c4c1798ec79ef4ad5771f03cc321038eb210ab590bd7c5f10a9","observation_id":"5ca8406c-512a-4f50-9e7e-82a894699813","resolution":{"observed_at":"2026-08-08T11:39:19.860431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.835401Z","title":"Nerfies: Deformable neural radiance fields","venue":null,"work_id":"0af2632f-dcc6-420a-9124-808f7df3b95c","year":2021},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.431832Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:82ce1aafbc42de07e4b4c2e9ca9936f21dd2fd5fa6974add30bbc91950e8d67a","observation_id":"035c7c01-ba46-434e-af22-b9c59d6f215a","resolution":{"observed_at":"2026-08-08T11:39:19.845050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.436448Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.436448Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:f7288daf48621b4b9286e440425e42d2327561106d973c1833fd6d2759f9062b","observation_id":"5c1f36ea-0cb9-45fd-a412-65aa7a43f0bd","resolution":{"observed_at":"2026-08-08T11:39:18.436448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00071","last_updated":"2026-02-06T19:40:50Z","snapshot_observed_at":"2026-08-01T02:15:47.181936Z","submitted_at":"2023-08-31T18:18:07Z","title":"YaRN: Efficient Context Window Extension of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00071","snapshot_observed_at":"2026-08-08T11:39:18.440888Z","title":"Yarn: Efficient context window extension of large language models.arXiv preprint arXiv:2309.00071, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.440888Z"},"links":{"cited_paper":"/paper/2309.00071","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:c2cac4df311e65a349def10dca5d8d621aa79d2120e9aba82b13258bd08d23f8","observation_id":"4b79be7d-0f2b-4628-9816-729d3b32d1a4","resolution":{"observed_at":"2026-08-08T11:39:18.440888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.445888Z","title":"Barron, and Ben Mildenhall","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.445888Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:11045103b193c4019c734a3e95e9a86ecfca95474fbe7d6a6fcc97ef95d90f15","observation_id":"b0b4ae09-25c8-4177-8845-fe47e18575ff","resolution":{"observed_at":"2026-08-08T11:39:18.445888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.450777Z","title":"3dgs-avatar: Animatable avatars via deformable 3d gaussian splatting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.450777Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:9b3fc10c646472131ead31d369d10f740b31fb2fe5e585d1e4a7c8c1134256a7","observation_id":"d8a096dc-1eee-4706-a156-72aff7cb010a","resolution":{"observed_at":"2026-08-08T11:39:18.450777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.792484Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"fdb968c7-ca21-49a3-9819-5eb28af777f0","year":2021},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.455786Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:4b375501f6135a30ca2db5dad436c9456ee014d36e9dd4ef4d0d587959b52223","observation_id":"5cab5ac9-127c-431b-9eca-448cba30f65e","resolution":{"observed_at":"2026-08-08T11:39:19.797530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13508","last_updated":"2023-03-27T15:34:19Z","snapshot_observed_at":"2026-07-06T15:07:18.636040Z","submitted_at":"2023-03-23T17:59:00Z","title":"DreamBooth3D: Subject-Driven Text-to-3D Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13508","snapshot_observed_at":"2026-08-08T11:39:18.460422Z","title":"Dreambooth3d: Subject-driven text-to-3d generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.460422Z"},"links":{"cited_paper":"/paper/2303.13508","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:673a2d797f1b31743b60fdb8d109e526b728ed2442888575c6748244d961dca2","observation_id":"a1df5468-7783-4a83-bc3b-c229849b5104","resolution":{"observed_at":"2026-08-08T11:39:18.460422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-08T11:39:18.465327Z","title":"Hierarchical text-conditional image generation with clip latents.arXiv preprint arXiv:2204.06125, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.465327Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:e73672922bffe901efc7225738ff5a9149a35d796a161fd9900e0e658c76ae54","observation_id":"a5fc3fa3-f30d-4af4-a000-bed94dd0a9bb","resolution":{"observed_at":"2026-08-08T11:39:18.465327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.470280Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.470280Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:2afbc497306f086fb60b66db1ff120bb224da68225d7b1527e708aab9c045e11","observation_id":"8591cadf-f05c-4f62-a737-627e1d6865e1","resolution":{"observed_at":"2026-08-08T11:39:18.470280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.766385Z","title":"Pifu: Pixel-aligned implicit function for high-resolution clothed human digitization","venue":null,"work_id":"c324f1b2-fb9d-4900-b8ce-1ee64e886c1c","year":2019},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.475386Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:62718e55b0c462031838e3d758cfac8519e981e821319901c1f22dab18ceb8db","observation_id":"15bf7494-5f1b-4dab-915e-6ba07e4093e5","resolution":{"observed_at":"2026-08-08T11:39:19.771336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.752255Z","title":"Pifuhd: Multi-level pixel-aligned implicit function for high-resolution 3d human digitization","venue":null,"work_id":"4efdf47c-11b4-4527-bc87-fd0aacf9c519","year":2020},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.479993Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:c237873129f252791e33f1a191cfaa0e4a0c337282d8638a2c68954bb1a1f462","observation_id":"54156dae-d133-436f-88a9-92377aa4792b","resolution":{"observed_at":"2026-08-08T11:39:19.756766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17994","last_updated":"2024-04-24T01:08:12Z","snapshot_observed_at":"2026-07-06T16:39:24.839340Z","submitted_at":"2023-10-27T09:06:43Z","title":"ZeroNVS: Zero-Shot 360-Degree View Synthesis from a Single Image","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17994","snapshot_observed_at":"2026-08-08T11:39:18.484501Z","title":"Zeronvs: Zero-shot 360-degree view synthesis from a single real image","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.484501Z"},"links":{"cited_paper":"/paper/2310.17994","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:793b92f9d14c47b1abaeaa9484e53c652c47c8226a69a855ad28600aa11a78f7","observation_id":"2af1dc38-5f13-4c8c-b7b9-80efb7b9266b","resolution":{"observed_at":"2026-08-08T11:39:18.484501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.490667Z","title":"Superglue: Learning feature matching with graph neural networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.490667Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:89fbe25a899d26ba4dd899ce3da96962d985e6bbd84f5e2bd009bec244b73410","observation_id":"088e543a-395a-422e-8805-88ec5d7ed78b","resolution":{"observed_at":"2026-08-08T11:39:18.490667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.494984Z","title":"Structure-from-motion revisited","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.494984Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:bb0163d1864f095a3ca3e4dc4141dec22d47e8c78b5a7fe5ff52b9c89557d33a","observation_id":"b1b85dcf-fe5a-47c2-ae88-78c6e2a09057","resolution":{"observed_at":"2026-08-08T11:39:18.494984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.499395Z","title":"Facenet: A unified embedding for face recognition and clustering","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.499395Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:3c2b1581d471162943fd102ce1c93ea2af5d399cd63d3c0760114c1095656260","observation_id":"e481f45b-1c09-40bd-a105-3d94652cbd31","resolution":{"observed_at":"2026-08-08T11:39:18.499395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.711815Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":"01ef9bf7-80fd-49c7-b101-809973afe21a","year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.504329Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:0004228d43b9e45d9448f509671cce535256420666c088e0d493dc831645a575","observation_id":"0307ba8b-44e9-4856-8351-23718a21acfa","resolution":{"observed_at":"2026-08-08T11:39:19.716439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.697028Z","title":"Diffhuman: Probabilistic photorealistic 3d reconstruction of humans","venue":null,"work_id":"8e2ab0dc-75e7-425d-b7b1-8bdc3f0c9092","year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.508841Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:5404be6904519c50b7644b9b8aed727a511660475351aeb363d9378c9072cce3","observation_id":"41a62492-cddb-436b-91f6-a8195a0be1ee","resolution":{"observed_at":"2026-08-08T11:39:19.701609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17251","last_updated":"2024-09-26T08:22:52Z","snapshot_observed_at":"2026-08-01T14:52:11.938084Z","submitted_at":"2024-05-27T15:07:04Z","title":"GenWarp: Single Image to Novel Views with Semantic-Preserving Generative Warping","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17251","snapshot_observed_at":"2026-08-08T11:39:18.513592Z","title":"Genwarp: Single image to novel views with semantic-preserving generative warping","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.513592Z"},"links":{"cited_paper":"/paper/2405.17251","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:7a8ea1fe18a5a36274877ddaff7391469f08ed357572064590efe9c9a642ec3a","observation_id":"dd150066-fedf-4c4d-a46a-3f96b657ca85","resolution":{"observed_at":"2026-08-08T11:39:18.513592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10261","last_updated":"2023-04-19T16:39:51Z","snapshot_observed_at":"2026-08-04T21:24:21.644542Z","submitted_at":"2023-04-19T16:39:51Z","title":"Anything-3D: Towards Single-view Anything Reconstruction in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10261","snapshot_observed_at":"2026-08-08T11:39:18.518581Z","title":"Anything-3d: Towards single-view anything reconstruction in the wild","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.518581Z"},"links":{"cited_paper":"/paper/2304.10261","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:8fba074ed4fcb49d54bb5e92d577b13b60fbde80912d814c677ce5ee40b995d4","observation_id":"3ee13e06-32d6-4c88-a20a-a808eb4a71f8","resolution":{"observed_at":"2026-08-08T11:39:18.518581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-07-06T16:12:38.269310Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-08T11:39:18.523357Z","title":"Mvdream: Multi-view diffusion for 3d generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.523357Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:f78ba1847f8ed3bd48ae8bdab06729a8c18072823ac3591b471f81b4a293bfc0","observation_id":"4bffbc15-bd33-4b0b-b40f-c758d46bbd2d","resolution":{"observed_at":"2026-08-08T11:39:18.523357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.682096Z","title":"Implicit neural representations with periodic activation functions","venue":null,"work_id":"8a17a6fc-da7f-4293-815d-ac16eb6907b1","year":2020},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.528267Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:53cae62cea3d02b028d525010cfcfd6d87f79e60c1472b0800bcf3b6b449c220","observation_id":"f69ee5a2-b544-4184-882a-5fc61eb8491d","resolution":{"observed_at":"2026-08-08T11:39:19.687128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.667404Z","title":"Light field networks: Neural scene representations with single-evaluation rendering","venue":null,"work_id":"f6719204-b401-4041-883d-2cbe9658830b","year":2021},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.532855Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:6b23fe7b5fa22ee4ca46c6bb10ed5982624d1dd7d3b93a867a44d5e9fed994a6","observation_id":"0229cd42-24fb-4f2f-aa24-176f031ac940","resolution":{"observed_at":"2026-08-08T11:39:19.672167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.537430Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.537430Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:c598eebe5bda0bb50f26cbc6f681580eb3aa0dc6e3c699b141be3d92b57d70a8","observation_id":"c1cfa288-4280-4b01-95a6-c267d02bd425","resolution":{"observed_at":"2026-08-08T11:39:18.537430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.642652Z","title":"Danbo: Disentangled articulated neural body repre- sentations via graph neural networks","venue":null,"work_id":"b4591faa-d6be-4544-85c8-c11392d76f61","year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.542183Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:3aba7b1817230fe7b570968e9621040d5472a215feab906865fc9cef583f62a4","observation_id":"8dcf4e79-0733-4845-92e4-e9b4d702c17b","resolution":{"observed_at":"2026-08-08T11:39:19.647253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.627629Z","title":"Npc: Neural point characters from video","venue":null,"work_id":"45eb4fe1-4ce1-451c-98fc-5a32d9c8c822","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.546812Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:e89738d837145300633b14bce112e456e35783975dadc0f6ed7b0f380d30559c","observation_id":"3e9a3dd5-e711-46ed-9006-0f15c7bf582a","resolution":{"observed_at":"2026-08-08T11:39:19.632389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.612407Z","title":"Variational autoencoders for deforming 3d mesh models","venue":null,"work_id":"07db4094-aad9-4b04-9963-5178c8a7ec54","year":2018},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.551622Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:f9ef81f9dca4c7c6d0c5fb1aeb49ebfd634043b135559df569fe47f02af31357","observation_id":"c627244c-2fc7-4fad-8763-afc95ac571d4","resolution":{"observed_at":"2026-08-08T11:39:19.617425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.597022Z","title":"Make-it-3d: High-fidelity 3d creation from a single image with diffusion prior","venue":null,"work_id":"30aea24b-fbe9-4fdd-a286-d8dc9bae09f4","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.556086Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:3abf81f46fe7221b92f5ee20262562f6bcb5ceabc6c15b31377587e0376750b8","observation_id":"4268681c-2dc0-4068-a527-4d2c37f240e9","resolution":{"observed_at":"2026-08-08T11:39:19.601797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.581747Z","title":"Textmesh: Generation of realistic 3d meshes from text prompts","venue":null,"work_id":"da581a74-ea45-4c8f-aca8-95b3493661e2","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.561574Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:538a446777e0ec8432247428644664167c22b9ceaa1d440678e5660dc6dd3821","observation_id":"0dfbb4cc-b95b-456d-ae1a-bebb554d3067","resolution":{"observed_at":"2026-08-08T11:39:19.586542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.566987Z","title":"Attention is all you need.Advances in Neural Information Processing Systems, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.566987Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:34021811dbe730290767b18ce3baae9f9f207add1e96258d625630819ac7e995","observation_id":"b614a880-b355-42ed-87dd-9ba86a39a0b7","resolution":{"observed_at":"2026-08-08T11:39:18.566987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01104","last_updated":"2025-05-30T23:46:05Z","snapshot_observed_at":"2026-08-09T17:03:53.787790Z","submitted_at":"2024-10-01T22:22:35Z","title":"Softmax is not Enough (for Sharp Size Generalisation)","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01104","snapshot_observed_at":"2026-08-08T11:39:18.571084Z","title":"softmax is not enough (for sharp out-of-distribution), 2024.https://arxiv.org/abs/2410.01104","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.571084Z"},"links":{"cited_paper":"/paper/2410.01104","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:89bed4b1578f3fcbf9b23e022b5f591d6c88c968b45899ed834e6c651ce52e69","observation_id":"05002aa6-067a-43e3-9750-2248515a8f9a","resolution":{"observed_at":"2026-08-08T11:39:18.571084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.575739Z","title":"Dust3r: Geometric 3d vision made easy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.575739Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:8bd79bb276eaa355c1beaab9d817d0353d43a2f0d31d2e4db38c0953c42452d4","observation_id":"eddb96e2-3eea-4bd7-8d7a-647448cd3b74","resolution":{"observed_at":"2026-08-08T11:39:18.575739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.547751Z","title":"Rodin: A generative model for sculpting 3d digital avatars using diffusion","venue":null,"work_id":"d7a91624-40e6-4374-aecb-6bd8be4fa8fe","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.580187Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:88630d168c1ed34aeabe99504608fe7044720619bf125d1ecddff9bba121b0ac","observation_id":"18030b82-d37d-4c5f-970b-d784c8f0451a","resolution":{"observed_at":"2026-08-08T11:39:19.553004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.532233Z","title":"4d-dress: A 4d dataset of real-world human clothing with semantic annotations","venue":null,"work_id":"f4f433a3-77be-4369-929d-9aefe26ad8e3","year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.584760Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:164c4e63bbac16ce7b17f786a8062dfda59a5576ca216891ebe95b06fefbc10e","observation_id":"768fb691-4d10-407d-a92f-9fa4cb1f6819","resolution":{"observed_at":"2026-08-08T11:39:19.537303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.516564Z","title":"Prolificdreamer: High-fidelity and diverse text-to-3d generation with variational score distillation","venue":null,"work_id":"64962de8-7de4-4f1f-a581-e33c81222645","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.589527Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:55653e4ec8c62f498154df961f784d6198889f2bf5ea059879cac80b42ac7278","observation_id":"ecd17e55-e792-48c9-9275-b4d268bd4225","resolution":{"observed_at":"2026-08-08T11:39:19.522067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.501817Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":"d06a90f1-18e2-4125-8c6d-24682bc393d1","year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.595035Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:5126a6b75bc1cd4374742bb24e081e73d08b70001a0d7a57c2f301d5c0ba2ba6","observation_id":"c6bcdb64-8b99-4223-bf53-fa976d57b587","resolution":{"observed_at":"2026-08-08T11:39:19.507007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.487412Z","title":"Gomavatar: Efficient animatable human modeling from monocular video using gaussians-on-mesh","venue":null,"work_id":"5f941830-3cc7-4400-b934-5ebbd5e94e69","year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.599682Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:cefe322a82b02f466bb44c8f821c2516481923ed64aa811581db470eef2bbf42","observation_id":"f3d3f707-0500-45a1-922d-08dc752f5cf6","resolution":{"observed_at":"2026-08-08T11:39:19.491874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.472499Z","title":"Humannerf: Free-viewpoint rendering of moving people from monocular video","venue":null,"work_id":"f674efe0-ca2a-45e1-9228-46e05d5dba29","year":2022},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.604589Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:62a9fea21172ee318cf4ceb4c3590af38fa9db44d228585b9aaeb976877d5478","observation_id":"f2f3f64f-4a53-4381-be6b-d1fbb64f0ec4","resolution":{"observed_at":"2026-08-08T11:39:19.477263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.457900Z","title":"Learning a probabilistic latent space of object shapes via 3d generative-adversarial modeling","venue":null,"work_id":"4d670955-c85c-49a0-9abf-f7cb68e7412d","year":2016},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.609116Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:e2db8c70f8d5598a532f9df160cb87eff8f4f39863dd5bfd7b8ad51537e3218a","observation_id":"1f32912f-0973-48cc-b66b-4c7d7ae8d5cd","resolution":{"observed_at":"2026-08-08T11:39:19.462705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:18.613742Z","title":"Detectron2.https://github","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.613742Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:87d66315cf7bafd33d50434a1c2a815acf2dd0692efee1091b1e0435c0d30093","observation_id":"0a4774a4-9a0e-49fc-b73c-2e3cc0ab82d1","resolution":{"observed_at":"2026-08-08T11:39:18.613742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.433480Z","title":"Learning descriptor networks for 3d shape synthesis and analysis","venue":null,"work_id":"bebee637-eeb8-4147-ae40-f8f7df4f76e9","year":2018},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.618036Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:818cdff1a368d3fa3b07e47ff865b54cd7fd645a5fcbb354a1415a6f0aa19576","observation_id":"58f77260-6e15-4682-afd9-dc6430a11178","resolution":{"observed_at":"2026-08-08T11:39:19.438168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.416519Z","title":"Mvhumannet: A large-scale dataset of multi-view daily dressing human captures","venue":null,"work_id":"9c557fa2-4263-4af7-836d-36996a7ae26e","year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.622937Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:52c9ad61ea0b873b13d8936045b5261adc7b826093d0f68d0de55dbe498a7562","observation_id":"ec71ad8f-366e-4376-b369-07725acb584e","resolution":{"observed_at":"2026-08-08T11:39:19.422881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.399674Z","title":"Neurallift-360: Lifting an in-the-wild 2d photo to a 3d object with 360deg views","venue":null,"work_id":"1bc4c35c-6cd1-40f9-8edd-24c58f94ced3","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.627798Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:517906e9c9a84464ca005972f390c617ed33691dd3ce53e309acc59182abe8ba","observation_id":"bdbffe71-c654-49ba-b23a-ff7d15029fbf","resolution":{"observed_at":"2026-08-08T11:39:19.404922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10667","last_updated":"2024-10-31T07:43:14Z","snapshot_observed_at":"2026-07-06T18:01:01.206270Z","submitted_at":"2024-04-16T15:43:22Z","title":"VASA-1: Lifelike Audio-Driven Talking Faces Generated in Real Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10667","snapshot_observed_at":"2026-08-08T11:39:18.632356Z","title":"Vasa-1: Lifelike audio-driven talking faces generated in real time.arXiv preprint arXiv:2404.10667, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.632356Z"},"links":{"cited_paper":"/paper/2404.10667","citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:ab6d4e20d461958dc7c731646ca37a1314efea82c2bb6b0484c773ecaf8d65aa","observation_id":"98f327b9-02a7-4d79-8321-f3bd1d7fc56d","resolution":{"observed_at":"2026-08-08T11:39:18.632356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.384397Z","title":"FaceScape: A large-scale high quality 3D face dataset and detailed riggable 3D face prediction","venue":null,"work_id":"d7fc147a-1fd8-4138-baf7-5cceb207c175","year":2020},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.637564Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:c9544707d4c4675344ec550e24311691628e0d036d112319ecad7e75999a7553","observation_id":"45834acb-a8cd-440e-8b83-dc99ef799636","resolution":{"observed_at":"2026-08-08T11:39:19.389616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.369111Z","title":"i3DMM: Deep implicit 3D morphable model of human heads","venue":null,"work_id":"501a9f85-9fb2-427a-bd04-ee9361d61b20","year":2021},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.642751Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:2e37a268b42cd15940cadaaf6e39405b17d446a860620da445a3be52ab461b1e","observation_id":"3efa08f5-5754-4fe0-b4a4-6cbc1b0ec130","resolution":{"observed_at":"2026-08-08T11:39:19.374510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.354476Z","title":"Long-term photometric consistent novel view synthesis with diffusion models","venue":null,"work_id":"639d28b2-57ee-4807-949c-4877e38f5bba","year":2023},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.648374Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:8b8d9ff209f75a51251cabfb95b4a06dcaeb56e0e6159a8f8f018b389e9cb046","observation_id":"c793d92e-b981-44fc-b8be-cce33f31527d","resolution":{"observed_at":"2026-08-08T11:39:19.359697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:39:19.339886Z","title":"HUMBI: A large multiview dataset of human body expressions","venue":null,"work_id":"d901f7f4-8aaa-4353-944e-da8337f416d9","year":2020},"citing_paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:18.653009Z"},"links":{"citing_paper":"/paper/2502.07785"},"observation_digest":"sha256:8b13f1b8848c5586e8fa571aea759828f3dd26591da07ec713178aea3d93c663","observation_id":"95f153b7-b5c2-4487-bb9c-c8a8785d4d8f","resolution":{"observed_at":"2026-08-08T11:39:19.344852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.07785","last_updated":"2025-02-11T18:59:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T17:04:05.203730Z","submitted_at":"2025-02-11T18:59:59Z","title":"Pippo: High-Resolution Multi-View Humans from a Single Image"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":67,"verified_exact":3,"verified_fuzzy":30},"total_outbound_references":113},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 113 outbound references and 2 inbound Pith citation observations for arXiv:2502.07785."}