{"as_of":"2026-08-10T19:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:53b9a56d323e90b97ea66c102209fa0e2284c27b30afac1ff433e535fc84d715","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":27,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T18:53:00.932093Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T14:48:32.980001Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-10T18:53:00.932093Z","title":"Available: http://arxiv.org/abs/2408.12569","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.10928","last_updated":"2025-04-19T14:52:08Z","snapshot_observed_at":"2026-08-10T18:47:01.186615Z","submitted_at":"2025-01-19T03:19:47Z","title":"Generative Physical AI in Vision: A Survey","version":2},"reference_index":239,"source":"pdf_text","source_observed_at":"2026-08-10T18:53:00.932093Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2501.10928"},"observation_digest":"sha256:d8c7ef8db7b9fbb2dcb49d47d3cc595e9ca8a129c3e4b557f6ef3bba1066ae82","observation_id":"06f81859-b2c0-45bc-8a19-15ccdac53684","resolution":{"observed_at":"2026-08-10T18:53:00.932093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-08T21:16:16.496425Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04847","last_updated":"2025-08-04T07:36:34Z","snapshot_observed_at":"2026-08-09T19:20:02.276094Z","submitted_at":"2025-02-07T11:36:36Z","title":"HumanDiT: Pose-Guided Diffusion Transformer for Long-form Human Motion Video Generation","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T21:16:16.496425Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2502.04847"},"observation_digest":"sha256:87cd7fa0191aed5a87c23b92997f5201ce2dfb494b2f45db3533ba58fc07b8a1","observation_id":"caa24bc2-58d8-48b4-b717-e5cceb5bdbca","resolution":{"observed_at":"2026-08-08T21:16:16.496425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-07T14:51:41.572907Z","title":"Sapiens: Foundation for human vision mod- els.arXiv preprint arXiv:2408.12569, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17475","last_updated":"2025-05-23T04:58:20Z","snapshot_observed_at":"2026-08-10T18:22:21.575267Z","submitted_at":"2025-05-23T04:58:20Z","title":"PoseBH: Prototypical Multi-Dataset Training Beyond Human Pose Estimation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:51:41.572907Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2505.17475"},"observation_digest":"sha256:c5208d8918ed8a5c61ef246965c675576a46bf967dafc9f160c74f180565b913","observation_id":"4134d363-e3ab-498e-ad66-b05f272d8a05","resolution":{"observed_at":"2026-08-07T14:51:41.572907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-07T13:55:27.939782Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20582","last_updated":"2025-05-26T23:32:51Z","snapshot_observed_at":"2026-08-09T13:25:50.447124Z","submitted_at":"2025-05-26T23:32:51Z","title":"Total-Editing: Head Avatar with Editable Appearance, Motion, and Lighting","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:27.939782Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2505.20582"},"observation_digest":"sha256:e593a606a1c3a3ee7f6599d642e8b46bdea426da19fbaa4623f2837035d8cb7f","observation_id":"14e38772-f43b-48b1-a47e-406ecd8c8adb","resolution":{"observed_at":"2026-08-07T13:55:27.939782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-07T10:50:50.117287Z","title":"Sapiens: Foundation for human vision mod- els.arXiv preprint arXiv:2408.12569, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04351","last_updated":"2025-06-04T18:11:23Z","snapshot_observed_at":"2026-08-10T18:21:13.030455Z","submitted_at":"2025-06-04T18:11:23Z","title":"HuGeDiff: 3D Human Generation via Diffusion with Gaussian Splatting","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:50:50.117287Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2506.04351"},"observation_digest":"sha256:b3dc9cfec056e19861dc5685193825b40ac339aa2a46ec75b84cf98abee51b71","observation_id":"062eb3d0-d154-444c-8b9b-5e2e1887a938","resolution":{"observed_at":"2026-08-07T10:50:50.117287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T23:42:33.980220Z","title":"Sapiens: Foundation for human vision mod- els.arXiv preprint arXiv:2408.12569, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16852","last_updated":"2025-06-20T09:01:17Z","snapshot_observed_at":"2026-08-10T18:20:46.490976Z","submitted_at":"2025-06-20T09:01:17Z","title":"Controllable and Expressive One-Shot Video Head Swapping","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:33.980220Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2506.16852"},"observation_digest":"sha256:c05d46cf41356798bbcf4cc3f682cec9df90d1197a541067208b1303b3b6d474","observation_id":"e7518576-ac00-44e3-aad1-8dfeedd98dfa","resolution":{"observed_at":"2026-08-06T23:42:33.980220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T23:35:05.494749Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17206","last_updated":"2025-06-20T17:55:06Z","snapshot_observed_at":"2026-08-06T23:28:32.574410Z","submitted_at":"2025-06-20T17:55:06Z","title":"DreamCube: 3D Panorama Generation via Multi-plane Synchronization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:35:05.494749Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2506.17206"},"observation_digest":"sha256:62db82bc41b2a0a0e660875b40909219a4a1602024c0746271d3f284e3208acc","observation_id":"816c7bcd-ba28-4ed8-8187-abb5b8b292a9","resolution":{"observed_at":"2026-08-06T23:35:05.494749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T22:33:30.636955Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21270","last_updated":"2025-06-26T13:56:27Z","snapshot_observed_at":"2026-08-10T18:20:10.971818Z","submitted_at":"2025-06-26T13:56:27Z","title":"Video Virtual Try-on with Conditional Diffusion Transformer Inpainter","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:33:30.636955Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2506.21270"},"observation_digest":"sha256:caa30773aadb2ec2a3eb95db72f53fd8d8f3a6dc4e0968b19f08047ac4fa68e7","observation_id":"df1e7e3f-843f-4dd4-87b8-45e8c909f101","resolution":{"observed_at":"2026-08-06T22:33:30.636955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T19:18:16.473720Z","title":"Khirodkar, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08022","last_updated":"2025-07-08T12:33:02Z","snapshot_observed_at":"2026-08-10T18:22:24.382852Z","submitted_at":"2025-07-08T12:33:02Z","title":"CuriosAI Submission to the EgoExo4D Proficiency Estimation Challenge 2025","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T19:18:16.473720Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2507.08022"},"observation_digest":"sha256:3c2866aa9f2794c7b0c5246e35615cca4aaa4cb5e65e2701878b1167980c7648","observation_id":"659b81d6-7980-4d5f-8377-d2320644712b","resolution":{"observed_at":"2026-08-06T19:18:16.473720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T18:05:52.105572Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09230","last_updated":"2025-07-12T09:59:31Z","snapshot_observed_at":"2026-08-08T23:17:10.616344Z","submitted_at":"2025-07-12T09:59:31Z","title":"EgoAnimate: Generating Human Animations from Egocentric top-down Views","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:05:52.105572Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2507.09230"},"observation_digest":"sha256:605bf1fc1a45ee1c5c41e52dd75513e22de1b627d22af352709a440a5b1272aa","observation_id":"19b506b2-4eb5-49ae-927e-1a82223fd318","resolution":{"observed_at":"2026-08-06T18:05:52.105572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T16:30:34.528734Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13344","last_updated":"2025-07-17T17:59:17Z","snapshot_observed_at":"2026-08-07T21:11:22.341718Z","submitted_at":"2025-07-17T17:59:17Z","title":"Diffuman4D: 4D Consistent Human View Synthesis from Sparse-View Videos with Spatio-Temporal Diffusion Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:30:34.528734Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2507.13344"},"observation_digest":"sha256:4a2e339f4906e2fd1ced3aea397d9e974dfc35ae250a2ad08682cf39e7298fa8","observation_id":"6ef0743c-0968-4fe6-b29d-cadef456ac28","resolution":{"observed_at":"2026-08-06T16:30:34.528734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-06T15:03:12.936155Z","title":"Sapiens: Foundation for human vision models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18655","last_updated":"2025-08-30T18:49:41Z","snapshot_observed_at":"2026-08-09T22:10:06.572982Z","submitted_at":"2025-07-22T19:42:34Z","title":"Part Segmentation of Human Meshes via Multi-View Human Parsing","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:03:12.936155Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2507.18655"},"observation_digest":"sha256:34531454d6562e5db5914213b590548478f207243ce2cba5704d6c98b3e4a5fb","observation_id":"b280cab7-c547-4bc9-a41c-462ccaa37c3d","resolution":{"observed_at":"2026-08-06T15:03:12.936155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-05T23:49:54.834936Z","title":"Sapiens: Foundation for human vision mod- els.arXiv preprint arXiv:2408.12569, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04824","last_updated":"2025-08-06T19:07:39Z","snapshot_observed_at":"2026-08-10T18:20:48.219450Z","submitted_at":"2025-08-06T19:07:39Z","title":"Delay-constrained re-entry governs large-scale brain seizures and other network pathologies","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:54.834936Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2508.04824"},"observation_digest":"sha256:e6d49cca5ed6bc1d84f153e2faf8733009a7904a1ebf4ea82c2280ec8bf96195","observation_id":"e306f04c-b886-48a6-9290-c1047cab6dcb","resolution":{"observed_at":"2026-08-05T23:49:54.834936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-05T21:55:44.834958Z","title":"InACM Trans","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.07905","last_updated":"2025-08-11T12:18:55Z","snapshot_observed_at":"2026-08-10T18:22:21.720056Z","submitted_at":"2025-08-11T12:18:55Z","title":"Generative Video Matting","version":1},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-05T21:55:44.834958Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2508.07905"},"observation_digest":"sha256:72cd89be6e57b8f0aa48cc0d03666eeb3a5b71e6cce2056e459ff01179901a5e","observation_id":"02209304-27e1-4d7f-8908-97dfcb40cae8","resolution":{"observed_at":"2026-08-05T21:55:44.834958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-05T15:19:37.163455Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20210","last_updated":"2025-08-27T18:36:30Z","snapshot_observed_at":"2026-08-09T16:12:19.928163Z","submitted_at":"2025-08-27T18:36:30Z","title":"InfinityHuman: Towards Long-Term Audio-Driven Human","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:37.163455Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2508.20210"},"observation_digest":"sha256:814e9181fcd13cd925a3b0313745e5d4024b72f38b8b253c6cf96f3a6019805f","observation_id":"aefc38d3-8410-471e-ae5e-979f2c89fec7","resolution":{"observed_at":"2026-08-05T15:19:37.163455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-05T11:54:57.300729Z","title":"Sapiens: Foundation for human vision mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02141","last_updated":"2025-09-02T09:43:47Z","snapshot_observed_at":"2026-08-07T21:39:07.255616Z","submitted_at":"2025-09-02T09:43:47Z","title":"GRMM: Real-Time High-Fidelity Gaussian Morphable Head Model with Learned Residuals","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T11:54:57.300729Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2509.02141"},"observation_digest":"sha256:37f7aea335df9e54600bc8b7ca6e21a9123cc878ce56f1bb88fe03ee63577fbb","observation_id":"fca705c6-4480-412b-a557-e8e826d19aac","resolution":{"observed_at":"2026-08-05T11:54:57.300729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-08-05T11:29:52.407904Z","title":"Sapiens: Foundation for human vision models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07994","last_updated":"2025-09-02T18:48:37Z","snapshot_observed_at":"2026-08-07T06:43:30.899251Z","submitted_at":"2025-09-02T18:48:37Z","title":"STROKEVISION-BENCH: A Multimodal Video And 2D Pose Benchmark For Tracking Stroke Recovery","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T11:29:52.407904Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2509.07994"},"observation_digest":"sha256:3173ae8dda41b99464ceccec924bf051f42cb9ef71063007fa0cb61e8a3d5ee7","observation_id":"90b452a8-e535-40ca-be4c-ed19577865d5","resolution":{"observed_at":"2026-08-05T11:29:52.407904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2511.16719","last_updated":"2026-03-28T16:54:56Z","snapshot_observed_at":"2026-08-07T05:59:39.049027Z","submitted_at":"2025-11-20T18:59:56Z","title":"SAM 3: Segment Anything with Concepts","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-17T20:22:46.220021Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2511.16719"},"observation_digest":"sha256:9b608d912ed6321f48c746969c4014589fc42deba8cc97108a6136aed6616bde","observation_id":"099940c9-e8a8-43ea-b9ca-db73581b73a9","resolution":{"observed_at":"2026-05-17T20:25:11.397091Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2512.09646","last_updated":"2026-04-08T15:03:02Z","snapshot_observed_at":"2026-08-03T08:11:41.374378Z","submitted_at":"2025-12-10T13:40:24Z","title":"VHOI: Controllable Video Generation of Human-Object Interactions from Sparse Trajectories via Motion Densification","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-16T23:30:14.969895Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2512.09646"},"observation_digest":"sha256:cff15e615ccec86807e954e2f53fede4090df4d15c408622dd30dcefefa9ded8","observation_id":"dfdef90a-a544-4d51-a081-eecaf0b00038","resolution":{"observed_at":"2026-05-16T23:31:22.021978Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2604.02764","last_updated":"2026-04-03T06:19:12Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T06:19:12Z","title":"InverseDraping: Recovering Sewing Patterns from 3D Garment Surfaces via BoxMesh Bridging","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-13T20:16:53.260771Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2604.02764"},"observation_digest":"sha256:e8fa1bcc73585f3c73b16fd707d42dd389892fc824372412d57592df8b9676eb","observation_id":"e69ec915-a80e-4e02-9723-a121158ab61b","resolution":{"observed_at":"2026-05-13T20:18:13.097908Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2604.03305","last_updated":"2026-03-31T01:28:42Z","snapshot_observed_at":"2026-07-30T07:10:43.620755Z","submitted_at":"2026-03-31T01:28:42Z","title":"HVG-3D: Bridging Real and Simulation Domains for 3D-Conditional Hand-Object Interaction Video Synthesis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-14T00:14:36.537688Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2604.03305"},"observation_digest":"sha256:f57be3f09a904be9aec80e1b197698428fa98dda6dd8c84c8321368e8d0a8d5f","observation_id":"759c3397-c114-4a79-ad84-dbe731f2562a","resolution":{"observed_at":"2026-05-14T00:18:30.120331Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2604.20715","last_updated":"2026-04-22T16:01:04Z","snapshot_observed_at":"2026-07-06T23:07:25.185196Z","submitted_at":"2026-04-22T16:01:04Z","title":"GeoRelight: Learning Joint Geometrical Relighting and Reconstruction with Flexible Multi-Modal Diffusion Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T01:19:12.431761Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2604.20715"},"observation_digest":"sha256:9cc67ca8aafb7a095aa7efcfc3385db673e59ae42c2ba1911cbcd9707b85427d","observation_id":"91286b49-0ae6-4e2d-a812-95909ae48b8c","resolution":{"observed_at":"2026-05-11T13:36:10.152128Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2604.22865","last_updated":"2026-04-23T09:01:27Z","snapshot_observed_at":"2026-08-10T19:19:33.551003Z","submitted_at":"2026-04-23T09:01:27Z","title":"MeshLAM: Feed-Forward One-Shot Animatable Textured Mesh Avatar Reconstruction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-09T22:06:58.480052Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2604.22865"},"observation_digest":"sha256:72e496a0eed634b3e5673f2d1bdd0fcc1ed8fa0b7a39c59743a321106a0154cc","observation_id":"9b6e0ef0-3ed2-466e-9441-c7cdc8af5759","resolution":{"observed_at":"2026-05-11T14:16:28.624552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2605.02094","last_updated":"2026-05-03T23:25:45Z","snapshot_observed_at":"2026-07-06T23:15:11.601042Z","submitted_at":"2026-05-03T23:25:45Z","title":"SignMAE: Segmentation-Driven Self-Supervised Learning for Sign Language Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T19:23:07.258575Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2605.02094"},"observation_digest":"sha256:fab126fdb32ec6dcbd26af8b08c69abdc24a50a2bafcc49193b9c76c282e8a9c","observation_id":"de71c350-fa05-417a-a583-34bfb38b363e","resolution":{"observed_at":"2026-05-09T05:55:30.827729Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2605.16419","last_updated":"2026-05-14T09:03:22Z","snapshot_observed_at":"2026-08-02T06:25:17.450009Z","submitted_at":"2026-05-14T09:03:22Z","title":"Agentic Pipeline for Self-Synchronized Multiview Joint Angle Monitoring in Uncalibrated Environments","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T21:33:29.195617Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2605.16419"},"observation_digest":"sha256:26e63d690ba8c3bb55668a8b4bcc9653897fabef98d5ce4af133de1f9f45dce8","observation_id":"988a177d-061c-447c-aa48-b3054b09a0df","resolution":{"observed_at":"2026-05-20T21:33:45.707145Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2605.21766","last_updated":"2026-05-20T21:57:31Z","snapshot_observed_at":"2026-07-06T23:32:10.472558Z","submitted_at":"2026-05-20T21:57:31Z","title":"BodyReLux: Temporally Consistent Full-Body Video Relighting","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-05-22T08:52:32.185764Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2605.21766"},"observation_digest":"sha256:c11105056671ee6abdb138acc31f965f3ef46c81a5c56a142b7868b77ac6f5de","observation_id":"eeb02796-ae3e-4c1c-aa43-2524eb78d273","resolution":{"observed_at":"2026-05-22T08:54:45.882987Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models","version":3},"cited_work":{"arxiv_id":"2408.12569","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.12569","snapshot_observed_at":"2026-07-03T14:48:32.980001Z","title":"arXiv preprint arXiv:2408.12569 , year=","venue":null,"work_id":"80c75e15-0fc5-43f3-836c-b196beae0c71","year":2024},"citing_paper":{"arxiv_id":"2606.13655","last_updated":"2026-06-11T17:54:05Z","snapshot_observed_at":"2026-08-01T16:23:27.797500Z","submitted_at":"2026-06-11T17:54:05Z","title":"Flex4DHuman: Flexible Multi-view Video Diffusion for 4D Human Reconstruction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T06:54:11.233650Z"},"links":{"cited_paper":"/paper/2408.12569","citing_paper":"/paper/2606.13655"},"observation_digest":"sha256:d0ee5234762a6d8a3d790c8f2cbe9846f70bdfa4a4a73837bad027b10aaf4d1f","observation_id":"1a233636-7f61-423c-922b-32cc3ff3f7a1","resolution":{"observed_at":"2026-07-03T14:48:32.982171Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2408.12569/citation-record","integrity":"/paper/2408.12569/integrity","json":"/paper/2408.12569/citation-record.json","paper":"/paper/2408.12569"},"outbound":[],"paper":{"arxiv_id":"2408.12569","last_updated":"2024-08-27T02:31:42Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T18:19:52.749489Z","submitted_at":"2024-08-22T17:37:27Z","title":"Sapiens: Foundation for Human Vision Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 27 inbound Pith citation observations for arXiv:2408.12569."}