{"as_of":"2026-08-17T13:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:746a93a4b7a8b123d43214c1c00ba9fff56c4ca68c971fcd0d9cf049004a964c","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T10:45:40.882265Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.18944/citation-record","integrity":"/paper/2411.18944/integrity","json":"/paper/2411.18944/citation-record.json","paper":"/paper/2411.18944"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2103.10180","last_updated":"2021-03-18T11:30:31Z","snapshot_observed_at":"2026-08-17T07:02:19.976452Z","submitted_at":"2021-03-18T11:30:31Z","title":"OmniPose: A Multi-Scale Framework for Multi-Person Pose Estimation","version":1},"cited_work":{"arxiv_id":"2103.10180","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.10180","snapshot_observed_at":"2026-08-12T10:45:41.007543Z","title":"OmniPose: A Multi-Scale Framework for Multi-Person Pose Estimation","venue":"cs.CV","work_id":"4cccb22f-e0ab-4706-b294-aacea53bdbf3","year":2021},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.754930Z"},"links":{"cited_paper":"/paper/2103.10180","citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:5a26fd91881ea602012c0c118b6ee72793f8366a943cb78094696fc2243706b9","observation_id":"49b2c69f-a853-4185-98c1-55aa3cb81cc3","resolution":{"observed_at":"2026-08-12T10:45:41.014544Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.315202Z","title":"Unipose+: A unified framework for 2d and 3d human pose es- timation in images and videos","venue":null,"work_id":"d75a2bb4-606c-426b-bd82-d5824bf93549","year":2021},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.761083Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:26d927afa572a8c13ba130859f7647faaaa5a3dafdd064aed3053b56b9ce69e0","observation_id":"3c1b5c4e-a886-4c86-a2ab-22003cca9fc9","resolution":{"observed_at":"2026-08-12T10:45:41.319831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.300580Z","title":"BAPose: Bottom-up pose estimation with disentangled water- fall representations","venue":null,"work_id":"41afec1e-05de-4a6d-bf59-3ead13627824","year":2023},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.765786Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:2b73ae12ae011889d37019d86a81928f4f99be910c2157690b5fc122768415d7","observation_id":"1b14281e-ec90-4655-9db5-e876def5fd98","resolution":{"observed_at":"2026-08-12T10:45:41.305921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.286175Z","title":"Full-BAPose: Bottom up framework for full body pose estimation","venue":null,"work_id":"749ecd14-2fdd-47e0-a0f0-68966c53cda9","year":2023},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.771217Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:fcb5245c61f62c4527f66b95c367039f6137a0fcb799ed0afd8b2daeac6f1261","observation_id":"d239611b-80e3-46f0-92db-5cd14179a6aa","resolution":{"observed_at":"2026-08-12T10:45:41.290399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.273040Z","title":"Realtime multi-person 2d pose estimation us- ing part affinity fields","venue":null,"work_id":"e62ea623-e48e-468a-b72a-cba9e60a8be8","year":2017},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.776181Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:5fd06060a05036a162f339010165121e0636b321abd1d33de8382b7d6e9a6001","observation_id":"1c42810f-6717-44a8-bbad-538185bc1cef","resolution":{"observed_at":"2026-08-12T10:45:41.277295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.257394Z","title":"Yuille, and Xiaogang Wang","venue":null,"work_id":"05af6caa-f3c2-4e8f-b846-ee8b56921292","year":2017},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.780889Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:6d9c08cd815bc37f4e01f1a151b9c233d2078b309ed233166dc367833ce57963","observation_id":"8bf586b1-2653-4038-848a-11750dc2696f","resolution":{"observed_at":"2026-08-12T10:45:41.263225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.242013Z","title":"Openmmlab pose estimation toolbox and benchmark","venue":null,"work_id":"65409654-72bc-4863-9e1f-36fc2dd59497","year":2020},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.786489Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:9e834a31278d088ed383e62c6e8eded73d18cc6467342d765f846bcfb1e75be7","observation_id":"c2146e82-d257-474f-b143-50aff9440978","resolution":{"observed_at":"2026-08-12T10:45:41.246717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-12T10:45:40.791075Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.791075Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:a46df87c5cc4a9ee6a6ed886a6dd8d6a833fc6101ee504f0199f8424b91eeb55","observation_id":"cedd7a66-f382-4208-bc40-5c12a5f30c62","resolution":{"observed_at":"2026-08-12T10:45:40.791075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15001","last_updated":"2023-01-16T18:58:58Z","snapshot_observed_at":"2026-08-16T16:28:04.474972Z","submitted_at":"2022-09-29T17:57:08Z","title":"Dilated Neighborhood Attention Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15001","snapshot_observed_at":"2026-08-12T10:45:40.795479Z","title":"Dilated neigh- borhood attention transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.795479Z"},"links":{"cited_paper":"/paper/2209.15001","citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:5ebe209987688c5f57fba1c2d24aed24fbc064ac9c0603d67ef4a252ae3e1e9a","observation_id":"6f70adb9-6405-4ea1-93da-b13d67a8cbab","resolution":{"observed_at":"2026-08-12T10:45:40.795479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.227915Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"a5606657-60f4-487d-9e74-38995a289046","year":2016},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.800136Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:b65fc7e1626636ec2c06b798371023628c25210087796921a3c51bea21f8c205","observation_id":"6d842eda-a9d8-4aa0-965a-cf1d7799f921","resolution":{"observed_at":"2026-08-12T10:45:41.232533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.00148","last_updated":"2019-05-30T01:30:32Z","snapshot_observed_at":"2026-08-16T09:34:05.801311Z","submitted_at":"2019-01-01T12:52:37Z","title":"Rethinking on Multi-Stage Networks for Human Pose Estimation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.00148","snapshot_observed_at":"2026-08-12T10:45:40.804871Z","title":"Rethinking on multi- stage networks for human pose estimation","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.804871Z"},"links":{"cited_paper":"/paper/1901.00148","citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:9b250125d650aa072ac6601a3fd2ea41e6d61ee9ff1eda29f08b6356861d0883","observation_id":"946f6bbe-7478-4852-9fd0-061826f8e1e1","resolution":{"observed_at":"2026-08-12T10:45:40.804871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.213763Z","title":"Token- Pose: Learning keypoint tokens for human pose es- timation","venue":null,"work_id":"d1830ae2-edf8-46fa-a874-790bdf1f2aa2","year":2021},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.809858Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:fd5bbbcfea2df47315d6d59f7d2a11c2a5d52019ed1c5bd519e04094f1462859","observation_id":"44929b41-d367-4730-8037-b72c42a43728","resolution":{"observed_at":"2026-08-12T10:45:41.218227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.199486Z","title":"Belongie, James Hays, Pietro Perona, Deva Ramanan, Piotr Doll´ar, and C","venue":null,"work_id":"51cea8e1-33bb-4019-b38f-ae2908212566","year":2014},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.814490Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:54e790c1818e8e625d49c1950f209e3fb06685947f50550bc8dc13e163fb3d60","observation_id":"0428547c-f1ef-4ccb-889c-ccd4a12be50c","resolution":{"observed_at":"2026-08-12T10:45:41.204328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.183794Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"7416f3da-55f5-4973-bc58-778e601428ae","year":2021},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.819136Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:461d938d53bc191b47d981fa7aedabf9dbae0c4412a6c3e9fd14c9db4360131f","observation_id":"51547b5c-ead1-4f7c-892f-42e806023fad","resolution":{"observed_at":"2026-08-12T10:45:41.188848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.168177Z","title":"Stacked hourglass networks for human pose estimation","venue":null,"work_id":"c24e9c51-e34b-449b-a8da-f1e18b4b25e1","year":2016},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.823482Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:699fc5b90872307a6fe4d0444e50c25c87227a1b07739a33f8252d009b621bec","observation_id":"e14903af-0820-4d31-9532-4f5f4a3d2d0b","resolution":{"observed_at":"2026-08-12T10:45:41.172765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09237","last_updated":"2019-04-19T16:21:38Z","snapshot_observed_at":"2026-08-14T16:43:55.734754Z","submitted_at":"2019-04-19T16:21:38Z","title":"On the Convergence of Adam and Beyond","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09237","snapshot_observed_at":"2026-08-12T10:45:40.827758Z","title":"On the convergence of adam and beyond","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.827758Z"},"links":{"cited_paper":"/paper/1904.09237","citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:468adb205cd6112e5b9d78b6bfa520288c8c1ff10f4d8bf9a33923aa4a8be894","observation_id":"a8dec8df-d24b-4455-8348-d01eeae7c86d","resolution":{"observed_at":"2026-08-12T10:45:40.827758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.154491Z","title":"15 keypoints is all you need","venue":null,"work_id":"85574379-70cb-4e7a-ac5f-2ef0429e0833","year":2020},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.832587Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:c122030cca473683bc20a66ed1b012e23e00a5a8a6195dfbfdca8ffd4214a236","observation_id":"93cef3a9-45e3-4152-8840-d8d7348ef792","resolution":{"observed_at":"2026-08-12T10:45:41.158898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.139771Z","title":"Deep high-resolution representation learning for hu- man pose estimation","venue":null,"work_id":"32714630-a26a-462b-917c-43e2b6b98a36","year":2019},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.837133Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:ab6fb01340ebed38d0ec062eff251534da2faf31b0c2ab5c9c577baac942567b","observation_id":"ef167870-978c-41a5-9cc3-17b8960760a3","resolution":{"observed_at":"2026-08-12T10:45:41.144722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.125236Z","title":"Deeply learned com- positional models for human pose estimation","venue":null,"work_id":"97ac99ee-6624-4ed0-bc18-b92c2d71b207","year":2018},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.841675Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:e5b5d317e07521b05c66496cb758ae2ca8b792b51c1855ec8ced86a3c006e278","observation_id":"850a7f89-1548-4479-a50a-d22121947c87","resolution":{"observed_at":"2026-08-12T10:45:41.129878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.110910Z","title":"DeepPose: Human pose estimation via deep neural networks","venue":null,"work_id":"d202d431-de01-4718-88da-17013d5eeb53","year":2014},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.846447Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:363be65a303d5e7d6b41de3e32b8bec2cd32c185136f5bb04a330d4a65b0cf16","observation_id":"f00b7b4f-58f2-4949-aa41-eba39dbcf6d8","resolution":{"observed_at":"2026-08-12T10:45:41.115506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:40.851188Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.851188Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:f6fec4b03cd3812238a06e0b2f82ed27a0f6ffac5f38aa9b78061f21860ff53b","observation_id":"b6d9ea08-9453-47e2-9a25-da2b23b31e43","resolution":{"observed_at":"2026-08-12T10:45:40.851188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.084310Z","title":"Deep high- resolution representation learning for visual recogni- tion","venue":null,"work_id":"a99834a3-ab1c-4183-97d8-01658f587821","year":2020},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.855807Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:f75ce0087e2640fb9ec27efcb3241c29ecde5e373566816185e0dd299161e784","observation_id":"df18c7d0-eed9-413a-ab73-a4f08c1d7a0e","resolution":{"observed_at":"2026-08-12T10:45:41.089839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.070004Z","title":"Convolutional pose machines","venue":null,"work_id":"2d0dad86-62b7-4728-b347-ca999887941a","year":2016},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.860167Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:9442b5f2c874bf768cf447b061c17a0f52b08485c595712a7b10833a7d919bcd","observation_id":"106afd55-cb4b-4ac3-ba3a-149ba594317e","resolution":{"observed_at":"2026-08-12T10:45:41.074381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.12484","last_updated":"2022-10-13T01:53:23Z","snapshot_observed_at":"2026-08-16T17:04:24.971575Z","submitted_at":"2022-04-26T17:55:04Z","title":"ViTPose: Simple Vision Transformer Baselines for Human Pose Estimation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.12484","snapshot_observed_at":"2026-08-12T10:45:40.864432Z","title":"Vitpose: Simple vision transformer base- lines for human pose estimation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.864432Z"},"links":{"cited_paper":"/paper/2204.12484","citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:b6cad987705562d87f408427b33c2eb729b98c554c25afe0f4a68b11038418ad","observation_id":"a2362cc5-7c70-4a12-b54e-ec1b8cacb17c","resolution":{"observed_at":"2026-08-12T10:45:40.864432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.055289Z","title":"TransPose: Keypoint localization via transformer","venue":null,"work_id":"345e9004-63a1-4682-9003-00b6f3006e69","year":2021},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.869277Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:769dda7b8e9e005b987748c6af3550a82f326484e010ed051859d920eab1fdb9","observation_id":"1d8b589b-af4d-4921-8095-9f669c78bed3","resolution":{"observed_at":"2026-08-12T10:45:41.060053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.040444Z","title":"HRFormer: High-resolution vision transformer for dense predict","venue":null,"work_id":"4f9c5b97-1e6f-46ec-967a-79a0b44ee160","year":2021},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.873458Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:4202a8c1f3cd7f74786d1c666b68cfe8e746815c04ccff1dab5503e16c400436","observation_id":"d48e2c71-5285-4b0b-9c18-d769ce02cad0","resolution":{"observed_at":"2026-08-12T10:45:41.044908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.01760","last_updated":"2019-01-07T11:58:10Z","snapshot_observed_at":"2026-08-14T17:34:20.618926Z","submitted_at":"2019-01-07T11:58:10Z","title":"Human Pose Estimation with Spatial Contextual Information","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.01760","snapshot_observed_at":"2026-08-12T10:45:40.877764Z","title":"Human pose estimation with spatial contextual information","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.877764Z"},"links":{"cited_paper":"/paper/1901.01760","citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:8b84683c3973729a3e03fca43b9814750c09fc641d9957fdd568e7d238772f05","observation_id":"a88c9097-a826-491e-9fbd-0f3d5403951a","resolution":{"observed_at":"2026-08-12T10:45:40.877764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:45:41.025187Z","title":"3d human pose estimation with spatial and temporal transform- ers","venue":null,"work_id":"9cd593d0-0e23-4f36-912e-0b8ca292fe08","year":2021},"citing_paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T10:45:40.882265Z"},"links":{"citing_paper":"/paper/2411.18944"},"observation_digest":"sha256:84ce53c220386c0429809af3e5a933bb91ef086c2a9ad7f91cd104b89e44716b","observation_id":"52b4b00b-bf0e-453b-b94e-51f4350897ed","resolution":{"observed_at":"2026-08-12T10:45:41.030614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.18944","last_updated":"2024-11-28T06:24:40Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T16:10:35.171956Z","submitted_at":"2024-11-28T06:24:40Z","title":"Waterfall Transformer for Multi-person Pose Estimation"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":1,"verified_fuzzy":20},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2411.18944."}