{"as_of":"2026-08-17T21:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:48a2e2df084dfb23848e4d756113cb2acd97575cb417e64e25359396e76201dc","coverage":[{"denominator":76,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":76,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:12:21.686913Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.05857/citation-record","integrity":"/paper/2508.05857/integrity","json":"/paper/2508.05857/citation-record.json","paper":"/paper/2508.05857"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.542493Z","title":"Social eye gaze in human-robot interaction: a review","venue":null,"work_id":"624ca280-def9-4096-b36e-c1f687dd928c","year":2017},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.210844Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:b04e917cc375a642d33c961697cb7e0038c8d5c1c91337da0a8819fd1f0f4726","observation_id":"4e2923ee-f787-4f6b-b870-ae6bb5f5e83c","resolution":{"observed_at":"2026-08-05T23:12:22.545200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.535117Z","title":"Multimae: Multi-modal multi-task masked autoen- coders","venue":null,"work_id":"e9cdb736-4dc7-43a6-8b64-9b01aa967b13","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.230744Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:8fef9c60950b6511fd787b459773055fc894bca8e1ab4bc0a41138d0cb023e82","observation_id":"52ce08d3-3d81-479d-99a9-2f619e7c29d3","resolution":{"observed_at":"2026-08-05T23:12:22.537683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.527173Z","title":"Escnet: Gaze target detec- tion with the understanding of 3d scenes","venue":null,"work_id":"f8d2e82e-630f-4760-bb24-3e4b32e75dd5","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.323049Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:2e8b580410acf69e604ce9c1a14a502f527418f83fe1a5955529034a265a57ce","observation_id":"ed803d02-9a6c-4c91-ad2d-df0bff25b8aa","resolution":{"observed_at":"2026-08-05T23:12:22.530076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.518522Z","title":"Unsupervised gaze representation learning from multi-view face images","venue":null,"work_id":"8db19504-0985-427c-bbf1-5b40bd4427ae","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.387407Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:eef82fa71a0d0bb659ad76f9443c61c08fade3341a786ae66bf365a3ba6ba93d","observation_id":"8c4676fb-cb19-4b4a-8f0c-938dedc5051c","resolution":{"observed_at":"2026-08-05T23:12:22.521719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.510057Z","title":"3d pictorial structures for multiple human pose estimation","venue":null,"work_id":"7e91b9e6-ef4c-4d98-8091-dd16cddb4571","year":2014},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.419028Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:cdaa83612ac794c679fd06ecb2b95f11fea070057431689277a7376b758b90fc","observation_id":"a95c762c-89b4-4bd9-9f0c-501218673abd","resolution":{"observed_at":"2026-08-05T23:12:22.513010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.501237Z","title":"How far are we from solving the 2d & 3d face alignment problem? (and a dataset of 230,000 3d facial landmarks)","venue":null,"work_id":"463115bd-75e6-4cd6-900c-1331647eea44","year":2017},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.447875Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:369b0b49134d58c7b2ce59eedc82694938637a430eabfb065198749309f68451","observation_id":"03fc9910-f779-4f92-b430-02d4d55a486f","resolution":{"observed_at":"2026-08-05T23:12:22.504869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.493051Z","title":"Mvsnerf: Fast general- izable radiance field reconstruction from multi-view stereo","venue":null,"work_id":"9cf7890a-e909-44da-b8ee-dec83c559fc0","year":2021},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.525152Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:638eef1d1bce10af81a32116cd6ff80c73002f5fe5b10582a0fcf0cec8a593b6","observation_id":"a693057a-acc5-4b56-ac48-1bc67a8a1e11","resolution":{"observed_at":"2026-08-05T23:12:22.495971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.485028Z","title":"Dvgaze: Dual-view gaze estima- tion","venue":null,"work_id":"bfcb5ee1-9f1f-4e15-89b7-37daea70e3d8","year":2023},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.575104Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:40088631abf10d804b90be04e83506b5318edc40b7d663b9dbe52e09b5dd3df9","observation_id":"d70fee5d-5f09-41d1-a2bc-7bbd98c1c5ce","resolution":{"observed_at":"2026-08-05T23:12:22.488148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.476960Z","title":"Connecting gaze, scene, and attention: Generalized attention estimation via joint modeling of gaze and scene saliency","venue":null,"work_id":"40708bec-02b1-45a1-8669-9beac56efb28","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.618672Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:385b81f33db68eb4c8347d5ad283a2922cdd15c35525af830d4871c32b7f139c","observation_id":"0e70f4c2-2bce-4b35-ac21-94e35617521e","resolution":{"observed_at":"2026-08-05T23:12:22.479913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.468722Z","title":"Detecting attended visual targets in video","venue":null,"work_id":"d9818411-d82f-495b-97f0-d93e6029c730","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.675129Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:c64ca4055bc4a4e96234a90ad5e5bf017dec7030cac206d9d1a659abdf4f2caf","observation_id":"7f599bc5-d63a-42a4-9bdb-40ab458e91ac","resolution":{"observed_at":"2026-08-05T23:12:22.471601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.459882Z","title":"Gaze estimation for as- sisted living environments","venue":null,"work_id":"2581719e-747a-41ca-aa7e-97390b5b14a6","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.745413Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:25238d5a40cdfd130cbacc67d7f3bc7153c3370414611d234210825fdb3072e0","observation_id":"2f471177-13cd-4abf-8c95-b56ca21b4135","resolution":{"observed_at":"2026-08-05T23:12:22.462753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.452043Z","title":"Fast and robust multi-person 3d pose estima- tion from multiple views","venue":null,"work_id":"bcea130c-7761-4bdf-b025-b09395f905f9","year":2019},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.790854Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:11085fe195fa88c61cfd8d683e3f2877978e064830a3fcb6df4479622657eeb9","observation_id":"0e11cedc-5973-4109-8ba1-28a7abb8f260","resolution":{"observed_at":"2026-08-05T23:12:22.454697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.444053Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"648e3e16-7acb-4207-91f0-112c654ba4d8","year":2021},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.847447Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:6d41daa3e2cbbb82a8d47b765292da2e2934c77bbf4179b74d42a4779b48c6e4","observation_id":"03ec5235-6363-40dc-b45c-d6fd225589bb","resolution":{"observed_at":"2026-08-05T23:12:22.446857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.435992Z","title":"The eyes have it: the neuroethology, func- tion and evolution of social gaze","venue":null,"work_id":"229e9f66-7d9a-4698-9fb6-cbf63820cd0f","year":2000},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:15.951124Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:9aedd81af527ee9f16260e6e22c6111e31e3f9c6bbe54c0b828df9f12fd7f4a5","observation_id":"4f78b97c-0877-45d0-b46e-b66909208892","resolution":{"observed_at":"2026-08-05T23:12:22.438835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.428065Z","title":"Dual attention guided gaze target detection in the wild","venue":null,"work_id":"90e1f47e-28a5-4002-8b86-38303598b596","year":2021},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.009149Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:3bdb58f504bdd6369ee2b96381c645571a8a8981f293e4e247d891811c062db4","observation_id":"b9199957-2ddf-41d4-8465-fec1100cca3c","resolution":{"observed_at":"2026-08-05T23:12:22.430669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.419316Z","title":"Social interactions: A first-person perspective","venue":null,"work_id":"a689841a-bb57-44c2-8a4c-ac52b3918f7a","year":2012},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.102338Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:8e4a1747a172fdd2271785a412c7bd8b902d08a4d8ba0e9bf95dc462202f1085","observation_id":"388f2899-635c-429e-832a-ba8b16f73f8b","resolution":{"observed_at":"2026-08-05T23:12:22.422024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.410236Z","title":"Learning to recognize daily actions using gaze","venue":null,"work_id":"bdc39f36-9b15-4278-96bb-ba272e3ec437","year":2012},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.188101Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:8e9a8526c1a72bd736862ae2fc498ecddf03a470b9cd61d7be8b19ff34cbba84","observation_id":"2eba7f01-a287-4953-a4ee-3be18de76ecb","resolution":{"observed_at":"2026-08-05T23:12:22.413683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.401432Z","title":"A meta-analysis of gaze differences to so- cial and nonsocial information between individuals with and without autism","venue":null,"work_id":"88ab9b14-6032-4499-8d89-8742db21293a","year":2017},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.231133Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:fd1d7bd37bd64e399bf3754b77d220fb520734f38ee21c281b4fd9d5ca460acc","observation_id":"7e7f57f1-931e-4a54-a67d-ebb66133d881","resolution":{"observed_at":"2026-08-05T23:12:22.404650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.290903Z","title":"Accurate, dense, and robust multiview stereopsis","venue":null,"work_id":"4a36a0dc-bcde-4c81-b9c7-7ead7190bb42","year":2009},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.271658Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:2c313ef1a7262b5e2742b454cb6aa693149ebfd5d03158c1f5362876a87f27c7","observation_id":"30f3bfbb-4417-47cb-ae1d-7aedcd65b865","resolution":{"observed_at":"2026-08-05T23:12:22.395446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.282472Z","title":"A modular multimodal architecture for gaze target prediction: Application to privacy-sensitive settings","venue":null,"work_id":"83c32546-29db-4805-91c8-45e50f2482e5","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.377604Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:e910fbc1ce1a187b3d5bb373be528bb64572576f0c5d61bc08b22a19ab813bbe","observation_id":"a13ea215-9296-4154-9605-80d88597d8bd","resolution":{"observed_at":"2026-08-05T23:12:22.285408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.274074Z","title":"A unified model for gaze following and social gaze prediction","venue":null,"work_id":"5841ba10-fcf5-459b-b351-c7555406a019","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.432892Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:7c72857137f41d369bf7a5134a19e6c07955805b5a6796d1528a4e3f4011fa51","observation_id":"f533c465-6f83-4f38-9c0d-6149a0dd17bd","resolution":{"observed_at":"2026-08-05T23:12:22.277017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.261693Z","title":"MTGS: A novel framework for multi-person temporal gaze following and social gaze prediction","venue":null,"work_id":"151b3f1f-653b-40a5-ae74-a635a16e4769","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.554134Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:ab5030d06b8002d77b464b59a450effb1cca0e3eacae07dcdb127f447cabf90b","observation_id":"9e182156-d73c-44ec-b31b-6e247615d08f","resolution":{"observed_at":"2026-08-05T23:12:22.264411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:16.630251Z","title":"Multiple view ge- ometry in computer vision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.630251Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:0d6105cd0e0c68af44f1e0365b62ae399b107a8f7d85ede09753c876d69c5b2d","observation_id":"7f402f56-6764-4894-877d-2cb67d522279","resolution":{"observed_at":"2026-08-05T23:12:16.630251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.248968Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"df16e965-82f7-4f8a-9962-82ddd66871fd","year":2016},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.667615Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:e7cb11b5dcc13068bf4a99f83707e82c959a293818ff9525d31be8fe06bd463a","observation_id":"47ec140e-1c92-4a6c-97a5-7c3a791f7e03","resolution":{"observed_at":"2026-08-05T23:12:22.251792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.241074Z","title":"Epipolar transformers","venue":null,"work_id":"c2758328-0fc8-41fb-a297-5f3b6bcb7330","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.741497Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:3adc76670486eed3f0420a7251a5abf850166a802da7c1a83e25ef010119890c","observation_id":"e8298c99-ff81-4e4a-b496-e58332ece39b","resolution":{"observed_at":"2026-08-05T23:12:22.243588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.232520Z","title":"Rotation-constrained cross-view feature fusion for multi-view appearance-based gaze estimation","venue":null,"work_id":"dbe80d3e-6bd8-437a-82fe-fb82e7043cdc","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.825432Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:2cd18ea0e68e2bbfa1ec36c456720129911e4832d7476fb330e0c4cc487a0b29","observation_id":"a5f25754-6fa2-4c86-98dc-94978ee481ca","resolution":{"observed_at":"2026-08-05T23:12:22.235253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.224596Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":"7bb2b06e-9c41-4cc8-8957-6b5397990e7d","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.862349Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:36fc4073a20b00617e465e84c3c89914b327e2ca0488cfa874a4e16e82c9242a","observation_id":"efbf6fc0-820c-436c-963d-c7cff65f5d29","resolution":{"observed_at":"2026-08-05T23:12:22.227557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.216145Z","title":"We know where they are looking at from the rgb-d camera: Gaze following in 3d.IEEE Transac- tions on Instrumentation and Measurement , 71:1–14, 2022","venue":null,"work_id":"c9056948-60d2-4a49-b912-a97ae8bd1d0d","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.928346Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:247a5c65c6892b03da05bc911a471b3c58dac5df7f6e347eba4f498b36b949ab","observation_id":"cf60ba83-ac8f-49a5-a87f-dbcd9224f176","resolution":{"observed_at":"2026-08-05T23:12:22.219548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.208065Z","title":"Gfie: A dataset and baseline for gaze-following from 2d to 3d in indoor environments","venue":null,"work_id":"61ef1f7d-3eeb-4ec1-9e40-e5240ae74f1c","year":2023},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:16.948306Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:d23328fdec50ae8459091e37038bbc5c3e06f976ab5752a6dc312de0d7dcc219","observation_id":"155c5f73-7e87-4bef-97e8-b74ca44622ca","resolution":{"observed_at":"2026-08-05T23:12:22.210796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.199514Z","title":"Smart construction","venue":null,"work_id":"10fe7b59-2428-47f9-8fc7-a683ca0d2904","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.054971Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:5e5b557f15753b6f6e98fc04379a288224582f7422b71c602c349ee222f5be69","observation_id":"dbd2547c-477f-4c40-b1b6-9561160a1e83","resolution":{"observed_at":"2026-08-05T23:12:22.202312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.191028Z","title":"Epidiff: Enhancing multi-view synthesis via localized epipolar-constrained diffusion","venue":null,"work_id":"8bad731e-03be-465c-9ddc-cfd5ceecd8e7","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.132449Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:1b28912ee4e39f0a7e6cd49723a75f3dbf73c1858cf6d64f8f6c83a9ce0199df","observation_id":"d5e37013-6e06-4cc1-8d68-6579e3678c6f","resolution":{"observed_at":"2026-08-05T23:12:22.194026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.182632Z","title":"Learnable triangulation of human pose","venue":null,"work_id":"699a4458-1b81-4cdf-bb08-813a6e4af182","year":2019},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.200874Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:693f1aa03fdb1fe7fa6c2bfefaef51d1576c82e7a61e5867b396648c64bc2e99","observation_id":"71bad21c-01fc-40c9-8df7-1179db1cdbbc","resolution":{"observed_at":"2026-08-05T23:12:22.185565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.174143Z","title":"Eye tracking in human- computer interaction and usability research: Ready to deliver the promises","venue":null,"work_id":"b4cc278b-1477-4497-8972-6b8c87cfdfc5","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.337137Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:b732a9c62b743c3aa9b11afdd7ff0ce9bf48fdd3d3bda838fba208efe53c281d","observation_id":"88e564a6-194f-45f4-bc94-209e06017148","resolution":{"observed_at":"2026-08-05T23:12:22.177399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.165034Z","title":"Learning a multi-view stereo machine","venue":null,"work_id":"5401c14e-21f6-4ef9-ae49-c72fa5a2c9ea","year":2017},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.370807Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:e645f47f3d9dc10b53fd2f22132b785af991aeb68fd70ab3b6e64ce05d128a75","observation_id":"2043dc41-fac4-4e2c-9539-4a12399166b3","resolution":{"observed_at":"2026-08-05T23:12:22.168536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.156382Z","title":"Gaze360: Physically uncon- strained gaze estimation in the wild","venue":null,"work_id":"ce44c79c-5eae-49cc-a61c-e51453a0f4fe","year":2019},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.441279Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:53fb9b2c6f72fab7f3daf8770ea2a6fa5b4f9ce09a8b3d98a4c8de0a0418c84a","observation_id":"edc7f50c-d2cc-42fb-ac3e-6d04ccc9b5db","resolution":{"observed_at":"2026-08-05T23:12:22.159485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.148231Z","title":"What uncertainties do we need in bayesian deep learning for computer vision? Advances in Neural Information Processing Systems, 30, 2017","venue":null,"work_id":"79dd1026-2f78-4025-878c-c904e50b17a5","year":2017},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.595861Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:46c7dec8c8ba5e90860fa7fd77a02d12f936af86ba40b15e41e717440106b6e2","observation_id":"9e5ccd9d-2b8c-4f74-ae7b-4c7be4363416","resolution":{"observed_at":"2026-08-05T23:12:22.151071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.140233Z","title":"Imagenet classification with deep convolutional neural net- works","venue":null,"work_id":"666f465f-b8c0-4b19-9b59-96134d7d629c","year":2012},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.659693Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:fa7210e36d8e76a1aa7cf1d5b732f5e5a8a6effca726fb2b930ab8e2bdaa2974","observation_id":"95e12600-3ba4-4db6-a129-8a081abb0e0a","resolution":{"observed_at":"2026-08-05T23:12:22.142931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.131841Z","title":"Looking here or there? gaze following in 360-degree images","venue":null,"work_id":"d25e572f-39b5-4007-8bd0-d7a2ce6c26d6","year":2021},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.803981Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:f80803da40a7ace945c54d2a4b498d68d0db1faef7c983a613796ee2db332254","observation_id":"be0f8150-2a37-48b9-9412-dc34a16d677e","resolution":{"observed_at":"2026-08-05T23:12:22.134884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.123388Z","title":"Believe it or not, we know what you are looking at! In Proceedings of the Asian Conference on Computer Vision , pages 35–50","venue":null,"work_id":"52fe35f1-8b93-4d26-aa14-db9cba53686a","year":2018},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.876025Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:e2f5cdfa53bba75da166fa5ed0c32d07a8d79323002c4eb6dbdb5fc93b0d45c6","observation_id":"6122db05-f11a-44dc-ac68-573b2a5fede6","resolution":{"observed_at":"2026-08-05T23:12:22.126223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.114998Z","title":"Deepgaze iie: Calibrated prediction in and out-of- domain for state-of-the-art saliency modeling","venue":null,"work_id":"48b0593a-4acd-4791-bd26-ec9a38125a42","year":2021},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:17.982830Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:2e487b5b14c977728aae1c3f37b17abe1532dd8d04ec8c8f753b5189d492a547","observation_id":"658c4319-ae62-47da-9dbe-60b92cd7e6d0","resolution":{"observed_at":"2026-08-05T23:12:22.117920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.106241Z","title":"3d gaze estimation for head-mounted devices based on visual saliency","venue":null,"work_id":"73e4111a-80c8-4fa3-9708-5b01dcd4fd00","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:18.097529Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:ca9f88e8f1b86caa45052cd82b6aad596b0a2836a3b006d3eaa66a9f9befbb70","observation_id":"3d2a0165-87ee-4210-80f5-82e5fd8083b5","resolution":{"observed_at":"2026-08-05T23:12:22.109348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.097483Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":"7c1c2c3f-d27a-4200-b609-f47bd6726c29","year":2023},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:18.232538Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:524c532e8c08b4a06d5fbb085689a7579d221ee893eb5b8596e84b278756280b","observation_id":"c47ee526-5ea7-4883-919d-8a521d0b134f","resolution":{"observed_at":"2026-08-05T23:12:22.100497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.088184Z","title":"Patch- level gaze distribution prediction for gaze following","venue":null,"work_id":"70bb08c6-0624-4612-84fb-f193e7af52cb","year":2023},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:18.407703Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:bed27c9fc45845052b0eb476505a4e899eda692c4e5e466e12f05c607cd6a7c2","observation_id":"929ac6c8-2678-4e2f-9ff2-2f09056893d5","resolution":{"observed_at":"2026-08-05T23:12:22.091512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.079929Z","title":"Diffusion- refined vqa annotations for semi-supervised gaze following","venue":null,"work_id":"a05f1226-1055-46aa-b7c4-0d1ebc61b4e7","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:18.562393Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:2ec4c16fe73dea633a7de0d760745b54d2892096813cb731513f12e3b9c06576","observation_id":"ea72dccd-691b-4bd4-b346-ff4098582bde","resolution":{"observed_at":"2026-08-05T23:12:22.082681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:18.672118Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:18.672118Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:9e609278b8dd7868cc56175b96c57180923d0b2b4c8812cbee9258038a8b602e","observation_id":"c19e05b0-9dbd-4a75-a01e-03116bc58e17","resolution":{"observed_at":"2026-08-05T23:12:18.672118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.064909Z","title":"Dynamic 3d gaze from afar: Deep gaze estimation from temporal eye- head-body coordination","venue":null,"work_id":"5b801980-f93d-444b-bbde-5be4bafb40c3","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:18.824660Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:4ef4294c2b25938ce6705fcf6b5e0f9a66fe4716b3dcce885a5f656649af5704","observation_id":"149fcc32-ce9b-4d68-85fd-81d30dc409bd","resolution":{"observed_at":"2026-08-05T23:12:22.068107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.055048Z","title":"Apriltag: A robust and flexible visual fiducial system","venue":null,"work_id":"f706e7bd-ba8e-43c2-865f-aae5cf1860c8","year":2011},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:18.948418Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:37647dbcd4e540f8a8a1b5d14bed31ad711900375363281f4dda8fd6fe8c0b6f","observation_id":"00b85e36-76dc-4f42-b415-a7ed39e0a8bc","resolution":{"observed_at":"2026-08-05T23:12:22.059502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:22.046925Z","title":"3d social saliency from head-mounted cameras","venue":null,"work_id":"ba178457-ea23-4c25-a886-4b765f2420ed","year":2012},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:19.094285Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:dc420e9e2b6220946017fa08cabd807f1bdb8c3ddaa015e9210160cfcc841670","observation_id":"da1b9572-e422-433f-bd6a-ca4aff5b346e","resolution":{"observed_at":"2026-08-05T23:12:22.049759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.951192Z","title":"Towards end-to-end video-based eye-tracking","venue":null,"work_id":"77e49462-b400-42be-813f-d176dc420057","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:19.228983Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:8e79945598596b8d31e8cf64bb73c4f9ee2302417d79238c32ef14d53a6c8550","observation_id":"10a7cfee-a17b-47c8-a285-0b43e4e87d9a","resolution":{"observed_at":"2026-08-05T23:12:21.963845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.934095Z","title":"Cross view fusion for 3d human pose estimation","venue":null,"work_id":"0dd9d06d-866a-4cae-b365-91c308e6dc35","year":2019},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:19.359995Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:84d3cb14ff7066110dd72b91212cef03807dc8fe86beada3c4aa027adcda8016","observation_id":"3f825fa6-e3e9-4962-bf18-f91756385c5b","resolution":{"observed_at":"2026-08-05T23:12:21.940424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.924233Z","title":"Where are they looking? In Advances in Neu- ral Information Processing Systems","venue":null,"work_id":"ed4384a9-1937-4432-9679-9c207f5c30a6","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:19.514789Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:38a3756620d57344452f6f183dad3e6a352fa25c9d2d5d718247e95cd827c09c","observation_id":"ab7e0b32-c20f-4231-b10d-0f96a88ed62e","resolution":{"observed_at":"2026-08-05T23:12:21.927491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.916664Z","title":"Following gaze in video","venue":null,"work_id":"568793b9-7d7d-4274-94c7-68b56108e1bf","year":2017},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:19.706265Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:587d1a0069dc911fa5b38c8e7463f9a685c541a48d058cad5928a44eb0654609","observation_id":"15f29581-6cfb-4117-807f-35968b262094","resolution":{"observed_at":"2026-08-05T23:12:21.919173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.909145Z","title":null,"venue":null,"work_id":"bd563600-3e3d-476f-a18f-047a296632b4","year":2018},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:19.828932Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:89560ff2232a932e1c2a6ff3613a82521dfdba514b38ca9c784da326dd86b6a1","observation_id":"a6953361-7bbb-4d2b-85d2-87945c2ed952","resolution":{"observed_at":"2026-08-05T23:12:21.911604Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.900628Z","title":"Flexible cooperation be- tween human and robot by interpreting human intention from gaze information","venue":null,"work_id":"a9aa6866-29b2-4df1-a02a-1a898cf0e34d","year":2004},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:19.955552Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:49dbc3b7510beec577b3b90aa5fcf412f96141d9e797d7d181a15380818a396d","observation_id":"33e65222-8da5-48ae-aa7a-cad1f20b86d6","resolution":{"observed_at":"2026-08-05T23:12:21.903162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12778","last_updated":"2024-11-14T11:21:09Z","snapshot_observed_at":"2026-08-16T14:08:22.417314Z","submitted_at":"2024-03-19T14:45:17Z","title":"ViTGaze: Gaze Following with Interaction Features in Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12778","snapshot_observed_at":"2026-08-05T23:12:20.018137Z","title":"Vitgaze: Gaze follow- ing with interaction features in vision transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.018137Z"},"links":{"cited_paper":"/paper/2403.12778","citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:9233720773c8d9b59d240b8211f1399ec9794cd0e3c2730ca2ee532c2298da11","observation_id":"b804309d-78c2-449d-8ac6-fb68046bdb0e","resolution":{"observed_at":"2026-08-05T23:12:20.018137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.892471Z","title":"Child- play: A new benchmark for understanding children’s gaze behaviour","venue":null,"work_id":"4dd05964-9004-47ee-8747-9626cb4bd166","year":2023},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.143092Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:bab8eeecf98d8ad5752787c68fdb7a0d8eb2b907fddd1c9e5730b493b06adef6","observation_id":"42da7089-37cf-4165-8e3f-01626c36240d","resolution":{"observed_at":"2026-08-05T23:12:21.895514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.884795Z","title":"Sharingan: A transformer architecture for multi-person gaze following","venue":null,"work_id":"7668a417-8640-4388-b637-a77d84adc15c","year":2008},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.292328Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:d9f9f2f4081df075d39352d6e7bf5427b28b9450b465f0c9053d29a338875920","observation_id":"6a5cb637-9ba8-4199-8e43-a31328f7e8f9","resolution":{"observed_at":"2026-08-05T23:12:21.887608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.877200Z","title":"Multi- modal across domains gaze target detection","venue":null,"work_id":"f9e2482c-9a29-46fc-bf81-4969d34c4b59","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.337172Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:206714326780f73c7a400bf2393ce0218dd02a7925bcfa12fffa0d3533fd7f85","observation_id":"ae3672a0-1e31-40b6-ba8f-23f4aa225746","resolution":{"observed_at":"2026-08-05T23:12:21.879975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.869724Z","title":"Object-aware gaze target detection","venue":null,"work_id":"c3f94109-ef4f-47fa-81b1-6e281b5fee74","year":2023},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.356424Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:fd8ddbc84f9c14877df1ad593433090530822e2f4fe680598d6d2e40a4422d39","observation_id":"a619653e-c759-409d-b032-43853affa962","resolution":{"observed_at":"2026-08-05T23:12:21.872393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.860873Z","title":"Al-gtd: Deep active learning for gaze target detection","venue":null,"work_id":"434832f2-205d-4330-a6fa-338a4db62372","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.432347Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:6caa8928193903866d7028559f1b896e9e5ef1c0849d5cdfe5d4bce167c377d2","observation_id":"f2522758-e819-4743-b559-719a937102dd","resolution":{"observed_at":"2026-08-05T23:12:21.864357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.853497Z","title":"End-to-end human-gaze- target detection with transformers","venue":null,"work_id":"3838d942-490f-4f31-ab71-d02ad8370b7f","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.533389Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:546f426cf81e33705aff99feae462c1025754ec3e79ba98b4ba9f71b6c6cbf6d","observation_id":"b5f3f99f-9e5b-4aaa-ae29-4089dd5ec054","resolution":{"observed_at":"2026-08-05T23:12:21.856241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.845757Z","title":"V oxelpose: Towards multi-camera 3d human pose estimation in wild en- vironment","venue":null,"work_id":"0738901c-b2f1-4c68-9fa8-bbab1a2ce5b3","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.563750Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:8a9762f0e55cde9a1cdb1fd4e33344b6977d9d01c093c137a8e8d32ef121d93b","observation_id":"a8f5f774-f34b-41de-b052-a90c39709734","resolution":{"observed_at":"2026-08-05T23:12:21.848717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.837610Z","title":"YOLOv5: A state-of-the-art real-time object de- tection system","venue":null,"work_id":"05d2964b-0ea0-4b67-aae2-6e90c544559b","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.696848Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:b90548784abb69706f53b5c8473d7ed0249f08177169930912566f278a134994","observation_id":"853f8169-80b2-4e39-8cda-1abc006d73bd","resolution":{"observed_at":"2026-08-05T23:12:21.840272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.830644Z","title":"Attention is all you need","venue":null,"work_id":"ebe8576a-75c5-4b3e-9d89-307533cf3bfe","year":2017},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.823248Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:2f447483ac6a395939f504020cbc2513fd55450fb099373ef3c7ae06a1d89135","observation_id":"3e598bf3-81bc-4b53-8b84-1fa6f40f75b3","resolution":{"observed_at":"2026-08-05T23:12:21.833120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.823508Z","title":"Gaze behavior in autism","venue":null,"work_id":"2ed6e382-c0fc-4d5e-8bba-8e306a508717","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.939260Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:f04699ff582521f8b3cbfc6e9f291b18fb1c68248c591ca61397bede6f7a3d71","observation_id":"22d55566-8c0a-4eb9-bd69-0fdb44cc1bdc","resolution":{"observed_at":"2026-08-05T23:12:21.826071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.815379Z","title":"Dust3r: Geometric 3d vi- sion made easy","venue":null,"work_id":"1d9671f4-0881-4cdf-a9a6-cd569416b5d5","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:20.986605Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:6a7481c0c90280cb22cb8aead9ecfe9e4fc40309e309b85f18c11307044b1ae0","observation_id":"4ed24cb1-88b5-4e53-b84d-f4307e022a29","resolution":{"observed_at":"2026-08-05T23:12:21.818139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.807422Z","title":"Gaze target detection based on head-local-global coordination","venue":null,"work_id":"5043a552-1622-4509-b612-7a3050f39c64","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.124734Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:16973b11500fb4b62e43ea9da798d329a0bb74d58c15814f93e4308de9d3be09","observation_id":"dd7e66be-68d2-4588-a89a-5467673922e6","resolution":{"observed_at":"2026-08-05T23:12:21.810171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.798547Z","title":"Gaze target de- tection by merging human attention and activity cues","venue":null,"work_id":"19e96b91-2f1b-46f6-8fbc-e3bb09d12914","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.218647Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:a89fd1c708c9a257606a6f62ca21e1022a6543e14f9b44f4166ae01ae76c78a4","observation_id":"49ab7205-106a-4fc6-9bf3-d355efdfb6de","resolution":{"observed_at":"2026-08-05T23:12:21.802114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.790176Z","title":"Mvs2d: Efficient multi-view stereo via attention-driven 2d convolutions","venue":null,"work_id":"cabeee7d-7428-466c-b100-7e08cd9add83","year":2022},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.330545Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:4f75191e29e157a2d8f1deb86c89e6505e811c6ef0ba3c6d7149373f7d180157","observation_id":"1dc093d5-ead5-47d2-8367-8d9f0901a288","resolution":{"observed_at":"2026-08-05T23:12:21.793178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.781056Z","title":"Mvsnet: Depth inference for unstructured multi-view stereo","venue":null,"work_id":"b1e8e2b0-6b92-4f91-89a6-a30bb9099248","year":2018},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.480786Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:e839d19d1bc769f25ed119c9fda332a6d8a2b9fb5905c4fa6111893ac530aaa1","observation_id":"5eadb762-3ab5-4b8e-b458-06f23fff0bf3","resolution":{"observed_at":"2026-08-05T23:12:21.784079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.772473Z","title":"Learning to recover 3d scene shape from a single image","venue":null,"work_id":"127c0698-6552-4b56-ad5b-04305cb7086c","year":2021},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.591051Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:7dfe7c9494dd19da7311d4873b000aeb8a9307aa23b45e8f7441d50170b1847e","observation_id":"c69aadec-9f84-47e2-a8a6-715f0dff1056","resolution":{"observed_at":"2026-08-05T23:12:21.775160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.764560Z","title":"Metric3d: Towards zero-shot metric 3d prediction from a single image","venue":null,"work_id":"d59a6672-4ae8-4a17-807d-0be35e1693f4","year":2023},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.676249Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:412475b3c0ddb430d345d10f67e2a546beac811b41a475053e028ab319254737","observation_id":"6e79cc9c-8857-4ed3-9039-41cf9876d622","resolution":{"observed_at":"2026-08-05T23:12:21.767265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.756071Z","title":"What i see is what you see: Joint attention learning for first and third person video co-analysis","venue":null,"work_id":"e4c9b29e-c42a-4729-b4f4-3cb8041150f7","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.678787Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:a86fd3039ba95afad3c775faa6688201a81c10f857bddd556d9619876239f1a2","observation_id":"9527fb49-843c-46a1-8176-e3060eb82beb","resolution":{"observed_at":"2026-08-05T23:12:21.759023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.747402Z","title":"Eth-xgaze: A large scale dataset for gaze estimation under extreme head pose and gaze variation","venue":null,"work_id":"82cdadcd-c40f-4516-8c3f-3027035f2863","year":2020},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.681392Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:201be47de201d33394f26c413b8026edcc809e33f6bfcf3b7edae34746c7772c","observation_id":"a529d215-2842-499a-9d39-00a029319665","resolution":{"observed_at":"2026-08-05T23:12:21.750275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03320","last_updated":"2025-02-13T19:52:38Z","snapshot_observed_at":"2026-08-16T13:28:08.527788Z","submitted_at":"2024-08-06T17:55:58Z","title":"Hedge Fund Portfolio Construction Using PolyModel Theory and iTransformer","version":3},"cited_work":{"arxiv_id":"2408.03320","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.03320","snapshot_observed_at":"2026-08-05T23:12:21.716345Z","title":"Hedge Fund Portfolio Construction Using PolyModel Theory and iTransformer","venue":"q-fin.PM","work_id":"0d1383fb-84ea-4559-ab24-14fba41bd782","year":2024},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.684190Z"},"links":{"cited_paper":"/paper/2408.03320","citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:ce0969e78b5a049c54911006bd8249206fea01e46f642ed7d05ef87b8f5b0638","observation_id":"e3504334-2fc1-4319-b4fa-77abba49c50c","resolution":{"observed_at":"2026-08-05T23:12:21.721577Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:12:21.738482Z","title":"We extend our model to use more than 2 views (S3)","venue":null,"work_id":"3369a9be-dcd8-40cf-bba7-934155bb2f65","year":null},"citing_paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T23:12:21.686913Z"},"links":{"citing_paper":"/paper/2508.05857"},"observation_digest":"sha256:2c6bfca6aa52343fa6133c43552473d86a494b86a3b414576456215bd35db1cf","observation_id":"0e24a479-b5ed-453c-bbcd-9d9e0a0230f4","resolution":{"observed_at":"2026-08-05T23:12:21.741481Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.05857","last_updated":"2025-08-07T21:15:15Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T11:44:07.318951Z","submitted_at":"2025-08-07T21:15:15Z","title":"Multi-view Gaze Target Estimation"},"reference_resolution":{"displayed":76,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":70},"total_outbound_references":76},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 76 of 76 outbound references and 0 inbound Pith citation observations for arXiv:2508.05857."}