{"as_of":"2026-08-16T13:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2fa60907cab18c947302e02c4567833881e5570c6b9e7d44537e858b7275cdd9","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:15:20.630864Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:15:20.532459Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T06:49:49.293792Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13688","snapshot_observed_at":"2026-08-15T20:15:20.532459Z","title":"Gaze-driven approaches to turn-taking prediction Several studies have explored the integration of gaze data for turn-taking prediction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.532459Z"},"links":{"cited_paper":"/paper/2505.13688","citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:082662411e4f0ab22e3891b38cd7df085db14959e253aedcfa3556a4728cb412","observation_id":"d7b23eb2-9353-4e16-b930-b45ef10acff4","resolution":{"observed_at":"2026-08-15T20:15:20.532459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"cited_work":{"arxiv_id":"2505.13688","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.13688","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"23ecd955-2794-4751-a79f-e59d959e2c0a","year":2025},"citing_paper":{"arxiv_id":"2604.23927","last_updated":"2026-05-14T02:22:23Z","snapshot_observed_at":"2026-08-11T16:12:01.689147Z","submitted_at":"2026-04-27T01:01:32Z","title":"Towards Localizing Conversation Partners using Head Motion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T02:40:30.978290Z"},"links":{"cited_paper":"/paper/2505.13688","citing_paper":"/paper/2604.23927"},"observation_digest":"sha256:4305c327017107650d3e183b6cdd83a67ae8b1cb6cf10873f67c5748286a4d21","observation_id":"31df9236-2389-48f0-9848-23c0315e8258","resolution":{"observed_at":"2026-05-11T22:41:15.180268Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"cited_work":{"arxiv_id":"2505.13688","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.13688","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"23ecd955-2794-4751-a79f-e59d959e2c0a","year":2025},"citing_paper":{"arxiv_id":"2604.23927","last_updated":"2026-05-14T02:22:23Z","snapshot_observed_at":"2026-08-11T16:12:01.689147Z","submitted_at":"2026-04-27T01:01:32Z","title":"Towards Localizing Conversation Partners using Head Motion","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-15T06:47:00.474535Z"},"links":{"cited_paper":"/paper/2505.13688","citing_paper":"/paper/2604.23927"},"observation_digest":"sha256:9e397b421691a93737f6eb7b8da442afa3aa0fd98442b7d759fea39532a88f22","observation_id":"f58a0f84-c134-42da-af20-04639735b189","resolution":{"observed_at":"2026-05-15T06:49:49.297240Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.13688/citation-record","integrity":"/paper/2505.13688/integrity","json":"/paper/2505.13688/citation-record.json","paper":"/paper/2505.13688"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.989992Z","title":"Accurate turn-taking prediction enhances conversa- tional flow by ensuring timely responses and sustained engage- ment [1, 2, 3]","venue":null,"work_id":"fb8292a7-42e0-4609-a554-8c5a138d553c","year":null},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.528235Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:6ad397a8e22fca4da06c77c38bd055f130ab602ca856992413fea286c378a473","observation_id":"04189463-2342-4ba2-b647-26b14e05c8c5","resolution":{"observed_at":"2026-08-15T20:15:20.993096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13688","snapshot_observed_at":"2026-08-15T20:15:20.532459Z","title":"Gaze-driven approaches to turn-taking prediction Several studies have explored the integration of gaze data for turn-taking prediction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.532459Z"},"links":{"cited_paper":"/paper/2505.13688","citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:082662411e4f0ab22e3891b38cd7df085db14959e253aedcfa3556a4728cb412","observation_id":"d7b23eb2-9353-4e16-b930-b45ef10acff4","resolution":{"observed_at":"2026-08-15T20:15:20.532459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.980273Z","title":"The dataset consists of 30 hours triadic conversations engaged in free-form conversations around a round table","venue":null,"work_id":"4b7ae1e8-78c6-46dc-aec4-50857a881ba6","year":null},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.535938Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:069e23b2a6d6794f39ca850dfb6aa615f3257403bbfd93463da747db6f214627","observation_id":"591aeb18-8a05-4536-9fa0-6ef696b60861","resolution":{"observed_at":"2026-08-15T20:15:20.983920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.971052Z","title":"An overview of these models is presented in Fig","venue":null,"work_id":"c4824ba8-08d4-4c88-8053-95221a35b72f","year":null},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.539077Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:ed4c5e1796067ab5983bbd46900174f9f758d7bf2fce19e5ad83879bbb423647","observation_id":"04690e04-3d5a-4bee-a4e1-0d6f39466f52","resolution":{"observed_at":"2026-08-15T20:15:20.974329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.962331Z","title":null,"venue":null,"work_id":"d3a698d2-0a47-4ae1-b3f0-532ca6537d5b","year":null},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.542332Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:cfa35bfbe81b421f283e058a53f4dd0219beb7775b3bb880e8fc6bcf26bb93f2","observation_id":"1d4bdb93-1a98-44be-990c-d20499256c35","resolution":{"observed_at":"2026-08-15T20:15:20.965366Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.952922Z","title":null,"venue":null,"work_id":"2caa4d11-eea6-4ad1-a3dc-b013c76a3664","year":null},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.545326Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:84127fbed251de606a2a421462a86219d11541e047820184b50b92bf58edfb36","observation_id":"69f43eb9-d304-4066-9767-6101fadc795d","resolution":{"observed_at":"2026-08-15T20:15:20.955858Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.943553Z","title":"A simplest systematics for the organization of turn tak- ing for conversation,","venue":null,"work_id":"538a140e-96c3-4415-a3d9-ae6c6212e06f","year":1978},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.548296Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:1887a9c156c6cc286e3aee3b652653463f08eb6643eb0e4b6e431a7757d0eda4","observation_id":"50e65e24-218b-42d4-a9d3-ed8630f4bae1","resolution":{"observed_at":"2026-08-15T20:15:20.946631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.934730Z","title":"On the structure of speaker–auditor interaction dur- ing speaking turns1,","venue":null,"work_id":"a4ddc174-bd45-4fdc-aa69-0c17fad0f03b","year":1974},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.551252Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:2bceb2aaefa5a6e96591498ff21859211ebf8144074743646df79f866e34b6d1","observation_id":"5851144d-8491-4ff7-bf86-682fe950d6f5","resolution":{"observed_at":"2026-08-15T20:15:20.937685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.925517Z","title":"Anticipation in turn-taking: mechanisms and information sources,","venue":null,"work_id":"02e0b056-2d13-4cb9-b638-43ba6fa439ba","year":2015},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.554028Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:797fac26e86e1076be34f7a3779db23df5fbdba50cafca49ac9ccb3c6084486e","observation_id":"d6d0c0df-9ab4-4348-a564-0db1854f7494","resolution":{"observed_at":"2026-08-15T20:15:20.928831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.916308Z","title":"The role of eye gaze in regulating turn taking in conversations: a systematized review of methods and findings,","venue":null,"work_id":"3633bbcc-d3cb-4d5d-ac7c-9b6af0948f8e","year":2021},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.556967Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:72961db7f504fa22972f4954f6833f71237ebbb50844c3c7133e47cf67a255cb","observation_id":"843bb2c3-462e-46f3-9592-fa93b0ebd4b8","resolution":{"observed_at":"2026-08-15T20:15:20.919423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.905668Z","title":"Gaze and turn-taking behavior in casual conversational interactions,","venue":null,"work_id":"4780a350-bd39-4057-95e0-7d23b219033b","year":2013},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.560392Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:1d1b9e7e51bbf7f3ea4f9a2773b6457ca15d048af1e0e0c2de69d1d66dff3970","observation_id":"49681ce2-8d4a-41f1-8321-52a9c0342e89","resolution":{"observed_at":"2026-08-15T20:15:20.910066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.895414Z","title":"Turn-taking in human face-to-face interaction is multimodal: gaze direction and manual gestures aid the coordination of turn transitions,","venue":null,"work_id":"9c22e8b8-d6ed-4d86-a726-63883dd097de","year":2023},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.563544Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:feaea8bd441c8dbedee261c3f4554afb940c5aae12b8bd132d3d9159e530ad36","observation_id":"9a155f4b-cd99-4400-a501-fca6e6961db3","resolution":{"observed_at":"2026-08-15T20:15:20.899398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.886182Z","title":"Influence of turn-taking in a two- person conversation on the gaze of a viewer,","venue":null,"work_id":"3e50bdde-0b2e-4e6d-860b-56bef4e42145","year":2013},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.566842Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:62872d5d3b93f6b5e46056f62b935c8d054105397cbed0c78e1cbc83786bcfb0","observation_id":"e2bd2555-5b7f-431b-9dbc-4f9d0780f8cc","resolution":{"observed_at":"2026-08-15T20:15:20.889070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.10874","last_updated":"2020-10-21T09:58:39Z","snapshot_observed_at":"2026-07-06T10:06:34.778687Z","submitted_at":"2020-10-21T09:58:39Z","title":"TurnGPT: a Transformer-based Language Model for Predicting Turn-taking in Spoken Dialog","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.10874","snapshot_observed_at":"2026-08-15T20:15:20.569849Z","title":"Turngpt: a transformer-based lan- guage model for predicting turn-taking in spoken dialog,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.569849Z"},"links":{"cited_paper":"/paper/2010.10874","citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:8252689a5b20f6b0f2b7496d65c322c4f8bb9df1a98766136efefe1f1533778d","observation_id":"cf8ec0b4-b29a-4343-872c-a130dcdc3909","resolution":{"observed_at":"2026-08-15T20:15:20.569849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.13321","last_updated":"2022-08-29T01:09:23Z","snapshot_observed_at":"2026-08-13T14:37:41.096961Z","submitted_at":"2022-08-29T01:09:23Z","title":"Turn-Taking Prediction for Natural Conversational Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.13321","snapshot_observed_at":"2026-08-15T20:15:20.573963Z","title":"Turn-taking prediction for natural conver- sational speech,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.573963Z"},"links":{"cited_paper":"/paper/2208.13321","citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:e78e9a2e02b7f18ecb8c02011112cb33378a27bfad251914997423ad71b8ba43","observation_id":"3b2dec23-2c29-4f88-a6a3-1001823ec45f","resolution":{"observed_at":"2026-08-15T20:15:20.573963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.876527Z","title":"Multimodal turn-taking model using visual cues for end-of-utterance predic- tion in spoken dialogue systems,","venue":null,"work_id":"36b9747c-f8df-4df2-8b76-923ba4d316c8","year":2023},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.578219Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:c4461e701b5afcbf459cc0a50c6581c3e1767942a693c6fd1bea5949186a46ea","observation_id":"5d8090b5-7234-4fc0-9783-d95eca13fa20","resolution":{"observed_at":"2026-08-15T20:15:20.879769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.866724Z","title":"Prediction of who will be the next speaker and when using gaze behavior in multi- party meetings,","venue":null,"work_id":"6b3ff766-e116-4603-a3c9-f472defaa152","year":2016},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.580919Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:5f476a9e2e0a042a829ff3d320099c604621a619a6e13168790061a939934ee1","observation_id":"7e7541a9-f94d-4d08-ba51-3ad948b8f261","resolution":{"observed_at":"2026-08-15T20:15:20.869655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.857250Z","title":"Multimodal turn analysis and prediction for multi-party conversations,","venue":null,"work_id":"13dea582-f742-4eac-a4ec-5769d8b60c36","year":2023},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.583545Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:572911b95887b2dc1cf66de9c0928d4901f2053f41312cb499db26aaf54d85ba","observation_id":"39acf6f3-56cf-4b51-981e-bbfc63704923","resolution":{"observed_at":"2026-08-15T20:15:20.860472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02896","last_updated":"2025-04-25T20:57:25Z","snapshot_observed_at":"2026-08-16T13:37:29.063509Z","submitted_at":"2024-07-03T08:17:59Z","title":"Predicting and Understanding Turn-Taking Behavior in Open-Ended Group Activities in Virtual Reality","version":2},"cited_work":{"arxiv_id":"2407.02896","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.02896","snapshot_observed_at":"2026-08-15T20:15:20.713733Z","title":"Predicting and Understanding Turn-Taking Behavior in Open-Ended Group Activities in Virtual Reality","venue":"cs.HC","work_id":"7f03f6c1-d889-4e52-a96a-feae6a5496b7","year":2024},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.586474Z"},"links":{"cited_paper":"/paper/2407.02896","citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:edcc5dea512cac02c499c69aedc1d9604958184050688e7639db718a569b936b","observation_id":"8ed1f9d8-1ff1-486f-a3ea-b5ea15264f4d","resolution":{"observed_at":"2026-08-15T20:15:20.717060Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.847657Z","title":"Egocentric deep multi- channel audio-visual active speaker localization,","venue":null,"work_id":"d7bde6cb-ce6d-496d-b634-e7aac970dcdf","year":2022},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.589677Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:5c79a15b0e4bd55373e1d14cf0169c4be4a4f05a37a32eccae0d5adb6836bf05","observation_id":"bfddea86-bcb0-4e98-b304-128384cbb544","resolution":{"observed_at":"2026-08-15T20:15:20.850933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.836849Z","title":"Hearing loss detection from facial expressions in one-on-one conversations,","venue":null,"work_id":"4ad4d53e-fab6-4b0e-8444-252e143675dc","year":2024},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.593010Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:0df449ba50dd18f028e54037c8d626ad2a9dc22f7eacdc3a1bfec1412ed2d77e","observation_id":"11a19636-bf81-43b7-851b-9dc9376f94cf","resolution":{"observed_at":"2026-08-15T20:15:20.840385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.827507Z","title":"Self- motion as supervision for egocentric audiovisual localization,","venue":null,"work_id":"34dfe16c-091c-485d-880f-dd0261922e71","year":2024},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.595631Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:0790b6be5777c27b803345853decdfabf32d5330234e83e7a5f605a3e386957f","observation_id":"432e789f-db5e-4da9-bd0c-c56042d6086a","resolution":{"observed_at":"2026-08-15T20:15:20.830612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.817612Z","title":"Spherical world-locking for audio-visual localization in egocentric videos,","venue":null,"work_id":"c6428bf3-2b70-4922-bce9-31143abccb04","year":2025},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.598441Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:7c76523465701c015789e661206f8d4fb2478454725b230c17dd5d1767e7d5df","observation_id":"5ad766ff-aa62-4f91-afdf-53f758f18d8c","resolution":{"observed_at":"2026-08-15T20:15:20.821243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13561","last_updated":"2023-10-01T20:16:22Z","snapshot_observed_at":"2026-08-13T14:52:21.014234Z","submitted_at":"2023-08-24T20:42:21Z","title":"Project Aria: A New Tool for Egocentric Multi-Modal AI Research","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13561","snapshot_observed_at":"2026-08-15T20:15:20.601179Z","title":"Project aria: A new tool for egocentric multi-modal ai research,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.601179Z"},"links":{"cited_paper":"/paper/2308.13561","citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:765813b1d755e90fc889e5a66655d0c63e515c983879b966e2606048383f321d","observation_id":"77e2dc3e-a840-49e1-9d0d-aeb994810b2e","resolution":{"observed_at":"2026-08-15T20:15:20.601179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.807560Z","title":"How pause duration influences impressions of english speech: Comparison between native and non-native speakers,","venue":null,"work_id":"73a3eb4f-69e8-48bb-8ea2-4ac6fdf0474b","year":2022},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.604223Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:7d5b94a1acd1a4a2d8bd126d014b9591f34d637b26146313c38af55d195ac8aa","observation_id":"c61262a0-d1cd-4666-942a-37890cf8cb11","resolution":{"observed_at":"2026-08-15T20:15:20.811024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.798118Z","title":"A large-scale multilingual study of silent pause duration,","venue":null,"work_id":"4b10c77c-0676-4bd2-beaf-a68bc1f26a3b","year":2002},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.606741Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:5eb6c2a0b914c1afb23593279f0da37e7caca5e88aa05721f29e95ab2001801c","observation_id":"5693bb88-67f5-4886-8d7b-f0a0248df955","resolution":{"observed_at":"2026-08-15T20:15:20.801199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.787851Z","title":"Convolutional lstm network: A machine learning ap- proach for precipitation nowcasting,","venue":null,"work_id":"1bec43bf-8117-4761-8a08-152bf037b9de","year":2015},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.609327Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:6452879c05b55573c870571dfdb2490b3d0c6155cc051eb8fb57f269ad25ba05","observation_id":"1681199f-0d99-4d67-ba1c-d73eb2133c6f","resolution":{"observed_at":"2026-08-15T20:15:20.791091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.612670Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.612670Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:29d23506eeed78e60cbfd6626925a44bf3258cc6b758745f3e35db71cfc5f511","observation_id":"3ec9c142-3326-4443-9f20-dbde745ee1e7","resolution":{"observed_at":"2026-08-15T20:15:20.612670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.00887","last_updated":"2017-02-16T17:52:03Z","snapshot_observed_at":"2026-08-14T21:18:11.607378Z","submitted_at":"2017-02-03T01:40:45Z","title":"Structured Attention Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.00887","snapshot_observed_at":"2026-08-15T20:15:20.615980Z","title":"Structured atten- tion networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.615980Z"},"links":{"cited_paper":"/paper/1702.00887","citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:cc2090d7b344b17451380c42913ff089d6ee79e44ee24f223c42a88729b48052","observation_id":"2d6e0e15-723f-4e23-91d1-c146e3d283e7","resolution":{"observed_at":"2026-08-15T20:15:20.615980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.772496Z","title":"Learning from imbalanced data sets with weighted cross- entropy function,","venue":null,"work_id":"c48a0107-29ef-4897-8ac9-4ecfe1cb5b94","year":1937},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.618915Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:c7e4b157e8213d7548bee65ef064cade7fd18aaca25f1aa4265bfb76efa130ab","observation_id":"9d5209ee-f9d5-41fd-8bb9-5d1a63fbf344","resolution":{"observed_at":"2026-08-15T20:15:20.775322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.03347","last_updated":"2021-02-08T18:20:55Z","snapshot_observed_at":"2026-08-12T17:42:40.914903Z","submitted_at":"2019-11-08T16:13:54Z","title":"Macro F1 and Macro F1","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.03347","snapshot_observed_at":"2026-08-15T20:15:20.621790Z","title":"Macro f1 and macro f1,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.621790Z"},"links":{"cited_paper":"/paper/1911.03347","citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:a7dda9c324278f62bff7b4303e6980b2b4486ee3377f26427c3948fbc6f397b1","observation_id":"57ce8eb2-2898-4271-90e1-a496e3fa3757","resolution":{"observed_at":"2026-08-15T20:15:20.621790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.762613Z","title":"Using respiration to predict who will speak next and when in multiparty meetings,","venue":null,"work_id":"0a12f83f-2079-4803-b6e4-dcaac3bd9458","year":2016},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.624733Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:319830cbdb51c044e8e73797d942c1937e62af6da89e114230f5e3353dc53d4c","observation_id":"e7966e29-1d1d-427a-b1a0-0e0616644128","resolution":{"observed_at":"2026-08-15T20:15:20.765933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.02452","last_updated":"2016-09-08T14:58:15Z","snapshot_observed_at":"2026-08-16T12:06:57.390106Z","submitted_at":"2016-09-08T14:58:15Z","title":"End-to-End Eye Movement Detection Using Convolutional Neural Networks","version":1},"cited_work":{"arxiv_id":"1609.02452","doi":null,"metadata_source":"pith","pith_arxiv_id":"1609.02452","snapshot_observed_at":"2026-08-15T20:15:20.663387Z","title":"End-to-End Eye Movement Detection Using Convolutional Neural Networks","venue":"cs.CV","work_id":"df54714e-a10d-4409-ae11-b7d19b1a16e5","year":2016},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.627667Z"},"links":{"cited_paper":"/paper/1609.02452","citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:3fd900952df39ee9c01b9fbdc3f4fb4c21707be52d68e5010142651fa6df1d22","observation_id":"9c3d3a9c-8c41-4dd4-ba51-432534ed9680","resolution":{"observed_at":"2026-08-15T20:15:20.669215Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:15:20.752759Z","title":"Online eye-movement classification with temporal convolutional networks,","venue":null,"work_id":"7d86f522-ef61-499d-a4b0-f8476d1b36be","year":2023},"citing_paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:15:20.630864Z"},"links":{"citing_paper":"/paper/2505.13688"},"observation_digest":"sha256:c1fa81ce9eddea58d18cfb2c8ac114e10d1976563cfcedc8e93e363c2f1e4117","observation_id":"f48ba852-4a70-49ff-9504-45cb13195d3f","resolution":{"observed_at":"2026-08-15T20:15:20.755999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.13688","last_updated":"2025-05-29T05:58:52Z","latest_version":3,"primary_category":"cs.HC","snapshot_observed_at":"2026-08-15T20:09:06.219191Z","submitted_at":"2025-05-19T19:43:58Z","title":"Gaze-Enhanced Multimodal Turn-Taking Prediction in Triadic Conversations"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":2,"verified_fuzzy":23},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 3 inbound Pith citation observations for arXiv:2505.13688."}