{"as_of":"2026-08-09T07:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c3f7f8a3fc1a1f3fe61565c0d0a25a1899760d200aa53ce45c7ba3b8f7729a2a","coverage":[{"denominator":89,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":89,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T23:36:33.774458Z","state":"measured"},{"denominator":89,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":89,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.23917/citation-record","integrity":"/paper/2607.23917/integrity","json":"/paper/2607.23917/citation-record.json","paper":"/paper/2607.23917"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-07-31T23:36:21.728868Z","title":"arXiv preprint arXiv:2303.08774 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:21.728868Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:38091e0d73eaf339e1ae18369147c521e6977e048c3ba9c4f678c4f3c4421103","observation_id":"96220f2c-8f7a-4fb9-abd2-52c0309dfac0","resolution":{"observed_at":"2026-07-31T23:36:21.728868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:21.809439Z","title":"Attention, Perception, & Psychophysics79, 1415–1425 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:21.809439Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:ccf57ce3dde7cfc97fca249f403c9835cd35a8b0b009e1a636aca0e97827eb8e","observation_id":"ee636b80-edd7-4637-b3d5-5d72a9201563","resolution":{"observed_at":"2026-07-31T23:36:21.809439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:21.965730Z","title":"In: Proceedings of the ACL Workshop on Intrinsic and Extrinsic Evaluation Measures for Machine Translation and/or Summarization","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:21.965730Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:5d6f740a1337112ef5a49f1d6b6fc96e48b9126be7ac25f3f5b54917af26bff6","observation_id":"00ad497e-c300-4ea2-b39b-a427a709ec48","resolution":{"observed_at":"2026-07-31T23:36:21.965730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:22.133669Z","title":"In: ACM Symposium on Eye Tracking Research and Applications (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:22.133669Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:3f7aaa9452d7a7d1d73bafbce580ab8f73760387e07632f91dad32ca482fd6dc","observation_id":"b3646b75-9b67-4a1e-a60d-40fa1a9ee308","resolution":{"observed_at":"2026-07-31T23:36:22.133669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:22.249953Z","title":"Computers & Graphics119, 103909 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:22.249953Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:8f56ee433d8d7fd71fd48960158a9ba80d17a8a58368d7fbeea8f3b2c31ab5ac","observation_id":"05cdc24b-2ea2-4f5c-b513-7d48b71aef9f","resolution":{"observed_at":"2026-07-31T23:36:22.249953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19812","last_updated":"2024-03-14T12:15:38Z","snapshot_observed_at":"2026-08-05T07:24:53.841613Z","submitted_at":"2023-10-18T09:51:38Z","title":"Brain decoding: toward real-time reconstruction of visual perception","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19812","snapshot_observed_at":"2026-07-31T23:36:22.401729Z","title":"arXiv preprint arXiv:2310.19812 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:22.401729Z"},"links":{"cited_paper":"/paper/2310.19812","citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:e78b8258bd88e65be9741d53e80b553ee48403f50d76631ad742db2f7144448b","observation_id":"c7ebd525-2353-4fdd-9f85-362d91504ac1","resolution":{"observed_at":"2026-07-31T23:36:22.401729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:22.536789Z","title":"Journal of Vision14(3), 29–29 (2014)","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:22.536789Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:ce6a5a38b59b333341d075817c567943443226e4c3cededae95a70eb7f1e008f","observation_id":"82edfb5a-9673-40bb-89d9-6b066bb8300b","resolution":{"observed_at":"2026-07-31T23:36:22.536789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:22.667828Z","title":"Neurocomputing149, 788– 799 (2015)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:22.667828Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:e13e57389ec6427761187bdae5c1c08ad4ebca45b06834996d4c644630dcd031","observation_id":"d07d4914-c531-4e85-aad7-603d0d72f45b","resolution":{"observed_at":"2026-07-31T23:36:22.667828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:22.745190Z","title":"Proceedings of the ACM on Human-Computer Interaction8(ETRA) (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:22.745190Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:18cec2d47a6471d142593bda5f40f883c82de99e2e8fb6a75d29b9d6fb3cfea8","observation_id":"5a13bac3-d764-4730-a855-166b81299357","resolution":{"observed_at":"2026-07-31T23:36:22.745190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:22.842982Z","title":"IEEE transactions on pattern analysis and machine intelligence33(4), 741–753 (2010)","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:22.842982Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:77ca362ed9c82f609c531607d7d74fb2ef874ec25ff6a966c0e8166438276ef1","observation_id":"3f4762a5-52b8-4ba8-8d64-5bbf17f624c8","resolution":{"observed_at":"2026-07-31T23:36:22.842982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00034","last_updated":"2025-02-25T03:43:20Z","snapshot_observed_at":"2026-08-07T17:51:22.165243Z","submitted_at":"2025-02-25T03:43:20Z","title":"MergeIT: From Selection to Merging for Efficient Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.00034","snapshot_observed_at":"2026-07-31T23:36:22.961995Z","title":"arXiv preprint arXiv:2503.00034 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:22.961995Z"},"links":{"cited_paper":"/paper/2503.00034","citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:81dc61d14b80ed45e3a0cb68793a1df39972fa3bf2229eecc9410a47b4892845","observation_id":"a8234be0-2764-4ccb-bfbe-e51e56366d09","resolution":{"observed_at":"2026-07-31T23:36:22.961995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:23.172391Z","title":"In: European Conference on Computer Vision (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:23.172391Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:5f33319ee5068587d69411cf4ed80577c6e49ebed941e585f0edeb260b11ec84","observation_id":"c4a0aea6-6c29-4616-8da8-7c1bdf5cf95d","resolution":{"observed_at":"2026-07-31T23:36:23.172391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:23.330958Z","title":"European Conference on Computer Vision (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:23.330958Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:25c4ef65faecb4f2ea7b974feef72bcffefc405867cedd550699ab23564019ec","observation_id":"e8939c3e-0146-4ee4-b40f-db99956f9fb7","resolution":{"observed_at":"2026-07-31T23:36:23.330958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:23.502422Z","title":"Scientific reports 11(1), 8776 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:23.502422Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:5fb1b3bc050a99cbd64fdb087054562a5ab7e50164bedb7916108328ab55ef97","observation_id":"2a9b3a2b-3c11-460d-848d-e477ee22f6cf","resolution":{"observed_at":"2026-07-31T23:36:23.502422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:23.685523Z","title":"In: Proceedings of CVPR International Workshop on Gaze Estimation and Prediction in the Wild (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:23.685523Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:eacfbd7ca5ff55f5d97a1d449715b4f6157915bc7a2ea4648b684307c864a6b9","observation_id":"be7e1fb7-e4ba-4f54-8a81-41448c7269a7","resolution":{"observed_at":"2026-07-31T23:36:23.685523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:23.853397Z","title":"Journal of neural engineering 10(2), 026002 (2013) 28 Sounak Mondal et al","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:23.853397Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:1c059ce6f3e088cc886668f676c9087bd734a706405a1336a56df18a8cb483a1","observation_id":"e41a807e-da32-4e01-ae36-6e0ed9787be5","resolution":{"observed_at":"2026-07-31T23:36:23.853397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:23.959646Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:23.959646Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:1abbb42ceae4f69eeeee7a5ed976b1e5cbdf43a384d0aa1cf6002cabe07a455a","observation_id":"d31249bf-0e61-4931-95ee-7443a9d4031e","resolution":{"observed_at":"2026-07-31T23:36:23.959646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:24.103294Z","title":"Scientific Reports13(1), 624 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:24.103294Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:c2784a813ef7cb7d3c101bfc8298f85426466e4438ed323fab38164fd11beb3b","observation_id":"5119b026-3119-436f-a46f-ec8081552370","resolution":{"observed_at":"2026-07-31T23:36:24.103294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:24.221964Z","title":"Nature Machine Intelligence5(10), 1097–1107 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:24.221964Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:2e742bfea7476faa322cd16d5bd9b8d8d02c66b329bc430842e35c111b891cf9","observation_id":"e3d28867-ad19-411d-9e72-6dd0bfda3765","resolution":{"observed_at":"2026-07-31T23:36:24.221964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-08-08T22:04:13.117781Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-07-31T23:36:24.326855Z","title":"arXiv preprint arXiv:2303.03378 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:24.326855Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:85ddee6ab0e8fd8576a1f0a912556e459fcd5f37eac51fa995c8abb6eda6fde0","observation_id":"5008a3ae-c966-446c-8cff-243dbf971362","resolution":{"observed_at":"2026-07-31T23:36:24.326855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:24.442524Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:24.442524Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:d87477ac839202b170564d96807b114b18873841b324c2fff4fe7304d0b40945","observation_id":"d0abad97-b739-4dc3-bc38-d178471bef80","resolution":{"observed_at":"2026-07-31T23:36:24.442524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:24.549735Z","title":"MIT Press, Cambridge, MA (1984)","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:24.549735Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:074e84c7727b496322d07d567136bcc8f349322c1606fec6760f2350bba6768a","observation_id":"8591820e-b24f-4c4b-bf73-fdee09f3d8bc","resolution":{"observed_at":"2026-07-31T23:36:24.549735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:24.693971Z","title":"Qualitative Health Research3(4), 430–441 (1993)","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:24.693971Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:8396dde4850d560ea98728ff8fb6513df01371001c0dc742d9521a65bc9af459","observation_id":"a7dcca60-e364-410e-8a6c-7c0b8edd58b5","resolution":{"observed_at":"2026-07-31T23:36:24.693971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:24.807409Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:24.807409Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:6a890710e1d5ee96d96bf9d23e836d5fa65582ec0746979d6177746695265550","observation_id":"b8ff364c-e349-42cc-87ac-6570fadb6a8e","resolution":{"observed_at":"2026-07-31T23:36:24.807409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:24.919105Z","title":"Trends in cognitive sciences9(4), 188–194 (2005)","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:24.919105Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:a725673534f968738965b7427d350c91986909b1bf8d0b8e231055b3f1613c72","observation_id":"3e7dea68-eb34-4b29-a962-02aabbcd725e","resolution":{"observed_at":"2026-07-31T23:36:24.919105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:25.039437Z","title":"In: Eye movements, pp","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:25.039437Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:f49143de32642acdddf1972ee876cdf52c467e964cffc543e85496f523c6b8be","observation_id":"e187554a-2de0-4260-af8e-680b1cace809","resolution":{"observed_at":"2026-07-31T23:36:25.039437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:25.156206Z","title":"Frontiers in Human Neuroscience15, 659410 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:25.156206Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:e84a3db895a997534a59ec55da621d2585e10745f3e3549a70fd389c671ac38a","observation_id":"df87171b-bc51-4748-a8ef-9353e51a02b5","resolution":{"observed_at":"2026-07-31T23:36:25.156206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-07-31T23:36:25.306322Z","title":"arXiv preprint arXiv:2106.09685 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:25.306322Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:7b009ec9c82036bf4262c16f21c09195bae54575f202e0780eaf2d1517e17fe2","observation_id":"c2b656d9-d5a3-4277-b573-10e79da111ee","resolution":{"observed_at":"2026-07-31T23:36:25.306322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:25.467151Z","title":"IEEE Transactions on Visualization and Computer Graphics29(4), 1992–2004 (2021)","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:25.467151Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:a155d8aa580cd60de5b2ce934c8642749afba130a6abe87e55ca26093ea0b32d","observation_id":"f1c0d7b5-ceed-4a27-be22-43b9c95f468d","resolution":{"observed_at":"2026-07-31T23:36:25.467151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:25.631844Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:25.631844Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:e9e7f8cfb903f37fcf3e995960652a58bcc700893cc7a328801f4f4dfba3debf","observation_id":"88d9ee35-1c31-41c5-ac72-c81433007dc3","resolution":{"observed_at":"2026-07-31T23:36:25.631844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:25.804307Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence 20(11), 1254–1259 (1998)","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:25.804307Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:691249477f8c3a9aad479c9cda4ca5b6aadcbfa5e14c753ff0c2ea791c724164","observation_id":"41ec74de-2bf3-4f17-a8b7-39a6bc5a8463","resolution":{"observed_at":"2026-07-31T23:36:25.804307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:25.956537Z","title":"In: 2019 IEEE conference on virtual reality and 3D user interfaces (VR), poster (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:25.956537Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:b3f3fb306c194bfd19794463f76e95ea03c5e6d7fd3946f2c70a1185f5b5aa66","observation_id":"87910552-89c2-4731-95cb-badc18e7e489","resolution":{"observed_at":"2026-07-31T23:36:25.956537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:26.082582Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:26.082582Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:674580253abf87828c5d2b28f6faf8f0e5ec92603a8d8056fcd2426f5999e2ce","observation_id":"1766b46e-9610-4638-9a97-ae01589829b2","resolution":{"observed_at":"2026-07-31T23:36:26.082582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:26.154611Z","title":"Scientific Reports14(1), 11491 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:26.154611Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:5912e6d95b78c9be3b6d3218b6d4bf8384e3dc7d9ea41b2307da43505d022617","observation_id":"a526e48d-71ae-45c4-a271-a8224ec42f59","resolution":{"observed_at":"2026-07-31T23:36:26.154611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:26.207043Z","title":"International journal of computer vision123, 32–73 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:26.207043Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:40e2cb55209cef4b7cb726e00f13fd7dbb738a899c14e14062e609ee0b6feb89","observation_id":"a45297da-11d9-4adf-95ee-1ad647af1c6c","resolution":{"observed_at":"2026-07-31T23:36:26.207043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13326","last_updated":"2025-06-05T01:47:25Z","snapshot_observed_at":"2026-08-06T07:56:11.183658Z","submitted_at":"2024-05-22T04:08:20Z","title":"Mosaic-IT: Cost-Free Compositional Data Synthesis for Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13326","snapshot_observed_at":"2026-07-31T23:36:26.346122Z","title":"arXiv preprint arXiv:2405.13326 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:26.346122Z"},"links":{"cited_paper":"/paper/2405.13326","citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:f49b5c9f680576047391054c65c1628cbda2ed7cf5ebaf909eb871440db8e80b","observation_id":"f0d1c850-79d1-4bb1-9ba3-42628e79beb4","resolution":{"observed_at":"2026-07-31T23:36:26.346122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:26.520836Z","title":"IEEE Transactions on Human-Machine Systems 47(4), 437–448 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:26.520836Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:28ed1946540326c7aa744f621f8d5da0ac36e1fd5fae1bffece99779bb9e9ba0","observation_id":"96982a15-d176-4952-8195-57cd600aa1b0","resolution":{"observed_at":"2026-07-31T23:36:26.520836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:26.668134Z","title":"International Conference on Learning Representations (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:26.668134Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:5799cdaebcf2ebacabe6b1e344b4ee1d19ea8f82d298c3ac849d20d5b277e0fd","observation_id":"9c5b10e2-209a-471a-9ccc-33303fcd3ef5","resolution":{"observed_at":"2026-07-31T23:36:26.668134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:26.823083Z","title":"Signal Processing: Image Communication94, 116198 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:26.823083Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:69441ebcf110138cf777095b710d56ea21c067a5aa829b6c443bb1c9618be412","observation_id":"c75d8c87-ee5a-4167-8459-975989057d79","resolution":{"observed_at":"2026-07-31T23:36:26.823083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:26.952656Z","title":"In: Text Summarization Branches Out","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:26.952656Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:19b18c9ff0d9620805b878e0cbd435d34530c64f4d231742a134bfaa59128d97","observation_id":"5218aab6-4b01-43e2-9432-dae6159e5d81","resolution":{"observed_at":"2026-07-31T23:36:26.952656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:27.092916Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:27.092916Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:8e9746a912abac8c236015eb74e5c43caec54c3ae481d455626601bff5942b38","observation_id":"9d709345-9f64-4f88-aacc-59d43dd8becb","resolution":{"observed_at":"2026-07-31T23:36:27.092916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:27.267847Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:27.267847Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:2bcdd43752315becc42bd083ab69b9de7742a93d83dcb7bbe53dc49a364b4286","observation_id":"0dabfc28-7a40-49ee-bdff-d26acf1cb7b9","resolution":{"observed_at":"2026-07-31T23:36:27.267847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:27.399504Z","title":"Advances in neural information processing systems36, 34892–34916 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:27.399504Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:9f4db1f22f0971aa65572b6fde1a7bcda39302f157323e087b110a1f9cb52bf0","observation_id":"1cac82fe-f463-4cfc-8dfc-3e983e397bf1","resolution":{"observed_at":"2026-07-31T23:36:27.399504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:27.517045Z","title":"Journal of Vision9(11), 25–25 (2009)","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:27.517045Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:9132487c5359ba9ce7d150820a27db6c180be9a46b40b562fbb3f810f1d415d0","observation_id":"22e98fbd-8a0d-4dd4-9f15-f1f7dcaf47ac","resolution":{"observed_at":"2026-07-31T23:36:27.517045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04721","last_updated":"2023-10-26T01:27:29Z","snapshot_observed_at":"2026-08-08T00:48:24.957345Z","submitted_at":"2023-07-10T17:32:13Z","title":"Large Language Models as General Pattern Machines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04721","snapshot_observed_at":"2026-07-31T23:36:27.645292Z","title":"arXiv preprint arXiv:2307.04721 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:27.645292Z"},"links":{"cited_paper":"/paper/2307.04721","citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:b88d2181b4c1d1b31e4f27196c109bf2eda88a4f7011682ba58ca1d391197a6b","observation_id":"af2c28cd-5871-44d3-8890-a300c1c376ca","resolution":{"observed_at":"2026-07-31T23:36:27.645292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:27.716335Z","title":"In: Proceedings of the 33rd ACM International Conference on Information and Knowledge Management (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:27.716335Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:621c8d5d40d9fce10ca7e01364791a28c6ddb38784d641e025e96c01cbc75162","observation_id":"a7e13230-43ff-4e28-8f58-37ace7934522","resolution":{"observed_at":"2026-07-31T23:36:27.716335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:27.834603Z","title":"In: European Conference on Computer Vision (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:27.834603Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:77447dc4e25ac1983ea2214a1c117ca7cce0d2c4301d742da95ba1bd1447878a","observation_id":"ca94cff2-a291-411f-a18a-0a7d03fd474c","resolution":{"observed_at":"2026-07-31T23:36:27.834603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:27.951758Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision (October 2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:27.951758Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:cdf9a521baf1bb4cd5637318538760fc171437c7fac0bdef47955658afc3f5bc","observation_id":"a8d8824c-b75b-4138-af6a-04d4817e125e","resolution":{"observed_at":"2026-07-31T23:36:27.951758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:28.100772Z","title":"In: Proceed- ings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (2023) 30 Sounak Mondal et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:28.100772Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:dbf53e2c761a606c088356def73febc23bd8a1a7b3f4d3c77876f7b3699055cf","observation_id":"784f5d39-6d94-4aaf-8315-1ac28d137e76","resolution":{"observed_at":"2026-07-31T23:36:28.100772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:28.242789Z","title":"Nature434(7031), 387–391 (2005)","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:28.242789Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:dd6f24e7c166a41bbb6346d541040eb5f0f134019524e581215e85019e9283de","observation_id":"1710bbc6-6cdc-439d-a00f-66d5c17cffb8","resolution":{"observed_at":"2026-07-31T23:36:28.242789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:28.363697Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:28.363697Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:937b21659aaabee0fe0e62e0cdfc4e5c7cc604cbe7ed032fdfc596a09a2826e2","observation_id":"8409522a-5181-4592-abd2-30afb90df8da","resolution":{"observed_at":"2026-07-31T23:36:28.363697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:28.490894Z","title":"In: Proceedings of the 40th Annual Meeting of the Association for Computational Linguistics","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:28.490894Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:986f9d312cb026c024ed708c9136d28e2accd314ca8ec4a83d9d1b0f106fbbba","observation_id":"a6cba62a-5038-453d-bac8-2881cf843395","resolution":{"observed_at":"2026-07-31T23:36:28.490894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:28.622558Z","title":"Advances in Neural Information Processing Systems (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:28.622558Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:f775705532f0a2ddd125bb0e7ee2d4ecb4f22db52d9d7395505a184ce8b4ef15","observation_id":"a0d37698-44ca-4152-92fa-16bd6ff7e9fe","resolution":{"observed_at":"2026-07-31T23:36:28.622558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:28.793680Z","title":"Developmental Neurorehabilitation23(3), 145–159 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:28.793680Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:e0487736594ba98afaa66172c9a75258c676c216fc4b6a64b46950bcbd2ba06f","observation_id":"4bc06b0b-28de-4bf0-9a51-eaf0a24af77e","resolution":{"observed_at":"2026-07-31T23:36:28.793680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:28.911570Z","title":"In: International Conference on Machine Learning (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:28.911570Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:d7c271879153002d57f037adb77163ee621eef8fb3c21fb1c524f507e3071e55","observation_id":"80ffb859-e1c6-4410-b736-34cce322a043","resolution":{"observed_at":"2026-07-31T23:36:28.911570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:29.051112Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:29.051112Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:1be9a605b01e13f66f921a64d0a743512bedfe8b492a2f90f8299d99daa241a7","observation_id":"8279ac28-630e-4cf9-b564-b88476020dbf","resolution":{"observed_at":"2026-07-31T23:36:29.051112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:29.202047Z","title":"In: Proceed- ings of the 26th ACM SIGKDD international conference on knowledge discovery & data mining (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:29.202047Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:25e9e45f3cd49c332a1b6bac6c47aaabdeb814ada2dd6846379ce0fb2bed1554","observation_id":"e1837326-b933-49f9-8bcc-17ca8137699b","resolution":{"observed_at":"2026-07-31T23:36:29.202047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:29.344077Z","title":"IEEE Access10, 70779–70792 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:29.344077Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:5cd5e66b8608aaabc0f278a5681924bfce378bcab0bdf46b72841bc9ae60eb41","observation_id":"9238a82f-97d6-40eb-93f1-98c9ccd1ac44","resolution":{"observed_at":"2026-07-31T23:36:29.344077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:29.447831Z","title":"In: Proceedings of the IEEE International Conference on Computer Vision Workshops (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:29.447831Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:7843f8c613189f6d9199ade891180a6acedaab1bce135f966bb28ce7eaf318e6","observation_id":"4ac9df2d-292f-43e1-8955-b3394f4d4b1b","resolution":{"observed_at":"2026-07-31T23:36:29.447831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:29.593172Z","title":"Neurocomputing387, 369–382 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:29.593172Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:8c7063badb6212aad794eb86ddf26eb56aeb338acd9920f1c18b110c1b5f078a","observation_id":"978713c7-a765-450f-b291-d14b53b101c4","resolution":{"observed_at":"2026-07-31T23:36:29.593172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:29.712980Z","title":"In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (2015)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:29.712980Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:3b24b703e5e78d25b89c2eeb97be10d0d29671bee16ed4fb50582319e02aef09","observation_id":"8045500a-a77d-497b-9026-f4fedb7fc75a","resolution":{"observed_at":"2026-07-31T23:36:29.712980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:29.857684Z","title":"Nature620, 297–302 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:29.857684Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:d0155d1d1c3fe4b4af6909de5bea47a501e749187dc9096696cbcff1bc4c319d","observation_id":"152e08bd-4d5b-43f1-a2e8-020bbf83cb13","resolution":{"observed_at":"2026-07-31T23:36:29.857684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:29.983710Z","title":"Academic Press, London (1994)","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:29.983710Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:9db044c5823c7e7736aff27b6d0dc80da6e2f3bf426de9a33cddf57bda93ee83","observation_id":"60095420-d407-447e-b90b-90bf059e87d8","resolution":{"observed_at":"2026-07-31T23:36:29.983710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:30.120976Z","title":"In: KI 2018: Advances in Artificial Intelligence: 41st German Con- ference on AI, Berlin, Germany, September 24–28, 2018, Proceedings 41","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:30.120976Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:2db0456ee029512cb9cd1bead4bc2decf23eca3e7af548a1d14e343441353965","observation_id":"f32ae614-2f8f-4416-b2a5-8064f6774d54","resolution":{"observed_at":"2026-07-31T23:36:30.120976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:30.294970Z","title":"In: Proceedings of the 2015 acm international joint conference on pervasive and ubiquitous computing (2015) Gaze-to-text Generation 31","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:30.294970Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:00d4d5ca0298aeb5b6b1e396f0dc1bcc465b01b3d61041e028fbc57b16b02274","observation_id":"9f90b3cd-ba80-49d1-80a0-8c20a1b7d1ec","resolution":{"observed_at":"2026-07-31T23:36:30.294970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:30.413120Z","title":"In: Proceedings of the 36th Annual ACM Symposium on User Interface Software and Technology (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:30.413120Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:5341127fe2734f07cbba3d3a9c793d79400d85575db3830bfcda0abc7192693e","observation_id":"96fab366-34d8-4e1a-ba83-e95839d3f077","resolution":{"observed_at":"2026-07-31T23:36:30.413120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:30.591231Z","title":"In: Proceedings of the IEEE/CVF Inter- national Conference on Computer Vision (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:30.591231Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:a180906d56fa9f39ac403c500c985ea7bc34a01a5879e4fd708c1898a3e28263","observation_id":"220e54b2-79e6-4a49-b2b5-3a1a75b04f9c","resolution":{"observed_at":"2026-07-31T23:36:30.591231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:30.765397Z","title":"In: Annual Conference on Neural Information Processing Systems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:30.765397Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:2df2e627525c91a2a526334912765587ee74143064b2058ad53c6cd3995a79b6","observation_id":"b3752793-416b-40af-a737-9187eec7392c","resolution":{"observed_at":"2026-07-31T23:36:30.765397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:30.913720Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:30.913720Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:bcd8c51632eaa168fed9d06fb23f7dc146635a7ebf80e7dfd0f35c33b3e2c30e","observation_id":"acc88630-5842-4e4d-bc81-de6639318a32","resolution":{"observed_at":"2026-07-31T23:36:30.913720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:31.023279Z","title":"In: 17th International IEEE conference on intelligent transportation systems (ITSC)","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:31.023279Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:443d2674ac042545e3f85454f649b4d25b95db88a5938f170fa6de39274ffeea","observation_id":"80aecf8d-3930-49e4-8012-297cab1bb9af","resolution":{"observed_at":"2026-07-31T23:36:31.023279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:31.201278Z","title":"IEEE Transactions on Visualization and Computer Graphics16(6), 953– 962 (2010)","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:31.201278Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:e3e6184cc05d625a3e32593e5310db42c9bdae8659b242240be0445299782aa6","observation_id":"177b7815-5257-4a0d-814f-ddba9194a180","resolution":{"observed_at":"2026-07-31T23:36:31.201278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:31.320560Z","title":"In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition (CVPR) (2015)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:31.320560Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:fcfa00541ad86d5663e7a652a6010b114c2c92dcbcf8c5bb44bee026594172c3","observation_id":"90b2000c-181e-4dc9-8bb3-1919d5992c02","resolution":{"observed_at":"2026-07-31T23:36:31.320560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:31.451818Z","title":"In: Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:31.451818Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:709407107da3023bd2adcfbd2be87cfa33bd51b0d442848f45a4b395091f5601","observation_id":"9a8c20d6-7d95-4741-88e2-050f8d4516ee","resolution":{"observed_at":"2026-07-31T23:36:31.451818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:31.598961Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:31.598961Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:0620aa85692d00274aee8b2de77eaf1032528e169d4f465a231705dd23ebfd20","observation_id":"1dfe1f60-3a9f-4a91-9c2f-a9dc01276d18","resolution":{"observed_at":"2026-07-31T23:36:31.598961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:31.744153Z","title":"In: Advances in Neural Information Processing Systems (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:31.744153Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:d948b2cc3bfbafa90fef1814d5fcec9f17979e380e4291e89de1c99c724f5d82","observation_id":"a2a350fb-ef2c-42c3-8e86-22720381e433","resolution":{"observed_at":"2026-07-31T23:36:31.744153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:31.900681Z","title":"In: Proceedings of the 2019 CHI Conference on Human Factors in Computing Systems (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:31.900681Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:441ba9f87805c8655bd8432bf07a084e1a63026c41bebea0aa3de38a0265c0ac","observation_id":"59e4e1e0-8632-4b62-a14d-cd87edbee6c8","resolution":{"observed_at":"2026-07-31T23:36:31.900681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:32.005865Z","title":"In: AKWI Jahrestagung 2024 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:32.005865Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:092bb97f880f4ccf7a79440fb6d69bfb7a8ed4af1a8d10970febd97d515b0335","observation_id":"cae31f13-397a-4dcd-ae19-2a9ba13b4b61","resolution":{"observed_at":"2026-07-31T23:36:32.005865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07732","last_updated":"2024-09-12T03:41:39Z","snapshot_observed_at":"2026-08-05T06:56:18.490212Z","submitted_at":"2024-09-12T03:41:39Z","title":"Large Language Models are Pattern Matchers: Editing Semi-Structured and Structured Documents with ChatGPT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07732","snapshot_observed_at":"2026-07-31T23:36:32.117360Z","title":"arXiv preprint arXiv:2409.07732 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:32.117360Z"},"links":{"cited_paper":"/paper/2409.07732","citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:97a08a0be0bc02d194c47c9b289d8eb7308a0259ffc642f1426fedf80b8f05ee","observation_id":"56aa241c-efdc-4667-a66d-2713adfd2734","resolution":{"observed_at":"2026-07-31T23:36:32.117360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:32.291900Z","title":"Vision3(3), 33 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:32.291900Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:8518b3f6277e511c42409dd04ea999f92cc703bd47935bfc444da43de15626d3","observation_id":"931fa90f-18a0-474e-a007-54e3fb872d07","resolution":{"observed_at":"2026-07-31T23:36:32.291900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:32.413912Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:32.413912Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:142f4edef6991513e5f2f6f8c46ba8304c6d98c9a90524180c754f2b3d59fa32","observation_id":"907461f8-c634-47b0-b437-567fbcc04801","resolution":{"observed_at":"2026-07-31T23:36:32.413912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02712","last_updated":"2025-03-04T00:49:07Z","snapshot_observed_at":"2026-08-06T04:32:16.849942Z","submitted_at":"2024-10-03T17:36:33Z","title":"LLaVA-Critic: Learning to Evaluate Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02712","snapshot_observed_at":"2026-07-31T23:36:32.551429Z","title":"arXiv preprint arXiv:2410.02712 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:32.551429Z"},"links":{"cited_paper":"/paper/2410.02712","citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:60ca46b71d82d5c9fb6a2ed68dbc3fdc858268d595eafdbd16b34a1a01a111b6","observation_id":"bb689320-823d-4dbb-b920-2895516fd83f","resolution":{"observed_at":"2026-07-31T23:36:32.551429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:32.733065Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:32.733065Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:c2d80fc29c1dd19e3e52ec8b239e0d650d11f443236b09c9837764c0849ab62a","observation_id":"aeeb8a53-24f7-441c-9bb3-0ff96b10b9d0","resolution":{"observed_at":"2026-07-31T23:36:32.733065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:32.864648Z","title":"In: European Conference on Computer Vision (2022) 32 Sounak Mondal et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:32.864648Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:3c3522ef0d9afafa3aa7b22bf9f0840e3f1ba01df3d5adfada07d32d09088229","observation_id":"b8667b41-ae62-49a7-bee6-5e8657b680dd","resolution":{"observed_at":"2026-07-31T23:36:32.864648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:33.030821Z","title":"Plenum Press, New York (1967)","venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:33.030821Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:ebe56ff3b5d6b85dfc00c6e6d9fb6ee21bf5e4649fa35521e20bc8ac4151e37b","observation_id":"fc63a720-562b-4a5c-8cd5-107f7b28213f","resolution":{"observed_at":"2026-07-31T23:36:33.030821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:33.158996Z","title":"In: European Conference on Computer Vision (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:33.158996Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:d40e09e07005d63638d5a44cc5bfb3e4904f6760731ba295cf57caffb777ee9e","observation_id":"fe4bc921-3318-446e-8001-5d6066babd4a","resolution":{"observed_at":"2026-07-31T23:36:33.158996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:33.334655Z","title":"Journal of Vision8(6), 380–380 (2008)","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:33.334655Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:d62bac5d84f82eb8dc8de623be5c399bbcecd19b8fc4fed0ae6ee9a2c90f75a6","observation_id":"5ec868c2-5520-495a-b286-157c07b66f1b","resolution":{"observed_at":"2026-07-31T23:36:33.334655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T23:36:33.506296Z","title":"Journal of Vision13(14), 10–10 (2013)","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:33.506296Z"},"links":{"citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:88972c8626c664ede5ebc03b4edb4a10f93d042b39e1786819588c9634daca93","observation_id":"585ddb2d-3f5b-4133-9e6a-66bd1de64305","resolution":{"observed_at":"2026-07-31T23:36:33.506296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02713","last_updated":"2025-08-01T16:40:14Z","snapshot_observed_at":"2026-08-02T12:24:31.329178Z","submitted_at":"2024-10-03T17:36:49Z","title":"LLaVA-Video: Video Instruction Tuning With Synthetic Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02713","snapshot_observed_at":"2026-07-31T23:36:33.653884Z","title":"arXiv preprint arXiv:2410.02713 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:33.653884Z"},"links":{"cited_paper":"/paper/2410.02713","citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:b2e7a51c0117849784ffef34ccde3b0448e6ffe2137cade73da2c0f890c0d31c","observation_id":"441420fb-da24-4344-b93c-0adc65c4ee83","resolution":{"observed_at":"2026-07-31T23:36:33.653884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-07-31T23:36:33.774458Z","title":"arXiv preprint arXiv:2306.05685 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-07-31T23:36:33.774458Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2607.23917"},"observation_digest":"sha256:79b94d3b0f97f2bd4253de14ea7a0af3a32edb2a78bc47b0276930cc14ed7a55","observation_id":"569ce836-8817-4399-a535-2e644b584d0c","resolution":{"observed_at":"2026-07-31T23:36:33.774458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.23917","last_updated":"2026-07-27T01:13:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T01:15:06.774218Z","submitted_at":"2026-07-27T01:13:57Z","title":"Gaze-to-text Generation: Beyond Categorical Decoding of Human Attention"},"reference_resolution":{"displayed":89,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":89,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":89},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 89 of 89 outbound references and 0 inbound Pith citation observations for arXiv:2607.23917."}