{"as_of":"2026-08-19T08:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aa5a0b6d3b5771a45f06c220818bb845494bf87fe125259da11721f070fb352f","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:45:04.591491Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:18:01.704779Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-09T11:31:04.937593Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18495","snapshot_observed_at":"2026-08-10T22:18:01.704779Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.02370","last_updated":"2025-02-07T20:12:12Z","snapshot_observed_at":"2026-08-16T01:05:08.422924Z","submitted_at":"2025-01-04T20:14:16Z","title":"Prepending or Cross-Attention for Speech-to-Text? An Empirical Comparison","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T22:18:01.704779Z"},"links":{"cited_paper":"/paper/2412.18495","citing_paper":"/paper/2501.02370"},"observation_digest":"sha256:400cc467b7b06ec03275d7e14ffefa77e59d8296bfd6ff22796581ce535e7ec0","observation_id":"e4057a89-793b-438e-a24d-9f910f5a11fc","resolution":{"observed_at":"2026-08-10T22:18:01.704779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"cited_work":{"arxiv_id":"2412.18495","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.18495","snapshot_observed_at":"2026-08-09T11:31:04.937593Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","venue":"cs.CL","work_id":"baf47a0d-d7c5-4abd-b67b-26445a852139","year":2024},"citing_paper":{"arxiv_id":"2502.02683","last_updated":"2025-02-04T19:50:15Z","snapshot_observed_at":"2026-08-14T11:20:12.475237Z","submitted_at":"2025-02-04T19:50:15Z","title":"Streaming Speaker Change Detection and Gender Classification for Transducer-Based Multi-Talker Speech Translation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T11:31:04.730913Z"},"links":{"cited_paper":"/paper/2412.18495","citing_paper":"/paper/2502.02683"},"observation_digest":"sha256:8b80af36dbedd4c1fb0c1f46da94423f3165c7c45040629dfeb346eacbc54227","observation_id":"b63d61c1-06e9-499b-b4de-cf2fa1f70acc","resolution":{"observed_at":"2026-08-09T11:31:04.941640Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.18495/citation-record","integrity":"/paper/2412.18495/integrity","json":"/paper/2412.18495/citation-record.json","paper":"/paper/2412.18495"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:05.110198Z","title":"Association for Computational Linguistics","venue":null,"work_id":"d1b2cbc6-c209-4663-813f-f6ab32eb468e","year":2023},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.462812Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:8d4acf27a3ffc64b224e1f424e9a534c4da2f12b7b73e3d80e7ba8b78fd80f01","observation_id":"c7bece20-406a-4f06-8ce8-d6a51e51bab7","resolution":{"observed_at":"2026-08-11T04:45:05.115769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:05.092797Z","title":"In Proceedings of the 2020 Conference on Empirical Methods in Natural Language Processing (EMNLP), pages 2599–2611, Online","venue":null,"work_id":"912565f0-66fe-4b98-86ee-b5f979b10986","year":2020},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.479651Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:46dc04f746068818c2c25a2100b1cfa72a14d162c22a43f1d879f31ee3aeebf5","observation_id":"1b3d2eb0-5fdf-40e1-9346-3e48c98245c5","resolution":{"observed_at":"2026-08-11T04:45:05.098173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:05.060378Z","title":"Association for Computational Linguistics","venue":null,"work_id":"436de6cd-4fc7-4b1b-ab71-b8fe4f5edd20","year":2019},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.489623Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:40124a67cab0122f96f2680fea9c9c1489138ba0acec20a86b6343b013be52c1","observation_id":"02c20c2c-21fc-4fc4-9748-4935fb740e4f","resolution":{"observed_at":"2026-08-11T04:45:05.065389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:05.044003Z","title":"In Proceedings of the 20th Interna- tional Conference on Spoken Language Trans- lation (IWSLT 2023), pages 363–375, Toronto, Canada (in-person and online)","venue":null,"work_id":"81ff8def-f160-4782-8fdc-30f66214810d","year":2023},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.494453Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:b25a6dcd0933ba806032c6c75cd4fec71ec74cab0f17465d40282883ebc760e0","observation_id":"2aa6c066-67f2-473f-bf8c-dadc05091ddb","resolution":{"observed_at":"2026-08-11T04:45:05.049478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:05.027355Z","title":"In Proceedings of the 21st International Conference on Spoken Lan- guage Translation (IWSLT 2024) , pages 170– 182, Bangkok, Thailand (in-person and online)","venue":null,"work_id":"a8a06ef8-dc4f-44a1-a2f2-cad0f5410942","year":2024},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.499387Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:9720b5f7f6fc380105ca43ad18d8f5614a6be3164ed6fbebc6bd345f41319514","observation_id":"09533624-a47e-4322-8c4a-1fd0c4b15d47","resolution":{"observed_at":"2026-08-11T04:45:05.032740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:05.009977Z","title":"In Proceedings of the 62nd Annual Meeting of the Association for Compu- tational Linguistics (Volume 1: Long Papers) , pages 1557–1575, Bangkok, Thailand","venue":null,"work_id":"d1a308a8-cf2e-4262-b705-10ce1ebb8232","year":null},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.509404Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:8bee98d8f276fac3d6c7ae00c858acfd24375a5f457f9c1da5ffc01b66890a5e","observation_id":"d3fd2cbb-6b41-4c2a-b960-d20a8f564fae","resolution":{"observed_at":"2026-08-11T04:45:05.016382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:04.992975Z","title":"In Proceedings of the 20th International Confer- ence on Spoken Language Translation (IWSLT 2023), pages 169–179, Toronto, Canada (in- person and online)","venue":null,"work_id":"563dde15-3400-4538-96a7-9ff26cb698d6","year":2023},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.514227Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:06c5260db530da72f22c3089e8c361199e8c65606ebb14db4c96ef09168ecfa0","observation_id":"49914a4a-8b6b-4ccf-9981-99a0b333819a","resolution":{"observed_at":"2026-08-11T04:45:04.998226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:04.977230Z","title":"In ICASSP 2020 - 2020 IEEE International Conference on Acous- tics, Speech and Signal Processing (ICASSP) , pages 6074–6078","venue":null,"work_id":"9b9e9d3c-6db4-40b1-b588-448f8bcfa010","year":2020},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.519034Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:bf1f9e784498536e95c74da647c56ce6b911dbe94513f9fa6ab2ea11c660b687","observation_id":"5d14f64c-50fa-44a0-a918-ddcdf0d045d8","resolution":{"observed_at":"2026-08-11T04:45:04.982551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11384","last_updated":"2023-09-20T15:10:12Z","snapshot_observed_at":"2026-08-16T15:16:01.924510Z","submitted_at":"2023-09-20T15:10:12Z","title":"Long-Form End-to-End Speech Translation via Latent Alignment Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11384","snapshot_observed_at":"2026-08-11T04:45:04.528661Z","title":"In Proceedings of the 16th International Con- ference on Spoken Language Translation, Hong Kong","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.528661Z"},"links":{"cited_paper":"/paper/2309.11384","citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:41acfd2cb98c26e7decda3a37af86ea65d1d076b82edf9ac8c736a6ddcca6775","observation_id":"7cf873a3-c4eb-43d9-b9f7-52d9de8e443e","resolution":{"observed_at":"2026-08-11T04:45:04.528661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:04.944219Z","title":"InProceedings of the 20th International Conference on Spoken Lan- guage Translation (IWSLT 2023) , pages 389– 396, Toronto, Canada (in-person and online)","venue":null,"work_id":"b0c88e98-9214-400c-bbb2-5558532766b1","year":2023},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.533976Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:a9ec37fd96e4be68d16b3ac7152962dfed77664c69d4ae13c4b7ad077d98d806","observation_id":"9085e9b2-b023-4be0-b4eb-0bc1221d42ef","resolution":{"observed_at":"2026-08-11T04:45:04.949105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:04.927547Z","title":"In Proceedings of the 19th International Confer- ence on Spoken Language Translation (IWSLT 2022), pages 277–285, Dublin, Ireland (in- person and online)","venue":null,"work_id":"408b649e-8b0d-4d4a-85c8-64e53cab5f66","year":2022},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.539212Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:b7367c329afc096e9be4e6fa90f10c4d97e3511f3b3307ee5038647010d41d6b","observation_id":"19e36631-f4d4-41e6-9d36-c0777cca3a68","resolution":{"observed_at":"2026-08-11T04:45:04.933319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:04.910799Z","title":"In Proceedings of the 40th International Conference on Machine Learn- ing, ICML’23","venue":null,"work_id":"fd661066-e0ce-4b99-afdf-8991221b14e1","year":2013},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.543890Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:a6f62d79c31f210ee0822bea2d7756f12a55509ebc9dd2c5c23e0b4bd4f79cd9","observation_id":"922f804e-101a-4a90-b744-14058460c459","resolution":{"observed_at":"2026-08-11T04:45:04.915782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09754","last_updated":"2022-10-18T11:07:28Z","snapshot_observed_at":"2026-08-16T16:23:14.672088Z","submitted_at":"2022-10-18T11:07:28Z","title":"Simultaneous Translation for Unsegmented Input: A Sliding Window Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09754","snapshot_observed_at":"2026-08-11T04:45:04.548789Z","title":"arXiv preprint arXiv:2210.09754","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.548789Z"},"links":{"cited_paper":"/paper/2210.09754","citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:0b43ff7b03793d0162851498809939613928104f03202deaec4eb3c305d2d82c","observation_id":"3461bb90-c1c4-474d-9cab-941217572f77","resolution":{"observed_at":"2026-08-11T04:45:04.548789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01172","last_updated":"2025-05-21T09:10:36Z","snapshot_observed_at":"2026-08-16T14:22:15.617373Z","submitted_at":"2024-02-02T06:31:50Z","title":"Streaming Sequence Transduction through Dynamic Compression","version":3},"cited_work":{"arxiv_id":"2402.01172","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.01172","snapshot_observed_at":"2026-08-11T04:45:04.687743Z","title":"Streaming Sequence Transduction through Dynamic Compression","venue":"cs.CL","work_id":"137ca122-6f77-4271-8bc6-dcfb81b69adc","year":2024},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.558921Z"},"links":{"cited_paper":"/paper/2402.01172","citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:2955cd8855a6da6ea3b9f80059cd99e3af428ff8423528850737004b92c5d5ab","observation_id":"94b41ff1-037d-49ef-8014-67a5e337cb18","resolution":{"observed_at":"2026-08-11T04:45:04.692975Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:04.895752Z","title":null,"venue":null,"work_id":"c085e3f7-0bc7-45c5-a20e-d045f1da6719","year":2023},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.564073Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:6217e0bccbe1e64e97ac1c45fbf7185e5905fe57b0b8381df517f34b9e9e9caa","observation_id":"22a342c8-a4dc-4139-9045-7779ddb0c672","resolution":{"observed_at":"2026-08-11T04:45:04.900458Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:04.878930Z","title":"In 2008 IEEE Spoken Language Technology Workshop, pages 233–236","venue":null,"work_id":"2b7f6a9e-2fcd-4177-a0b3-8c9ef5fd3725","year":2008},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.568423Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:8fac174a6f09b935a021334e98f7073f6ceec87101364eff6d39ad9f2766832d","observation_id":"9623cff7-04a8-40bb-8563-856382ac611d","resolution":{"observed_at":"2026-08-11T04:45:04.884534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.12984","last_updated":"2019-08-16T08:32:08Z","snapshot_observed_at":"2026-08-14T16:00:21.011935Z","submitted_at":"2019-07-30T14:35:06Z","title":"DuTongChuan: Context-aware Translation Model for Simultaneous Interpreting","version":2},"cited_work":{"arxiv_id":"1907.12984","doi":null,"metadata_source":"pith","pith_arxiv_id":"1907.12984","snapshot_observed_at":"2026-08-11T04:45:04.662407Z","title":"DuTongChuan: Context-aware Translation Model for Simultaneous Interpreting","venue":"cs.CL","work_id":"9429b8a9-36cc-4c7f-b12f-9ae3bf070329","year":2019},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.572736Z"},"links":{"cited_paper":"/paper/1907.12984","citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:002878576c0fde0bc96aa3aaec897db3e27c13e8b424278ac46cf76485d4f091","observation_id":"880dc3a8-772e-47b4-a4b0-6159045c7661","resolution":{"observed_at":"2026-08-11T04:45:04.670518Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.15729","last_updated":"2022-06-17T07:08:05Z","snapshot_observed_at":"2026-08-19T02:31:59.105777Z","submitted_at":"2021-10-13T08:33:31Z","title":"Decision Attentive Regularization to Improve Simultaneous Speech Translation Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.15729","snapshot_observed_at":"2026-08-11T04:45:04.577631Z","title":"In 2023 IEEE Automatic Speech Recog- nition and Understanding Workshop (ASRU) , pages 1–7","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.577631Z"},"links":{"cited_paper":"/paper/2110.15729","citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:963b22d6ee42ad9f52f563500b7478dc549ed554aa9591d11ab30100491de161","observation_id":"890306da-aaba-47e7-b01a-5776deef69a1","resolution":{"observed_at":"2026-08-11T04:45:04.577631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:04.846629Z","title":"Association for Computational Linguistics","venue":null,"work_id":"5102291a-6398-4470-8342-adcb8fd0b61d","year":2021},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.586780Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:62be8e95bc16ec9609b9fd56ba229dd235f1aa3e097385fa2c1e01c952548ebf","observation_id":"453b643f-f6a0-4f4d-b91b-cbd5808d024c","resolution":{"observed_at":"2026-08-11T04:45:04.851673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01037","last_updated":"2023-09-25T01:20:23Z","snapshot_observed_at":"2026-08-16T15:51:28.593814Z","submitted_at":"2023-03-02T07:47:18Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01037","snapshot_observed_at":"2026-08-11T04:45:04.591491Z","title":"speech” already in- cludes the results for “speech-to-text","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.591491Z"},"links":{"cited_paper":"/paper/2303.01037","citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:2bd7f214e1c0e43041db77b1a0345ec5e0b04324ae8961f742343b8a6c027bf7","observation_id":"0b59554b-6038-49f1-9ad9-031f2a0890b7","resolution":{"observed_at":"2026-08-11T04:45:04.591491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.00048","last_updated":"2019-05-31T19:57:49Z","snapshot_observed_at":"2026-08-16T21:07:07.599735Z","submitted_at":"2019-05-31T19:57:49Z","title":"Thinking Slow about Latency Evaluation for Simultaneous Machine Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.00048","snapshot_observed_at":"2026-08-11T04:45:04.451602Z","title":"Francisco Casacuberta, David Llorens, Carlos Martinez, Sirko Molau, Francisco Nevado, Her- mann Ney, Moisés Pastor, David Pico, Al- berto Sanchis, Enrique Vidal, and Juan M","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":1901,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.451602Z"},"links":{"cited_paper":"/paper/1906.00048","citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:a8f61cbfde70cc6c2a255aab6719c4021bc93ed969ed69b86f9b423415f009a7","observation_id":"03cb2abd-ef0f-40ac-9e4f-6f442104f82d","resolution":{"observed_at":"2026-08-11T04:45:04.451602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:05.126911Z","title":"Machine translation, 21:209–252","venue":null,"work_id":"3099f187-485c-408b-a3e5-59e4d9bcb1b5","year":2013},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":2007,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.457724Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:d45eb59b6c781565b6bf52b9040d1ec4081d42a2a3553d3c7ef0d686eb16d02a","observation_id":"fb29785d-d0a9-4e7f-ad0e-c33eea92d5b8","resolution":{"observed_at":"2026-08-11T04:45:05.132320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12792","last_updated":"2023-09-22T01:44:46Z","snapshot_observed_at":"2026-08-18T23:30:52.275198Z","submitted_at":"2023-08-24T13:47:16Z","title":"Sparks of Large Audio Models: A Survey and Outlook","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12792","snapshot_observed_at":"2026-08-11T04:45:04.504086Z","title":"In Proceedings of the 5th Interna- tional Workshop on Spoken Language Transla- tion: Papers, pages 174–181, Waikiki, Hawaii","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.504086Z"},"links":{"cited_paper":"/paper/2308.12792","citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:15d5ce17608de9e65ca7d40b9f5e25d4fa8cf35a73714263b58b07fd97935534","observation_id":"d0ea79f4-c8d4-4ab4-843d-bd20c128ea11","resolution":{"observed_at":"2026-08-11T04:45:04.504086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14835","last_updated":"2022-03-29T07:55:11Z","snapshot_observed_at":"2026-08-16T17:11:15.764329Z","submitted_at":"2022-03-28T15:17:11Z","title":"Multilingual Simultaneous Speech Translation","version":2},"cited_work":{"arxiv_id":"2203.14835","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.14835","snapshot_observed_at":"2026-08-11T04:45:04.709829Z","title":"Multilingual Simultaneous Speech Translation","venue":"cs.CL","work_id":"20588638-7749-4a40-ad2b-15232d77d423","year":2022},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.553804Z"},"links":{"cited_paper":"/paper/2203.14835","citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:051db4e0e0d5f06575dbe4bb35d5cda50951f21ad242d72c217de50e8ecae683","observation_id":"9a58ef28-c26f-426a-99ab-1f52c1e6ff60","resolution":{"observed_at":"2026-08-11T04:45:04.714979Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:04.960089Z","title":"In Proceedings of the 2016 Conference of the North American Chapter of the Associ- ation for Computational Linguistics: Demon- strations, pages 82–86, San Diego, California","venue":null,"work_id":"6d9a23f5-2a7a-408e-89b2-8cb2db6da4e8","year":2016},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.524059Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:8e04bbf347e4ec074f0f87a3fcc3728c55c87e56cc0ef18f784bf276eb5c0af1","observation_id":"3da9458d-44a8-4586-b611-19f06ac6fd8e","resolution":{"observed_at":"2026-08-11T04:45:04.965778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:05.143616Z","title":"In 2019 IEEE Au- tomatic Speech Recognition and Understanding Workshop (ASRU), pages 792–799","venue":null,"work_id":"fed01766-1cef-4383-a53a-8619bf273111","year":2019},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.441261Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:ae86f4cf63ce30032f940627f0cdbc971fd8dcb6621e458665f91a1a72be84d1","observation_id":"dc0e109b-0df0-4150-8837-5ecdec4c0dc4","resolution":{"observed_at":"2026-08-11T04:45:05.149124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01512","last_updated":"2022-11-09T16:52:45Z","snapshot_observed_at":"2026-08-16T16:27:04.150506Z","submitted_at":"2022-10-04T10:34:25Z","title":"Code-Switching without Switching: Language Agnostic End-to-End Speech Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01512","snapshot_observed_at":"2026-08-11T04:45:04.474291Z","title":"In Proceedings of the 17th International Conference on Spoken Language Translation, pages 62–68, Online","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.474291Z"},"links":{"cited_paper":"/paper/2210.01512","citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:9078ce6ad58bfb89f689f05e9447ced9195df8ed36cef5a5773db290a7c840fc","observation_id":"4ad31a45-0956-4576-92d3-0f8456506204","resolution":{"observed_at":"2026-08-11T04:45:04.474291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:04.862872Z","title":"In Findings of the As- sociation for Computational Linguistics: ACL- IJCNLP 2021, pages 2461–2474, Online","venue":null,"work_id":"f7ed2277-a5e2-4908-ad0b-39425fbc72b4","year":2021},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.582235Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:b118e49e54b292b1aaa32e5dd663e0ddce3445934da9d1dc76ff0290fc91397b","observation_id":"0626450e-f4a3-4379-85cc-c1beb805342b","resolution":{"observed_at":"2026-08-11T04:45:04.868148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05700","last_updated":"2024-01-11T07:05:02Z","snapshot_observed_at":"2026-08-16T14:28:20.213817Z","submitted_at":"2024-01-11T07:05:02Z","title":"R-BI: Regularized Batched Inputs enhance Incremental Decoding Framework for Low-Latency Simultaneous Speech Translation","version":1},"cited_work":{"arxiv_id":"2401.05700","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.05700","snapshot_observed_at":"2026-08-11T04:45:04.796738Z","title":"R-BI: Regularized Batched Inputs enhance Incremental Decoding Framework for Low-Latency Simultaneous Speech Translation","venue":"cs.CL","work_id":"0e314218-9fdd-4f79-911d-c9791e8480dc","year":2024},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.468154Z"},"links":{"cited_paper":"/paper/2401.05700","citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:1b269493049daf4c480dbc681142d9de4441aab2a2cf5b9bd038200573932a6d","observation_id":"766ff721-2d6c-4fbb-9b85-22dd551093b2","resolution":{"observed_at":"2026-08-11T04:45:04.802354Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05187","last_updated":"2023-12-08T17:18:42Z","snapshot_observed_at":"2026-08-17T17:18:07.224353Z","submitted_at":"2023-12-08T17:18:42Z","title":"Seamless: Multilingual Expressive and Streaming Speech Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05187","snapshot_observed_at":"2026-08-11T04:45:04.446640Z","title":"arXiv preprint arXiv:2312.05187","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.446640Z"},"links":{"cited_paper":"/paper/2312.05187","citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:8e730215ceeee583f2109a73df51bc584f24f850462729c767b1c7ff4f29576a","observation_id":"8f5c02d6-c97e-4a85-9161-d221f8354af9","resolution":{"observed_at":"2026-08-11T04:45:04.446640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:45:05.076792Z","title":"Transactions of the Association for Computational Linguistics, 12:1104–1121","venue":null,"work_id":"3f9edf41-708c-427d-bee7-d4a3d4e0290a","year":2021},"citing_paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:04.484632Z"},"links":{"citing_paper":"/paper/2412.18495"},"observation_digest":"sha256:b90d0c0b54af9172a3d1a682b9c75407d11b48cd2edf9584e0cc441e2f685b7c","observation_id":"5408e4ab-d430-49b1-a625-a606ef4f6ac4","resolution":{"observed_at":"2026-08-11T04:45:05.082002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.18495","last_updated":"2024-12-24T15:26:31Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-19T06:07:18.331684Z","submitted_at":"2024-12-24T15:26:31Z","title":"How \"Real\" is Your Real-Time Simultaneous Speech-to-Text Translation System?"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 2 inbound Pith citation observations for arXiv:2412.18495."}