{"as_of":"2026-08-09T22:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ed6cdb1b7a713144b77ffa9616a991f9f6af192dccfe6eeff2d67ede8de30c51","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:52:02.004873Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03141/citation-record","integrity":"/paper/2608.03141/integrity","json":"/paper/2608.03141/citation-record.json","paper":"/paper/2608.03141"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:57.249494Z","title":"Semantic communications : Overview, open issues, and future research directions,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:57.249494Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:65f7c2c6a9a1f9ddb0a01a3070ab7687ec03a50d17941d9cbf562ad1e9a3a07a","observation_id":"7f2d2899-b625-4594-864e-9fd4cd06cb3d","resolution":{"observed_at":"2026-08-06T00:51:57.249494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:08.359474Z","title":"A su rvey on multimodal large language models,","venue":null,"work_id":"4992317f-acaa-4398-b18d-be212f133840","year":2024},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:57.344171Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:31bf36d91719eacf489430b163e43e62ed760f33cc9b9a8b798ffe9277bdaf9a","observation_id":"4ccf99a8-7450-46e8-be1d-a7c138f6f092","resolution":{"observed_at":"2026-08-06T00:52:08.404211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:08.240635Z","title":"Visual instruction tun ing,","venue":null,"work_id":"2f33122b-14f6-482c-8059-dd573be6aea8","year":2023},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:57.497384Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:7a8bc51e5e4f948453b639d3d625ef0b3f1053d7f067616d0e1f01e380492ea1","observation_id":"89d4a034-afe5-4e27-99c7-eb4d71421cfb","resolution":{"observed_at":"2026-08-06T00:52:08.272342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:08.081621Z","title":"Matryoshka query transformer for large vision-language m odels,","venue":null,"work_id":"bf019ba9-ec63-4ead-8b6d-e3712e9ba763","year":2024},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:57.621510Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:1d38397422369b49c7d8480ec3a668c7921606fe3c4175a5c03c65c319b196fe","observation_id":"56b504d7-009e-4b06-b414-d85be1c57ac9","resolution":{"observed_at":"2026-08-06T00:52:08.156580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03766","last_updated":"2024-02-06T07:16:36Z","snapshot_observed_at":"2026-08-09T19:28:34.281681Z","submitted_at":"2024-02-06T07:16:36Z","title":"MobileVLM V2: Faster and Stronger Baseline for Vision Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03766","snapshot_observed_at":"2026-08-06T00:51:57.723161Z","title":"MobileVLM V2: Faster and stronger baseline for vision language model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:57.723161Z"},"links":{"cited_paper":"/paper/2402.03766","citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:50e2a99003c5c47b190373a5aa170afe9f3782ff0ccd8746d8b46e84a1517e5e","observation_id":"15f98822-efca-476e-a94c-f2048e67ec07","resolution":{"observed_at":"2026-08-06T00:51:57.723161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:07.919459Z","title":"Honeybee: Locality-e nhanced projector for multimodal LLM,","venue":null,"work_id":"3a474d80-0b8c-4b04-ae54-9bc09ff2fbc2","year":2024},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:57.815000Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:ae160f55b15f31a47815bf625ec8541c375ac6f865b224634ef58b1f87805090","observation_id":"75aae6af-74d1-4b6c-a1d6-af8fd9b6fcc2","resolution":{"observed_at":"2026-08-06T00:52:07.996821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:07.763017Z","title":"BLIP-2: Bootstrapp ing language- image pre-training with frozen image encoders and large lan guage models,","venue":null,"work_id":"ae70e083-472b-49d1-9fa9-7ffb89011d79","year":2023},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:57.935515Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:bc95bbc0e99865c75912f0a75f5e9260779489c46e521ec544e326328e2fbe96","observation_id":"eae965f8-62ba-49bd-80e2-0e1b613ac9d3","resolution":{"observed_at":"2026-08-06T00:52:07.837970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T00:51:58.057013Z","title":"Qwen-VL: A versatile vision-language model for understanding, localization, text reading, and beyond ,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:58.057013Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:fa1acd7b8f89c58362a7f7e611ff879cf135ffe52e1f1d6b983aeb71044cf82b","observation_id":"f175a07e-3588-44c6-945b-1e22d9479a31","resolution":{"observed_at":"2026-08-06T00:51:58.057013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:07.639346Z","title":"TG-LLaV A: Text guided LLaV A via learnable latent embeddings,","venue":null,"work_id":"32cf8bc9-c616-4200-b461-b4dfd805dc14","year":2025},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:58.133912Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:37a08f212efd0d8a97ce30fe95509864631c85a946f6ba3d15442217b6349516","observation_id":"d502e42d-9623-4a73-bcf2-13b6523aaab5","resolution":{"observed_at":"2026-08-06T00:52:07.687098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:07.468068Z","title":"Token communications: A large model-driven Framewor k for cross-modal context-aware semantic communications,","venue":null,"work_id":"33a0ae4d-89d3-47e0-a1f7-629a03dabc7d","year":2025},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:58.217915Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:50e0614885630bacb22cb1ff615cb685235c330179a75679a960e11ddf7d80ab","observation_id":"fa9ed134-1e54-46f8-b3e2-50c7f96d23bf","resolution":{"observed_at":"2026-08-06T00:52:07.541291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:07.336597Z","title":"Task-oriented mul timodal token transmission in resource-constrained multiuser net works,","venue":null,"work_id":"19853342-e472-4b2e-a947-ec438aa95b69","year":2025},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:58.304887Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:29bfce2f71cdd62ad59dd9bf07c768fe9a2a5512f2a18f3ab4423fb095df5cdb","observation_id":"78cca56d-3cc3-4a57-bfbd-9a3364a7aa6e","resolution":{"observed_at":"2026-08-06T00:52:07.385309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10946","last_updated":"2026-07-09T04:46:56Z","snapshot_observed_at":"2026-08-07T16:19:08.656374Z","submitted_at":"2025-05-16T07:30:42Z","title":"ToDMA: Large Model-Driven Massive Token Communications for Semantic Multiple Access","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10946","snapshot_observed_at":"2026-08-06T00:51:58.392440Z","title":"ToDMA: Large model-driven token-domain multiple access for seman tic commu- nications,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:58.392440Z"},"links":{"cited_paper":"/paper/2505.10946","citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:f2741054c9e3680b2ec053c0c88f28677c6b6d3b2a1dfeb5511957a66abe6e07","observation_id":"32e894ef-dfb7-45af-b971-4e875de52c9e","resolution":{"observed_at":"2026-08-06T00:51:58.392440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:07.172909Z","title":"Adaptive semantic token communication for transformer-b ased edge inference,","venue":null,"work_id":"1c8cd791-ea2d-4e82-ba2d-6c15bbb2862d","year":2026},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:58.526574Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:09a96cd89a7ed333302f4b5c7df2ecd2f528ac99678c0a0da2bf011ee5de6a65","observation_id":"d76ccade-b9b9-44d1-870b-c713e5e214de","resolution":{"observed_at":"2026-08-06T00:52:07.249177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:07.024413Z","title":"Conte xt-aware iterative token detection and masked transmission for wire less token communication,","venue":null,"work_id":"5e499523-d148-41f9-8df0-ae4dc671be38","year":2026},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:58.610396Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:caa398b4a57130a1d5c4eac0031ddcfe27cdc4c38dddc362db930e414a125fda","observation_id":"24b26535-f083-467b-93c5-93ef8c5a6868","resolution":{"observed_at":"2026-08-06T00:52:07.087268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:06.883403Z","title":"Text-guided token communication for wireless image transmission,","venue":null,"work_id":"260bb85c-556d-4da7-a0c6-447f6aa63ee1","year":2025},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:58.695492Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:b51c2654ebabc338f6b715c15c1d3c06d71849ac6d9f55d97b6cd00ab6b8fb75","observation_id":"783d95f5-fefa-4a50-b7f9-8536f3ca1176","resolution":{"observed_at":"2026-08-06T00:52:06.943732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:51:58.749944Z","title":"Video TokenCom: Textual intent-guided multi-rate video t oken com- munications with UEP-based adaptive source–channel codin g,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:58.749944Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:ed573ee3b30ba29ac07781f4ec21e49d069ccf6023b6be56caab4dc659bbe367","observation_id":"5b45b25e-bd30-4131-a532-b114f53062f4","resolution":{"observed_at":"2026-08-06T00:51:58.749944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:06.732205Z","title":"Tok en communication in the era of large models: An information bot tleneck- based approach,","venue":null,"work_id":"72af7379-893f-485d-8302-4358dc5056d5","year":2025},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:58.849071Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:8d47e5b3e205c619b2834a604eade8a92a248b0615c89fcc10acc5d7fa77ce70","observation_id":"a7db727e-5dbd-4f19-afd0-b74801c0c9c4","resolution":{"observed_at":"2026-08-06T00:52:06.832850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.00482","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:02.311528Z","title":"TokenCom: Vision-language model for multimodal token communications,","venue":null,"work_id":"dcdb6b1f-64e9-4428-b901-4eb44daa6f46","year":2026},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:58.960297Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:310aef1e556ebbb3ac49da51e10977ff12cfcadb33c35d4f33b223a2bff32bf7","observation_id":"99d66709-35d9-4cef-b907-0c90669a6535","resolution":{"observed_at":"2026-08-06T00:52:02.383090Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:06.571199Z","title":"Joint seman tic-channel coding and modulation for token communications,","venue":null,"work_id":"07eaa8c0-2695-47fc-a73c-0c30f1fe0dc6","year":2025},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:59.030635Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:6745cf9a5086410d5e4a27f63f95713fbb4956c463195628e38856257f0b3314","observation_id":"6e37bdd5-8206-496e-bbe2-7f79175db21d","resolution":{"observed_at":"2026-08-06T00:52:06.646277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:06.402527Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"691bc35e-2501-4fe3-93a1-4b8bc9dac126","year":2021},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:59.113245Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:594699efe9b385f998f6f246b5d5c71b6483cbf2e5f3bef6076d221767836080","observation_id":"9b0a6389-f608-4af2-90b4-be77b42434b6","resolution":{"observed_at":"2026-08-06T00:52:06.460571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:06.233584Z","title":"A tria ngle enables multimodal alignment beyond cosine similarity,","venue":null,"work_id":"491e5212-6911-434a-9ca4-47058e523328","year":2025},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:59.187621Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:a0d92077e8fe2b811130964fa2f1037297da52dd0239aa53b2982e45842c1bf3","observation_id":"114def9e-7375-4368-a177-3a05eb650633","resolution":{"observed_at":"2026-08-06T00:52:06.338778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:06.123589Z","title":"CA DeepSC: Cross-modal alignment for multi-modal semantic communications,","venue":null,"work_id":"bf75f0e8-e9f1-44f0-b865-60780ac1ec74","year":2023},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:59.279166Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:6297ea2ebd4868c6096c2d6105ed75d339837bb798da3c1e5b7188ba63e46622","observation_id":"3ff96a58-d98a-4181-939d-27b0c542fb7e","resolution":{"observed_at":"2026-08-06T00:52:06.169858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:05.906148Z","title":"Unifying modalities through sem antic embed- dings,","venue":null,"work_id":"17e800a2-e2ca-4b97-97a5-5241fd6fe385","year":2025},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:59.342622Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:5709521fd11fa63a7ad60d64ad5bbb92cdb97729f1dd489e117fa64e7ff769aa","observation_id":"eafdd37c-bfc5-4386-9bb4-6e4e308e74e0","resolution":{"observed_at":"2026-08-06T00:52:06.016842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:05.743976Z","title":"Large model e mpowered multi-modal semantic communication with selective tokens for training,","venue":null,"work_id":"28923505-74ee-4520-8df5-910bc746f8f7","year":2025},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:59.453156Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:74043b5c4bd6699eb72152aa0b78d422ccb98d439a094777d8f080e50e292733","observation_id":"2fe851f6-20c3-4d36-a519-fd3ec62e1960","resolution":{"observed_at":"2026-08-06T00:52:05.845825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:05.595325Z","title":"Not all patches are what you need: Expediting vision transformers v ia token reorganizations,","venue":null,"work_id":"b3ac9d90-2a90-4bd0-9655-df2bf00cf4ee","year":2022},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:59.530910Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:0ea42466ae38559f5ff689e53b8f8359101d64625d99ed64526f19daf833f352","observation_id":"553cfccd-6219-406d-aa62-de3df15f5154","resolution":{"observed_at":"2026-08-06T00:52:05.656974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:05.408777Z","title":null,"venue":null,"work_id":"880e9634-8ad7-47df-90b0-2b1c2d483a1b","year":2013},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:59.627737Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:ee738404b789361f7178becea21034d651789d921824cc6621802e38797dcef8","observation_id":"eee19b54-010e-42a9-96f7-b5bdcce5933d","resolution":{"observed_at":"2026-08-06T00:52:05.512839Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14744","last_updated":"2023-10-12T04:37:56Z","snapshot_observed_at":"2026-07-06T15:32:14.701994Z","submitted_at":"2023-05-24T05:32:49Z","title":"Block Coordinate Descent on Smooth Manifolds: Convergence Theory and Twenty-One Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14744","snapshot_observed_at":"2026-08-06T00:51:59.741426Z","title":"Block coordinate descent on smoot h manifolds: Convergence theory and twenty-one examples,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:59.741426Z"},"links":{"cited_paper":"/paper/2305.14744","citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:3b7523850ad802e495ec2ea207b698f688c7f69e0ea4073e53ff8794e0729b04","observation_id":"7f2cd2ba-f035-49d0-b154-0523b7586d85","resolution":{"observed_at":"2026-08-06T00:51:59.741426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:05.241819Z","title":"Making the V in VQA matter: Elevating the role of image understandin g in visual question answering,","venue":null,"work_id":"5e0e9c6f-e286-41cf-9afb-6158f1a0fdd9","year":2017},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:59.824756Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:10da1346c4ba538fa443184d3b9101dd3172142ffa29628c4e69ce8dc6298eb5","observation_id":"362bc15e-fe44-4979-846c-99827e2ee68c","resolution":{"observed_at":"2026-08-06T00:52:05.346257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:05.090087Z","title":"Tackling data bias in MUSI C-A VQA: Crafting a balanced dataset for unbiased question-answeri ng,","venue":null,"work_id":"70a1b204-4a6f-4ca2-b730-eb26eb765f75","year":2024},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:59.893959Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:f92d01326fab55024c628c95b686689a665f79db56264fde31d381671e593ce2","observation_id":"7cb7abf6-4a9c-40c0-8783-3400788bbe83","resolution":{"observed_at":"2026-08-06T00:52:05.165343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:04.951798Z","title":"Geometr y-driven joint token selection for multimodal token communications,","venue":null,"work_id":"25880d8d-4577-4c61-add4-28e5333d6915","year":2026},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:00.007972Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:ddca08b49d8655b2d038a46774a9310bcb599da20f920f9c7db753a36004dcde","observation_id":"4752a344-e4a2-4092-b814-3fca3bb31c94","resolution":{"observed_at":"2026-08-06T00:52:05.014643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:00.138792Z","title":"A uniﬁed multi- task semantic communication system for multimodal data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:00.138792Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:a99ed38f2a6ec112bcc1cafb2de0090b192f0b19781d5c8fc4d055e2f1b2c7ba","observation_id":"824f5631-64c6-4880-a7d3-ee0a75af5845","resolution":{"observed_at":"2026-08-06T00:52:00.138792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:04.734803Z","title":"How much training is need ed in multiple-antenna wireless links?,","venue":null,"work_id":"731b6518-65d3-4330-ad16-c3a686401aa7","year":2003},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:00.214164Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:4523b52b0e16b043d5b10cd8fa678e31f23ca401afb6c097bd06004fd6158ca3","observation_id":"f7983e4a-dfc2-44dc-892f-99f8281de287","resolution":{"observed_at":"2026-08-06T00:52:04.835291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:04.564254Z","title":"ViLBERT: Pretrai ning task- agnostic visiolinguistic representations for vision-and -language tasks,","venue":null,"work_id":"2ed0bf33-082e-4c5f-afad-0fe03fa8f63d","year":2019},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:00.342454Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:66a55d96e5c53efea15f2d234cc1d354fc6e2997348bda948b210f2a6583d251","observation_id":"cb46ff94-cbe6-41f8-ada3-66f184e72def","resolution":{"observed_at":"2026-08-06T00:52:04.670129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:04.446504Z","title":"An image is worth 16 ×16 words: Transformers for image recognition at scale,","venue":null,"work_id":"72e4b2a2-b8f2-4876-b789-301314d45b6b","year":2021},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:00.472425Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:174cd15fee48e3a6dbabd5028223942acebb946f2db456ef7037200cb6260bdc","observation_id":"38b2f8c7-dfed-404a-acd5-8ea2c7592262","resolution":{"observed_at":"2026-08-06T00:52:04.502806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:04.295386Z","title":"Hubs i n Space: Popular Nearest Neighbors in High-Dimensional Data,","venue":null,"work_id":"6bc9e6c4-7988-49da-9fd4-b150f070c100","year":2010},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:00.616297Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:cfc7df37464b2b2a2d0437a8fc0b2c8f5a61a058190bbe188f79ecb398e7c1bb","observation_id":"acf683ad-dbbe-4448-8086-dd632b53d5ba","resolution":{"observed_at":"2026-08-06T00:52:04.352782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:04.106618Z","title":"A branch-and-cut algorithm for the resolution of large-scale symmetric traveling salesman pr oblems,","venue":null,"work_id":"455e4788-41ff-479d-9a57-5c31e5a76deb","year":1991},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:00.801041Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:130e3137edeba61640ecadd74bd1294d562769488f7093cfbf9b8a2d0c07eca2","observation_id":"f1ed5711-ba0c-41ec-85cf-ea5dcea1140e","resolution":{"observed_at":"2026-08-06T00:52:04.192645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:03.913344Z","title":null,"venue":null,"work_id":"f0ed3fd4-2992-4c28-bedd-b7fdd4217474","year":1988},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:00.972107Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:4cd1682856e14053c7d563ce9b05c918349502c9a5e630092f246006f190ebb1","observation_id":"02835e1d-9a26-4a43-8576-bbdcf6fead95","resolution":{"observed_at":"2026-08-06T00:52:04.032748Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:03.735321Z","title":"Synchronous multi-modal semantic communication system with packet-level coding,","venue":null,"work_id":"218f0fcd-02c2-4ac7-a098-97bba96ffca9","year":2025},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:01.116997Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:6367135ed72cb886d4bfc6953b9131f61ba587428a74d01cbbdbbe1e5df1994a","observation_id":"5b82c610-6bcb-442e-81f9-a3456fd2951c","resolution":{"observed_at":"2026-08-06T00:52:03.793726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.19451","last_updated":"2025-06-24T09:25:44Z","snapshot_observed_at":"2026-08-09T18:52:16.386719Z","submitted_at":"2025-06-24T09:25:44Z","title":"Low-Complexity Semantic Packet Aggregation for Token Communication via Lookahead Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.19451","snapshot_observed_at":"2026-08-06T00:52:01.243486Z","title":"Low-complexity se mantic packet aggregation for token communication via lookahead search,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:01.243486Z"},"links":{"cited_paper":"/paper/2506.19451","citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:9de360be6fefe89fb6744acb5921130163ff6556411a3967f9be0db6aec315fa","observation_id":"33984434-4f9e-4851-96ab-e9021adbdc87","resolution":{"observed_at":"2026-08-06T00:52:01.243486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:03.536077Z","title":"Goldsmith, Wireless Communications","venue":null,"work_id":"7c0ff2f8-793c-49e0-9656-bd4fb5fdc725","year":2005},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:01.374572Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:b1e86bc41f5490f98ae21ad6fe99f418ee1e5855f8f33970b1120bf0557f3b8e","observation_id":"d04d37ea-cd8d-4cca-b13f-a47ddc2f6f50","resolution":{"observed_at":"2026-08-06T00:52:03.603970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:03.334744Z","title":"BERT: Pre-training of deep bidirectional transformers for language understan ding,","venue":null,"work_id":"dbc96751-59ba-42e1-b24e-3af0cc153d3a","year":2019},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:01.484982Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:b39810966922004796df7f76f6774812630cbc03fae97382400863f45d428d1c","observation_id":"0c350e08-08de-44f0-b2fb-5c186dfc40bf","resolution":{"observed_at":"2026-08-06T00:52:03.440405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:03.143882Z","title":"wav2vec 2. 0: A framework for self-supervised learning of speech represen tations,","venue":null,"work_id":"ec26aea1-d658-45d2-86ea-33bd49d3079b","year":2020},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:01.619548Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:e337c8d23d31baadc3f78b69f80180b5883d0e0fcd10bcba206aab88c2ff578d","observation_id":"208ce809-d22c-40d1-a147-3fd82489e6d4","resolution":{"observed_at":"2026-08-06T00:52:03.232783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:02.996512Z","title":"Decoupled weight decay re gularization,","venue":null,"work_id":"6ea7cbfb-0087-4ea9-9133-68c4c9d583e0","year":2019},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:01.735248Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:2d6510c920e132fc883237a48f7c318ffc9475d6d13c2fa27ade15788b3a0e09","observation_id":"1d580350-8fb2-4b61-acc6-a621a8057454","resolution":{"observed_at":"2026-08-06T00:52:03.071014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:02.805513Z","title":"An image is worth 1/2 tokens after layer 2: Plug-and-play inference accelera tion for large vision-language models,","venue":null,"work_id":"56f07add-7535-41d2-bab1-efbde9390156","year":2024},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:01.876995Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:c0083dc29f0738c74b55ef56d73da849655c90b29feea256cc7175be9142e54c","observation_id":"95b7bb69-5bac-4514-b35a-3d559e258fe0","resolution":{"observed_at":"2026-08-06T00:52:02.881178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:52:02.643108Z","title":"Multidimensional scaling: I. Theory and method,","venue":null,"work_id":"360639f1-72ee-4b93-a4d7-017e471dcaf3","year":1952},"citing_paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T00:52:02.004873Z"},"links":{"citing_paper":"/paper/2608.03141"},"observation_digest":"sha256:3f85d5cd88e91ef42b8204b2157ebd6a9c93cd96a46c2d6d50ba2b847497170f","observation_id":"c80fd7f0-3493-4368-b56c-aa4c51376231","resolution":{"observed_at":"2026-08-06T00:52:02.715939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03141","last_updated":"2026-08-04T05:14:08Z","latest_version":1,"primary_category":"eess.SP","snapshot_observed_at":"2026-08-07T23:10:37.178375Z","submitted_at":"2026-08-04T05:14:08Z","title":"Geometric Cross-Modal Token Selection for Latency-Constrained Multimodal Token Communication"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":1,"verified_fuzzy":34},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2608.03141."}