{"as_of":"2026-08-09T20:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a02af320a1d7c23211715319c2efccb5ae1c2abe911f3c13f797a2fbc91fc75d","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T04:55:08.078807Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.03099/citation-record","integrity":"/paper/2607.03099/integrity","json":"/paper/2607.03099/citation-record.json","paper":"/paper/2607.03099"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Multi-modality sensing and data fusion for multi-vehicle detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:0cf8784a152ed509ff7c701aeeb9fbd091a7e08ea45b79aba4fdb5a20902be40","observation_id":"1fd06087-a626-4ef2-9646-b78b9130da30","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Generative Artificial Intelligence-enhanced multimodal semantic communication in Internet of Vehicles: System design and methodologies,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:ad09acaf035c8dad25aa018a4f736a410063d13a24c31fe5976163d5b7207994","observation_id":"0e0762ea-7481-41f9-919e-26fe079a3ee0","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Cooperative perception with learning-based V2V com- munications,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:4d969992a7c044447549adf2893ab3425f5d9866bf4f74bb401ca433ffb30303","observation_id":"c2db4c4f-61b2-418e-adb8-e686f58c3817","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Task-oriented multi-user semantic communication based on deep over-the-air computation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:7d9ad0ac5f4c9bcb596bebf1e64b4d8a2ee298b1549da4128f32faa0317fc88a","observation_id":"5652e22a-07c6-4f0d-892c-60507979d689","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Deep joint source- channel coding for wireless image transmission,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:fb60c67d233fd5d852d713809ccfed69f7930840c3a2d12fb51182d2a10fb280","observation_id":"4754cdec-e47e-4353-9a03-5bfac45c0db7","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"AI empowered wireless communications: From bits to semantics,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:19d3af18897cd5a7c45870d6f178eb1f6189d117d79f310782d6c3f54fac975a","observation_id":"9d9605ac-e6b9-4c48-ae8c-a91e34207dd6","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Latency-aware generative semantic communications with pre-trained diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:d46e19d6a0cf585162d23b85cd11027e99411a0c4f8b748d532ca4bbbbad42f3","observation_id":"9a636f7f-231b-4161-8184-10e051548f4c","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Token communications: A large model-driven frame- work for cross-modal context-aware semantic communications,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:fc62bd234f2eb0a4f3a89fc50160260506193d9b53c5dfdba812016f89bd441b","observation_id":"dd2cfbf0-9f41-440a-a2fa-ccf38fbdc291","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Communicate less, synthesize the rest: Latency-aware intent-based generative semantic multicasting with diffusion models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:b4d13dbbe986259ee3330f0d6f612e4032f2b777366ed1024be1952beb8bceec","observation_id":"620f9cdb-6288-478f-a96d-6e1791c3abb5","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09955","last_updated":"2025-09-12T04:11:59Z","snapshot_observed_at":"2026-08-04T18:26:54.376444Z","submitted_at":"2025-09-12T04:11:59Z","title":"Adaptive Token Merging for Efficient Transformer Semantic Communication at the Edge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09955","snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Adaptive token merging for efficient transformer semantic communication at the edge,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"cited_paper":"/paper/2509.09955","citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:ace041fa8e8b3bc1c8f60d35e86233488ed7c35cc81a90925920e686b295b1bc","observation_id":"7daf5105-413e-462e-a8cd-fa4fa92cac5d","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Knowledge distillation-driven semantic NOMA for im- age transmission with diffusion model,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:e9fab7a4303a5e813fc3118354e374e54b113c38cee887b6b7f6f9511c0d6d4e","observation_id":"11c01c98-8d11-4f69-a2e0-e4376d01be67","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Over-the-air computing for wireless data aggregation in massive IoT,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:cca5d3cefe39d8890faa9e2a7fb31302f1aa8ba51be4cd3d6059edc5db3ac48a","observation_id":"427541ce-56ba-4caa-83e2-afcc2697489e","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Over-the-air fusion of sparse spatial features for integrated sensing and edge AI over broadband channels,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:b07b14a5ef45a6e82426ea91d1844720199856ae1e7fe2603cf23684a2106221","observation_id":"6f1fc9ef-c4ec-42d5-ae66-96da80fb9935","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"MD-AirComp+: Adaptive quantization for blind mas- sive digital over-the-air computation,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:6a72e434908b3cd3c3fcd53bddf0f37064328627d7349d1885c9429c8a0d5538","observation_id":"c3f55c41-3513-4f7a-84ea-815b3fbbbd97","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Communication and computation efficient federated learning for Internet of Vehicles with a constrained latency,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:a1870e09d34905bfef7b687ccb8610d80494eaf44220ed6768e240ad632be8b8","observation_id":"978c88fd-cfa2-4573-ab28-cef521390a95","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"E2E learning massive MIMO for multimodal semantic non-orthogonal transmission and fusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:8314642eee0f3bd53de8a48a370e97f22aca1c170ed23611180040ad8aab329b","observation_id":"140d9fb7-d940-407b-9a11-d173404b8aee","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Multimodal and multiuser semantic communications for channel-level information fusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:56e94b01322f19e6c48afd76c9d698e4107e04cad6340d0b99cd0059c4747ab4","observation_id":"4c9f9523-4b7c-4748-8d12-f28683965183","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"RTFNet: RGB-thermal fusion network for semantic segmentation of urban scenes,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:4203a501649e2223f87541f6a080bf7164550555093eb0d0b5638950ec44fff0","observation_id":"d45ba78b-acfb-43a6-a116-49e7161683b0","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"PST900: RGB-thermal calibration, dataset and segmentation network,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:4fc733483bbcf33869e72d21f9be6088b6ab726645507b29d913e8f0299ed18c","observation_id":"1f6e13c1-454e-4b1b-a18a-c8ee01bd5bcb","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Transformer-aided wireless image transmission with channel feedback,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:c2d9409b59d54f7cbd0c69e21382cd8c412d07edf6613d1df0155e232109f5e1","observation_id":"2b0d5ab9-55e5-4e53-bd82-c31c487aaf10","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:7e74d2b8cdb27d27b8dd3bc91b44e55b422b44811c19c6ac115482591c212371","observation_id":"f5d75480-286a-40b0-a16c-d921fb0180bf","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Toward the unification of generative and discriminative visual foundation model: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:16724d1e3606e9112c44f1930c16ba555d621ce2d29732981afe59dff8c759ce","observation_id":"930004a8-5dbd-4ba6-8f1f-3fa7a30d933e","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Large model enabled embodied intelligence for 6G inte- grated perception, communication, and computation network,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:3e58fed3cb18b36e2850b35f80e322ae26bc35e2b7dd74b3258c0f02ef145799","observation_id":"910354c6-d17a-492d-b5bd-8a07b6c7558a","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"5G: A tutorial overview of standards, trials, challenges, deployment, and practice,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:57465a065f783b26d8ad37efb589ef6ec6ae12c22eb353d85d0bfd12759d894c","observation_id":"8103a386-2871-4844-81b1-35a93b106f18","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"A tutorial on 5G NR V2X communications,","venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:90d227335cc79945bb28f84767469f362d80ff9876d4c528ef12e0c7bd0db90b","observation_id":"72f4cd15-26cf-4a3e-8e8a-b83a14bc7084","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Wireless image transmission using deep source channel coding with attention modules,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:851dbb661c88399904892ea3d09a6ec0c5e097c89ed724925da82222645fa615","observation_id":"fc55fc3f-475b-4adf-b879-4e96bcb76484","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Training Vision Transformers with only 2040 images,","venue":null,"work_id":null,"year":2040},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:0e7fbf5d519ddbdb648762adad1fef89e6d8c56f3d5bcff860e498fa6476f3e2","observation_id":"a84ec67d-ad6e-433a-a28c-7d450ae676dd","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"ImageNet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:fdcfb062f949434a4a281bb65e64ef5fc285ba4712604215c3390757564b5adc","observation_id":"6cbe3dc6-0d41-4fb7-ac00-8fcb447b4579","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"SemanticRT: A large-scale dataset and method for robust semantic segmentation in multispectral images,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:088a3b98a5173eec458386dba9ff7e096ac608b70659d02f23012993e1565999","observation_id":"0cc933d3-b42c-4935-9559-443f0ce7ec3b","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Federated edge learning with misaligned over-the-air computation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:274936e13dac77bb48a83b65ec6581290dd61c656ba598dfe6b0038479fd47d6","observation_id":"5d6bc4e3-913e-4599-b2c3-a40dbd1dabd7","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T04:55:08.078807Z","title":"Massive digital over-the-air computation for communication-efficient federated edge learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-12T04:55:08.078807Z"},"links":{"citing_paper":"/paper/2607.03099"},"observation_digest":"sha256:1eb35584d056b8bef20d267203286f546cf96b2f1992594009c0a88b053836ca","observation_id":"44783825-ef49-436b-a170-a47fd781244a","resolution":{"observed_at":"2026-07-12T04:55:08.078807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.03099","last_updated":"2026-07-03T08:36:07Z","latest_version":1,"primary_category":"eess.IV","snapshot_observed_at":"2026-08-06T08:09:55.626298Z","submitted_at":"2026-07-03T08:36:07Z","title":"AirTF: Over-the-Air Token Fusion for Task-Oriented Multi-Modal Token Communications"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2607.03099."}