{"as_of":"2026-08-18T03:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7b3d53c211dd02e1507b4b8c2ea1e850999258d74a5d703de7279d911d3f3fff","coverage":[{"denominator":87,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":87,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:04:00.870139Z","state":"measured"},{"denominator":87,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":87,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.03675/citation-record","integrity":"/paper/2506.03675/integrity","json":"/paper/2506.03675/citation-record.json","paper":"/paper/2506.03675"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.463645Z","title":"Fully convolu- tional networks for semantic segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.463645Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:afe720c1f83d964f9e9457e949fe02a0724e13552d696a906848962c58451a70","observation_id":"1b258a05-46e4-45ef-bdfb-6084bf9e584a","resolution":{"observed_at":"2026-08-07T11:04:00.463645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.468441Z","title":"Deeplab: Semantic image segmentation with deep convolutional nets, atrous convolution, and fully connected crfs,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.468441Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:3acbf278dccb97fe3e0648e928a3b327d03362604d3565713d497e66e5d680b1","observation_id":"cbc2be4c-6205-4a5e-8d69-a3b2d74079b6","resolution":{"observed_at":"2026-08-07T11:04:00.468441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.473059Z","title":"Encoder-decoder with atrous separable con- volution for semantic image segmentation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.473059Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:7aa6ea948fb98da41bbd1f9467825e56bd94ff6a58f5ae2bbbcea16b9be10bd3","observation_id":"0f6eac92-46b4-4706-9320-7ab406e8ce3a","resolution":{"observed_at":"2026-08-07T11:04:00.473059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.477789Z","title":"Rethinking semantic segmentation from a sequence-to-sequence perspective with transformers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.477789Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:1f02410bd527c207a60b5facc3d5f74686b6936e9ea9223866ae54c671dde3bd","observation_id":"fd0a2738-d60c-462a-a08c-9a860a46db87","resolution":{"observed_at":"2026-08-07T11:04:00.477789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.482334Z","title":"Contour knowledge-aware perception learning for seman- tic segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.482334Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:a7bcaeb0a562212efbfb4c984b76fbb923200935592041b380f2534130a5f64e","observation_id":"7fc3c472-5236-4337-b9c0-00710d45137a","resolution":{"observed_at":"2026-08-07T11:04:00.482334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.486394Z","title":"Omnisam: Omnidirectional seg- ment anything model for uda in panoramic semantic segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.486394Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:1a122dd4bf53878cfd3a059716fc55b337845860162a8e4c7f58256b19025b40","observation_id":"fc321bbf-6e3f-438f-9d3b-22e9b9b7364a","resolution":{"observed_at":"2026-08-07T11:04:00.486394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.491149Z","title":"Muses: The multi-sensor semantic perception dataset for driving under uncertainty,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.491149Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:80e0ea281a5e5a9c5ea84d91a2dc3ba0d240e8a529c2cbce13a2d1394b24d01a","observation_id":"3edec125-49c8-4d1f-9286-f6f1edd3799e","resolution":{"observed_at":"2026-08-07T11:04:00.491149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.495448Z","title":"Delivering arbitrary- modal semantic segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.495448Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:e731732362c9e7d4736496fd9fad6d66141a1c8f5b188e12c3e1079bac054a22","observation_id":"c5927e21-e05f-4ee9-bbf4-56d8874d9ed9","resolution":{"observed_at":"2026-08-07T11:04:00.495448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.106528Z","title":"Indoor segmentation and support inference from rgbd images,","venue":null,"work_id":"43d52148-4cfa-41d1-8407-7400d068b3e1","year":2012},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.499805Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:e2a57aae8727582b9904fc813e672ca7a8b2923ab7b51d59e65ab4d6165ffe25","observation_id":"7d14dabd-e728-493f-a73b-a4a152d4f0b0","resolution":{"observed_at":"2026-08-07T11:04:02.111109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.092747Z","title":"Centering the value of every modality: Towards efficient and resilient modality-agnostic semantic segmentation,","venue":null,"work_id":"5da7634e-63e6-4078-8f90-dcd68e4880ce","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.504618Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:632ed446b253cb69829261ab03907406423e2afe725d2a88a841be0c0a18c06e","observation_id":"8d864917-01d2-40cc-960d-8de33b8fe35b","resolution":{"observed_at":"2026-08-07T11:04:02.097218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17141","last_updated":"2025-05-15T18:54:21Z","snapshot_observed_at":"2026-08-12T12:25:58.124112Z","submitted_at":"2024-11-26T06:15:27Z","title":"Learning Robust Anymodal Segmentor with Unimodal and Cross-modal Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17141","snapshot_observed_at":"2026-08-07T11:04:00.509320Z","title":"Learning robust anymodal segmentor with unimodal and cross-modal distillation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.509320Z"},"links":{"cited_paper":"/paper/2411.17141","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:b7e94f4552e7a9d1983dfe9cd3ddd6fcb3389e667face89c852168f9f951a7ce","observation_id":"7684729b-52e1-4c8c-8a7a-8331fa9631ae","resolution":{"observed_at":"2026-08-07T11:04:00.509320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.078171Z","title":"Cafuser: Condition-aware multimodal fusion for robust semantic perception of driving scenes,","venue":null,"work_id":"6ee4c3ca-a3a7-40c2-9173-20c964f7c593","year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.513880Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:c047fe3b8caaacc9b5348eb23f1d7c55ec6acc6b02445177b08d9d3f9927fb22","observation_id":"dada0cfc-525c-4500-9f1f-b5742af6cbf3","resolution":{"observed_at":"2026-08-07T11:04:02.082719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.064104Z","title":"Learning modality- agnostic representation for semantic segmentation from any modalities,","venue":null,"work_id":"abb452eb-9d27-48ce-a95b-60bef452a756","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.518184Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:e98283746605df2a05b68e01abde092e7cbce7d56fe31ef210ddb2523b368705","observation_id":"a66de4a8-c509-4bc3-9181-0cb903a6115d","resolution":{"observed_at":"2026-08-07T11:04:02.068649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.048596Z","title":"Cmx: Cross-modal fusion for rgb-x semantic segmenta- tion with transformers,","venue":null,"work_id":"b199a027-ae26-44c1-9dd6-695fbe1ed605","year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.522131Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:730978e01287a067f8c9d71f38cf6db450fe51d9b81d3452490cfa01f63936b1","observation_id":"4c02518b-9a2d-4196-853e-2d865590ebbb","resolution":{"observed_at":"2026-08-07T11:04:02.054223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02581","last_updated":"2025-07-22T13:20:58Z","snapshot_observed_at":"2026-08-16T12:53:13.354876Z","submitted_at":"2025-03-04T13:04:46Z","title":"Unveiling the Potential of Segment Anything Model 2 for RGB-Thermal Semantic Segmentation with Language Guidance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.02581","snapshot_observed_at":"2026-08-07T11:04:00.526326Z","title":"Unveiling the potential of segment anything model 2 for rgb-thermal semantic segmentation with language guidance,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.526326Z"},"links":{"cited_paper":"/paper/2503.02581","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:9a8a0c98b72bd2a5eb251527491b81e5e3d6db77a902e54b29b7123130631ab3","observation_id":"85c2180f-2b79-46a1-8897-ba83e26bbc90","resolution":{"observed_at":"2026-08-07T11:04:00.526326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18445","last_updated":"2025-04-10T08:56:52Z","snapshot_observed_at":"2026-08-16T12:47:27.377082Z","submitted_at":"2025-03-24T08:46:52Z","title":"Benchmarking Multi-modal Semantic Segmentation under Sensor Failures: Missing and Noisy Modality Robustness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18445","snapshot_observed_at":"2026-08-07T11:04:00.530644Z","title":"Benchmarking multi-modal semantic segmentation under sensor failures: Missing and noisy modality robustness,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.530644Z"},"links":{"cited_paper":"/paper/2503.18445","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:cd8c9e25050bca78cda1333bb7ed841ee2f74dd074d5f4e278534cf0a33c9233","observation_id":"60019358-77f7-4544-af4c-11f73801300b","resolution":{"observed_at":"2026-08-07T11:04:00.530644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.033321Z","title":"X-prompt: Multi-modal visual prompt for video object segmentation,","venue":null,"work_id":"5bfd8680-0684-4df9-b62f-ac8ffe6c7cd7","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.535096Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:33aa8d73672dc8b98d48c057b93cf2b258ff43644ffbde8e66b1811740403651","observation_id":"a4b7217e-9a89-473a-8f95-479c9f0055df","resolution":{"observed_at":"2026-08-07T11:04:02.038582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.019259Z","title":"Ro- bust multimodal learning with missing modalities via parameter-efficient adaptation,","venue":null,"work_id":"0b2992ee-7ac6-4b9c-a06a-5419f035431a","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.539016Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:57d07771e228e6a90074c1793a4ffc51c673406259f4acff575d80921918322c","observation_id":"87e16734-282d-4612-a637-01de39377f06","resolution":{"observed_at":"2026-08-07T11:04:02.024031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09668","last_updated":"2024-02-07T11:07:29Z","snapshot_observed_at":"2026-08-16T19:16:34.764885Z","submitted_at":"2023-09-18T11:09:11Z","title":"DFormer: Rethinking RGBD Representation Learning for Semantic Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09668","snapshot_observed_at":"2026-08-07T11:04:00.543430Z","title":"Dformer: Rethinking rgbd representation learning for semantic segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.543430Z"},"links":{"cited_paper":"/paper/2309.09668","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:0cd39c95b520b5c2d420b1c818a8d1bd5bcebaf62de9f68e2e68384fb06587be","observation_id":"d7ed4ac6-79ef-4b78-9c47-0cb2e8190850","resolution":{"observed_at":"2026-08-07T11:04:00.543430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:02.004164Z","title":"Cpal: Cross- prompting adapter with loras for rgb+ x semantic seg- mentation,","venue":null,"work_id":"e9c5e715-4ff2-4124-b26e-9a0d1d51f396","year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.548760Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:afa62321076698b44426eabfc892d741ec0fbda8468c87a59a6e94f6e2b0b25f","observation_id":"d483dc7a-46b7-4694-96bf-d2f64c94c675","resolution":{"observed_at":"2026-08-07T11:04:02.008789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.989056Z","title":"Context-aware interaction network for rgb-t semantic segmentation,","venue":null,"work_id":"b4cb772c-2331-4852-a198-23907d5bf0d5","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.552744Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:ba251abe60a990fffa3e7a1db606d9c93fee14fe633756d40385ee4e2c3e4ad6","observation_id":"4d989659-0d80-4d5f-b850-251511ee77f8","resolution":{"observed_at":"2026-08-07T11:04:01.993801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.973271Z","title":"Embracing events and frames with hierarchical feature refinement network for object detection,","venue":null,"work_id":"05e9ca76-4047-4f7d-bbaa-7d0cf018fb3a","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.556877Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:bb17f816d16c5d39c4cf411b6154822e87ea329c151a6a96789ec39dd991c215","observation_id":"e7dd0730-d7f9-4bbe-9a49-b8a13798a4d9","resolution":{"observed_at":"2026-08-07T11:04:01.978318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.957932Z","title":"Mawkdn: A multimodal fusion wavelet knowledge distillation approach based on cross-view attention for action recognition,","venue":null,"work_id":"b6494ce9-8153-4e87-888b-c32fd69e89b7","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.560815Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:c13566c062e2b60a2c1cccf3640b1a2a9a5dc4daed6fd553d34c996b96c0e8d3","observation_id":"739022c0-43f9-4078-8430-5ad5962d06a9","resolution":{"observed_at":"2026-08-07T11:04:01.962794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.941986Z","title":"Cpal: Cross- prompting adapter with loras for rgb+ x semantic seg- mentation,","venue":null,"work_id":"4e6064b5-1195-4f47-b5e8-26e137432b0b","year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.564769Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:58a6e862c39f780256d7c83f2a3ef64db12800284f05edeb87d83241c8e32acf","observation_id":"6e923aa9-94b9-4009-8c9c-01e670eb183e","resolution":{"observed_at":"2026-08-07T11:04:01.947259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.925534Z","title":"S3f2net: Spatial- spectral-structural feature fusion network for hyperspectral image and lidar data classification,","venue":null,"work_id":"35ab5f5b-2981-4797-90bd-26b411bff7c1","year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.568839Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:df033c9054999a2223acb11cf11c15fe732bde8f55504a5d1bb1c0d42295b6ab","observation_id":"a7957b06-7a5a-4f04-9884-19d81db84db3","resolution":{"observed_at":"2026-08-07T11:04:01.930862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.910854Z","title":"T 2 ea: Target-aware taylor expansion approx- imation network for infrared and visible image fusion,","venue":null,"work_id":"04f6eba2-1003-48c7-90e5-41c914318d5b","year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.572887Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:39214041ebf1143cefcb613ddc9512c73ca96a42aaf091204d60cbbb8fd8b043","observation_id":"c5013d83-4476-4994-b741-7593ca0b105f","resolution":{"observed_at":"2026-08-07T11:04:01.915599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.895472Z","title":"Nuc-net: Non- uniform cylindrical partition network for efficient lidar semantic segmentation,","venue":null,"work_id":"ca34a0f2-d0c9-4f3d-ba56-43f4d391902b","year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.577374Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:3371648d5da9935a33bdc6bf36b27671f0aa363e9982ef3af9939efeacd17551","observation_id":"e1ac892b-907c-46ea-b348-451fd1f7947c","resolution":{"observed_at":"2026-08-07T11:04:01.900337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06635","last_updated":"2025-05-10T12:58:15Z","snapshot_observed_at":"2026-08-17T18:52:10.932653Z","submitted_at":"2025-05-10T12:58:15Z","title":"Reducing Unimodal Bias in Multi-Modal Semantic Segmentation with Multi-Scale Functional Entropy Regularization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06635","snapshot_observed_at":"2026-08-07T11:04:00.581807Z","title":"Reducing unimodal bias in multi-modal semantic segmentation with multi-scale functional entropy regularization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.581807Z"},"links":{"cited_paper":"/paper/2505.06635","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:3b34fe9001aa97ee333ccd6eb2394dcbdf76f4133948804c5a94010983ea5e2c","observation_id":"c7243d09-eeae-4c5f-a155-1e5b031e0ed9","resolution":{"observed_at":"2026-08-07T11:04:00.581807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.879712Z","title":"Primkd: Primary modality guided multimodal fusion for rgb-d semantic segmentation,","venue":null,"work_id":"168c1d93-eea8-4a04-b699-4ae77c95c880","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.586563Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:662daa6b7464866b97cead768931824293ccd368045b4dd15b199e04646e9ec2","observation_id":"3e395c87-633c-4aa0-ac8d-6a716ccb44f1","resolution":{"observed_at":"2026-08-07T11:04:01.884761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.865021Z","title":"Imagenet large scale visual recognition challenge,","venue":null,"work_id":"34eecae9-350e-4fbf-91c6-5c5fdcc6b87f","year":2015},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.590946Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:f5b763441594bf8687fe23ca5167124f163fea8c0dc6a47a586ecf9ac094031d","observation_id":"e30a52cb-98e5-4b6e-aaf7-a686af2fe480","resolution":{"observed_at":"2026-08-07T11:04:01.869683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.594913Z","title":"Masked-attention mask transformer for universal image segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.594913Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:d890b4b488b749b6785ce3d326870f33105d3283fb7ff3fd235e3d0c58da62ed","observation_id":"9c3577d8-fe22-4ab8-a290-51d59436bcbc","resolution":{"observed_at":"2026-08-07T11:04:00.594913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.839575Z","title":"Per-pixel classi- fication is not all you need for semantic segmentation,","venue":null,"work_id":"1b1ddd03-ae9d-47e2-b71a-2eb4e44a6de1","year":2021},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.598937Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:c57c8d481723b895e0be3d1ba10131e33886180401bf982169a3fb3bd5b4a422","observation_id":"dbdeb659-6f03-4004-b13c-2a8497727dc8","resolution":{"observed_at":"2026-08-07T11:04:01.844583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.824973Z","title":"Group detr: Fast detr training with group-wise one-to-many assignment,","venue":null,"work_id":"1432184c-9ad1-423f-92a0-e20b64a4ab30","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.602750Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:ded475db7ccf493093733568d73a086b19f4dbd830b4b08b14d06170e6e6aa5b","observation_id":"5f309f33-de7f-4c28-aadb-8add8eb703a1","resolution":{"observed_at":"2026-08-07T11:04:01.829820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.809760Z","title":"Detrs with collaborative hybrid assignments training,","venue":null,"work_id":"38daf34a-d407-48ed-ba76-3f64c5c86ed1","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.606579Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:857e6b07862ed2461c3b1a5b238fc04da6711dd6e424a0c81adf6dc873a69e7c","observation_id":"f1345d5d-ac5c-4535-a10e-5520b4578dcf","resolution":{"observed_at":"2026-08-07T11:04:01.815228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.794541Z","title":"Detrs with hybrid matching,","venue":null,"work_id":"6b542c53-c0a1-4794-9da2-e92c776189b6","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.610669Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:fdf4296b5125202bf15945298086744954d7a1fdebb10612966c863ea14937b3","observation_id":"c432808b-9ec8-49bd-9934-4284ad5ea05b","resolution":{"observed_at":"2026-08-07T11:04:01.799859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.778551Z","title":"Ms-detr: Efficient detr training with mixed supervision,","venue":null,"work_id":"8f88445b-0b33-433b-85a2-a4d97e1bf619","year":2020},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.614876Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:80aeab8a91107a936f734bcb52cd537ea57b23b56e54bd0c93b57975dd4f2277","observation_id":"eded07c9-8f60-4282-9921-d9a2db812599","resolution":{"observed_at":"2026-08-07T11:04:01.783744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.762241Z","title":"Detection transformer with stable matching,","venue":null,"work_id":"ca39af8f-3113-492f-983a-0c13be9ac42a","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.618666Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:78fd51433bc657cea8a47dc034af89320ebf909bd9d12af1905295ce8ca1d7f1","observation_id":"2ff03b25-9c8b-4fcd-ab0b-b257366ea2a9","resolution":{"observed_at":"2026-08-07T11:04:01.766791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.747331Z","title":"Rank-detr for high quality object detection,","venue":null,"work_id":"461e3c54-6738-4393-a221-bc9d94d42ace","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.622722Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:b0d28bfd42476076e282bff797d5f589d675cdfb4e7f8ae5de85b4271628f639","observation_id":"bde81fa0-16db-4a6a-91a7-42171bd1d085","resolution":{"observed_at":"2026-08-07T11:04:01.752114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03605","last_updated":"2022-07-11T10:30:29Z","snapshot_observed_at":"2026-08-17T01:41:21.303070Z","submitted_at":"2022-03-07T18:55:26Z","title":"DINO: DETR with Improved DeNoising Anchor Boxes for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.03605","snapshot_observed_at":"2026-08-07T11:04:00.627257Z","title":"Dino: Detr with improved denoising anchor boxes for end-to-end object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.627257Z"},"links":{"cited_paper":"/paper/2203.03605","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:6c8270365715bab1c14ae597b2b93f758cd7dde76620464e77084f8c93ce67ac","observation_id":"09f8dc25-66df-4cc2-8d7e-3d3f6c38b237","resolution":{"observed_at":"2026-08-07T11:04:00.627257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.731052Z","title":"Emo2-detr: Efficient-matching oriented object detection with transformers,","venue":null,"work_id":"9f620584-f47e-46b3-9c02-6bec8ed1b5f5","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.631710Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:5185c04d89a15ce6369f00e839ac35c9a6b253a7074021fb1cad71f67c8ae3c6","observation_id":"40ae5cb2-1281-4b87-93dd-a3e3e29953a5","resolution":{"observed_at":"2026-08-07T11:04:01.736649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.714603Z","title":"Hybrid proposal refiner: Revisiting detr series from the faster r-cnn perspective,","venue":null,"work_id":"d5bfb62e-8437-4979-9d4e-d6234a8a6b28","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.635575Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:51c8a0611ef17bc10f3167860abcf24c0dbe7edeed1e3092597bfa7a58f05cde","observation_id":"fce1bd6b-e1b2-4a83-9514-afedbcc918c5","resolution":{"observed_at":"2026-08-07T11:04:01.719811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.699155Z","title":"Salience detr: Enhancing detection transformer with hierarchical salience filtering refinement,","venue":null,"work_id":"04b02df0-37ba-446a-97f6-ae8fb1dcb87e","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.639910Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:1eaa201b4c20c0360fdc8604c8de8d7900a8184c2e812b282e6174d005fd50ce","observation_id":"0a0893db-8e2e-4eda-8b11-d2b86db6af07","resolution":{"observed_at":"2026-08-07T11:04:01.704051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.644467Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.644467Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:909eeed2e7fb65a4e19f1a8d7c4d7ce8811aecd45cba88bb9fdb1a39dde14b15","observation_id":"04b723a1-e390-410c-bdf4-ddbf0f874ce0","resolution":{"observed_at":"2026-08-07T11:04:00.644467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.673999Z","title":"Going deeper with convolutions,","venue":null,"work_id":"bbc2d06b-3ba0-464a-9a26-4234818837b6","year":2015},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.648338Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:f6acfd9c8b2c34fac326faeb9c2b1a2c9444f611a4827991cba3a0ddd1e39bd9","observation_id":"68e7a3b6-f594-48a5-a09f-d611ac3218c0","resolution":{"observed_at":"2026-08-07T11:04:01.678869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.652621Z","title":"A convnet for the 2020s,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.652621Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:0a88c2d0313cf432cf2afc2009a42b022eab1ef9eae89bd88197100f209c090b","observation_id":"5b093bbc-cdf5-4d9b-a91e-b49e4f6181c0","resolution":{"observed_at":"2026-08-07T11:04:00.652621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04220","last_updated":"2024-12-05T14:54:31Z","snapshot_observed_at":"2026-08-17T23:29:24.004954Z","submitted_at":"2024-12-05T14:54:31Z","title":"Customize Segment Anything Model for Multi-Modal Semantic Segmentation with Mixture of LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04220","snapshot_observed_at":"2026-08-07T11:04:00.657432Z","title":"Cus- tomize segment anything model for multi-modal semantic segmentation with mixture of lora experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.657432Z"},"links":{"cited_paper":"/paper/2412.04220","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:e8f68ddceb562ae1716500780ffb2972d1840505ace0096a7637d1f903bc090c","observation_id":"c21fc46d-3cad-44e9-a2f6-8e307c9da61d","resolution":{"observed_at":"2026-08-07T11:04:00.657432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.648929Z","title":"Adversarial co-training for semantic segmen- tation over medical images,","venue":null,"work_id":"e24f43e3-49ea-4a11-894c-a4337e10fcc8","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.662672Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:9825155f5582270e23775f911daef0e54362afeb62c4ae8cdb753170360ba50b","observation_id":"8135c43d-c0ba-47db-9bde-be3a68684a20","resolution":{"observed_at":"2026-08-07T11:04:01.653572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.667774Z","title":"Look at the neighbor: Distortion-aware unsupervised domain adaptation for panoramic semantic segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.667774Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:e3a0c115626ee6e41579e54b721eef8aa339ca323c543bdb3817a2e9b8759275","observation_id":"dee1a2ac-6f76-49e2-aa27-4ae7c6eba2c3","resolution":{"observed_at":"2026-08-07T11:04:00.667774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.624093Z","title":"Deformable convolutional networks,","venue":null,"work_id":"fb84e697-9ffc-4e23-a98f-a1a550d5cfc3","year":2017},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.672191Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:1dc3d87e15aaadf0fa31a5495cbdd859136637c5626087ab0cb1f64d1e5b4363","observation_id":"25bbc081-3c56-4608-9c27-35f3124fd4e0","resolution":{"observed_at":"2026-08-07T11:04:01.628584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.608672Z","title":"Segformer: Simple and efficient design for semantic segmentation with transformers,","venue":null,"work_id":"ee9a1f22-4f59-4cdc-a011-c1f5ea5e600f","year":2021},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.677130Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:3bf70784b0d1aab55fa1d52f3a7b3133710d7c10b283c3e240c4169d9c9a3942","observation_id":"2815ca5a-15a9-4103-8559-e60d21c5023a","resolution":{"observed_at":"2026-08-07T11:04:01.613184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.595318Z","title":"Segnext: Rethinking convolutional attention design for semantic segmentation,","venue":null,"work_id":"4db43aa2-cc72-4e58-8c9d-96a34ace8999","year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.683044Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:e7c486709ef2f254b871c05408edbc5e25098b7aaff9e4f01641f6f18d17e35c","observation_id":"90830fe5-444e-492d-8c35-35960de78dde","resolution":{"observed_at":"2026-08-07T11:04:01.599650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.581221Z","title":"Frozen is better than learning: A new design of prototype- based classifier for semantic segmentation,","venue":null,"work_id":"918725f2-1106-4f69-a237-aa5557839d03","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.687789Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:95290d5029b1f93bd61bf422df2f4f28a767af5c9b32c55030c3e824c63305dd","observation_id":"7ceb9021-8c9c-4ef7-8032-b9f80244d04c","resolution":{"observed_at":"2026-08-07T11:04:01.585874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.567624Z","title":"Uncertainty-aware deep co-training for semi- supervised medical image segmentation,","venue":null,"work_id":"1c6d5300-29ab-497d-862e-b0155986d90f","year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.693373Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:b127465594a8db0ba175a61e94e89bb6039a6556526dffc17b8c5af567672ec4","observation_id":"1fae5683-53f4-42f2-a1ec-282b96baaf68","resolution":{"observed_at":"2026-08-07T11:04:01.571937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.553734Z","title":"Both style and distortion matter: Dual-path unsupervised domain adaptation for panoramic semantic segmentation,","venue":null,"work_id":"c2bc2c8f-9781-4752-ac23-87700de14257","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.698671Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:ff58620ddafd0ec22cdbd17522588881233d058b38cf6928cda0e293f35de192","observation_id":"1285a183-63a3-4a73-bda0-dbce9c4426d7","resolution":{"observed_at":"2026-08-07T11:04:01.558494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.539683Z","title":"A good student is cooperative and reliable: Cnn-transformer collaborative learning for semantic segmentation,","venue":null,"work_id":"556218f1-7523-4896-a7d1-49ff3b59837b","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.705084Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:268ba1ee377c1087e87b1d33b048897b4813fd7611fe04b8a0976d4048d6e50d","observation_id":"467d4ae0-adf9-447b-9f87-0575eae88b9c","resolution":{"observed_at":"2026-08-07T11:04:01.544352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.525436Z","title":"Semantics distortion and style matter: Towards source- free uda for panoramic segmentation,","venue":null,"work_id":"13941ab7-2f7a-43be-90d9-1aba796e52d7","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.710670Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:c4892c67b2c306c26d2c4947d5cdc7634aa8d185048b64c372966de09ecf72ba","observation_id":"b1bff59f-0b95-4ad6-819f-18b403aac779","resolution":{"observed_at":"2026-08-07T11:04:01.530177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.511903Z","title":"Attention is all you need,","venue":null,"work_id":"20062400-6d62-4588-9ffe-54aab036b575","year":2017},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.715830Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:3cd97ff94477d81f2dd8ebe8798023e474f9ca6daa490ebfb0486ecc7ac77761","observation_id":"3811f309-0207-400c-811b-084416b6bea8","resolution":{"observed_at":"2026-08-07T11:04:01.516392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T11:04:00.721118Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.721118Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:1bb68a598ec255291d5493e8ffd46a3a9737428df3cddcdf13d646148849358a","observation_id":"f01095fd-8be7-4ea8-8285-473cbe345e81","resolution":{"observed_at":"2026-08-07T11:04:00.721118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03135","last_updated":"2024-07-24T13:50:56Z","snapshot_observed_at":"2026-08-16T15:10:28.775050Z","submitted_at":"2023-08-06T15:05:42Z","title":"EventBind: Learning a Unified Representation to Bind Them All for Event-based Open-world Understanding","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03135","snapshot_observed_at":"2026-08-07T11:04:00.727420Z","title":"E-clip: Towards label-efficient event-based open-world understanding by clip,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.727420Z"},"links":{"cited_paper":"/paper/2308.03135","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:a3714d9c58e95f3aae79b907f6cf4d268f82fe5aa0c6de1a6895caa89e75f17d","observation_id":"fbefb9b9-6294-401e-9abb-3c3080be1ec6","resolution":{"observed_at":"2026-08-07T11:04:00.727420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16108","last_updated":"2024-05-25T07:45:41Z","snapshot_observed_at":"2026-08-16T13:49:31.934755Z","submitted_at":"2024-05-25T07:45:41Z","title":"OmniBind: Teach to Build Unequal-Scale Modality Interaction for Omni-Bind of All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16108","snapshot_observed_at":"2026-08-07T11:04:00.732923Z","title":"Omnibind: Teach to build unequal-scale modality interaction for omni-bind of all,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.732923Z"},"links":{"cited_paper":"/paper/2405.16108","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:2882d5eb9b65214bfdecf5a880e4b224479d4f72315c2b7bde2132423738bb89","observation_id":"c0434cf8-ba3b-402e-aabc-5f41d0e2de49","resolution":{"observed_at":"2026-08-07T11:04:00.732923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.497105Z","title":"Exact: Language-guided conceptual reasoning and uncertainty estimation for event-based action recognition and more,","venue":null,"work_id":"e7229984-88b4-4b40-9542-748a1ac4d8c7","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.738471Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:b2c0648001a24a456da19f28540d85784d3cdccef5d5512fd8963d8547e389ba","observation_id":"60965e60-4676-4b21-b9e6-183321bf6050","resolution":{"observed_at":"2026-08-07T11:04:01.501835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.482468Z","title":"Missing modal- ity robustness in semi-supervised multi-modal semantic segmentation,","venue":null,"work_id":"b202c855-ea28-41bc-a4c1-fb1e65d05cec","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.744026Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:22411e49cfb97c6ec6b57e49d6a7cfbcbfecc1457380495aa2f8f7cd92304afc","observation_id":"b46f05cb-96bc-4f91-ab6f-0c17a1b693e0","resolution":{"observed_at":"2026-08-07T11:04:01.487199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.467621Z","title":"Towards good practices for missing modality robust action recognition,","venue":null,"work_id":"2ac1fe1c-eaca-4931-9205-7b23546c1f26","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.750010Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:ede9e2495591c435cafb11024b2d8d5c35a673178689885497fb6974239646a6","observation_id":"33d0b394-ede4-45ca-9375-f9f366a24afe","resolution":{"observed_at":"2026-08-07T11:04:01.472508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.453201Z","title":"Unified multi-modal image synthesis for missing modality imputation,","venue":null,"work_id":"a2c81501-dd38-417b-9151-84590dff8b5a","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.754926Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:adfc0900f3ad8ad025864a4fa778bd3ae789f240307460adad3fb01ec2873580","observation_id":"f32ade72-c97a-44d4-b057-9d2ed05f7db6","resolution":{"observed_at":"2026-08-07T11:04:01.457939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.438562Z","title":"M3ae: multimodal representation learning for brain tumor segmentation with missing modalities,","venue":null,"work_id":"12694cc4-ca32-44c6-a8ff-2015e577dd8f","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.759901Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:b313d7df05dd1ad8f40881bd131b26c116d616bf649304b4eaef9eceb46d4ca0","observation_id":"abf56ed5-9e0e-43c7-8f6a-cd83eba56d94","resolution":{"observed_at":"2026-08-07T11:04:01.443336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.422487Z","title":"Semi-mamba: Mamba-driven semi-supervised multimodal remote sensing feature classification,","venue":null,"work_id":"5ceb2641-f924-4345-9157-4da0759852b1","year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.765276Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:fe2d1c7f07906a9e0bf27472d3bff7f2764d96f642a9f5c571706061c5e0a224","observation_id":"1b957305-4cdd-4da7-ae4c-c3255a7c6409","resolution":{"observed_at":"2026-08-07T11:04:01.427608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08890","last_updated":"2024-04-11T15:34:46Z","snapshot_observed_at":"2026-08-17T09:05:47.162911Z","submitted_at":"2023-02-17T14:19:28Z","title":"Deep Learning for Event-based Vision: A Comprehensive Survey and Benchmarks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.08890","snapshot_observed_at":"2026-08-07T11:04:00.771080Z","title":"Deep learning for event-based vision: A comprehensive survey and benchmarks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.771080Z"},"links":{"cited_paper":"/paper/2302.08890","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:37cdebedc06a953b166126ea80dcd6d6a248809b6f59ac41bfd685c564f017c0","observation_id":"c9d38745-974f-4587-b0fc-16b5690e280c","resolution":{"observed_at":"2026-08-07T11:04:00.771080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.406714Z","title":"Chasing day and night: Towards robust and efficient all-day object detection guided by an event camera,","venue":null,"work_id":"75468f43-9b73-4064-97ae-34a22eefbd40","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.777068Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:f79edb520f8ded7c5df0a4a6db383292e7d1628e66737a8dd76d620734c09c63","observation_id":"a947058e-ad07-4925-b7e2-3cae33de7f12","resolution":{"observed_at":"2026-08-07T11:04:01.411602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.391393Z","title":"Unibind: Llm- augmented unified and balanced representation space to bind them all,","venue":null,"work_id":"e0efc279-88b2-4b80-a6a9-27ed27c33b61","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.782728Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:a2c4d480154560352e1f2eec3977937e1cb55662a9f4efa3e3833abf4942e2ec","observation_id":"4f717564-93c7-47ed-aa3c-8f81e612f825","resolution":{"observed_at":"2026-08-07T11:04:01.396350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.376526Z","title":"Eventdance: Unsupervised source-free cross-modal adaptation for event-based object recognition,","venue":null,"work_id":"68fbeb4f-617c-4d0f-b4fd-fa4178bb0087","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.788052Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:1e1e2fccb0f84ea82f209f2a662207f32020fa8f2fcbb4475d627b8d6b1b31b5","observation_id":"5a389bdd-68b1-4914-b3dc-3a288fb8a2ec","resolution":{"observed_at":"2026-08-07T11:04:01.381116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.362414Z","title":"Eventbind: Learning a unified representation to bind them all for event-based open-world understanding,","venue":null,"work_id":"64b3ba9f-ef2b-469d-bb3b-f696670e4c92","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.793431Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:b2b4b202c68af74265fc49bb26613cd09f1ebb9976173db573783381f39cb5c1","observation_id":"3ac21538-25ad-4b79-9435-6ef779c7d4cb","resolution":{"observed_at":"2026-08-07T11:04:01.366901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06700","last_updated":"2025-03-20T18:36:20Z","snapshot_observed_at":"2026-08-16T12:51:45.395210Z","submitted_at":"2025-03-09T17:33:15Z","title":"MemorySAM: Memorize Modalities and Semantics with Segment Anything Model 2 for Multi-modal Semantic Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06700","snapshot_observed_at":"2026-08-07T11:04:00.798023Z","title":"Memorysam: Memorize modal- ities and semantics with segment anything model 2 for multi-modal semantic segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.798023Z"},"links":{"cited_paper":"/paper/2503.06700","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:649547fae51ec2ab3f653a0b28dd942d17434862d90e6190ba6a1e911d8d0397","observation_id":"3722a80e-04f1-49be-b4ac-0f7b9bfeeb85","resolution":{"observed_at":"2026-08-07T11:04:00.798023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16876","last_updated":"2024-12-22T06:12:03Z","snapshot_observed_at":"2026-08-15T05:47:29.055177Z","submitted_at":"2024-12-22T06:12:03Z","title":"MAGIC++: Efficient and Resilient Modality-Agnostic Semantic Segmentation via Hierarchical Modality Selection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16876","snapshot_observed_at":"2026-08-07T11:04:00.803912Z","title":"Magic++: Efficient and resilient modality-agnostic se- mantic segmentation via hierarchical modality selection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.803912Z"},"links":{"cited_paper":"/paper/2412.16876","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:80403870a726f37020ca3f08511c3d6e948cbfa9f43d02f30bd3736fff74e4b8","observation_id":"79a60b95-a4a7-4e0a-938b-6a32b5a57d18","resolution":{"observed_at":"2026-08-07T11:04:00.803912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.346965Z","title":"Fcos: Fully convolutional one-stage object detection,","venue":null,"work_id":"8298fbb6-6dd6-4aae-bc14-b603086c011f","year":2019},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.809604Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:385f580d4c3f95b48d06d094ee960084d9a9adaba909202319e642aef0350688","observation_id":"3e677c59-3523-4910-a01d-737c2c5e6edc","resolution":{"observed_at":"2026-08-07T11:04:01.351857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.814311Z","title":"Focal loss for dense object detection,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.814311Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:27dd4810bd003707271185541b920ff3c054ff452aa63c42988c648de2f02115","observation_id":"c4c44799-24d6-4376-9f9a-e3d76b2f2fb9","resolution":{"observed_at":"2026-08-07T11:04:00.814311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.321978Z","title":"End-to-end object detection with transformers,","venue":null,"work_id":"c66f09cd-4f60-4425-9da9-1a1a0db88ff4","year":2020},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.819403Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:cd0c7cde0e1022ca91bf11bb0a822ee3814a34ac26b5c66b317619648a3dd6e3","observation_id":"74076452-ed14-4cf9-8c99-0b525e30dec1","resolution":{"observed_at":"2026-08-07T11:04:01.326502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.306333Z","title":"Mask dino: Towards a unified transformer- based framework for object detection and segmentation,","venue":null,"work_id":"765f34b8-908c-4525-a9cc-c02b99ae5568","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.824393Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:961763e08edbfa8f218578f49d7cb3c803928a0929ada2bcde1c0d425a96c1ba","observation_id":"2229a1c8-baea-4986-8170-68a654d8715b","resolution":{"observed_at":"2026-08-07T11:04:01.310990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.291231Z","title":"Primitive generation and semantic-related alignment for universal zero-shot segmentation,","venue":null,"work_id":"b471462f-5bf8-4d61-a064-b068ba459ff5","year":2023},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.829429Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:6d5245dd0006612c5e1e5fa2f2540ef824406fe3e64b2510cae632c5d3e19f0c","observation_id":"e7fee3c7-777e-4e40-b0fd-69b11354e52a","resolution":{"observed_at":"2026-08-07T11:04:01.296122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13697","last_updated":"2024-02-21T10:57:21Z","snapshot_observed_at":"2026-08-16T18:41:50.215639Z","submitted_at":"2024-02-21T10:57:21Z","title":"Generalizable Semantic Vision Query Generation for Zero-shot Panoptic and Semantic Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13697","snapshot_observed_at":"2026-08-07T11:04:00.833790Z","title":"Gen- eralizable semantic vision query generation for zero- shot panoptic and semantic segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.833790Z"},"links":{"cited_paper":"/paper/2402.13697","citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:491537c965366603cc60b0b1dc42ca44ed55be43b6102a47dd6e0985afb6a566","observation_id":"7810af1e-3748-4971-8b65-b40194d410ef","resolution":{"observed_at":"2026-08-07T11:04:00.833790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.276102Z","title":"Acnet: Attention based network to exploit complementary features for rgbd semantic segmentation,","venue":null,"work_id":"95082c0b-8322-4469-8282-88217753ff9f","year":2019},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.838599Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:54e35945aa606e6873e042f55ab435bca4c4089411938ef6925a8bf1fa00aeb2","observation_id":"a4c40b69-dc76-4db3-a7cb-c7066ea7c017","resolution":{"observed_at":"2026-08-07T11:04:01.281044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.261473Z","title":"Shapeconv: Shape-aware convolutional layer for indoor rgb-d semantic segmentation,","venue":null,"work_id":"cdd9daa8-b35a-40fa-8dca-786c9cf3b493","year":2021},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.842951Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:5c0503a63e6f94e4e1bd04868cb9daa2132604a57c3e7cb73a4996855fc93df2","observation_id":"f6e336a3-0e03-4250-81b7-1d30fbe18aa2","resolution":{"observed_at":"2026-08-07T11:04:01.266073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.847251Z","title":"Aggregated residual transformations for deep neural networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.847251Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:75e0a2da803021595ac23145cb59642c685bb1cceaf2f9e5c64e3138923e57e5","observation_id":"d4177e31-54f2-4720-9402-5490a648afd4","resolution":{"observed_at":"2026-08-07T11:04:00.847251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.236108Z","title":"Efficient rgb-d semantic segmentation for indoor scene analysis,","venue":null,"work_id":"abb2ca70-04e6-475e-982d-c4938ec36d99","year":2021},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.851918Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:40fbeef23953832d5719c5c426c3d0e1d787b73ac41f5f70592305e1b1835f44","observation_id":"8c559ef2-90ee-4002-95f3-f983288c102b","resolution":{"observed_at":"2026-08-07T11:04:01.241496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.220577Z","title":"Multimodal token fusion for vision transform- ers,","venue":null,"work_id":"434c872b-931e-44cb-aa30-2fcbf5f654b1","year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.856773Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:f2d395fc1e8f9dc49b8385fece2e2b2709daa7a51af0360a544a3dd70b2859b9","observation_id":"97a397eb-72f7-4464-ac1d-5528e8023c9c","resolution":{"observed_at":"2026-08-07T11:04:01.225280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.860997Z","title":"Omnivore: A single model for many visual modalities,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.860997Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:0289d1a241a7e130212368ce365c29f9853b8208183ad84e4de46a7228297ff8","observation_id":"56ff219a-4c1b-4c22-88cc-16e5e2204c51","resolution":{"observed_at":"2026-08-07T11:04:00.860997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:00.865416Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.865416Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:bae8455764ce3448d58f39e09b66c518d5ac55e927c8523f7e4c8285c59759b6","observation_id":"9be0eaf8-2e99-4e47-8a0f-16d7ef59df28","resolution":{"observed_at":"2026-08-07T11:04:00.865416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:04:01.185248Z","title":"Prompting multi-modal image segmentation with semantic grouping,","venue":null,"work_id":"fe124c29-78e5-4d57-bcad-b3ccf043b2af","year":2024},"citing_paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:00.870139Z"},"links":{"citing_paper":"/paper/2506.03675"},"observation_digest":"sha256:531b1b9beb592483f321f5bba457daeeea14dba39538bc65aaa896b0d584433e","observation_id":"b8c3a830-b3c7-4975-98bf-27300e50b614","resolution":{"observed_at":"2026-08-07T11:04:01.191808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.03675","last_updated":"2025-06-04T08:04:58Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T17:58:31.148025Z","submitted_at":"2025-06-04T08:04:58Z","title":"BiXFormer: A Robust Framework for Maximizing Modality Effectiveness in Multi-Modal Semantic Segmentation"},"reference_resolution":{"displayed":87,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":57},"total_outbound_references":87},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 87 of 87 outbound references and 0 inbound Pith citation observations for arXiv:2506.03675."}