{"as_of":"2026-08-10T04:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4e82a6c5cfa89ddaf1a37920a859fd3901fe02c77c4c66e97a04ad14118cbf35","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:37:13.701589Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.07802/citation-record","integrity":"/paper/2507.07802/integrity","json":"/paper/2507.07802/citation-record.json","paper":"/paper/2507.07802"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.881167Z","title":"Multimodal federated learning in aiot systems: Existing solutions, applications, and challenges","venue":null,"work_id":"a2f69d5b-c9cc-436e-b98a-27856eadc534","year":null},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.420171Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:f0c4bbaa2144c68505906cd9387ac52c9d5f666acc3a3f3cf6e3c2501c8a689e","observation_id":"29824960-47d2-4a26-84d6-a3dfc402161f","resolution":{"observed_at":"2026-08-06T18:37:14.887631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1702.01992","last_updated":"2017-02-07T13:05:19Z","snapshot_observed_at":"2026-08-05T13:29:33.669402Z","submitted_at":"2017-02-07T13:05:19Z","title":"Gated Multimodal Units for Information Fusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.01992","snapshot_observed_at":"2026-08-06T18:37:13.426170Z","title":"Gated multimodal units for information fusion","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.426170Z"},"links":{"cited_paper":"/paper/1702.01992","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:7f2b62e3235364fcadf0d5285a6081b9ada28e49741bc5d7b731a6c18dc08eca","observation_id":"d0f7061e-57b4-4b8c-8f3d-fde0e1e47dfd","resolution":{"observed_at":"2026-08-06T18:37:13.426170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.861607Z","title":"Vivit: A video vision transformer","venue":null,"work_id":"579aaf54-f468-4394-bb98-c041e272b459","year":2021},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.432861Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:f6eeb2c1f9e4e7d824234cbf5e5fef86dde6414b684815d0dc4b4c971fd9fad8","observation_id":"f8e94412-97da-4f4f-a7ad-e6f1b7b25c83","resolution":{"observed_at":"2026-08-06T18:37:14.866741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-06T18:37:13.437969Z","title":"Layer normalization","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.437969Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:db968734f11461049544b7ea18fab94779cb8ac465cdbaada0c1acb8e27002a7","observation_id":"29d58b42-ffaf-41cb-aaad-14227c8a6e8a","resolution":{"observed_at":"2026-08-06T18:37:13.437969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.843462Z","title":"Sharegpt4v: Improving large multi-modal models with better captions","venue":null,"work_id":"c1fa3121-9405-4642-b4e1-0235ce0448a1","year":null},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.443770Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:0d18833c050eba31cac64e5613f18fa8bd1fbb22c2f1ef970a8a4a6669865f24","observation_id":"f990f6de-3dff-4c5c-a8d8-fd6725a46b46","resolution":{"observed_at":"2026-08-06T18:37:14.848876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.827573Z","title":"A fine-grained self- adapting prompt learning approach for few-shot learning with pre-trained language models","venue":null,"work_id":"fc9bcb95-4423-43fb-bc3c-35a3dc7c244f","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.448863Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:572662228d2f859b7b691b87017d8fea9712b49888d4614cc23c4e4bc10e64e7","observation_id":"9c4cbc9e-61c8-4f40-a36e-ec1bb4712fc2","resolution":{"observed_at":"2026-08-06T18:37:14.832544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.810496Z","title":"Retrieval-augmented hypergraph for multimodal social media popularity prediction","venue":null,"work_id":"cda5c1ca-d2dc-4929-8421-d8c0846929e8","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.454468Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:f7bd85bf1347a0ea7f3f95aebddfd74509299347b137cac8a1e2e70a56c8699a","observation_id":"37d500be-722d-4d45-890c-c0911e873262","resolution":{"observed_at":"2026-08-06T18:37:14.815670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T18:37:13.459599Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.459599Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:83a6173bd963d2279eff8c0a08131923d35c5423a92fc5284ca1330bbb189dbb","observation_id":"c3fb0cec-546d-4502-b074-42d45886a880","resolution":{"observed_at":"2026-08-06T18:37:13.459599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.793364Z","title":"Mfhod: Multi-modal image fusion method based on the higher-order degradation model","venue":null,"work_id":"01e8d142-37d8-4762-a0c5-6da374f3e34b","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.466222Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:cade16f3b3a1226c8203fb7e96c45b1caeca7351fa9861110f682d68050fcc8f","observation_id":"81606e5c-6139-406d-91e6-3a7624fc2176","resolution":{"observed_at":"2026-08-06T18:37:14.798139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.776089Z","title":"Uncertainty-aware align- ment network for cross-domain video-text retrieval.Advances in Neural Information Processing Systems, 36:38284–38296,","venue":null,"work_id":"3584a595-9a82-41bb-9045-0bfafecd7f10","year":null},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.475320Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:731510e2a9e9e67d70c3815083a32eecf2f4937a4138261fec56299c68110c5e","observation_id":"85665874-10bf-4f86-8a81-52068c30dfcc","resolution":{"observed_at":"2026-08-06T18:37:14.781808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.760583Z","title":"Dual alignment unsupervised domain adaptation for video- text retrieval","venue":null,"work_id":"d39870cc-4892-4451-bc4c-7791abc7345f","year":null},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.480887Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:b6e042378bcd17a77501e9cfc133f57b4e9f00a8a6951ef63852a7e2c95bfc6c","observation_id":"71de438a-9358-470b-accb-70dba9c16c04","resolution":{"observed_at":"2026-08-06T18:37:14.765461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.743939Z","title":"Mixgen: A new multi- modal data augmentation","venue":null,"work_id":"856075c9-bbd0-48be-9004-60ce813ecbe8","year":2023},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.485972Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:8d4c3aa223cfc80d6d22629eb72bd9dbbbd806a23c833eff0c4d36cb64df8d42","observation_id":"5e755984-60dd-47d1-9089-ef25ceb7f0f5","resolution":{"observed_at":"2026-08-06T18:37:14.748736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.727201Z","title":"Mapfusion: A novel bev feature fusion network for multi-modal map construction","venue":null,"work_id":"2fb24001-c126-46be-919e-0b7df2ea60eb","year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.491491Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:bdc898cd6a822ed5e081329bf60ce671513e2953e2fe326beb0704ea85e3b52a","observation_id":"77bf2cbe-f265-4dce-bbfb-aaee999d2c40","resolution":{"observed_at":"2026-08-06T18:37:14.732151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-06T18:37:13.497259Z","title":"Gaussian error linear units (gelus)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.497259Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:ab17edbfd9a2f696e58230d9cb99b80d04a344399474c86ebe556102e9c6de29","observation_id":"37d9903f-bbff-438f-836e-c7e6d377ff26","resolution":{"observed_at":"2026-08-06T18:37:13.497259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.711124Z","title":"Robobrain: A unified brain model for robotic manipulation from abstract to concrete","venue":null,"work_id":"870f6e4a-5224-407f-a521-745fd16f961f","year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.502288Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:935dcbaceddab3e4bb7ebc7590364de8c8e6f0970a64c2c8bd3f7bd0ade9d100","observation_id":"ea79b0ad-483f-46ef-bbb1-0673f0ea3b0c","resolution":{"observed_at":"2026-08-06T18:37:14.716541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.690626Z","title":"Cross-modal implicit relation rea- soning and aligning for text-to-image person retrieval","venue":null,"work_id":"ff1214bd-2523-447b-a06d-7608778e614d","year":2023},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.507508Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:662998aeea8cd1d5df1fd2058dffce70e16e9137ad848d9695b1da24a3c06717","observation_id":"f50bd447-bf4e-4e96-af8a-42645db08538","resolution":{"observed_at":"2026-08-06T18:37:14.698866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.674537Z","title":"En- hancing industrial prognostic accuracy in noisy and missing data context: Assessing multimodal learning performance","venue":null,"work_id":"b440cec5-4983-40ce-81fd-9486d699cf17","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.512559Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:69569c192dbd68a2f2fcba82082055ac31fd5d4007f7bd32faf3e4abeb4918ec","observation_id":"eecdd19d-d9e8-48c8-af83-57aeb708c98d","resolution":{"observed_at":"2026-08-06T18:37:14.679304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.657466Z","title":"Exploring contactless tech- niques in multimodal emotion recognition: insights into di- verse applications, challenges, solutions, and prospects","venue":null,"work_id":"14e181ae-89d9-42c0-b225-e585531f4f80","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.517722Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:22a1f772f5f6c1cfb34eeafb31f721b3969cd492f0d6aa59f530ba5a5d5c0bab","observation_id":"45a10e59-fc49-47c3-b718-23a829dbab3a","resolution":{"observed_at":"2026-08-06T18:37:14.662398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.640081Z","title":"Maple: Multi- modal prompt learning","venue":null,"work_id":"b4ab55ce-d28f-4bbd-9791-968b015e97df","year":2023},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.522485Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:0b1a6ea19659aa31ad738cbc09aea982457bbb19f4625b1166c247eb10ec7757","observation_id":"4ba418a1-379e-40c0-9e56-58e284417763","resolution":{"observed_at":"2026-08-06T18:37:14.645348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.624035Z","title":"The hateful memes challenge: Detecting hate speech in multimodal memes","venue":null,"work_id":"106a6298-5b7d-4a4c-8e10-286ebd88ff59","year":2020},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.527275Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:48bb15604026d6c1e63db2699dc58a151b9ff62999db26b25782e1c80cc67534","observation_id":"562eb04f-e921-4680-8c02-e8238374632f","resolution":{"observed_at":"2026-08-06T18:37:14.628705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.606410Z","title":"Missing modality predic- tion for unpaired multimodal learning via joint embedding of unimodal models","venue":null,"work_id":"04370b27-df00-4bb0-8aa1-ffb68e113616","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.533911Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:7c0c1b8a4a25786ce91b711c6e51201c852615eb261410c417bf87dd70ffffb9","observation_id":"b95bb752-84b3-4e0d-9f23-312d59c22121","resolution":{"observed_at":"2026-08-06T18:37:14.611757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.588436Z","title":"Do you remember? dense video caption- ing with cross-modal memory retrieval","venue":null,"work_id":"f9920b49-c46a-41f6-976a-c69964472c65","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.539597Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:09de5ba1635828e4963213fef5fe8e698a156e1ec22e77a7a8f58ab4f3793097","observation_id":"fb281050-dacd-412d-9d16-631421fc465e","resolution":{"observed_at":"2026-08-06T18:37:14.593348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01120","last_updated":"2025-06-14T00:49:08Z","snapshot_observed_at":"2026-07-06T20:15:40.852454Z","submitted_at":"2025-01-02T07:39:48Z","title":"Retrieval-Augmented Dynamic Prompt Tuning for Incomplete Multimodal Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01120","snapshot_observed_at":"2026-08-06T18:37:13.545125Z","title":"Retrieval-augmented dynamic prompt tuning for incomplete multimodal learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.545125Z"},"links":{"cited_paper":"/paper/2501.01120","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:fdd420f48a87160eb4cc0a6f2146f4a903646050aacb4889b8dc62771f3b0720","observation_id":"dd0e78d9-ab23-42cd-902a-4f3c0eb0a959","resolution":{"observed_at":"2026-08-06T18:37:13.545125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13898","last_updated":"2025-03-06T11:38:00Z","snapshot_observed_at":"2026-08-06T19:09:10.512808Z","submitted_at":"2024-01-25T02:25:23Z","title":"Cross-Modal Prototype based Multimodal Federated Learning under Severely Missing Modality","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13898","snapshot_observed_at":"2026-08-06T18:37:13.551429Z","title":"Cross-modal prototype based multimodal federated learning under severely missing modality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.551429Z"},"links":{"cited_paper":"/paper/2401.13898","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:0586d5c749ef02feb37b019ca98442f548f1422dfb9573b1ea04037463b776c5","observation_id":"0e24097f-3669-49d9-b958-25fe42510cdf","resolution":{"observed_at":"2026-08-06T18:37:13.551429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.571915Z","title":"Multimodal prompting with missing modalities for vi- sual recognition","venue":null,"work_id":"bb876046-4cc4-423e-8025-281b7dadaa3a","year":2023},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.557711Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:5dcc4800cc339cfeba2a46cd5a34c344ecdf82432d36f1db8446a0c565633f53","observation_id":"15120a6f-1ae5-4105-9529-c727bd4d6781","resolution":{"observed_at":"2026-08-06T18:37:14.576772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:13.562777Z","title":"What foundation models can bring for robot learning in manipulation: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.562777Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:f1637c7e0b35a882a2ce6f22dabe02c8ad582b281ce9dd2a568dc34d7e8bc024","observation_id":"5402fef5-b762-4f35-a000-3522a75de606","resolution":{"observed_at":"2026-08-06T18:37:13.562777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.553169Z","title":"How to configure good in-context sequence for visual question answering","venue":null,"work_id":"aff9cd98-a537-4d0f-9783-9fc0c3af016a","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.569460Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:5da5f7d9d04b03e49f9b2e7bf504a1e3aa591fe73f0fe0d2c98948b6147c9d01","observation_id":"75420f2c-28c6-4702-bbdf-9175d31d18ee","resolution":{"observed_at":"2026-08-06T18:37:14.559231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.535404Z","title":"Tackling real-world complex- ity: Hierarchical modeling and dynamic prompting for multi- modal long document classification","venue":null,"work_id":"d1cc9523-088e-4a48-bfc0-d666e57e27fa","year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.575539Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:e7757338dffb552ed897073cdeec93fceffdaced7f547fe8f5a898755f9b0c55","observation_id":"f72ca698-15d8-480e-9f05-dbb355128fd6","resolution":{"observed_at":"2026-08-06T18:37:14.540445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.518300Z","title":"Cross-modal causal relational reasoning for event-level visual question answer- ing","venue":null,"work_id":"7b1fde25-cbfe-49ac-abda-c16afa735cdc","year":2023},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.583735Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:b39dbc35ee946d764774256cc1a23679e482b1c99886f6a1fb3d1070293ee2a7","observation_id":"6de5f2d3-7fb1-4956-9e98-0dae29a73fbf","resolution":{"observed_at":"2026-08-06T18:37:14.523862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:13.589686Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.589686Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:77ffa9ced6545dd7a308cae2b562b798e7580e2bcad8f3d7751e5ee473d6bc4b","observation_id":"ecf6230c-4e78-4039-adc1-6779e87e26a0","resolution":{"observed_at":"2026-08-06T18:37:13.589686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T18:37:13.594952Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.594952Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:9671135fa1b16a820066c77479c18f535e45f8f71a8f1daa8893edfe8f468112","observation_id":"71f7e8d8-50fe-4b47-8f23-a8063d776e71","resolution":{"observed_at":"2026-08-06T18:37:13.594952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.488848Z","title":"Multi-modal modality-masked diffusion network for brain mri synthesis with random modality missing","venue":null,"work_id":"640fe893-9817-4cd0-9b8c-eb2cc6b4d222","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.599767Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:d61257aad8727f846469df81488088a22baedfc095c42f243b024b14a44ea924","observation_id":"7183cab3-a810-4635-8169-5f0b42ae1de3","resolution":{"observed_at":"2026-08-06T18:37:14.493831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.472102Z","title":"Semantically conditioned prompts for visual recognition under missing modality scenarios","venue":null,"work_id":"4800cd43-19cc-4385-8202-09684cbc4344","year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.605667Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:d602a207a5c6ad45529509500f9bbda190e5598122947d312f049afd45ccfad2","observation_id":"1ba48732-092d-4651-8ec7-c2fa7421cc76","resolution":{"observed_at":"2026-08-06T18:37:14.477067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.455541Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"d108b165-c5c0-463c-8d0d-eb0093b75515","year":2021},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.610864Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:8c9eebe192aaf698bc40142dfbcda8e104f8a29331609c0ad9f42de982582096","observation_id":"6352b3aa-7d51-47c2-a24b-560635b775af","resolution":{"observed_at":"2026-08-06T18:37:14.460440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.438361Z","title":"Deep correlated prompting for visual recognition with miss- ing modalities","venue":null,"work_id":"d24ad2b3-9186-4f6e-afe5-32fe788fa9d6","year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.615693Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:381807ff925602aeb5f216a1e1ec23f7ca28a17ebfcb8b915b2d625a7c068c78","observation_id":"bc58cc0d-0697-40b1-8667-55cd64948704","resolution":{"observed_at":"2026-08-06T18:37:14.443089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.422256Z","title":"Drivelm: Driving with graph visual question answering","venue":null,"work_id":"92cb5124-5ea7-4614-9a65-418be758e483","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.620779Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:8e201008c95afff9bee771b35a68b50973a1f4c4aa8c4d2881325df93e5c7c20","observation_id":"771209da-c689-4fc3-82b3-6683c23f9306","resolution":{"observed_at":"2026-08-06T18:37:14.427398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.405557Z","title":"Emotional video captioning with vision-based emo- tion interpretation network","venue":null,"work_id":"8714dcd0-4c43-463b-acb6-541d3e50f640","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.625853Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:910d3916f2726dd113e784d317f9fc16fcf26bb88e25f847b93957cdba636324","observation_id":"01260b47-1eef-4f8e-a123-129ab953052b","resolution":{"observed_at":"2026-08-06T18:37:14.410844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.387586Z","title":"Strong and weak prompt engineer- ing for remote sensing image-text cross-modal retrieval.IEEE Journal of Selected Topics in Applied Earth Observations and Remote Sensing, 2025","venue":null,"work_id":"66d0609c-8397-453d-bd82-646a321cb168","year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.630665Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:3b24808b4cc6b9c02ebb02d971974261f6c903fae464df2b0f61561a91d85a6d","observation_id":"1fffe9f0-fe0f-46db-bbe8-d771d870db0e","resolution":{"observed_at":"2026-08-06T18:37:14.393043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:13.635122Z","title":"Reason- rft: Reinforcement fine-tuning for visual reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.635122Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:62275bf49bb494e496dc4a4680494e02247120023945200b3283a1aa1f736eb8","observation_id":"92552c73-82af-4b1a-848c-296027f52315","resolution":{"observed_at":"2026-08-06T18:37:13.635122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.369898Z","title":"Visualizing data using t-sne","venue":null,"work_id":"b5e33a91-190f-4a08-a959-02f9d194ec24","year":null},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.639953Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:b21aad78fee6d73fb955b4addd4c69924f5199b7329149b8cf84b8810800f58e","observation_id":"84d31d32-1718-4d3c-a2a9-f42ee4972010","resolution":{"observed_at":"2026-08-06T18:37:14.375289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.351828Z","title":"Recipe recognition with large mul- timodal food dataset","venue":null,"work_id":"4de94184-5deb-47fe-9027-15f82dbe0e20","year":2015},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.644572Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:6de3241466e7e857e49bd0c091e5ce157b1c14b2723ebdbdf7ca3998edc25758","observation_id":"23c2961d-ceec-4580-9f68-7511e3dafdec","resolution":{"observed_at":"2026-08-06T18:37:14.357218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07825","last_updated":"2026-02-04T04:12:12Z","snapshot_observed_at":"2026-08-02T14:14:17.863359Z","submitted_at":"2024-09-12T08:15:39Z","title":"Deep Multimodal Learning with Missing Modality: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07825","snapshot_observed_at":"2026-08-06T18:37:13.649742Z","title":"Deep multimodal learning with missing modal- ity: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.649742Z"},"links":{"cited_paper":"/paper/2409.07825","citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:5d7d96f388b71489d11e510e5dc1e50bfe39ff42fed89784437ff02eeef60792","observation_id":"f809d894-284a-4059-b3c4-662e38bbbecc","resolution":{"observed_at":"2026-08-06T18:37:13.649742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.334310Z","title":"Consistent prompt tuning for generalized category discovery","venue":null,"work_id":"2494d63a-ec42-426b-ac82-9be6def24edd","year":2025},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.655121Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:f67d6123a7ee0e60e199654433528e8353543a9c0b808565202a70f379875181","observation_id":"075a79b3-ed4d-4e6e-83d3-59e99431fef5","resolution":{"observed_at":"2026-08-06T18:37:14.339410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.315289Z","title":"Cpt: Colorful prompt tuning for pre-trained vision-language models","venue":null,"work_id":"5898e8ab-508c-4cf8-a619-ef12d08e45c5","year":null},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.661195Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:01f71f249b4881023decb5aa21c91b3ac584862474aaf198d65b4214162a7a84","observation_id":"ae40199f-0210-4065-96e6-775b53ecc9be","resolution":{"observed_at":"2026-08-06T18:37:14.320478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.294970Z","title":"Dept: Decoupled prompt tuning","venue":null,"work_id":"fb3c3cb9-30cf-4abf-bb26-fb7534c1cc21","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.667097Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:cdc396dcbd16129e2049f3bf407dc14390a64d803a8742ef3d55225aa205aeb1","observation_id":"6369c64d-ff7c-4537-8957-96cf86b9c8d1","resolution":{"observed_at":"2026-08-06T18:37:14.303121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.276734Z","title":"Unified multi-modal diagnostic framework with reconstruc- tion pre-training and heterogeneity-combat tuning","venue":null,"work_id":"6fdce26c-03ec-4c33-95a0-60380cd737ff","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.675335Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:06d832b2ba6a51587f5a5cd8da7b62d95a2fbb7067012444ca3b73f77b68c6e3","observation_id":"e91a0685-a5d7-4409-8fed-69eed97b46a2","resolution":{"observed_at":"2026-08-06T18:37:14.281905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.259374Z","title":"Missing modality imagination network for emotion recognition with uncertain missing modalities","venue":null,"work_id":"89484b0f-64b4-4f68-9098-196bae5b64ea","year":2021},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.680855Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:63c5af69a43f8195fc578ad34b88f4f3c0ba4f8253c8ddab62f186eb35e676f7","observation_id":"438d17e5-578e-4684-8783-d4177ebaec3e","resolution":{"observed_at":"2026-08-06T18:37:14.264815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.242847Z","title":"A survey on safe multi-modal learning systems","venue":null,"work_id":"ff7a0041-7370-4b3c-91a1-6b6e706c836f","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.687519Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:cbd007a0b7522e5036df04c61449931a58dd907f0579ddee4c8414bcf911b300","observation_id":"7c16890b-27fe-44c5-8c5e-f0b76d8182ff","resolution":{"observed_at":"2026-08-06T18:37:14.248112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.224947Z","title":"Learning to prompt for vision-language models","venue":null,"work_id":"6739b7e5-6d18-4fde-b582-19131fe9a71d","year":2022},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.694447Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:041a6345576f393e07cb97888ce6b35852af64ff9717ba96ab6b42bdec0bb6fd","observation_id":"0700690a-23b0-44fd-8d01-0ff2678c6e70","resolution":{"observed_at":"2026-08-06T18:37:14.231259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:37:14.205472Z","title":"Dynamic adapter meets prompt tuning: Parameter-efficient transfer learning for point cloud analysis","venue":null,"work_id":"1d07695a-4c02-45ca-a197-4ac2947c1688","year":2024},"citing_paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:37:13.701589Z"},"links":{"citing_paper":"/paper/2507.07802"},"observation_digest":"sha256:d996c233620c938d5308efdfa7d2a796fadb2a252aa37ed085aa8392b19c43ad","observation_id":"1c2519d5-65fd-4724-b933-b92b0e244433","resolution":{"observed_at":"2026-08-06T18:37:14.212711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.07802","last_updated":"2025-07-11T16:27:52Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T11:10:25.494357Z","submitted_at":"2025-07-10T14:28:12Z","title":"Synergistic Prompting for Robust Visual Recognition with Missing Modalities"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":39},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2507.07802."}