{"as_of":"2026-08-18T07:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e2deaddb15a157557d60aaa48ea0f6a284995764297245895f81d4a382c3a50f","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:59:26.645260Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:35:00.960635Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-10T20:35:01.175104Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"cited_work":{"arxiv_id":"2411.15770","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15770","snapshot_observed_at":"2026-08-10T20:35:01.175104Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","venue":"cs.CV","work_id":"9777c5ba-eaee-4470-994c-882e3d416df7","year":2024},"citing_paper":{"arxiv_id":"2501.08131","last_updated":"2025-08-08T15:09:52Z","snapshot_observed_at":"2026-08-15T21:07:19.442312Z","submitted_at":"2025-01-14T14:07:48Z","title":"SAR Strikes Back: A New Hope for RSVQA","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:00.960635Z"},"links":{"cited_paper":"/paper/2411.15770","citing_paper":"/paper/2501.08131"},"observation_digest":"sha256:f1cde9f38da04560e2eacf021a6cbdb0f887b074e116759bcd2e3a39917f40c8","observation_id":"aa4d9c6a-15f4-4bf5-9117-8c6aa52eac8a","resolution":{"observed_at":"2026-08-10T20:35:01.182630Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.15770/citation-record","integrity":"/paper/2411.15770/integrity","json":"/paper/2411.15770/citation-record.json","paper":"/paper/2411.15770"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:27.176178Z","title":"Lawrence Zitnick, and Devi Parikh","venue":null,"work_id":"7def595c-9188-438f-91f0-d92ccfa390e6","year":2015},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.468524Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:6887dd1617345194c9992c8da7f623591164624f4977474d98ce8c9b151d54a7","observation_id":"d2813d7c-b63a-4f92-bd27-ae2910e1cf01","resolution":{"observed_at":"2026-08-12T13:59:27.179818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:27.165433Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover classification","venue":null,"work_id":"55e1e895-bc0c-4a7c-adaf-2af152bcf4cb","year":2019},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.473995Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:3e116c958d1475a04acf889635b613915c73afeded5a62c37534817acb78dd17","observation_id":"bf902116-28df-4fee-9cc9-80b474d678f0","resolution":{"observed_at":"2026-08-12T13:59:27.169269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:27.154704Z","title":"Three-dimensional visualized urban landscape planning and design based on virtual reality technology.IEEE Access, 8:149510– 149521, 2020","venue":null,"work_id":"eb8e975b-fd65-41d8-8466-5dfb32ec1728","year":2020},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.479365Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:8626da80b509a4088cc2d55d5d7995f60bdf6f0415bfe11f306db313d7fd96fa","observation_id":"ebb77bb6-9808-4600-9ca9-1ed42afc06b3","resolution":{"observed_at":"2026-08-12T13:59:27.158813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:27.142687Z","title":"A review of remote sensing for environmental monitoring in china","venue":null,"work_id":"e188924e-e677-42d6-9b42-4b47e771f7b0","year":2020},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.483833Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:00d6faec1e53a583551bd2626d6f5af9e8a56f5c3ce38ea4b946b864d151473d","observation_id":"3df302a7-a0b1-4ad1-94d9-e8ee8503ea55","resolution":{"observed_at":"2026-08-12T13:59:27.147678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:27.131339Z","title":"Remote sensing in multirisk assessment: Improving disaster preparedness.IEEE Geo- science and Remote Sensing Magazine, 5:53–65, 2017","venue":null,"work_id":"43fa16fd-2624-48d6-9af3-6575a4a73e59","year":2017},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.488072Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:460d0d8fc80ecef04f193922d2113aa7e1f2a77359d3a5467fe1d5bac6e6d243","observation_id":"1ab456fe-7049-4bd4-af9b-fe585ccb1285","resolution":{"observed_at":"2026-08-12T13:59:27.134998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:27.119482Z","title":"Rsvqa: Visual question answering for remote sensing data.IEEE Transactions on Geoscience and Remote Sensing, 58:8555–8566, 2020","venue":null,"work_id":"cd07c656-d305-46be-ad00-419623e7aa2a","year":2020},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.492183Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:b165e3ca27f73d8d0f7c6dbe29d7546bfcd9528f9fbac9dbbd008ee62d56c5ca","observation_id":"0f23c616-2813-424b-9957-b0659706fe75","resolution":{"observed_at":"2026-08-12T13:59:27.123791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:27.108637Z","title":"Mu- tual attention inception network for remote sensing visual question an- swering","venue":null,"work_id":"fb597bfa-ca7f-4ab7-b46e-fe8791b587e5","year":2022},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.496442Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:aa3dba24048e9a5efe874d875d91878816a22984d995fd7b580b5cda77c88daf","observation_id":"f350e75e-12a8-45d9-be93-b00b3b523f43","resolution":{"observed_at":"2026-08-12T13:59:27.112531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:27.096920Z","title":"Hrvqa: A visual questionansweringbenchmarkforhigh-resolutionaerialimages","venue":null,"work_id":"6643c428-a96a-44a1-b601-49a367c030ba","year":2024},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.500843Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:7a6d4b30f2cef654ecff7140369916e50d7aa761acaf21294c7adcd720cfc994","observation_id":"a0c9fe97-3d42-4e68-82e9-28b848ebe1cc","resolution":{"observed_at":"2026-08-12T13:59:27.100766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:27.085455Z","title":"Prompt-rsvqa: Prompting visual context to a language model for remote sensing visual question answering","venue":null,"work_id":"2beb0aed-5249-4237-ae33-c34a5c0d87b1","year":2022},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.504795Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:567b3c364c3cf412cb632aaa0b6e435656466bd017b1b1e9b83e99505a7495cb","observation_id":"e5c03adf-d806-419b-b83f-5bbc601a376e","resolution":{"observed_at":"2026-08-12T13:59:27.089616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:27.072858Z","title":"Multistep question-driven vi- sualquestionansweringforremotesensing","venue":null,"work_id":"b33da4d0-a2d9-4641-bde2-238204720463","year":2023},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.508906Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:aed5512e8861e0688720f0c4a76d8bebe21b02e1b75a597a8de351e8f88f6014","observation_id":"05d88c6a-4f36-406f-94f0-2794826cca45","resolution":{"observed_at":"2026-08-12T13:59:27.077143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:27.060026Z","title":"Bi-modal transformer-based approach for visual question answering in remote sensing imagery","venue":null,"work_id":"670c417e-d167-4430-a5cc-29e452a1182e","year":2022},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.513110Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:314d051f862d9932393df0d4b88a719987b5a77e172ec70675c75daeab30af71","observation_id":"23796d60-bf72-4a54-9f8f-8105716d6b4a","resolution":{"observed_at":"2026-08-12T13:59:27.064161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:27.047956Z","title":"From easy to hard: Learning language-guided curriculum for visual question answering on remote sensing data.IEEE Transactions on Geoscience and Remote Sensing, 60:1–11, 2022","venue":null,"work_id":"cb01233a-785f-43d1-9e97-7b2f656cacd6","year":2022},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.517582Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:d5f22d4ac68db698e7b7789d12c1c203d8650efbdc21e05d36865945a6718eea","observation_id":"5d829128-e2bb-4097-8a28-26f1b4ffbb48","resolution":{"observed_at":"2026-08-12T13:59:27.052067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:27.033701Z","title":"Aspatialhierarchicalreasoningnetwork for remote sensing visual question answering.IEEE Transactions on Geoscience and Remote Sensing, 61:1–15, 2023","venue":null,"work_id":"5e32b2df-a840-4d68-a697-446e0fd415a4","year":2023},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.521498Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:cde45f5cdb94a0fb037de504b834b7df40790c6b176d2b131c953a2c0f23b8d8","observation_id":"f7e0171b-2718-47d8-8c7a-f6cd41fe698d","resolution":{"observed_at":"2026-08-12T13:59:27.039017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:27.022493Z","title":null,"venue":null,"work_id":"177e807a-fe0e-4b81-903b-762f640bb997","year":2023},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.525869Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:9bf44422b136d7df1b0fb41bfcbe9a3875986a359194f76678d2121845af6ae7","observation_id":"55050a6d-41e6-4719-bb2b-b57bf6a2adc5","resolution":{"observed_at":"2026-08-12T13:59:27.026253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:27.011360Z","title":"Change detection meets visual question answering.IEEE Transactions on Geoscience and Remote Sensing, 60:1–13, 2022","venue":null,"work_id":"e42abace-c5fb-4d2b-93a7-48bf21fc2806","year":2022},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.529544Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:9f87b3290d7e1d700d13167fbf8d90ec7ee1b2ff528f232ddcddba6fb3bbcf52","observation_id":"42e1e073-d679-4db2-90c3-8316e7076018","resolution":{"observed_at":"2026-08-12T13:59:27.015382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.999100Z","title":"Floodnet: A high resolution aerial imagery dataset for post flood scene understand- ing","venue":null,"work_id":"c3063864-d969-4799-a8af-fcc53cd508a6","year":2021},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.533486Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:e081e214b624f93358535cacb1f260d0fc5abc65ed86135d3e779381ca686693","observation_id":"87c099c1-032f-47a8-835c-8e119ff65c22","resolution":{"observed_at":"2026-08-12T13:59:27.003060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.987348Z","title":"Category-oriented localization distillation for sar object detection and a unified benchmark","venue":null,"work_id":"45377cd0-c94c-4e08-9ec8-9a7fe33fc6bc","year":2023},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.537504Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:00fe6409a8c75b9cbba28e89857708e7b44a8f8dda253e542c6d51d11071e3e1","observation_id":"46c2dcf0-1555-458e-b6fa-2c09717f6122","resolution":{"observed_at":"2026-08-12T13:59:26.991257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.975277Z","title":null,"venue":null,"work_id":"7ae22694-1ab8-411d-ac55-e273d307b8b3","year":2016},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.541467Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:91e35953ea58a4b2d415f2ff94fa35dddd8346e5c3b27024ad71aa6d15e0fe19","observation_id":"dfc744e3-2654-4d89-afe7-e29af32221af","resolution":{"observed_at":"2026-08-12T13:59:26.979304Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.963624Z","title":"Multimodal classification of remote sensing images: A review and future directions.Proceedings of the IEEE, 103:1560–1584, 2015","venue":null,"work_id":"75a85997-4af3-4b87-81ae-f0ed11bcb8bc","year":2015},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.545217Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:2c50b5c5ef93c831c16548f1872d13d718b2f9845a7a797825c4d2aa3a12ad1e","observation_id":"d46c1292-833c-4c7d-b740-0ad7a3cc39f1","resolution":{"observed_at":"2026-08-12T13:59:26.967757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.950480Z","title":"Data fusion and remote sensing: An ever-growing relationship","venue":null,"work_id":"ba12fedd-6a20-4868-8217-ba0986a9ca0d","year":2016},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.548844Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:6db8443cc25d83e3bad8ccc3d95b029a44945706e9cde1c21d7820ecb8e19645","observation_id":"bdf1ac78-3b9c-4848-bd12-a46a766bd61a","resolution":{"observed_at":"2026-08-12T13:59:26.955668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.937680Z","title":"Multitemporal very high resolution from space: Outcome ofthe2016ieeegrssdatafusioncontest","venue":null,"work_id":"9dc1bc71-6190-4fd3-a1fd-2b4313baf581","year":2017},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.553055Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:e8e716fdaa35581037d94a39c083c91b802e6d3e16ea4549179c53bdd37a176d","observation_id":"24b08f9f-7263-4c1d-8834-4d145c9b78be","resolution":{"observed_at":"2026-08-12T13:59:26.942570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.926022Z","title":null,"venue":null,"work_id":"6a7d444d-68ad-4845-86fe-941d635c6996","year":2022},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.557231Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:56b11eb9e6b975725ba4b325adfcbda9a0c268c632031de058d4041cf144b3da","observation_id":"b15da479-029d-4dc4-ade0-4234e2227d10","resolution":{"observed_at":"2026-08-12T13:59:26.929715Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.913519Z","title":"InternationalJournalofAppliedEarthObservationand Geoinformation, 109:102769, 2022","venue":null,"work_id":"1c993314-8124-431e-aaff-882adf8afe0c","year":2022},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.561508Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:517d77232b747f6e7f3882e23b9994d68da0d1f8f5b7ff38c8f1dbb3843a95a1","observation_id":"c9933815-6bc1-46f2-8e60-d35dc41f7992","resolution":{"observed_at":"2026-08-12T13:59:26.918310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.901892Z","title":"Unsupervised domain adaptationbasedonprogressivetransferforshipdetection: Fromoptical to sar images.IEEE Transactions on Geoscience and Remote Sensing, 60:1–17, 2022","venue":null,"work_id":"2ec7bbd5-6ae7-4ac1-a15f-de84e343dabc","year":2022},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.565768Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:3f98e0cb8d541a9ce4c0b3e8b50567343a95ed65cb468198ec91b5d2442b96e3","observation_id":"b3db5d12-d6b3-4229-bc1e-365d6443abdd","resolution":{"observed_at":"2026-08-12T13:59:26.906092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.891042Z","title":"Askyourneu- rons: A neural-based approach to answering questions about images","venue":null,"work_id":"a1037761-3206-4541-bc38-332967708633","year":2015},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.569425Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:4fcbf3768bb248dad85dff73a97b2d19fa8a1f0d5f96d22203b7f5c214233ba6","observation_id":"d097bdf2-120d-46af-be0b-16cf2a5ca650","resolution":{"observed_at":"2026-08-12T13:59:26.894921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.879483Z","title":"Are you talking to a machine? dataset and methods for mul- tilingual image question","venue":null,"work_id":"2c74ded0-4368-4fc1-8677-828e0401f353","year":2015},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.573251Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:6c957ea0ff7c50fb25d1fa0f44f723241f0dcaae302e20b9933de8010b6b6c8e","observation_id":"e06a810c-c9ca-47d3-9c3f-a6c72bba2682","resolution":{"observed_at":"2026-08-12T13:59:26.883686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.577364Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.577364Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:12fa8a0cb0801af304f1cdd9c2db82efb97e0a62654b14a9b033aeed4c52f758","observation_id":"0a7a1784-f0f7-4a02-8a85-07782f5cebcf","resolution":{"observed_at":"2026-08-12T13:59:26.577364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.860967Z","title":"Where to look: Focus regions for visual question answering","venue":null,"work_id":"964a66eb-edfa-4271-9c05-3209b62cfefa","year":2016},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.581350Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:2aa0e0e0ea71912561797044e37ccbb1a22417a4d884bda94f9db50eea9dad6d","observation_id":"806430b8-8801-4db7-b78e-da4c99367e32","resolution":{"observed_at":"2026-08-12T13:59:26.865686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.850170Z","title":"Deepmodular co-attention networks for visual question answering","venue":null,"work_id":"9b82b5dd-4fd4-4405-b194-0123d6260fcd","year":2019},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.585088Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:d53f113c16d91ad67653647ca6e11da03b52cb2b2a52d090261b88a046022a49","observation_id":"fba079e0-5d49-4fb0-8c83-5b9dca03953f","resolution":{"observed_at":"2026-08-12T13:59:26.853857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.08276","last_updated":"2022-06-01T16:45:09Z","snapshot_observed_at":"2026-08-16T17:41:33.408972Z","submitted_at":"2021-11-16T07:55:26Z","title":"Multi-Grained Vision Language Pre-Training: Aligning Texts with Visual Concepts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.08276","snapshot_observed_at":"2026-08-12T13:59:26.588729Z","title":"Multi-grained vision lan- guage pre-training: Aligning texts with visual concepts.arXiv preprint arXiv:2111.08276, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.588729Z"},"links":{"cited_paper":"/paper/2111.08276","citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:c24c2bc562e1c1094b6ea3d03cb7abe468b70e05b3047cbed7e421fa3710d068","observation_id":"0bb39779-06a4-4b32-8249-778652e0c5d6","resolution":{"observed_at":"2026-08-12T13:59:26.588729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.02570","last_updated":"2015-11-12T01:10:38Z","snapshot_observed_at":"2026-08-14T22:24:18.672290Z","submitted_at":"2015-11-09T05:25:57Z","title":"Explicit Knowledge-based Reasoning for Visual Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.02570","snapshot_observed_at":"2026-08-12T13:59:26.592898Z","title":"Explicit knowledge-based reasoning for visual question answer- ing","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.592898Z"},"links":{"cited_paper":"/paper/1511.02570","citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:83a08ecbb0b4a134aa140f8e6e19c153a409f4673518444ed3f85934daf8f989","observation_id":"7aa2cd06-5d97-4abb-b1c6-b1b24690ec9c","resolution":{"observed_at":"2026-08-12T13:59:26.592898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.838514Z","title":"Ask me anything: Free-form visual question answer- ing based on knowledge from external sources","venue":null,"work_id":"43180913-e61d-4051-9149-17fbe74a1bf6","year":2016},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.596937Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:549554c7a322f063957ce2ec496cccc37d6e3a9e961a93d220d49c6de3f18004","observation_id":"c7c12729-6a99-4acb-9a97-640f2682048e","resolution":{"observed_at":"2026-08-12T13:59:26.842335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-12T13:59:26.600807Z","title":"Clip: Learningtransferablevisualmodelsfromnatural language supervision.arXiv preprint arXiv:2103.00020, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.600807Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:c661976ccf09ede74f9705ba94438eb0e51bac778105f0ec246a340a2e9e5706","observation_id":"7e22169b-dbb1-4cf5-a3f4-dec09f731ea3","resolution":{"observed_at":"2026-08-12T13:59:26.600807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.827370Z","title":"Imagenetclas- sification with deep convolutional neural networks.Advances in neural information processing systems, 25, 2012","venue":null,"work_id":"b3dc9d58-bbb7-44bc-b080-b04df39b755b","year":2012},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.604677Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:b01efea2db73416967303a0c6feb16b40806c59417c09b18a9a85914e1e6a6c6","observation_id":"ee52684b-590f-4f26-8039-9e6ce968a85e","resolution":{"observed_at":"2026-08-12T13:59:26.831434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.815828Z","title":"Gen- erative adversarial networks.Communications of the ACM, pages 139– 144, 2020","venue":null,"work_id":"1e4cb04b-3eec-48b8-97b5-d38bbc933ba9","year":2020},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.608278Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:a9960e45d171c98ffb8c3a44a9ba053c2b1b752ca15ac23033784675cfeeb448","observation_id":"ccb0b86e-6da5-45d3-9b54-8fd739d3129e","resolution":{"observed_at":"2026-08-12T13:59:26.819984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.804571Z","title":null,"venue":null,"work_id":"6aca7dac-3e78-40a7-b055-3c4345a58aed","year":2020},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.612623Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:c0d520fe2ef8af5fa3ab22955d0137a2fe2882489b15897ad780c62467bba479","observation_id":"022d0ea6-579c-4529-8647-d65ed32ab5ab","resolution":{"observed_at":"2026-08-12T13:59:26.808152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.792956Z","title":"ISPRS Journal of Photogrammetry and Remote Sensing, 158:11–22, 2019","venue":null,"work_id":"048348dc-4cca-4e4d-93b4-7ce489a074d4","year":2019},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.617280Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:41d9a694192715a3c528c25c633fdab15b7b50af67cc44998faf5214ebd1f7f9","observation_id":"2c353c6b-099f-48c9-95d0-799bb831f9c3","resolution":{"observed_at":"2026-08-12T13:59:26.796996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.780651Z","title":"Multi-temporal sentinel-1 and-2 data fu- sion for optical image simulation.ISPRS International Journal of Geo- Information, 7:389, 2018","venue":null,"work_id":"63515b90-d414-49e9-93fb-d5fa08149b0b","year":2018},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.620899Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:19298e8545b4cf036a48b9ccd3b502dfd043ad9150ab98524638f504c8fee7d2","observation_id":"9662e955-2a56-434f-bd12-c0eb3848599d","resolution":{"observed_at":"2026-08-12T13:59:26.785404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.767520Z","title":"Cloud removal with fusion of sar and optical images by deep learning","venue":null,"work_id":"952fb4d3-c5af-4dc1-a4b0-aaf6edb30fe9","year":2019},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.624599Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:0870b20300ca405c2e4d0ca04674316b759e93d08f70f81b12f07c4d8b3749c9","observation_id":"e81e87f3-8f74-48df-a21d-6d385096275c","resolution":{"observed_at":"2026-08-12T13:59:26.772133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.755842Z","title":null,"venue":null,"work_id":"e1393548-3347-4260-a0fb-4be0ef679c2e","year":2021},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.629415Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:fbb4e69e55ac28a590cbe24ea5f5cfa5e24ca98f6cd08244329733e8e7a6a7ad","observation_id":"5230b05e-2201-4670-9269-def9cf46002a","resolution":{"observed_at":"2026-08-12T13:59:26.759625Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.744167Z","title":"A conditional generative adversarial network to fuse sar and multispectral optical data for cloud removal from sentinel-2 images","venue":null,"work_id":"7c56434a-97dd-4c51-a3cb-0d920438816c","year":2018},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.634062Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:ab25774a2d3bc1717c17ff9c7d091d55fdcf626a8cf94d77c26fa0fd5357d52a","observation_id":"203dce97-df96-41b5-a7c0-46ed36a80175","resolution":{"observed_at":"2026-08-12T13:59:26.748359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.08259","last_updated":"2021-04-25T04:11:55Z","snapshot_observed_at":"2026-08-16T18:38:53.578530Z","submitted_at":"2021-03-15T10:22:46Z","title":"The QXS-SAROPT Dataset for Deep Learning in SAR-Optical Data Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.08259","snapshot_observed_at":"2026-08-12T13:59:26.637809Z","title":"The qxs-saropt dataset for deep learning in sar-optical data fusion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.637809Z"},"links":{"cited_paper":"/paper/2103.08259","citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:022a4ee9fbadc9038b9f54792e1926719658483a9880b7a190d630dbac66c850","observation_id":"4b3ac976-be08-409f-b5f2-d58c71552462","resolution":{"observed_at":"2026-08-12T13:59:26.637809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.731955Z","title":"Trar: Routingtheatten- tion spans in transformer for visual question answering","venue":null,"work_id":"eff33350-02be-41db-a063-5aa5f31f7a84","year":2021},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.641420Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:62b67153eceb1c7d52915f4d9668c10d577d4d2245638f5261614b7972868f9b","observation_id":"310596b4-5208-40ba-a63f-7fc6ae50a325","resolution":{"observed_at":"2026-08-12T13:59:26.736269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:59:26.717255Z","title":"Rsadapter: Adapting multimodal modelsforremotesensingvisualquestionanswering","venue":null,"work_id":"fad9d6e0-e54d-44c4-81a6-ebda156c7522","year":2024},"citing_paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T13:59:26.645260Z"},"links":{"citing_paper":"/paper/2411.15770"},"observation_digest":"sha256:fc11b3a53d517337c4afa3160842b304ca6dfda1a2b190e3975d0d437415a95a","observation_id":"a313ab84-f333-4913-ba5e-60129cc56f29","resolution":{"observed_at":"2026-08-12T13:59:26.723414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.15770","last_updated":"2025-01-13T14:00:18Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T13:53:03.732569Z","submitted_at":"2024-11-24T09:48:03Z","title":"Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":34},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 1 inbound Pith citation observation for arXiv:2411.15770."}