{"as_of":"2026-08-14T10:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aaebf71c6cdf75a3155918701553a0f1a73f4d681dd2aa998dfbc3ba565e7605","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:21:13.367274Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T13:48:08.135538Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T14:10:29.700682Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"cited_work":{"arxiv_id":"2507.05887","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.05887","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ma et al","venue":null,"work_id":"325ac7bb-56ef-469e-973b-e06c936d74ca","year":2025},"citing_paper":{"arxiv_id":"2604.13654","last_updated":"2026-04-15T09:20:02Z","snapshot_observed_at":"2026-07-06T23:01:37.207817Z","submitted_at":"2026-04-15T09:20:02Z","title":"Vision-and-Language Navigation for UAVs: Progress, Challenges, and a Research Roadmap","version":1},"reference_index":143,"source":"pdf_text","source_observed_at":"2026-05-10T13:48:08.135538Z"},"links":{"cited_paper":"/paper/2507.05887","citing_paper":"/paper/2604.13654"},"observation_digest":"sha256:729c4dcb2691c18c1cdf7604508f6a5d2838187c0390bc4be542a984a2dfdef2","observation_id":"aac5cf92-72e5-47c9-8fb2-6a913f272e42","resolution":{"observed_at":"2026-05-10T14:10:29.702309Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.05887/citation-record","integrity":"/paper/2507.05887/integrity","json":"/paper/2507.05887/citation-record.json","paper":"/paper/2507.05887"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:14.040480Z","title":null,"venue":null,"work_id":"1fb3de34-baba-45a7-8747-614df4851a5f","year":2022},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.143569Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:1650c796b5cc90107847875608f06931cd7713190584dd28460e4a90de4fe82a","observation_id":"660a1f91-b8c4-4537-acd0-de3ec6c2ea49","resolution":{"observed_at":"2026-08-06T19:21:14.042976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:14.033051Z","title":null,"venue":null,"work_id":"06aa9165-832f-4312-85ac-70d62d83391d","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.147351Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:b4b7bbc4c2c6553a459ba8b50a168243cf398dca47c2d9688c74f917f53807ae","observation_id":"4fe231dc-6394-4cb4-9b75-a67c53ee0d07","resolution":{"observed_at":"2026-08-06T19:21:14.035632Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:14.026600Z","title":null,"venue":null,"work_id":"59d2a066-f134-40b2-b42f-8226b71abea9","year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.150054Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:3e7ccf0ce0ab1b42a9886f74722a97dfb8831df6b6289666adb3defc10369675","observation_id":"08392f80-3662-40d5-913d-2dac8a2d35dd","resolution":{"observed_at":"2026-08-06T19:21:14.029030Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09478","last_updated":"2023-11-07T18:25:48Z","snapshot_observed_at":"2026-08-06T12:38:03.720232Z","submitted_at":"2023-10-14T03:22:07Z","title":"MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09478","snapshot_observed_at":"2026-08-06T19:21:13.156391Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.156391Z"},"links":{"cited_paper":"/paper/2310.09478","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:847975ead9aabab4a8dda60a0c28c5971f73ba8383e69a0c65c242137c4d314d","observation_id":"44fe557e-3584-4247-85d4-9a04de3c28ce","resolution":{"observed_at":"2026-08-06T19:21:13.156391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.159336Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.159336Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:90bbc1b1e4abce6aebd0cd84e9fa7e35ba3615243768dc7ba5470846413b2e79","observation_id":"990c18ce-a9d2-4dda-815c-ee0dfdd012f5","resolution":{"observed_at":"2026-08-06T19:21:13.159336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10764","last_updated":"2021-12-20T18:59:59Z","snapshot_observed_at":"2026-08-13T17:11:52.200632Z","submitted_at":"2021-12-20T18:59:59Z","title":"Mask2Former for Video Instance Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10764","snapshot_observed_at":"2026-08-06T19:21:13.164766Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.164766Z"},"links":{"cited_paper":"/paper/2112.10764","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:1565a1afeac2ba414e1a82e7b87051b0fd71e04a27b3f4800008e9387d097f83","observation_id":"87b8979b-f055-487d-850c-6ce6b719beea","resolution":{"observed_at":"2026-08-06T19:21:13.164766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:14.007060Z","title":null,"venue":null,"work_id":"5994a47e-a4b2-4292-b3a8-42718d04598a","year":2017},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.167299Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:34607fb8c07759f85473341f5106e54387fe25381ad42ecfbaf8d502d395a7f3","observation_id":"ab24024a-4d56-43e4-bd9d-10fcb4f55991","resolution":{"observed_at":"2026-08-06T19:21:14.009573Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T19:21:13.169862Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.169862Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:bcf4b47f7baa76ccda49495ed9cfd901ca558c64809b464071517ad65f7db8cc","observation_id":"ca29ec16-60a7-46b2-afc1-3e144705fa15","resolution":{"observed_at":"2026-08-06T19:21:13.169862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:14.000330Z","title":null,"venue":null,"work_id":"bf2a7e1a-d18a-4369-8b26-fe56e91af1c2","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.172240Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:c980868972af7ba5c8f21adcd867b99073bb0e2258e81353c1f3e1483d2a346d","observation_id":"88bfb066-6fcd-4b11-8de4-449e69f7987c","resolution":{"observed_at":"2026-08-06T19:21:14.002689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.994049Z","title":null,"venue":null,"work_id":"12ba3d3b-54b7-4bbc-93a5-46b6793e4e75","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.175292Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:d97bc0cc6d386e5ffc94e69b37aa7789fff5d7d4c01dd7e74804b2002e2b1ba0","observation_id":"80b4fd08-4977-473b-840e-8ea585e4cf04","resolution":{"observed_at":"2026-08-06T19:21:13.996422Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.985477Z","title":null,"venue":null,"work_id":"b5e67958-5a89-4ff0-a2c4-80317fd0811d","year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.177848Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:aad2901359431e9a1ab81a504490e8f5963e1119af551fd2646d03fe891b3ad2","observation_id":"98abd4af-a645-40ab-8820-57cade6dc2eb","resolution":{"observed_at":"2026-08-06T19:21:13.988823Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.977879Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":"0e28fe08-a0b3-4450-9a8f-f9a209dfd2c8","year":2022},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.181509Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:987800af7b168e25500c3c6a38699d8ced28a86c99f4b7b13a146ba693dbac46","observation_id":"d52040e1-bb1a-4e0d-a888-2d550952178e","resolution":{"observed_at":"2026-08-06T19:21:13.980544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.185096Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.185096Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:015694332b4bb281ea85026caeef1a8564549678dfc92a0b6589e8207c52434c","observation_id":"2abdf2c8-bf7f-4555-9742-abd655a3e995","resolution":{"observed_at":"2026-08-06T19:21:13.185096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15266","last_updated":"2023-07-28T02:23:35Z","snapshot_observed_at":"2026-08-13T10:45:48.484753Z","submitted_at":"2023-07-28T02:23:35Z","title":"RSGPT: A Remote Sensing Vision Language Model and Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15266","snapshot_observed_at":"2026-08-06T19:21:13.189322Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.189322Z"},"links":{"cited_paper":"/paper/2307.15266","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:89f606758c1ab1f3b3ac9dc74cdf5f6b3b3630933f7288dba297641ecabe1706","observation_id":"4e9ac6fd-9126-4258-8354-b240f88382ba","resolution":{"observed_at":"2026-08-06T19:21:13.189322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.970455Z","title":null,"venue":null,"work_id":"aea4f612-8854-48d5-918d-79f53bfb6f24","year":2020},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.192202Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:cd4b50e1d2d84c9cfd5b5350c3b4fe11ef7ce55cd1065b5368b1f38282fd618e","observation_id":"65dd5862-7f1d-4773-a7f2-cdb1b5ce76bb","resolution":{"observed_at":"2026-08-06T19:21:13.972737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.962931Z","title":null,"venue":null,"work_id":"63925813-8014-490f-b864-e97b0e706572","year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.196080Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:c681b7cb5ebdfd93a968cf41eb9cfbec31b3376c88eb46fc4fa7d4eab06b4eeb","observation_id":"4a153714-2a6b-4318-88bc-8c7df6ae1895","resolution":{"observed_at":"2026-08-06T19:21:13.965643Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.949039Z","title":null,"venue":null,"work_id":"84975a7a-4399-4717-a41d-242b0cf21dc5","year":2020},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.202533Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:ebc13be7ba3e973fe60467cbd19cec49cdd77dccfd48ec2df0adaf551fc0bce1","observation_id":"992e79f1-7e66-4435-b192-acc3c1158f6c","resolution":{"observed_at":"2026-08-06T19:21:13.951410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.941160Z","title":null,"venue":null,"work_id":"1022a0e8-ec7d-48f7-b5d7-55ba7972f189","year":2020},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.205579Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:dd617a85d693fbd4480bd0947d24709fe523dceeaa0405ee5c70a84d2bf6cc63","observation_id":"c5205458-7692-45d3-97ee-a1885b95543d","resolution":{"observed_at":"2026-08-06T19:21:13.943794Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.956332Z","title":"In Proceedings of the 32nd ACM International Conference on Multimedia","venue":null,"work_id":"5feb4a7f-1c04-41d8-b784-c64afb1cf05e","year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.199960Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:4c5dc10266afcfbd968b63b0348e4b63b8f2a4cb3fed8309247e3638b9115191","observation_id":"006fde85-9844-47a7-9dd6-4e7868bda8de","resolution":{"observed_at":"2026-08-06T19:21:13.958947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.928112Z","title":"Berg, Wan-Yen Lo, Piotr Dollár, and Ross Girshick","venue":null,"work_id":"c5c6a898-9fbb-4aaf-b879-b6a7d55593bf","year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.211572Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:189ba945253f0ebe2bf57bbbcc3a354828ce7584aa89b2e1d4dc812d6afda5dc","observation_id":"4ad76e4e-2a31-4744-a110-ea7c2bdb28c0","resolution":{"observed_at":"2026-08-06T19:21:13.930986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.919498Z","title":null,"venue":null,"work_id":"31598afa-97ad-4817-b25a-dbea51a0b2ca","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.214187Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:d5362f3872537647ec23fddd9d0feb2f08572eb8bee8417985f041dce236b0a3","observation_id":"15774070-291f-4f9d-ab02-93be78c868f9","resolution":{"observed_at":"2026-08-06T19:21:13.921871Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.934959Z","title":null,"venue":null,"work_id":"93fd0eb3-1b5a-4174-b25b-d7a3de18a6f8","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.208979Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:9e3192b88f75b0ddfcd8a62bbd454c5d80a949dde31ecdb3fe5239cd60386f84","observation_id":"ce00f0bb-c9b0-4bf2-8141-86ad6f7f1659","resolution":{"observed_at":"2026-08-06T19:21:13.937372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.907107Z","title":null,"venue":null,"work_id":"fb59d67f-b61e-481b-946d-63597490405f","year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.219540Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:3dd08ba66d5b39bb412ad9277d02bc20aa317c9ec6995ab50761ce934410063a","observation_id":"27f1a8d1-5b89-4874-9576-e14d1bcd213e","resolution":{"observed_at":"2026-08-06T19:21:13.909566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.900208Z","title":null,"venue":null,"work_id":"0c05e049-fe5d-4884-86c8-f1c9a71a15e7","year":2018},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.221724Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:65bbf9ca2cc0bfa96a838954ff674e9cd6ce4e4141b12592b55ee7abee29fc72","observation_id":"0f322e28-3588-4940-bf27-e0635665978a","resolution":{"observed_at":"2026-08-06T19:21:13.902724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.913432Z","title":null,"venue":null,"work_id":"a2c46691-b62d-4949-9e2a-4292b61160ad","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.216889Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:810164df466b28b5178e15baa68f95aa8cb13fe46ad7cec08358b0584d7e325f","observation_id":"29daef95-d187-420b-9b1e-e046e5f19aff","resolution":{"observed_at":"2026-08-06T19:21:13.915729Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.892049Z","title":null,"venue":null,"work_id":"fadfe935-92a0-4a12-9378-c38175c4002c","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.227452Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:1f66cf22a0aa8d8697a43678cf9acfdd0896582da9dc07874acb49de13d9e9dc","observation_id":"dcd04b3d-21f1-466b-acc8-f9e011286240","resolution":{"observed_at":"2026-08-06T19:21:13.894271Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.885819Z","title":null,"venue":null,"work_id":"f1a9bfa5-6706-4303-a20a-4ef124ffeb15","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.230510Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:f529c78657caca5357434ea9703d709526744dc357c9810a43bfc9f37e509d88","observation_id":"53d83f55-59a3-440b-b250-de80680836cf","resolution":{"observed_at":"2026-08-06T19:21:13.888100Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07575","last_updated":"2023-11-13T18:59:47Z","snapshot_observed_at":"2026-08-13T14:59:44.917623Z","submitted_at":"2023-11-13T18:59:47Z","title":"SPHINX: The Joint Mixing of Weights, Tasks, and Visual Embeddings for Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07575","snapshot_observed_at":"2026-08-06T19:21:13.224734Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.224734Z"},"links":{"cited_paper":"/paper/2311.07575","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:444b8728fdfb9de52544451cecc56dfbbdc578a23fc17440dc5c50b334e73637","observation_id":"43f7876a-9f76-4b38-b789-214e274fef8a","resolution":{"observed_at":"2026-08-06T19:21:13.224734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.871859Z","title":null,"venue":null,"work_id":"aabe189f-224e-4c87-a5b0-cddc22fbde16","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.237360Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:451f56145936d19043685594e4c2de21e035e2b5396aa2e39ff24b5b955d81c5","observation_id":"4fee696a-b798-4960-bb9c-5f73414d7e5b","resolution":{"observed_at":"2026-08-06T19:21:13.874721Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.864384Z","title":null,"venue":null,"work_id":"69cca589-87a4-4ce5-8aa0-aea6ebe91cd5","year":2020},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.240906Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:baad2c95bb955f47873637d0fff99251dad66e9b0e69b2c09921bacbafcf4e44","observation_id":"db180228-8e0b-48f6-9043-9cb10f3825c7","resolution":{"observed_at":"2026-08-06T19:21:13.866702Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.878709Z","title":null,"venue":null,"work_id":"f0b855e8-7716-4623-be6e-c1e8ffc02697","year":2022},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.233699Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:a96ba92afbf18f74cae8cfe938c6b5857e0ea20b8563dbac2e537b115e80757d","observation_id":"a739e5d1-b051-4268-b139-62245d60267e","resolution":{"observed_at":"2026-08-06T19:21:13.881102Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.850264Z","title":null,"venue":null,"work_id":"a4715e7d-483a-4c62-8dbe-d9c54973cce4","year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.247160Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:bbaf27fe8302122672ef0ccae54ba2deee07b36f5adacfbf467dc9f82b3ce7f4","observation_id":"d475d376-f5c5-4010-9617-5f26236c15d4","resolution":{"observed_at":"2026-08-06T19:21:13.852972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.842023Z","title":null,"venue":null,"work_id":"b8f45455-2829-40c1-85e1-835cea20a80f","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.249555Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:343a2b812c2a6fc173bd3df0c57b45a46afc6935302eeeec9b4938609ecaa1da","observation_id":"f2be949d-2dc0-471e-a283-0bdba0ea3463","resolution":{"observed_at":"2026-08-06T19:21:13.845529Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.857096Z","title":null,"venue":null,"work_id":"1ebf3eef-51c2-48ba-b304-38df10b60325","year":2020},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.244116Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:107ae39a2a69a5dd07326a361a55e9eec310487b604ac563505a7fa91450fb1f","observation_id":"b8310541-dd47-480d-b3bc-46426c9a4c7c","resolution":{"observed_at":"2026-08-06T19:21:13.859514Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.827970Z","title":null,"venue":null,"work_id":"128e7c54-283f-4a28-bac4-d120c09d9ff0","year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.255801Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:93f034ce6a00eca9404289f63a27f197fe5876d7f1d0b211008e81446ee32140","observation_id":"a91a7979-d10b-4013-98ae-455d104ca42f","resolution":{"observed_at":"2026-08-06T19:21:13.830301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06828","last_updated":"2025-03-13T08:16:01Z","snapshot_observed_at":"2026-08-13T16:56:56.343853Z","submitted_at":"2025-01-12T14:45:27Z","title":"GeoPix: Multi-Modal Large Language Model for Pixel-level Image Understanding in Remote Sensing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06828","snapshot_observed_at":"2026-08-06T19:21:13.258836Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.258836Z"},"links":{"cited_paper":"/paper/2501.06828","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:d75940c6eb451cd8f31abbf85ba3b7f076b1cabaa3268519a841a6305a4623db","observation_id":"834d3338-f0eb-4b07-8389-c1ba5296fd3f","resolution":{"observed_at":"2026-08-06T19:21:13.258836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.835182Z","title":null,"venue":null,"work_id":"23c2c8f8-6f3f-4415-b4cc-aa5ae4e9b31f","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.252196Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:fa0c7f7b8c8f10f9234eabc4a6fee92cfcff0cb279154bb1ff7316a0e2aa52f9","observation_id":"40fb3bb9-c16b-45ff-bc40-84bef7a2d219","resolution":{"observed_at":"2026-08-06T19:21:13.838010Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20213","last_updated":"2024-12-19T13:46:40Z","snapshot_observed_at":"2026-08-13T00:42:14.577442Z","submitted_at":"2024-03-29T14:50:43Z","title":"VHM: Versatile and Honest Vision Language Model for Remote Sensing Image Analysis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20213","snapshot_observed_at":"2026-08-06T19:21:13.264931Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.264931Z"},"links":{"cited_paper":"/paper/2403.20213","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:4a6024afe2035ab4428341aa22afba54a79550d94459f3b67bef6f943cb4079c","observation_id":"f1be23c9-f869-48ca-a5ac-204dcf3a7b54","resolution":{"observed_at":"2026-08-06T19:21:13.264931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.811961Z","title":null,"venue":null,"work_id":"ef2ab88e-d874-4012-9ab7-4869047a464f","year":2016},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.269158Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:4515a1c734df3a826d76dd0f11a0b675f001aa06b6082420e83e62fc6f633730","observation_id":"e7067a98-c6f4-4be2-80c6-e26be70dceeb","resolution":{"observed_at":"2026-08-06T19:21:13.816439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.820986Z","title":null,"venue":null,"work_id":"33bde7be-3c39-4472-af11-02826a1471a3","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.261276Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:1798e34c5f34144452cc7f477d09ad59c0b4319e3eb6175a3fdda7ffb939fa09","observation_id":"2e6f1aa2-2560-4fca-8f32-2c34d3100d7c","resolution":{"observed_at":"2026-08-06T19:21:13.823609Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-06T19:21:13.276238Z","title":"Girshick, Piotr Dollár, and Christoph Feichtenhofer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.276238Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:f2a3dff9e0a9a25b0ca9699e6e6b02b650133a33b0125af50d84990f273cf848","observation_id":"e4a13af7-1844-42d6-93d6-0a6d67f9dbff","resolution":{"observed_at":"2026-08-06T19:21:13.276238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.796478Z","title":null,"venue":null,"work_id":"8ee009fb-e30e-421e-af51-7fe435efafe0","year":2016},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.278550Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:c5e35adf7083e64f91b4ac5d1ff0ebbc1cc49a5b86eaee50ef7c07d1666851ed","observation_id":"b6291716-896e-4d4f-8657-c0397c1553df","resolution":{"observed_at":"2026-08-06T19:21:13.799299Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.803527Z","title":"Anwer, Eric Xing, Ming-Hsuan Yang, and Fahad S","venue":null,"work_id":"77dd864c-ae9d-423b-8fad-ce296c0cfc09","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.272763Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:d569c7d84c82908a69735b74a0cddbab6b9abde30bf28fa465885c4e77134659","observation_id":"16e1e160-34ec-4a0a-814c-851c45e775ea","resolution":{"observed_at":"2026-08-06T19:21:13.807238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13925","last_updated":"2025-01-23T18:59:30Z","snapshot_observed_at":"2026-08-10T21:53:41.825866Z","submitted_at":"2025-01-23T18:59:30Z","title":"GeoPixel: Pixel Grounding Large Multimodal Model in Remote Sensing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.13925","snapshot_observed_at":"2026-08-06T19:21:13.283891Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.283891Z"},"links":{"cited_paper":"/paper/2501.13925","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:090586fa574c2a813fbb3d9a31a5c23d93300db6ea7d6d40fce674f038e25623","observation_id":"c50c9b8c-f911-4bfe-a4eb-2902647bee8f","resolution":{"observed_at":"2026-08-06T19:21:13.283891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06475","last_updated":"2024-02-09T15:31:01Z","snapshot_observed_at":"2026-08-13T04:22:30.692524Z","submitted_at":"2024-02-09T15:31:01Z","title":"Large Language Models for Captioning and Retrieving Remote Sensing Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06475","snapshot_observed_at":"2026-08-06T19:21:13.286686Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.286686Z"},"links":{"cited_paper":"/paper/2402.06475","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:34a61b49101c6f27c45d4de19f2e1ec3a087aa737e420d2944c15a181c7466ff","observation_id":"19bc2291-6fe5-4971-a707-3496f8f536d9","resolution":{"observed_at":"2026-08-06T19:21:13.286686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.787649Z","title":null,"venue":null,"work_id":"95ee5ce8-3be1-485c-9e34-3ca9f20ead34","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.281545Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:f92e5a522f92db02b21dcad371f46f0032e8d30e1411af67d5a12e932c445aaa","observation_id":"e5a92dce-f0ce-439b-a275-d9926c439dbd","resolution":{"observed_at":"2026-08-06T19:21:13.790384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.770979Z","title":null,"venue":null,"work_id":"d0d7596b-18d2-47ce-8f41-071cbb5fffea","year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.293721Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:796649f65b6784ea83a83afde6babcc078da9a57d21e57c2e874d82c347f48b4","observation_id":"1398aaa4-0d11-40b4-9203-03d3c90883d8","resolution":{"observed_at":"2026-08-06T19:21:13.773456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.296856Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.296856Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:4ae66295e230664dee22e2559a66daebda4930cdf9f99ad48e3f881b41686965","observation_id":"3139df1b-d263-47a1-a5ff-384402c2d462","resolution":{"observed_at":"2026-08-06T19:21:13.296856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.778729Z","title":null,"venue":null,"work_id":"89ed0859-dd3f-4ef9-8b3c-2d0ea769089c","year":2021},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.290441Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:a6245742e2f1c64a7328c9df5b2264418593772872155da8c1fcf83d51b52a33","observation_id":"cda49601-2565-4316-b30e-084aa50e37d3","resolution":{"observed_at":"2026-08-06T19:21:13.781799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.306581Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.306581Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:d283fa24251d17f9b6b180bb7b37b9b4512136df6b27ab3d1fbdea736ddba551","observation_id":"370315d0-0337-406d-84b2-17e478daee79","resolution":{"observed_at":"2026-08-06T19:21:13.306581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.733927Z","title":null,"venue":null,"work_id":"6df65e9e-6954-4745-94d0-cc50dbc787cb","year":2022},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.313598Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:57d40afc2a2179a48ca519be88bdfafeafa1e100362867a7748cab89b2c56ebc","observation_id":"8aad0995-fb31-487e-9deb-d0f163877cbc","resolution":{"observed_at":"2026-08-06T19:21:13.736268Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.757914Z","title":"In Thirty-Eighth AAAI Conference on Artificial Intelligence, AAAI","venue":null,"work_id":"32b46381-3cd9-4c49-ae2d-670b73ed7d1d","year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.299510Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:7104f294121e9528d41c6344272897ce8a2e0e8c48d5711fbea4c7ed2766a05e","observation_id":"7bfbd995-2672-46e4-be7e-36c992a47117","resolution":{"observed_at":"2026-08-06T19:21:13.760628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.751245Z","title":null,"venue":null,"work_id":"b288bf29-0313-4e4a-b55b-9c003b7dfad0","year":2017},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.302774Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:e5f86be21ce066813f4a50bfc85d9c0b687d7a1cd457461faf89567a0da0911e","observation_id":"3dfc2135-b3a0-46b2-aa8d-ffbd32d67f99","resolution":{"observed_at":"2026-08-06T19:21:13.753754Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.719903Z","title":null,"venue":null,"work_id":"0751ebf2-1760-49e7-bf92-0955ecee0571","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.324235Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:0b72b1db8f4b7728532f21455cec6c3c7c17bd997ab56df08388e8509cdb17a0","observation_id":"9b92d08e-69c7-4f22-838f-bead8935f663","resolution":{"observed_at":"2026-08-06T19:21:13.722769Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.740643Z","title":"In 2024 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)","venue":null,"work_id":"e1821ccc-57f5-4c82-9334-238531c0a9e8","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.309904Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:17e709a57802566d46e2ac78e20870cfde20c7c3e5b803cabd024ef4297d8b73","observation_id":"82fed69e-eb37-4aec-8a8a-8b7a7b5f4f38","resolution":{"observed_at":"2026-08-06T19:21:13.743850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.706215Z","title":null,"venue":null,"work_id":"a20f2c4a-ee46-4905-b15a-2b53dd6dfe31","year":2022},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.331013Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:e77c0cf574527121265f28d0dbdc627a1922348779307a692ef750efb02ffd83","observation_id":"7e8f46a2-2ca1-4f98-b02a-ad6bc6549a17","resolution":{"observed_at":"2026-08-06T19:21:13.709036Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.726771Z","title":null,"venue":null,"work_id":"653811b1-d3da-494c-a6c3-7fd99be21407","year":2019},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.317527Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:07086a548581be150486abafd4a4775e098265593415bc93bda77168e10ade3b","observation_id":"6fd21edc-21df-4105-b5c1-3c1082656000","resolution":{"observed_at":"2026-08-06T19:21:13.729445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23121","last_updated":"2025-07-14T02:03:48Z","snapshot_observed_at":"2026-08-13T07:06:55.063213Z","submitted_at":"2025-06-29T07:05:27Z","title":"CRISP-SAM2: SAM2 with Cross-Modal Interaction and Semantic Prompting for Multi-Organ Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.23121","snapshot_observed_at":"2026-08-06T19:21:13.320858Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.320858Z"},"links":{"cited_paper":"/paper/2506.23121","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:bc1a22ca027f2e2b0f278786abc960a435708a424874c3e4fa47c83bdf7c4058","observation_id":"947e4535-6317-43b0-bf7a-605d93095ee8","resolution":{"observed_at":"2026-08-06T19:21:13.320858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.683426Z","title":null,"venue":null,"work_id":"61f502d2-0ada-4fc2-94da-8bcab311b88a","year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.338926Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:12a5195fea678765990dfc18979276b95205971d77d336285853c33a7b16d926","observation_id":"829b1c60-1fca-447e-9c12-208c093301a4","resolution":{"observed_at":"2026-08-06T19:21:13.687003Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.712863Z","title":null,"venue":null,"work_id":"4858b2c9-1a01-4b56-b9fb-b1453e647834","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.328132Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:41b0e6683b13b56674c7d0751e40c02fb57d91a8884bb34858b2a63219260186","observation_id":"e28927dd-530c-4f9c-9c5b-c6833ce5f410","resolution":{"observed_at":"2026-08-06T19:21:13.715343Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.668064Z","title":null,"venue":null,"work_id":"d1cc7df0-3892-403b-a1c1-f55ecf0396cc","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.344062Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:9064a0156996e5656392d4fccfdef9b20beeebd5537e08a2f65933588eaf907e","observation_id":"d7744566-f025-4dfa-81b3-0904d0c68210","resolution":{"observed_at":"2026-08-06T19:21:13.670516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.699159Z","title":null,"venue":null,"work_id":"38b04ea0-f6ca-4585-bac8-b4af2cd717ea","year":2022},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.333285Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:e22a6fc29622bb3c34020eda168359050c9eca453ca2b3428886d63bcf089b3f","observation_id":"9431b12f-f9c8-47dd-86fa-3a38c5a22c9d","resolution":{"observed_at":"2026-08-06T19:21:13.701542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.690994Z","title":null,"venue":null,"work_id":"35b90e2d-165d-474e-95c6-0bf4fb16c1bf","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.336019Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:0a33f1176fa6715d9e7b12a5759544a1a26c93965557308ec962197ee4a4a30c","observation_id":"3ed71ea3-5fb5-4a71-b1c6-1998b732307d","resolution":{"observed_at":"2026-08-06T19:21:13.694407Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.645059Z","title":null,"venue":null,"work_id":"e36b81b5-f405-43f7-a971-a3e5d6e06734","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.352176Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:389427bb1f1f06aa3ae950e7525a964a3f103e70394e4263fa218c63d5feb274","observation_id":"2a2c9517-0d03-4e9f-832f-d7d7d6358057","resolution":{"observed_at":"2026-08-06T19:21:13.647788Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.675323Z","title":null,"venue":null,"work_id":"bd298bfd-c667-4ee3-957a-73fe73d34128","year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.341312Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:0dae7ae9f8675fd3dd3a5b615b450951034c07f68acdc1ee74ea803dbefbaae4","observation_id":"879f8f35-cb9c-441a-a31c-9787a5a48bbd","resolution":{"observed_at":"2026-08-06T19:21:13.678571Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.626711Z","title":null,"venue":null,"work_id":"a4af9fca-efd3-462c-9cb4-757ce53a0c69","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.357608Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:fd157837ba20e9edde07407a7e9e1fb95314833357bc2a3aa3435f9b47e5b056","observation_id":"983bb320-2b7d-4016-9477-8a22e806b279","resolution":{"observed_at":"2026-08-06T19:21:13.630116Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.660845Z","title":null,"venue":null,"work_id":"fb84a97d-903f-44e5-882e-e2b44b1f84c3","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.346772Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:dcfda4abc0b287961e9f1293873538c84165670dbfd870df66b345bf201297bc","observation_id":"e3036c18-8b06-4bb6-a620-d837be777cb0","resolution":{"observed_at":"2026-08-06T19:21:13.663937Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.652624Z","title":null,"venue":null,"work_id":"2ba583eb-f4f8-4344-aa44-81f233e75388","year":2025},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.349219Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:e9df68e813c628709eb61362889cd09cc5456d24e10cda07e0934339f76921f5","observation_id":"f75c8f71-3d14-4602-b34d-e36134cb1eb5","resolution":{"observed_at":"2026-08-06T19:21:13.655643Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.606553Z","title":null,"venue":null,"work_id":"a1f64a3b-8195-4cca-9afe-36b9e53fb995","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.367274Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:eb06329d3aac3a0a89cafc291e494fd7f86e5bffd104b83ee751c9aa884e93ff","observation_id":"d46e012c-9253-4086-900d-a8ac205feadd","resolution":{"observed_at":"2026-08-06T19:21:13.609896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.637216Z","title":null,"venue":null,"work_id":"b23abacc-ab9b-4921-bc5d-6f21ef4c4ace","year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.355285Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:d92b1d5dc989ca36956740eb9109218e34b49e30071bef049d0407dd0aa8d49b","observation_id":"bfeaa366-de9b-4bc5-ab6a-480a6314524e","resolution":{"observed_at":"2026-08-06T19:21:13.639760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.616431Z","title":null,"venue":null,"work_id":"0047f162-624b-4e88-9847-a4340473b631","year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.359963Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:d2fb1f5d2edde7d199c22502ecafea650b29abadb00eac80b074883067df0bcc","observation_id":"16898cdb-0e34-4a8c-986b-6054fffe0bee","resolution":{"observed_at":"2026-08-06T19:21:13.620141Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:13.363352Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.363352Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:0a7fe939a6b004709f54d52b1bc3a606e4ae685d5c6a7d97f0a12e2b54b6f6ab","observation_id":"2027e50a-c177-4b33-8295-ebd69acc55e2","resolution":{"observed_at":"2026-08-06T19:21:13.363352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15195","last_updated":"2023-07-03T16:08:00Z","snapshot_observed_at":"2026-08-13T14:42:26.982679Z","submitted_at":"2023-06-27T04:31:52Z","title":"Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15195","snapshot_observed_at":"2026-08-06T19:21:13.162233Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.162233Z"},"links":{"cited_paper":"/paper/2306.15195","citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:60b538ca71d74265f96390440f013eca5e3ead6ac94f50603523c750d62e39db","observation_id":"39f31653-ee2c-44a8-bf41-da90ac5ac89a","resolution":{"observed_at":"2026-08-06T19:21:13.162233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:21:14.019041Z","title":"In Proceedings of the 32nd ACM International Conference on Multimedia","venue":null,"work_id":"b81af395-d6b1-437c-99e6-f6562d2b7eb5","year":null},"citing_paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T19:21:13.153310Z"},"links":{"citing_paper":"/paper/2507.05887"},"observation_digest":"sha256:e8a0de4c2b42277203c2e991c520f26c71cae077bbc16f81d3bb674ea70ac652","observation_id":"df890d5a-c0c6-4ccc-a69e-e136f69f0ce7","resolution":{"observed_at":"2026-08-06T19:21:14.021685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.05887","last_updated":"2025-07-18T12:41:26Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T20:54:26.650929Z","submitted_at":"2025-07-08T11:21:03Z","title":"GeoMag: A Vision-Language Model for Pixel-level Fine-Grained Remote Sensing Image Parsing"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":67,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 1 inbound Pith citation observation for arXiv:2507.05887."}