{"as_of":"2026-08-12T12:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9a24517f0025fd84dc0750708de7285f9da284488b0af2b526e0cb7a60a30dd6","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T04:45:31.261331Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T02:06:27.741680Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-08T02:14:26.170166Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"cited_work":{"arxiv_id":"2606.17020","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2606.17020","snapshot_observed_at":"2026-08-04T02:31:02.680925Z","title":"arXiv preprint arXiv:2606.17020 (2026)","venue":null,"work_id":"83fe07b1-a587-42e7-99ed-a5263c9bcf39","year":2026},"citing_paper":{"arxiv_id":"2607.06552","last_updated":"2026-07-07T17:53:58Z","snapshot_observed_at":"2026-08-08T21:53:56.166413Z","submitted_at":"2026-07-07T17:53:58Z","title":"MonoIR-RS: Infrared Remote Sensing Vision-Language Learning with CLIP and VLM Adaptation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-08T02:06:27.741680Z"},"links":{"cited_paper":"/paper/2606.17020","citing_paper":"/paper/2607.06552"},"observation_digest":"sha256:1028a6e17c212a6d6107c365577d024f7c770227a25012a685c84504e72a20fe","observation_id":"c54bd88a-c3a8-4e8e-8887-3bce2262d3a0","resolution":{"observed_at":"2026-08-04T02:31:02.680925Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.17020/citation-record","integrity":"/paper/2606.17020/integrity","json":"/paper/2606.17020/citation-record.json","paper":"/paper/2606.17020"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-04T04:45:28.542027Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:28.542027Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:fddcc71e7d10525fb0776d38149306a76e931c40fa04a674a5268f2a4e8f178b","observation_id":"ec12db69-84e6-486b-b530-b7ff43105cf1","resolution":{"observed_at":"2026-08-04T04:45:28.542027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:28.612801Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:28.612801Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:a22390a3975a565129142fbec27546c64651f6d26d36ea4efef07ebf7de1acf0","observation_id":"2ce98129-60e1-419e-be1c-edcedc64217b","resolution":{"observed_at":"2026-08-04T04:45:28.612801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:28.735312Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:28.735312Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:592b243934990fa4ee30dcb18982aa0b9c88d64941f0e49756361f765b7bf1bf","observation_id":"755d5cc3-6a7d-4e2c-9ded-74fcc0bb7333","resolution":{"observed_at":"2026-08-04T04:45:28.735312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:28.819707Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:28.819707Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:b82db74727b48ea9a309708f393d6aabf1c0f1722bcc0c793f7e7e4b979cafa2","observation_id":"2a535d50-d76f-4af5-bbbe-676a13e2a8f5","resolution":{"observed_at":"2026-08-04T04:45:28.819707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:28.901116Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:28.901116Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:fb68c1e64cf2d11311d9e5d4c29fd6bfc5a6c5246bd48631a15653370dbaf51d","observation_id":"a5300715-6f64-4d2d-9a94-b0d6b777dc57","resolution":{"observed_at":"2026-08-04T04:45:28.901116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:29.023095Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:29.023095Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:d77c3c6c8fff4ba0a94f2692ae707f0d069f2871f45128d72bcdf7a665a56b78","observation_id":"94e9e22f-98ff-4a11-b460-292dd41c5c9f","resolution":{"observed_at":"2026-08-04T04:45:29.023095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:29.111353Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:29.111353Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:7427fdbf99a73bcafb2f63608abaee6715910c614df111f1d4022b809bb2ebd4","observation_id":"5fca18ef-d387-40b1-ab90-bf75cc2bc6e2","resolution":{"observed_at":"2026-08-04T04:45:29.111353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:29.164432Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:29.164432Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:b91f1b4bf287c61a8950d78262c51ffa9ae6d7e5e5f09299396c1d67492b6679","observation_id":"7e9172d3-e85c-4117-841a-4d424cf7bd1b","resolution":{"observed_at":"2026-08-04T04:45:29.164432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:29.241017Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:29.241017Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:482eb700248ba300121ecd1940897d2258d059eb889135d43d53c7527643c292","observation_id":"65dd9081-72f4-4de0-bc00-4b8b7fa6662b","resolution":{"observed_at":"2026-08-04T04:45:29.241017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:29.303956Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:29.303956Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:01e8af3ff82e529537830046641c39431029323fcba45572e88782078fe3fcba","observation_id":"b9c42ad2-973a-4803-82bc-81c784350f93","resolution":{"observed_at":"2026-08-04T04:45:29.303956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:29.465179Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:29.465179Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:b6075c503876772688fdd14ab1f6203a54d08e6800f99fbc641442bfdde89a34","observation_id":"070b36aa-a366-4cb1-9bb6-5f22cb7e0cc1","resolution":{"observed_at":"2026-08-04T04:45:29.465179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:29.521535Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:29.521535Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:c403b688c2bf73f40eee407f531c684b57839cdb6c5412df2acc196975401f7e","observation_id":"38e4afd0-bbea-4922-ba94-184d1c19bf8c","resolution":{"observed_at":"2026-08-04T04:45:29.521535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:29.570655Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:29.570655Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:b587b62b832ffecf2370f428c2d03603278451ede7eecfb57e050eb05e56daac","observation_id":"7dc9b347-b796-4c3a-9662-5caee46681f0","resolution":{"observed_at":"2026-08-04T04:45:29.570655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:29.644880Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:29.644880Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:ad503c91291995478a951046f2fc90be838edc43fda32efae4d78fa493210864","observation_id":"b7faf06e-8542-487c-84ff-b72723e5769e","resolution":{"observed_at":"2026-08-04T04:45:29.644880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:29.719826Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:29.719826Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:d3ee7dd0f1c50b2398c501d52066fa19b2fcf17e50b99f7057b22fd8207c0b8d","observation_id":"99e60b4f-d94a-42f2-8e57-59c4676c32c9","resolution":{"observed_at":"2026-08-04T04:45:29.719826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:29.775927Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:29.775927Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:13e0df87442a92caba385add1eeb7d6dc2116353691467a8e3522a2d3c46ed37","observation_id":"06ddeecc-d614-4939-9604-cab19144d989","resolution":{"observed_at":"2026-08-04T04:45:29.775927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:29.828851Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:29.828851Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:963379115de9f2b5c326a942255ccb72a3cdee7a505ea775c15d94bee422ae10","observation_id":"56297287-ef05-43ea-ae53-641602aa22c7","resolution":{"observed_at":"2026-08-04T04:45:29.828851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:29.871337Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:29.871337Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:f149e1cabe9c2591734269ee3a0f202167353cb3dd9f4530e42028c25a22817c","observation_id":"8c772512-483a-4a23-97d6-f6e607ec5366","resolution":{"observed_at":"2026-08-04T04:45:29.871337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:29.942192Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:29.942192Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:cbbc42454fa376fa5f3bb9ba3e3dcf08722e8ad26d29f62dd474ffc515666aa1","observation_id":"8b6aa93c-91ff-4dbc-8d78-61767e8e9678","resolution":{"observed_at":"2026-08-04T04:45:29.942192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19654","last_updated":"2025-03-30T15:08:23Z","snapshot_observed_at":"2026-08-07T16:38:22.084819Z","submitted_at":"2025-03-25T13:43:47Z","title":"RGB-Th-Bench: A Dense benchmark for Visual-Thermal Understanding of Vision Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19654","snapshot_observed_at":"2026-08-04T04:45:30.017006Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:30.017006Z"},"links":{"cited_paper":"/paper/2503.19654","citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:e79792a95966bcfbd308ad8dcddc7cbafdbc4df2a2c9256f67a9d139c271995e","observation_id":"4f11923a-16a8-4e50-9d53-7d019c42aba9","resolution":{"observed_at":"2026-08-04T04:45:30.017006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:30.101379Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:30.101379Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:5856945f026fc93fc111a5e5a10bcdedbbdf9a122df2cde7f0a5c660c2f9accc","observation_id":"e92022c6-cff4-40d5-be6d-5d92fada6906","resolution":{"observed_at":"2026-08-04T04:45:30.101379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:30.224918Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:30.224918Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:010fa073a50d6e34c34cd3771735cbfd6f53f270da800c3858231401322960b2","observation_id":"48c1ea77-5456-47e5-b05a-bd64a0b9e6d9","resolution":{"observed_at":"2026-08-04T04:45:30.224918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19012","last_updated":"2025-03-24T17:58:09Z","snapshot_observed_at":"2026-08-07T16:40:27.010988Z","submitted_at":"2025-03-24T17:58:09Z","title":"DiffV2IR: Visible-to-Infrared Diffusion Model via Vision-Language Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19012","snapshot_observed_at":"2026-08-04T04:45:30.384285Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:30.384285Z"},"links":{"cited_paper":"/paper/2503.19012","citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:60aefd10716ed4acd9011037c7856067fb1bc8fb59e081bb91160e8cb9397cb7","observation_id":"b01884d0-867c-47ef-b4a6-b4d6e1defe6c","resolution":{"observed_at":"2026-08-04T04:45:30.384285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:30.483248Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:30.483248Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:897ae8df00d929bb9e71818c22410bf4ec6a4b5261cc124b1605119c7cad48fb","observation_id":"8b858bd8-3a40-47b9-992b-22c9b6671e89","resolution":{"observed_at":"2026-08-04T04:45:30.483248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:30.575458Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:30.575458Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:e147cf1a71d32a8a7285d04fca0accebbe1df6a2e983aaf0ff472ad2d0b12345","observation_id":"aee0fa9a-f1ed-404c-87af-507b6e3b31b3","resolution":{"observed_at":"2026-08-04T04:45:30.575458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:30.675071Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:30.675071Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:9f765e4a805787f8bf0c9cb6373ef7a01998b31ced1b6604256dddf86c1299cb","observation_id":"923d2a75-5a7d-4902-8bbe-9daa70d3f4da","resolution":{"observed_at":"2026-08-04T04:45:30.675071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:30.726615Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:30.726615Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:e10066a7838192ac38b0df0df2dd9c1e73c082300bdd269c14707ff0759e761b","observation_id":"c87067ee-b683-40ce-96f7-48216e96e6a3","resolution":{"observed_at":"2026-08-04T04:45:30.726615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:30.825910Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:30.825910Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:509fe585ba89d32226887f5f29d05edf2e8d8578058b35de499a6107d2d43abc","observation_id":"82a1ed91-046f-4ad0-952f-0061b8e72e0c","resolution":{"observed_at":"2026-08-04T04:45:30.825910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:30.973543Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:30.973543Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:393e51e3bc5a796c236b6ac46e5e313dcfb428b93bf4c84df06551aacf0bae0c","observation_id":"7310abe3-df21-4bef-8b4c-aa89a3a38716","resolution":{"observed_at":"2026-08-04T04:45:30.973543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:31.120703Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:31.120703Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:35d569b8ed704176f26a403bc84fb7d510edfa3e04d234ae57f2a362c689d69b","observation_id":"cde3e0ed-cbf6-430f-a1dc-f8af51189994","resolution":{"observed_at":"2026-08-04T04:45:31.120703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:31.177208Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:31.177208Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:0036511c08cf6175f1abd214d34f6801f7c1118602c716e0c3d4294f7ec44635","observation_id":"57e27ab1-1f51-4119-8eab-2c9459540230","resolution":{"observed_at":"2026-08-04T04:45:31.177208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T04:45:31.261331Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T04:45:31.261331Z"},"links":{"citing_paper":"/paper/2606.17020"},"observation_digest":"sha256:9aee94b33665f99c05ffc746fb0e3266e1f3d9cefce5fca2e7fc86765411d13b","observation_id":"843bbb81-0401-45fc-a401-504e7be20ca8","resolution":{"observed_at":"2026-08-04T04:45:31.261331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.17020","last_updated":"2026-08-03T06:48:50Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T02:51:40.637824Z","submitted_at":"2026-06-15T17:49:34Z","title":"FusionRS: A Large-Scale RGB-Infrared-Style Remote Sensing Dataset for Cross-Modal Vision-Language Learning"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 1 inbound Pith citation observation for arXiv:2606.17020."}