{"as_of":"2026-08-24T02:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c379463c027e359e3a528d6e82d36696c4daaef6d90f251516ebc8869347ab29","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T16:51:37.845654Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.08110/citation-record","integrity":"/paper/2604.08110/integrity","json":"/paper/2604.08110/citation-record.json","paper":"/paper/2604.08110"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2411.15869","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IEEE Transactions on Image Processing34, 8271–8284 (2025) arXiv:2411.15869 [cs.CV]","venue":null,"work_id":"eb3b0b97-4f81-45f7-a75b-048963a5fbe9","year":2025},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:4d9fd87b18605f5ee2683bfd6af7c086288c642cb0ac60edd295d0ea1262921c","observation_id":"b72ce85b-f2ff-4d51-b6ac-a353df8ecde4","resolution":{"observed_at":"2026-05-11T08:00:59.036522Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grounding everything: Emerg- ing localization properties in vision-language transformers","venue":null,"work_id":"cc30c56b-8f23-47e8-830f-c1f516207408","year":null},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:2e4ef1b1645a340f0918b665c7e3a82a4b218e69376d4819b054613e5fb67611","observation_id":"77bcb078-8f7d-4358-804b-4485157b1bdd","resolution":{"observed_at":"2026-05-17T13:14:38.485294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-supervised learning from images with a joint-embedding predictive architecture","venue":null,"work_id":"44224e77-d096-42c4-a7a6-cd8f3449fcc9","year":2023},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:6301254e231de7e020ffb4e65f08b960c27dea4b803979ed2b7de08948a161d2","observation_id":"9d9a0b19-722d-4b46-a91e-032e21b50020","resolution":{"observed_at":"2026-05-17T13:14:38.675106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Window attention is bugged: How not to inter- polate position embeddings","venue":null,"work_id":"01e7a7d0-d186-4e1b-841e-b5f5424675ad","year":2024},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:f787d50cfd53dbf70fc2509b9a72233456c7d035cb37dfb63b1a92303d3ce6d1","observation_id":"99e6fdb3-80ab-4238-950d-97dfc448feca","resolution":{"observed_at":"2026-05-17T13:14:38.541535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Coco- stuff: Thing and stuff classes in context","venue":null,"work_id":"6109ccfd-9edb-4ac5-bdc1-1c1479137bcc","year":2018},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:129549aa9688b77b8770d976d764ae355e98f2f3261d0e6e2e16106405601cb0","observation_id":"e8596122-abe0-4c45-a3c5-ad3c686325cd","resolution":{"observed_at":"2026-05-17T13:14:38.534041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":"824ea0c6-d81c-4189-b02f-bf86b7f1a506","year":2021},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:3309d33e1a76836f390174557ad0d62b94ad98405f2028b5e45937259daee450","observation_id":"d00f5b77-a62a-4e0d-8138-32487afaaace","resolution":{"observed_at":"2026-05-17T13:14:38.678602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learn- ing to generate text-grounded mask for open-world semantic segmentation from only image-text pairs","venue":null,"work_id":"3a7d0aac-4647-4112-a6e8-c1e8e4a8bd31","year":2023},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:251825d8259b5c5cb7c94abacc03fdd5b62a69296f6bf81dbc3bb3187e0eba61","observation_id":"f68ca8c4-2255-4382-b07a-1d0679dc6bc4","resolution":{"observed_at":"2026-05-17T13:14:38.682001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3854cdb9-72e1-448d-914b-99c35af1de3a","year":2023},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:4e79ea2673df6dce976ccca1236211d0a39ed79ab551217ddd4916a37e22b3f0","observation_id":"b139db0b-01b4-404d-9b44-cfc80788a1cb","resolution":{"observed_at":"2026-05-17T13:14:38.709413Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cat-seg: Cost ag- gregation for open-vocabulary semantic segmentation","venue":null,"work_id":"72d861f7-3624-4d35-8f50-4546d31ccd8b","year":2024},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:9ef90b20bc7edc95c5619d50ae6e62bd3e5fe9234cbd02a2c79fbd359785cfb8","observation_id":"feff64dc-82e3-4fb0-bcea-4ad5edc3f88c","resolution":{"observed_at":"2026-05-17T13:14:38.594149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MMSegmenta- tion: Openmmlab semantic segmentation toolbox and benchmark","venue":null,"work_id":"3ccb3c73-6196-4b04-9180-5b428570f914","year":2020},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:e4887fb32e51539c279776494e84ac8d2680dbe5d5c543e0f75dd1fb65a91dfa","observation_id":"358be2be-73d5-4d9b-986f-bcb75f8d512f","resolution":{"observed_at":"2026-05-17T13:14:38.549109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MMEngine: Openmmlab foun- dational library for training deep learning models","venue":null,"work_id":"991852c3-bea3-46c1-a734-42bf0f0c36ec","year":2022},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:40cad631355ba7aad395627b987be88ee153aa578f716a218a470b6c0b574d49","observation_id":"60409d8b-0066-4074-b4ae-47746677662a","resolution":{"observed_at":"2026-05-17T13:14:38.702630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The cityscapes dataset for semantic urban scene understanding","venue":null,"work_id":"0a4d87b0-ca5c-4052-b05c-78fdb7d3841a","year":2016},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:568987d2d800bd8b1c9b89bf02e8ecbb7666f3c6af7b70ddf12fcf0cc530ea0c","observation_id":"f4f32675-9f18-42cf-9279-b650a50df429","resolution":{"observed_at":"2026-05-17T13:14:38.602374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FlashAttention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":"f483ae7e-3d3f-4806-b3e0-844ce29b1912","year":2024},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:2c8e851eb74ec5b66dc8f3b818c333ac62d11d8b9e0064a57bb2f40e943d2a62","observation_id":"7bd57adb-6605-41e0-bc20-1230d907916e","resolution":{"observed_at":"2026-05-17T13:14:38.519178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vision transformers need registers","venue":null,"work_id":"80128299-0c39-45e5-8ade-2d446a4fe707","year":2023},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:1e5d19c2caca840a74a86e2af111d24388726df69a21b204f0591b26efb7760c","observation_id":"f3a8ea58-7171-4cfc-8d18-79ba47aa6d29","resolution":{"observed_at":"2026-05-17T13:14:38.637823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"50742798-4dfb-4d40-88a7-0514cb4a034e","year":2009},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:9724da0afd15097ee2039a1ad301865926754ec294c066dcdc52a5d528c4f035","observation_id":"5b2008a9-5b55-4f82-bf57-bd35c15da1b0","resolution":{"observed_at":"2026-05-17T13:14:38.650050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The pascal visual object classes (voc) challenge.International journal of computer vision (IJCV), 88(2):303–338","venue":null,"work_id":"4ac5906b-315b-4c47-a9db-d6c0d51285e7","year":2010},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:579214fbf47397f2d87c057d70449ee3bd698b93b76f338f4a0dcf7ebda3a373","observation_id":"9d94261f-aca6-4113-b945-96a9a5aee8bd","resolution":{"observed_at":"2026-05-17T13:14:38.689133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17425","last_updated":"2023-11-06T02:47:51Z","snapshot_observed_at":"2026-08-16T14:56:25.720519Z","submitted_at":"2023-09-29T17:37:29Z","title":"Data Filtering Networks","version":3},"cited_work":{"arxiv_id":"2309.17425","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17425","snapshot_observed_at":"2026-07-04T20:50:12.674098Z","title":"arXiv preprint arXiv:2309.17425 (2023)","venue":null,"work_id":"9922937e-9c54-4233-8816-d729dfaf746e","year":2023},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"cited_paper":"/paper/2309.17425","citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:0cecb6e4fbfcda447a79c66d0aec2f649c2dd4cd4479adf4a9bc29f5973478cc","observation_id":"9be06f81-bdca-4615-bedd-3198732cb9db","resolution":{"observed_at":"2026-05-11T08:00:59.030358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:1f05dbfcd0f1df11c35be39d2d82167ec04fea30008627f5f814555ef250b86d","observation_id":"5b44dbb1-ec04-4a4a-ad05-c4844f71ef9d","resolution":{"observed_at":"2026-05-11T08:00:59.041990Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pay at- tention to your neighbours: Training-free open-vocabulary semantic segmentation","venue":null,"work_id":"a3594f32-f0fa-4d22-8c1a-611a15b75af8","year":null},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:349b2fc8d1bdfdeef484783c5b242d2dbead464660f48e06a8706f06dd73d487","observation_id":"c7fe71a3-e571-48c1-a20d-4929af91c595","resolution":{"observed_at":"2026-05-17T13:14:38.537890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Few-shot object detection with foundation models","venue":null,"work_id":"ec4342f7-73f7-4c66-9e7e-9020ca3b9a15","year":2024},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:a98b3dc5857e68c6ca0fe743f97efb835cdf46d6916b93477ae7a6c8fdadd60e","observation_id":"a52d56c9-8174-4953-bf50-d43b7d429746","resolution":{"observed_at":"2026-05-17T13:14:38.671668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"8e3ea4dd-af7f-423b-a3f7-dad6687f8cdb","year":2022},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:df5a65bca2eee4d7f8b1672465bcdea4d1eaacaaee790dbe900631737f29e8a2","observation_id":"0df1a131-65bc-4a8f-b562-d2c49d82a801","resolution":{"observed_at":"2026-05-17T13:14:38.526677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7671330c-e305-4754-bd39-a40361c0d2c2","year":2025},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:7304e1a5ec73fa5b8674ea13e33af486315e9ec93222c733c0b2c6967a45e2e5","observation_id":"d74e3b7e-fa64-40ce-9107-d37d63ed7ddd","resolution":{"observed_at":"2026-05-17T13:14:38.629581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Distilling self-supervised vision transformers for weakly-supervised few-shot classification & segmentation","venue":null,"work_id":"55d94f30-4db0-4789-b4e0-8a659d2aeb77","year":2023},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:2819bb46a148a45cc602459b101e42ba8314fc209c6cad168d93ecca2f27c7ac","observation_id":"a82c764e-dae7-4893-9556-0bd6d52bf767","resolution":{"observed_at":"2026-05-17T13:14:38.579071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In defense of lazy visual grounding for open-vocabulary semantic segmentation","venue":null,"work_id":"a6fcc312-1d29-43dc-a7bc-1caaa7fa226f","year":2024},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:6451cdea990dac0faa312145427f6770bb66497847b90ed67a0a3e8db1ab2162","observation_id":"5d90df35-195c-42f2-8fdd-b6bae95c046e","resolution":{"observed_at":"2026-05-17T13:14:38.626030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Distilling spectral graph for object-context aware open-vocabulary semantic segmentation","venue":null,"work_id":"588b9ff5-a18d-4ec5-9c2d-91e1203d6e96","year":2025},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:52dc43b6dec0495562b4ca00fd34d9af0890baf9df79c8cf506e0680812dac5a","observation_id":"2c8e3905-209c-4e29-b33c-497f9532cc62","resolution":{"observed_at":"2026-05-17T13:14:38.685548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards generalizable scene change detection","venue":null,"work_id":"87d990e6-f0ee-4bb1-a19e-e135ff24051c","year":null},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:81edf00fbf2162905c45bd971c648990bd36088cb1d52efed93daad0b47a4878","observation_id":"1ea18610-894c-4c17-aa8a-f8103a25022f","resolution":{"observed_at":"2026-05-17T13:14:38.530387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sam-r1: Leveraging sam for reward feedback in multimodal segmentation via reinforce- ment learning","venue":null,"work_id":"ec0b6e63-efb5-4b3c-9536-22c4463dc7c2","year":2025},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:27db15dfa5982cd7a36eb0d78cd38266cf69eed6d51b24af108e6c870f53df1c","observation_id":"e064fa2d-e471-4b68-9912-574e7138aee5","resolution":{"observed_at":"2026-05-17T13:14:38.572161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Segment anything","venue":null,"work_id":"dae24621-5cd3-4c47-a3a1-77b769b2f6be","year":2023},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:cb7818388880fd322df2594008881ee157912917ddb4a902d1b698f4749282f4","observation_id":"f516c915-7522-4169-b6fc-efbd3ae9c81f","resolution":{"observed_at":"2026-05-17T13:14:38.664699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The open images dataset v4: Unified image classification, object detection, and visual relationship detection at scale","venue":null,"work_id":"b3eeefbe-69ab-4858-bceb-c3d4aa9f1ef5","year":1956},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:c2fb410ff5bcba6a621d9e0ce2e8d5f006488a76e2f6a665878916c401b38459","observation_id":"2b2fd6b2-6896-40c5-81fc-734e551287d2","resolution":{"observed_at":"2026-05-17T13:14:38.523055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clearclip: Decompos- ing clip representations for dense vision-language inference","venue":null,"work_id":"5c344bee-a994-4c46-b34d-4b8bb12a1910","year":2024},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:ee1550c06e6841900fd2aa672f9056689d58d1d596d57d7dcaa4cb07fd543dec","observation_id":"8f450fec-0180-477e-8396-8641261fc022","resolution":{"observed_at":"2026-05-17T13:14:38.633246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proxyclip: Proxy attention improves clip for open-vocabulary segmentation","venue":null,"work_id":"7b889261-646c-4c13-b1b6-b8dfc6235560","year":2024},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:6bd1a1d78d1e35b80d2f0ffd409fe82e964e3788ba36aed11c9c6bb1a4e292d6","observation_id":"020b473f-4eee-44ed-ade7-a243fadad138","resolution":{"observed_at":"2026-05-17T13:14:38.606642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A closer look at the explainability of contrastive language-image pre-training.Pattern Recognition (PR), 162: 111409","venue":null,"work_id":"c637b993-d8b0-44a5-b229-2c0f2acf2f25","year":2025},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:274c2cb4e0ce8d6132db8770b4f3c4bb77c9a16fbbdb779c606480b24ab6dfc6","observation_id":"39f4bcd9-97b8-44fa-871e-1751481d843f","resolution":{"observed_at":"2026-05-17T13:14:38.556079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open-vocabulary semantic segmentation with mask-adapted clip","venue":null,"work_id":"861679c9-b055-4662-a35b-5173594f4bb6","year":2023},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:18d867df52efe90424ed83507fc73e91551095fc568518cd64f5fca5f7dadc79","observation_id":"f49bb096-12e4-4b89-b52a-bb47369de1c8","resolution":{"observed_at":"2026-05-17T13:14:38.503928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"0d9024c2-5bbb-45da-ba6d-ff2c34919b9f","year":null},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:595ef079a3051ca7427f18752fdaf314c0e96d102b8512537dc60f3063f89a7a","observation_id":"4c9294b7-8abe-47e7-ab00-3761fbdd2ef4","resolution":{"observed_at":"2026-05-17T13:14:38.492440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open-vocabulary segmentation with semantic- assisted calibration.Proceedings of the IEEE/CVF Confer- ence on Computer Vision and Pattern Recognition (CVPR)","venue":null,"work_id":"caa9aaa8-dec7-4134-bdde-1f65a18c932a","year":null},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:1699ffe9474df54101fc253c0f8a423a237e415a32244800318697252aa69294","observation_id":"b53cc95e-8bb4-4081-8820-8a68845c16e0","resolution":{"observed_at":"2026-05-17T13:14:38.569209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SegCLIP: Patch aggregation with learnable centers for open-vocabulary semantic segmentation.The International Conference on Machine Learning (ICML)","venue":null,"work_id":"0333eadb-5389-4e4c-8dd6-9be48fb77066","year":2023},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:a236b71410d47270410b21057cb2ea457577126e4d9e87033a10e34e81845814","observation_id":"5a254704-11fb-46ee-b790-fabb7f35386e","resolution":{"observed_at":"2026-05-17T13:14:38.586108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The role of context for object detection and semantic segmentation in the wild","venue":null,"work_id":"504f3cf5-c8d3-440a-8414-85730cb10a04","year":2014},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:a2c2acf790592e2dca2714cb6ddf670db1bd107794fa25d9707782dd9c147ad9","observation_id":"860e835e-d375-4b2f-bf6b-8461995fd2c9","resolution":{"observed_at":"2026-05-17T13:14:38.598338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dinov2: Learning robust visual fea- tures without supervision.Transactions on Machine Learning Research (TMLR)","venue":null,"work_id":"7a06f53e-ba51-4709-b641-9f4d811e4153","year":2023},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:b281c4ac035bbf276bdaa255f11d0b9d0438a2373314250c54316a5250d7a0a7","observation_id":"3903164e-b4a5-47d8-bab8-76d7aebb8ef2","resolution":{"observed_at":"2026-05-17T13:14:38.618591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ramesh, Gabriel Goh, Sandhini Agarwal, Girish Sastry, Amanda Askell, Pamela Mishkin, Jack Clark, Gretchen Krueger, and Ilya Sutskever","venue":null,"work_id":"ae5f023a-9919-4d82-ba74-5be63bc5d826","year":2021},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:77abad77cdf429fb2e0e3ec62b9c3511f3cf04e10d0e9285a876cf673ac3c66f","observation_id":"6b46753c-4f63-4bf2-bc2b-b1bc568525a2","resolution":{"observed_at":"2026-05-17T13:14:38.582642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sam 2: Segment anything in images and videos.The International Conference on Learning Representations (ICLR)","venue":null,"work_id":"3df89892-c13c-4615-93bb-6ae916a25b0f","year":2024},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:840bbdb50e557d785451bfc20a8623ade4a4b6446a2bb601ed4b50e98c82aeb3","observation_id":"ffb46a98-41d3-49a6-b2d0-c7fed850515b","resolution":{"observed_at":"2026-05-17T13:14:38.575757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet-21k pretraining for the masses.Advances in Neural Information Processing Systems (NIPS)","venue":null,"work_id":"74210f7e-4cb9-4e23-88e4-1e4df909b1c3","year":2021},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:0ac0d089b2d9f8a77a1e71e20fe09c56e997fbe7888c12e722f40f4d8d3bbb61","observation_id":"a262db59-041f-4ab5-ae84-6507754ec5bb","resolution":{"observed_at":"2026-05-17T13:14:38.614589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hiera: A hier- archical vision transformer without the bells-and-whistles","venue":null,"work_id":"61b01740-f4c6-4e2b-8297-89447ae18f50","year":null},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:c56e99090647b56a7cd1e4c3e257caa7d2d5ad389e3bea0ef7355c896ad25470","observation_id":"fed023ba-8bba-4085-a53f-e0a3121d374a","resolution":{"observed_at":"2026-05-17T13:14:38.656053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ex- plore the potential of clip for training-free open vocabulary semantic segmentation","venue":null,"work_id":"6fe4aa3f-0e43-4101-8047-ed985858a7fe","year":2024},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:6a1c4d88bafed9a1c3a9ffa2b162d85376f5304a73de974e2e9de75e4d66a7c2","observation_id":"75393c63-0ad9-4d03-8fb8-90d947bf5f2a","resolution":{"observed_at":"2026-05-17T13:14:38.645879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Harnessing vision foundation models for high-performance, training-free open vocabulary segmentation.Proceedings of the International Conference on Computer Vision (ICCV)","venue":null,"work_id":"c8801b98-2474-46ee-a9df-be4231cf9eb9","year":2025},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:dca41fa21c8a5c10ce160c68480ced1829648e3297315d825222faa3b0795325","observation_id":"d0febd9e-920b-4b51-bd6c-88d76d33333a","resolution":{"observed_at":"2026-05-17T13:14:38.590098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-08-18T01:07:23.737664Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":"2508.10104","doi":"10.1055/a-2487-1252","metadata_source":"pith","pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DINOv3","venue":"cs.CV","work_id":"c8b07deb-8fe7-4e18-9620-f3569d3529ce","year":2025},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:19f9ab180cd66a0d03c9fee5badd171abdd61f0671225fc5ee8ad41af4d5bfc2","observation_id":"dc3620ce-8b02-40ce-9b00-e344524994f4","resolution":{"observed_at":"2026-05-11T08:00:59.064055Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clip as rnn: Segment countless visual concepts without training endeavor","venue":null,"work_id":"8882d0bb-5717-4a21-8e6d-c5346ac4e71a","year":null},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:d7e9dbc4352462419a8184527c74e315dab37518e9e96a148bde855271483e0d","observation_id":"c8e24d61-af22-4d55-a773-a41fc3daf51e","resolution":{"observed_at":"2026-05-17T13:14:38.552700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sclip: Rethinking self-attention for dense vision-language inference","venue":null,"work_id":"c7c7e56a-76b9-4f37-a3fa-243ca84d1adf","year":2024},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:437b83618bd6b1a05706f4a3dcf28131b542db00a3dde38c48286e3192626ac5","observation_id":"f3704bf8-9c97-4929-a9f9-4130cac8bee7","resolution":{"observed_at":"2026-05-17T13:14:38.668232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Use: Universal seg- ment embeddings for open-vocabulary image segmentation","venue":null,"work_id":"11ef36e0-57a8-4c75-b010-b4b9705b4c33","year":null},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:d270be952b211bcc517a337524dc187cc240d39a97a21c3a024fa85a11df158b","observation_id":"6d0b32a1-3344-4c5a-a4ff-ccec45fe4a80","resolution":{"observed_at":"2026-05-17T13:14:38.500125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stronger, fewer, & superior: Harnessing vision foundation models for domain generalized semantic segmentation","venue":null,"work_id":"c6d817be-d347-4152-8204-0e78d91b20a7","year":2024},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:1e4bdf0d155579fa31db7a7f0357e4adfdf3a706f789f3a60ad94ab4bc13c97a","observation_id":"2d3fc850-81c9-42a4-a5d4-406fca17d2a3","resolution":{"observed_at":"2026-05-17T13:14:38.496264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Image-text co- decomposition for text-supervised semantic segmentation","venue":null,"work_id":"14293a18-4ae5-44c9-870e-ccf7d5767ed0","year":2024},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:cd7e6584d5b92c4958d34221e050b53ebb7f85a93edcd633e39e67cb2e7ec4ae","observation_id":"314928d8-ad4a-403c-9eb7-d64572046b81","resolution":{"observed_at":"2026-05-17T13:14:38.488889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clip-dinoiser: Teaching clip a few dino tricks for open-vocabulary semantic segmentation","venue":null,"work_id":"a94ae5e4-8a47-4105-8777-427a2654179c","year":2024},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:c6cf4b5f9cb226517c7fc599c9f77ecf758c782f396bd7fc4db63ea7c17b0fa0","observation_id":"ad1b7641-9220-4818-a4c2-5c2a87c186a7","resolution":{"observed_at":"2026-05-17T13:14:38.610645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Textregion: Text-aligned region tokens from frozen image-text models.Transactions on Machine Learning Research (TMLR)","venue":null,"work_id":"347fdd69-6e91-4117-abf2-09bc443c30b2","year":2025},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:365323cd1af6928a5df6958b2e786d3651fd7380fa3b94d72108a7a200708f76","observation_id":"d5d595c9-60ea-4b5e-a837-1d6c8d5d0256","resolution":{"observed_at":"2026-05-17T13:14:38.511659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simmim: A simple framework for masked image modeling","venue":null,"work_id":"cad4f9f9-d7b8-44ae-bbf8-6dcfc991830b","year":2022},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:da05382eb807449975de7a137a70b2d101cdb80fb5507cfd02db2276270651ef","observation_id":"eb28cd98-a3be-404b-acf8-5587c38cb196","resolution":{"observed_at":"2026-05-17T13:14:38.507766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sed: A simple encoder-decoder for open-vocabulary semantic segmentation","venue":null,"work_id":"5008f585-49f3-4a43-bc3e-e5a639ac1a6a","year":null},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:1002bd630858bb2361a9effae618fd81b2834b885ffbda7465b550a26c29fbb0","observation_id":"9875273c-2d79-4043-b773-2b6d07f82417","resolution":{"observed_at":"2026-05-17T13:14:38.515463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rewrite caption semantics: Bridging seman- tic gaps for language-supervised semantic segmentation","venue":null,"work_id":"e528006d-34e9-4340-9bf9-46ae826b6249","year":null},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:94934c056c7e151304d54d096de49688a41ca574b85fc7e994ced6cc22c68468","observation_id":"bb72b9fa-c396-4965-86d4-f072ed0050b7","resolution":{"observed_at":"2026-05-17T13:14:38.699552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Demysti- fying clip data.The International Conference on Learning Representations (ICLR)","venue":null,"work_id":"3666d102-95fb-495a-9030-540be7f0226a","year":2023},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:9cff47369e5b04284d06a3fea7e70e3610dec40245964ef5b5e8e7450cde69f5","observation_id":"f33fc446-186e-4685-a8a4-d917b2bf49e2","resolution":{"observed_at":"2026-05-17T13:14:38.706262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Side adapter network for open-vocabulary semantic segmentation","venue":null,"work_id":"0a03a99e-7315-4065-bc21-715dcb54c918","year":2023},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:cc8c8efc98fc275238bc195abbd312d47799bb45fb5e5f3e82fc3be0abde8ce8","observation_id":"c46d1cf1-f951-45a6-b91e-e9a5f7a7778b","resolution":{"observed_at":"2026-05-17T13:14:38.696077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Resclip: Residual attention for training-free dense vision- language inference","venue":null,"work_id":"67f0b691-0e94-49e9-ab9c-3c7aeb031b0a","year":2025},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:1b3fae9444170fbd15615921c9aa44732139de5f757ddd179e2c53f4d735d5ea","observation_id":"3ce42ca1-3721-4df5-beb6-9d96a85771f3","resolution":{"observed_at":"2026-05-17T13:14:38.559534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Convolutions die hard: Open-vocabulary seg- mentation with single frozen convolutional clip","venue":null,"work_id":"6104053f-c094-4107-a670-cd4e71056adc","year":2023},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:f15e20e1297b48eaa71f16e637eb86b01fc16db2ad340fc6b5bf1ba636ac8794","observation_id":"24bc501f-0317-424b-ac48-796869647437","resolution":{"observed_at":"2026-05-17T13:14:38.562867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Soma: Singular value decomposed minor components adaptation for domain generalizable representation learning","venue":null,"work_id":"7f648340-6739-4f75-b95d-ab25bfdfc9d4","year":2025},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:e7a4beee97211d8dabe3669b0905b57835a86addf8efdc0ceb11cd299134a538","observation_id":"6a2901e3-2be9-4131-a63a-e0feffec379e","resolution":{"observed_at":"2026-05-17T13:14:38.622370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":"325c0867-abdc-4ba3-b30d-c2ed37481a7c","year":2023},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:d1bbccc01e3123d1fd1a08c5fac0a8c8e9c4ca03caa8a4b60058088639eeb67a","observation_id":"42b9323d-2453-4143-a3c0-bff0a17ef8f7","resolution":{"observed_at":"2026-05-17T13:14:38.565721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Uncovering prototypical knowledge for weakly open-vocabulary semantic segmentation.Advances in Neural Information Processing Systems (NIPS)","venue":null,"work_id":"fa62743a-dc33-4bca-8cfe-026e346eec89","year":2023},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:02daf3112450a4c0742b16c9f60b3882ffdee923adfbf715795791de968317f2","observation_id":"dca5a7f9-3a67-41a2-9fae-91a4a9400eab","resolution":{"observed_at":"2026-05-17T13:14:38.545168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Corrclip: Re- constructing patch correlations in clip for open-vocabulary semantic segmentation.Proceedings of the International Con- ference on Computer Vision (ICCV)","venue":null,"work_id":"e76ca273-3e69-4eb0-b4bb-36cdc34c878b","year":2025},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:d4bdf3c736f5be8e62aca9f35e372bda24013d51b6668da08739f52c5bff9cca","observation_id":"670f0778-0c86-41c9-ad9a-87e15c4d4f1d","resolution":{"observed_at":"2026-05-17T13:14:38.692745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mamba as a bridge: Where vision foundation models meet vision language models for domain-generalized semantic segmentation","venue":null,"work_id":"183627c7-11e1-4aff-9bfe-1336cfcece9c","year":2025},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:ff89dde6b3b3c1f637906164f492ed7fb4cbc9639814545e9029b11cca5ea1a1","observation_id":"63bec8ea-2808-4df9-8166-69dab67831b7","resolution":{"observed_at":"2026-05-17T13:14:38.660337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scene parsing through ade20k dataset","venue":null,"work_id":"709e4648-e26a-45b3-9d64-cbc8c2522aae","year":2017},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:82899dbdb7b0ed38ef1ee6a0e584bf249e51d581422065ebc3cfa816a36d0dd3","observation_id":"61864df6-fd0c-46f7-b844-e8649c7c58b2","resolution":{"observed_at":"2026-05-17T13:14:38.641488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1940.0139","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"a photo of {class}","venue":null,"work_id":"b9cc04f5-ccd7-4ca7-bdc7-548b1c7f2310","year":2022},"citing_paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-10T16:51:37.845654Z"},"links":{"citing_paper":"/paper/2604.08110"},"observation_digest":"sha256:0893e4ae5727f519b42d3adde72dd4dd9e796c634f078637d71dc6840545757c","observation_id":"84888123-5abd-45bf-943d-3bf8274d76c5","resolution":{"observed_at":"2026-05-11T08:00:59.076099Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.08110","last_updated":"2026-04-10T02:00:12Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T01:47:26.723410Z","submitted_at":"2026-04-09T11:28:43Z","title":"OV-Stitcher: A Global Context-Aware Framework for Training-Free Open-Vocabulary Semantic Segmentation"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":3,"verified_fuzzy":59},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2604.08110."}