{"as_of":"2026-08-14T20:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5cf80f7d290a64642cca28e29b45c264210a9c61f344a74226c5b0d0f7ef1312","coverage":[{"denominator":82,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":82,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:24:02.661925Z","state":"measured"},{"denominator":82,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":82,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19242/citation-record","integrity":"/paper/2505.19242/integrity","json":"/paper/2505.19242/citation-record.json","paper":"/paper/2505.19242"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:55.231201Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.231201Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:8476f9ecd0ac498dd4068efc5509d3ce3f5c871f710549c9cfa3829ea7a4b00e","observation_id":"3f6410fe-6fb1-4bb9-98fb-caba500f279a","resolution":{"observed_at":"2026-08-07T14:23:55.231201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:55.291714Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.291714Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:2b2d21bf5b93cc97dc80962178b3566811bb25f2bc409429b13664882e05cfec","observation_id":"cdb46eb2-b735-48be-978c-ca6a962ed597","resolution":{"observed_at":"2026-08-07T14:23:55.291714Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.05547","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:05.264624Z","title":null,"venue":null,"work_id":"f012b8bf-7b0a-4dde-98b4-6dbae2beaa65","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.366792Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:d6a754077058092a50ba72e135b686fc5b7ee42c393796583e5e74ca8ddcf009","observation_id":"412683ca-6f9b-4dd5-8200-2bc36d88cd40","resolution":{"observed_at":"2026-08-07T14:24:05.388730Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/s24206539","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Yu, Y.-D","venue":"Sensors","work_id":"ff96f7ed-862b-4b95-b211-b06de003cd94","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.463304Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:11100a9dcc1855c2dfa778d08aa332902d3120292ee1cebeb080caae8aa03799","observation_id":"c2f9cadf-12fe-4657-8c24-7907b677958d","resolution":{"observed_at":"2026-08-07T14:24:03.176683Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:15.043895Z","title":"Zhang, Y","venue":null,"work_id":"e1cc4813-55bc-4b9e-a18a-494c5d5693e0","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.588072Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:8ff7943ff7bbf2f6c116804a6775a0ca071e66b1e682a026831ea640a04da171","observation_id":"0df95f99-df1f-445d-9ae1-b661898d6657","resolution":{"observed_at":"2026-08-07T14:24:15.153992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.869037Z","title":null,"venue":null,"work_id":"ae196bff-90fc-4946-b870-0fd852858a5a","year":2017},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.695336Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:8045132bc847632f83a962e7cb25331e1105b6f813169216b7296bd31736544a","observation_id":"54530ca0-a14c-449c-8991-f03757b523e5","resolution":{"observed_at":"2026-08-07T14:24:14.939368Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.651523Z","title":null,"venue":null,"work_id":"3244e2e1-4e78-4308-aa9c-860a282bbd02","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.774266Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:51259ed7827aca4b6414f1090f6ac542968c759bb741a005863b7ead9f32bbb9","observation_id":"848018ab-c4e8-4435-b19e-ae27ce6660eb","resolution":{"observed_at":"2026-08-07T14:24:14.745038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14969","last_updated":"2023-05-24T10:02:27Z","snapshot_observed_at":"2026-08-13T11:34:39.554053Z","submitted_at":"2023-05-24T10:02:27Z","title":"MMNet: Multi-Mask Network for Referring Image Segmentation","version":1},"cited_work":{"arxiv_id":"2305.14969","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.14969","snapshot_observed_at":"2026-08-07T14:24:04.997922Z","title":"MMNet: Multi-Mask Network for Referring Image Segmentation","venue":"cs.CV","work_id":"8cb8d1d6-7851-4ee4-abbd-fe8597f7e04f","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.863064Z"},"links":{"cited_paper":"/paper/2305.14969","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:2bf1c1052c8073e3d74d5632ec80ea61a0ea36f2bf21ae4e851d9d513c890946","observation_id":"5eee0ec0-c900-4f14-bce0-ac7b9b2f14b9","resolution":{"observed_at":"2026-08-07T14:24:05.093098Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.10747","last_updated":"2021-11-25T03:43:26Z","snapshot_observed_at":"2026-08-13T17:30:14.414046Z","submitted_at":"2021-11-21T05:54:17Z","title":"MaIL: A Unified Mask-Image-Language Trimodal Network for Referring Image Segmentation","version":2},"cited_work":{"arxiv_id":"2111.10747","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.10747","snapshot_observed_at":"2026-08-07T14:24:04.784748Z","title":"MaIL: A Unified Mask-Image-Language Trimodal Network for Referring Image Segmentation","venue":"cs.CV","work_id":"2f80e924-a618-43cc-bddf-2f7355593adb","year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:55.923057Z"},"links":{"cited_paper":"/paper/2111.10747","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:18c8f21e3a17c87f12abfd9bd681ce0e78aa79975de972f1e3b021491dccfdbb","observation_id":"2edc4afd-c848-419c-913f-0508787ae2c6","resolution":{"observed_at":"2026-08-07T14:24:04.861073Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.05565","last_updated":"2021-08-12T07:24:35Z","snapshot_observed_at":"2026-08-10T13:52:46.061913Z","submitted_at":"2021-08-12T07:24:35Z","title":"Vision-Language Transformer and Query Generation for Referring Segmentation","version":1},"cited_work":{"arxiv_id":"2108.05565","doi":null,"metadata_source":"pith","pith_arxiv_id":"2108.05565","snapshot_observed_at":"2026-08-07T14:24:04.564620Z","title":"Vision-Language Transformer and Query Generation for Referring Segmentation","venue":"cs.CV","work_id":"0c800f62-9d8f-4624-a502-b59d20a3a1c3","year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.019878Z"},"links":{"cited_paper":"/paper/2108.05565","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:7f1cad065ea9e60e08172c8ae23c29fd9e24e233e282f50519eb2de3d79ab90f","observation_id":"ac1b0ce9-8dab-4242-9879-a2119c0bbea0","resolution":{"observed_at":"2026-08-07T14:24:04.682750Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.456850Z","title":null,"venue":null,"work_id":"591666b5-13dd-495a-bd10-29af34018c97","year":2025},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.123163Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:5a2a62cf8241bbf235f79d8e30c048c8e99d37f7802c92057089fdbd3661bbe8","observation_id":"1b93d672-0cb6-4b6f-8022-ab749369de45","resolution":{"observed_at":"2026-08-07T14:24:14.552615Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08021","last_updated":"2024-10-25T16:25:26Z","snapshot_observed_at":"2026-08-12T22:26:14.007425Z","submitted_at":"2024-10-10T15:18:19Z","title":"OneRef: Unified One-tower Expression Grounding and Segmentation with Mask Referring Modeling","version":2},"cited_work":{"arxiv_id":"2410.08021","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.08021","snapshot_observed_at":"2026-08-07T14:24:04.368528Z","title":"OneRef: Unified One-tower Expression Grounding and Segmentation with Mask Referring Modeling","venue":"cs.CV","work_id":"092d0445-7b78-4407-839c-2add4fe7af6f","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.247306Z"},"links":{"cited_paper":"/paper/2410.08021","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:1ca54e0f7ed081edf75e3fdf49b0a733d7bdf95a4cb3ef27ad66094804bd5513","observation_id":"d2c58a35-5ffa-41a2-bd3c-8a8a7b6918d4","resolution":{"observed_at":"2026-08-07T14:24:04.432677Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/ojsp.2023","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:02.984251Z","title":null,"venue":null,"work_id":"718848fa-fad2-4c79-a07f-ad956631186f","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.317625Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:78a7f32b426b74ccd53e921519a5739a4cf0b4d4a5976ae602f03473b2a8757a","observation_id":"b35ca022-fd38-4b79-bf1f-4c981d69bec8","resolution":{"observed_at":"2026-08-07T14:24:03.024883Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-07T14:23:56.388050Z","title":"Radford, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.388050Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:aaf9f8d7a603dd508992994a2bba6d8e690a32d63ca91e0c38f352dacc16bc33","observation_id":"b53b66ad-3e8f-4f5b-842a-6cd644faa492","resolution":{"observed_at":"2026-08-07T14:23:56.388050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.309502Z","title":null,"venue":null,"work_id":"258c3bff-d506-479c-857b-fc8f16fca07f","year":2016},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.466157Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:76ba5cf989496d8545b8688f0094d8bd0ff7fb41df0895b00a45f4df77bdefe2","observation_id":"c54f4648-76c2-456f-ab7b-d9d613a3b96d","resolution":{"observed_at":"2026-08-07T14:24:14.380077Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06718","last_updated":"2023-07-11T18:13:14Z","snapshot_observed_at":"2026-08-13T12:03:21.129454Z","submitted_at":"2023-04-13T17:59:40Z","title":"Segment Everything Everywhere All at Once","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06718","snapshot_observed_at":"2026-08-07T14:23:56.532387Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.532387Z"},"links":{"cited_paper":"/paper/2304.06718","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:2a913cc335915b1a3370a9c0d0e819b116d518bba586328354ba1f5d33752ad5","observation_id":"abf5aaca-21bb-4d6a-a111-80dc9d3d8b09","resolution":{"observed_at":"2026-08-07T14:23:56.532387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12086","last_updated":"2022-02-15T05:43:32Z","snapshot_observed_at":"2026-08-09T08:39:37.884261Z","submitted_at":"2022-01-28T12:49:48Z","title":"BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12086","snapshot_observed_at":"2026-08-07T14:23:56.621484Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.621484Z"},"links":{"cited_paper":"/paper/2201.12086","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:828bf9eec51d2a7ff463fc7c0b174dc1e42725b28e96f17694d9131c9acb0f2e","observation_id":"16464c40-9da1-4e3c-a1af-1ab136a3a7b7","resolution":{"observed_at":"2026-08-07T14:23:56.621484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:14.105971Z","title":null,"venue":null,"work_id":"1c33cd59-b62b-4026-8ab7-a0b752b9ed53","year":2022},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.695977Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:ac1ee63e8edb3c27fd5b4c3c6e994608d04bdc5525a29a91e18b9fadffbcd34d","observation_id":"e2fa1244-118e-4fd5-a092-22e8fec15f3f","resolution":{"observed_at":"2026-08-07T14:24:14.209386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.950712Z","title":null,"venue":null,"work_id":"e18da8de-762d-4f25-b8aa-b30ab9bd94b4","year":2016},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.763694Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:21aaef3b18e929f88c4c718d6bf187c68ffef7f2d61547828ea6a6e00c3ef793","observation_id":"d1b7499d-b955-4fb2-9811-4fb21a275e80","resolution":{"observed_at":"2026-08-07T14:24:14.034285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.762695Z","title":null,"venue":null,"work_id":"b61f8090-488e-474a-84cd-1d8bab78cb0c","year":2016},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.826515Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:8ba13635ee85e8e4f83d6982847ff51f42bd0471c3eeeb4e7e7a6e87dc8113fc","observation_id":"2cdfde7c-6275-4341-9fcc-578f69b3ef8c","resolution":{"observed_at":"2026-08-07T14:24:13.849499Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.576171Z","title":null,"venue":null,"work_id":"fac59cee-f1fc-4190-b261-7fe0835e3e11","year":2020},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:56.927064Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:d9770c6430ba251731249980aaa45f3dc2f6b284283a0db448d29472baab7743","observation_id":"f539b3f7-0aa0-41dc-a64e-ffbbdcad97c2","resolution":{"observed_at":"2026-08-07T14:24:13.653021Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.390478Z","title":"Liu, et al., Referring image segmentation using text supervision, in: Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV), IEEE, 2023, pp","venue":null,"work_id":"c00d62ea-0da1-46ce-a972-3e0510cbd100","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.022949Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:ade959e5fb39b81d895cff348e833d1443d13d0032fe278b989af2b5eb911855","observation_id":"888f1f31-1e12-4423-bd9e-642a46b3f33e","resolution":{"observed_at":"2026-08-07T14:24:13.488439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.253145Z","title":"Alalyani, N","venue":null,"work_id":"2670bd30-629f-48cd-a150-d705dbca04f5","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.136273Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:57077a280038d1e74f508fe6429ec93f0eb172122f3ba4ba0d5bac9530216857","observation_id":"afb4b531-4dd5-4fe7-8ffd-49b1fbc76b48","resolution":{"observed_at":"2026-08-07T14:24:13.304568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:13.076997Z","title":"Alalyani, N","venue":null,"work_id":"7bc4f10c-f4b8-486c-af91-3bef2bbc59b7","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.285282Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:2dc8aba2b6949ee012235c95956d054ed99247e2b0656cb8007585fb3546d2a9","observation_id":"17d8670d-381a-441b-86b2-75bceeb4afef","resolution":{"observed_at":"2026-08-07T14:24:13.174981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:57.397914Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.397914Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:12be03a933fb78bb4128ae226727cb6cc50d8cff1e8954dfdd882dc2ee79ba4b","observation_id":"26e14445-2226-47ed-b3cd-a706bdf235dd","resolution":{"observed_at":"2026-08-07T14:23:57.397914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:12.922463Z","title":"Shridhar, D","venue":null,"work_id":"6929876f-74bd-473b-a416-ec272f3d03bf","year":2018},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.517867Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:6bd5fa577c5f20508bfc563c372dcf584a40df11473dd9897694623741565792","observation_id":"0c5918fa-4d25-4102-83dc-1ab4d6a164d2","resolution":{"observed_at":"2026-08-07T14:24:13.004080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:12.708541Z","title":null,"venue":null,"work_id":"e42549b4-42ac-4fc4-adff-af1dd02fcfcd","year":2020},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.635202Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:fe978ae26b0275c8d33ae51d4513d447ea9ad6fe7ae8c976266fe77a6df10460","observation_id":"d17e2835-d6cf-4d28-aa8b-0219b9c1225f","resolution":{"observed_at":"2026-08-07T14:24:12.831559Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:12.445903Z","title":null,"venue":null,"work_id":"e3d104b2-c839-459e-91e4-4228d32802c1","year":2018},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.816518Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:f31f6df982f45c32bc67ea83eaadb9f29cb4ced20993c9053ced42064c6e7806","observation_id":"231ae591-fd23-4d3b-ab01-2ea7ef7d12b6","resolution":{"observed_at":"2026-08-07T14:24:12.574482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:12.193667Z","title":null,"venue":null,"work_id":"385f49d7-e62f-48de-8cff-7af692745ed0","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:57.935540Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:95399b39c1acb4ee50adf705a9c76fea86bad3f9d080c288fd976fd6cf4b886c","observation_id":"0bec7c59-e0cb-47eb-9141-51e28bd49d4d","resolution":{"observed_at":"2026-08-07T14:24:12.319447Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:12.001875Z","title":null,"venue":null,"work_id":"3ed75c1c-7114-45c3-86e8-31debc2294b7","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.043937Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:9626d47829b0678d9833c278cb9c1fd0721e9f49816db85a118f7d52a18e4fdf","observation_id":"067cbf1f-f58b-496c-b010-350c67dc83ef","resolution":{"observed_at":"2026-08-07T14:24:12.107304Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:11.734372Z","title":null,"venue":null,"work_id":"159ae1c7-f20a-4e66-b475-44996fc18cec","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.212888Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:92b79265b42829f85116a7f1da0f6d604e065b0b9c105d92e4f0a3521580dfa2","observation_id":"0e0ff6f3-8991-4445-858b-fd4f36765da6","resolution":{"observed_at":"2026-08-07T14:24:11.870863Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:11.513650Z","title":null,"venue":null,"work_id":"94a4a148-a2f6-4104-8b43-0f8493f46540","year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.326136Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:f473f587ffe1c7de701b49ba3dfb87993b69d4e56369041e688d8033b97ff8e5","observation_id":"69d98dbe-b2af-4509-aae5-63d680b17fe7","resolution":{"observed_at":"2026-08-07T14:24:11.611389Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:58.434580Z","title":"Radford, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.434580Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:4a62711cfd807afc05b0db3db7a65dfff27a33df0e63c591a73455f8ca6bdae1","observation_id":"0ea30ce3-ac38-4b4e-842f-a35c32a162ba","resolution":{"observed_at":"2026-08-07T14:23:58.434580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:11.287588Z","title":null,"venue":null,"work_id":"323c9e5f-fefe-4c09-9ea8-424e5d9893df","year":2022},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.563432Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:fc732b0cafe42967ea76769e75aa41cb2859468baa494345949db5d85f6fab94","observation_id":"19a68453-b557-43ee-a567-2d93bf862482","resolution":{"observed_at":"2026-08-07T14:24:11.370014Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.10442","last_updated":"2022-08-31T02:26:45Z","snapshot_observed_at":"2026-08-13T14:40:51.995893Z","submitted_at":"2022-08-22T16:55:04Z","title":"Image as a Foreign Language: BEiT Pretraining for All Vision and Vision-Language Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.10442","snapshot_observed_at":"2026-08-07T14:23:58.697195Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.697195Z"},"links":{"cited_paper":"/paper/2208.10442","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:6f50db8b4e0ed118a613087dd7fe53f39ce416a29964aabacdab2141bcd48d9c","observation_id":"55dda319-a44a-484b-af45-a7782b2d1cda","resolution":{"observed_at":"2026-08-07T14:23:58.697195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-07T14:23:58.809623Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.809623Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:ed1cf111c7003a69d43e1f5f5df6b2cf82f0f038b6274d9c60030a6a5c693244","observation_id":"b2516255-6c1a-4c0e-821b-184673f4e58f","resolution":{"observed_at":"2026-08-07T14:23:58.809623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:11.053254Z","title":null,"venue":null,"work_id":"5af28754-4d7c-49db-ba54-8615d7ed879e","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:58.931516Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:1c2b7877e9df3ef8ea31a56a89870679ee11254e0649ad320997678be67cbbab","observation_id":"d5f05b20-233d-43e2-9996-0314f6808bc1","resolution":{"observed_at":"2026-08-07T14:24:11.166259Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:10.776803Z","title":null,"venue":null,"work_id":"87eeb3a7-a7e0-492a-9dee-bddb0f438594","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.035287Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:19f5b8ad43da1ab165bcd9c17654c64d36223370dfe37b365223ee19cafd68a4","observation_id":"2466b221-5558-4a6e-b063-2e49e8e0c6d1","resolution":{"observed_at":"2026-08-07T14:24:10.906943Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:10.497761Z","title":"Radford, J","venue":null,"work_id":"a6e20ef0-5263-48e5-8253-7ca21a55d7d9","year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.180506Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:7f233e8993c02cb6fdb049e997c78f0b86dcc12ff306e2afea6d68508775f359","observation_id":"b631d4ea-e6c3-4389-b97b-ed3feb4a376a","resolution":{"observed_at":"2026-08-07T14:24:10.632179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:59.281949Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.281949Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:df39abbc8f8245070f587a18966f3d001f056241d72c66b8a7fce1c8aada1549","observation_id":"423aeafe-d9f9-46ae-aa6a-09fdc8f09f43","resolution":{"observed_at":"2026-08-07T14:23:59.281949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:10.261984Z","title":"not specified, Referring expression comprehension using language adaptive dynamic subnetworks, in: Proceedings of the AAAI Confer- ence on Artificial Intelligence, Vol","venue":null,"work_id":"b4116683-64ba-4c30-b394-239c880af55c","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.439204Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:c0a6759ae5c1e973316a031cf97b9374a3ca60e39939fe34fce8498d4460e833","observation_id":"96126dca-0cb7-44ca-898a-c6196cbc6fc2","resolution":{"observed_at":"2026-08-07T14:24:10.371389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:10.043126Z","title":"Hemanthage, H","venue":null,"work_id":"6f387a40-eafc-43c3-9e49-f9a2abbb9893","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.553531Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:0977a3eda70d5918c2a8e80c28a85790bb85262b18038880d22cd7e3f46a0d0e","observation_id":"d220c982-4abf-40f4-8120-a7b4dd6171cf","resolution":{"observed_at":"2026-08-07T14:24:10.148740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:09.814694Z","title":null,"venue":null,"work_id":"e2d19629-740d-4e87-a785-60ed0b78543e","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.703413Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:32d3fe6b81e83689a495847016a6a6b5a0faaac6c8c3a40f93925f5102c66732","observation_id":"9da7424e-4c4d-4846-a2a1-f9677a5c425d","resolution":{"observed_at":"2026-08-07T14:24:09.926052Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:09.643613Z","title":null,"venue":null,"work_id":"63a5cbb2-e057-4147-b3cb-d5c520412626","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.781051Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:f97de02eccd51dba9a2d741be0e78532e98c14a7d99bd920966047bda44321eb","observation_id":"aaf930b9-ce87-4ab2-985e-1ade0322aa45","resolution":{"observed_at":"2026-08-07T14:24:09.714408Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:09.472817Z","title":"Zou, Z.-Y","venue":null,"work_id":"771b2373-5964-4a4c-8e5f-e87b3012d2a6","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.839299Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:84f7162ef990af40b58f3fb1220addca311a4cbd724401c11748a341d5d0034a","observation_id":"412f41f1-7c08-49d3-b47a-22ebc342fad5","resolution":{"observed_at":"2026-08-07T14:24:09.546223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:09.283593Z","title":null,"venue":null,"work_id":"eccb7685-8d75-421b-8bb2-6b3d8bcd819d","year":2022},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:59.925614Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:b8e58650ee5ba8ecb79a407dbf961a39d226bc6a78085e2535c7daec1e14d04d","observation_id":"5185efd4-c16d-4bb5-88df-51b35726cb53","resolution":{"observed_at":"2026-08-07T14:24:09.366169Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:09.115277Z","title":null,"venue":null,"work_id":"f7a26d0c-24ec-496a-ac56-ee277ff6bbca","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.030773Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:efd00e72e4ba3363bbc8dd955f1c92244e7bdb036602f43478d7a75fb2a540d9","observation_id":"d765574d-0b72-4cf6-93ca-9dfa43452022","resolution":{"observed_at":"2026-08-07T14:24:09.201043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:00.111259Z","title":"Hadsell, S","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.111259Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:52819ba07aee21d5c29d6a273e96fdf5aca0fde61589403af7e711dc9e79afda","observation_id":"32441750-473c-4ecb-9aaf-c3d84bdd4c1a","resolution":{"observed_at":"2026-08-07T14:24:00.111259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.913305Z","title":null,"venue":null,"work_id":"083bf5f6-405e-4223-9dd9-0cf72f4a7ffb","year":2020},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.220749Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:cb08ffb85aaa90aaba9860e52d90cf82c083f3f6c040d205768106d211e90107","observation_id":"acc1b547-e3e8-47be-8666-0e3f053482b0","resolution":{"observed_at":"2026-08-07T14:24:09.026516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-19809-0_17","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:03:45.533247Z","title":null,"venue":"Lecture notes in computer science","work_id":"825d5941-5355-4a1d-a380-9f4fe6929c5f","year":2022},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.317061Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:b6f900159c7b73e51007741b909c3310cce6c35aeee51b504c55938178474534","observation_id":"2c8164a5-158e-4815-a5d4-275aa7826736","resolution":{"observed_at":"2026-08-07T14:24:02.906483Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.726346Z","title":null,"venue":null,"work_id":"914356b7-cea8-492f-90cd-189074b52aab","year":2020},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.398671Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:cf87e0c5def3b03e5af6d6c22b9c94ec6ed298d686257b81331d7312934d18e4","observation_id":"29267644-e5a1-402c-a845-f44a2f1e0dcd","resolution":{"observed_at":"2026-08-07T14:24:08.828284Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:00.565964Z","title":"Zhang, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.565964Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:8c043674b190f670705e262f2450e45add91a1790b861da7cef3e2ccf6fb4f5d","observation_id":"82b3b28e-75cc-4fc8-995b-71d5d638f3a6","resolution":{"observed_at":"2026-08-07T14:24:00.565964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:00.620701Z","title":"Zhang, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.620701Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:eecff73f4864fa754cdc23da5111038887db64d705ec217301cec715d9c746a6","observation_id":"848d770f-30f1-44e2-8721-41cfbb2e4972","resolution":{"observed_at":"2026-08-07T14:24:00.620701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.05499","last_updated":"2020-12-07T20:16:40Z","snapshot_observed_at":"2026-08-08T11:49:27.221156Z","submitted_at":"2020-11-11T01:28:11Z","title":"Unsupervised Learning of Dense Visual Representations","version":2},"cited_work":{"arxiv_id":"2011.05499","doi":null,"metadata_source":"pith","pith_arxiv_id":"2011.05499","snapshot_observed_at":"2026-08-07T14:24:03.760774Z","title":"Unsupervised Learning of Dense Visual Representations","venue":"cs.CV","work_id":"bbe40933-7e60-45ae-87d4-dd06a8c9852f","year":2020},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.697079Z"},"links":{"cited_paper":"/paper/2011.05499","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:3007365a1f3f4463246c5344ca074af4e677948a8ad7404715802bf7c7a8f2c6","observation_id":"df32b2a5-cb45-4aac-af94-7e79b4cc9678","resolution":{"observed_at":"2026-08-07T14:24:03.849322Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:00.775943Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.775943Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:9e326aeca642a8f534354307ac1df522dffdc64e797af6a446cdf97281c22fe5","observation_id":"1ef81135-eba8-4072-afa4-5b6318bd3adc","resolution":{"observed_at":"2026-08-07T14:24:00.775943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.577605Z","title":null,"venue":null,"work_id":"48771372-576e-4b3c-ad0e-4fc988a547ea","year":2018},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.862978Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:541dc66a87ed726cce0ecdcf0099236ccedc617e2b3ddd8b137821d1c3047bb0","observation_id":"1432f7da-eaef-47c4-b0fd-bff5cf8c402e","resolution":{"observed_at":"2026-08-07T14:24:08.657255Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.436569Z","title":null,"venue":null,"work_id":"0eb67b29-52ff-423d-bd22-f7526e0eb330","year":2017},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:00.943994Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:fb55b0943d68a4ad5be3b639d12aed462ae2fa03d0cac888ee3b893648da2d7d","observation_id":"5fa0e70c-cc02-4fb3-b329-db3f9de29aa5","resolution":{"observed_at":"2026-08-07T14:24:08.500465Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.314673Z","title":"Margffoy-Tuay, J","venue":null,"work_id":"53e94ec6-263f-4717-9c75-01c0caacc98e","year":2018},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.017186Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:92568cac454dd385b1c3312572093cd554aa6c170c29ef9769b8ecec0f804040","observation_id":"118f7de5-60b4-4621-a25b-0bd88916e34c","resolution":{"observed_at":"2026-08-07T14:24:08.368385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:01.094938Z","title":"Hochreiter, J","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.094938Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:8c3c6ab39a6f4b59caadac85788bc7ab190a30b5a23b592e48cb7b8b65ccdfa0","observation_id":"ea41c28b-7846-4fdd-8f49-bb51bb337cd1","resolution":{"observed_at":"2026-08-07T14:24:01.094938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:08.159529Z","title":null,"venue":null,"work_id":"6cb02767-d949-49ef-87a9-61c7f41f96fb","year":2015},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.141345Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:a5e71172ba135f14b70d7b5a92bf809fad7b1093210425d9853e15a7c1bdb93c","observation_id":"7950053c-14fa-4d21-8639-71daafe7955f","resolution":{"observed_at":"2026-08-07T14:24:08.227758Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.959342Z","title":null,"venue":null,"work_id":"24cc4439-4c90-4786-8524-a7bd7534e78b","year":2017},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.188503Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:334f16a68f540293d2a38f3f4c2a4f77331c3a0c2c73ddb9d992a260f304f26c","observation_id":"e2491f1b-6bdf-4638-be67-e5bec3bedc0c","resolution":{"observed_at":"2026-08-07T14:24:08.053768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.777437Z","title":null,"venue":null,"work_id":"c979ee3b-b776-4063-a9f8-0f812c3d4b32","year":2020},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.282692Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:9fe600009f79c74ac1b735bbb795cae2e13365952f0e762f14b8cfbe2ca3d60c","observation_id":"9f254d5f-8998-4e6a-ad90-44ab246303e1","resolution":{"observed_at":"2026-08-07T14:24:07.877328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15727","last_updated":"2024-05-21T10:06:33Z","snapshot_observed_at":"2026-08-13T14:52:15.503629Z","submitted_at":"2023-11-27T11:24:25Z","title":"RISAM: Referring Image Segmentation via Mutual-Aware Attention Features","version":4},"cited_work":{"arxiv_id":"2311.15727","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.15727","snapshot_observed_at":"2026-08-07T14:24:03.577171Z","title":"RISAM: Referring Image Segmentation via Mutual-Aware Attention Features","venue":"cs.CV","work_id":"bbd097ed-fad3-4503-88b4-0c81646f94a5","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.366937Z"},"links":{"cited_paper":"/paper/2311.15727","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:cd5779414b6845237c73dfeafc791abcb1bd7f060b20c483a5706fcf65b327d2","observation_id":"c85775b8-f1e0-4042-84db-a1d5dea91816","resolution":{"observed_at":"2026-08-07T14:24:03.639776Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:01.450292Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.450292Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:7db8c936d8787382232cf396ad7286716b43134b11b6c057cb2d8630e3800886","observation_id":"ee341433-de90-4bb6-aae0-1890f69eca37","resolution":{"observed_at":"2026-08-07T14:24:01.450292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.594473Z","title":"Ouyang, H","venue":null,"work_id":"ae5f2d18-e908-4237-956c-ad84354461c9","year":2023},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.571934Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:c6a79982247bbc16e97374548e0416ed82020f8f2f7bc32d5fd52ca1eeeef25a","observation_id":"a0331324-08cc-486a-bec5-faafbe7a564a","resolution":{"observed_at":"2026-08-07T14:24:07.693966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.431100Z","title":null,"venue":null,"work_id":"df940cc2-de09-4166-9f2f-37f3d66cf5b9","year":2019},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.630230Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:0686f23e4e63e182b97d0c959e280294b937be1c71d1d133c397fa03f2f5aeb9","observation_id":"967f50e9-1f7e-49bf-9cb5-15f106fa7f31","resolution":{"observed_at":"2026-08-07T14:24:07.488342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.284961Z","title":null,"venue":null,"work_id":"d1b90935-6ec4-42b5-903e-079b473aa18a","year":2020},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.713039Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:277ba3402f8979ef58d6e1b249712cffbee224d4416a32ed3a9faf74978c1ee3","observation_id":"208ff8a1-b668-4e2b-b72f-0dfca595616e","resolution":{"observed_at":"2026-08-07T14:24:07.339062Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11205","last_updated":"2024-05-18T07:21:12Z","snapshot_observed_at":"2026-08-13T00:04:42.653759Z","submitted_at":"2024-05-18T07:21:12Z","title":"Fuse & Calibrate: A bi-directional Vision-Language Guided Framework for Referring Image Segmentation","version":1},"cited_work":{"arxiv_id":"2405.11205","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.11205","snapshot_observed_at":"2026-08-07T14:24:03.430865Z","title":"Fuse & Calibrate: A bi-directional Vision-Language Guided Framework for Referring Image Segmentation","venue":"cs.CV","work_id":"858b486f-64d4-492c-974c-2f7357e43206","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.789143Z"},"links":{"cited_paper":"/paper/2405.11205","citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:34e65a12361adf3a8b1d4b9ffa818685df5b3ddb3ce1e04e1399ddb00e691821","observation_id":"6930561c-3ab8-4c66-b906-7ad4467d85c1","resolution":{"observed_at":"2026-08-07T14:24:03.476176Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.neucom.2024.01.123","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:02.741702Z","title":"Shang, Z","venue":null,"work_id":"bbfbcd47-34a6-4537-a91f-7ca9199a314d","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.893751Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:249b60ce923eb24a0dee62e6ced3c9628a4c4e83f2fdaf358666654a436f4118","observation_id":"92f42f8a-7bb5-47d9-88ac-83235de47f5f","resolution":{"observed_at":"2026-08-07T14:24:02.784627Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.120741Z","title":null,"venue":null,"work_id":"3f2c57ef-879c-40e6-87c6-886889bc2df8","year":2017},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.943222Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:2b317a467ea55da88fd7468fc9db98ad78b410d2c063d0c9377ca4d1eacaa143","observation_id":"eb10da80-9867-4d9c-8759-206e9dd2e0f4","resolution":{"observed_at":"2026-08-07T14:24:07.209822Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:07.009939Z","title":"Goodfellow, Y","venue":null,"work_id":"223c9bee-c94c-4504-aa5f-182348830797","year":2016},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:01.987299Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:b36931098f06b0bdf0ec869b5165636a45e5fda8786d5887d1c1323a45a51e7b","observation_id":"e60e183c-2ac1-4506-8ec1-48aea573963c","resolution":{"observed_at":"2026-08-07T14:24:07.054842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:02.069128Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.069128Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:199ca01e9ee5c439cf658dfd584963c94464623b805f7e8a53a7cac50b9bdad4","observation_id":"cdd47221-99d3-487f-a880-387df5b5678a","resolution":{"observed_at":"2026-08-07T14:24:02.069128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:06.803438Z","title":"Milletari, N","venue":null,"work_id":"206b45e7-7a1a-4d15-aa95-858e7e74d96a","year":2016},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.129152Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:bfde0231e662600b6ebac900ce7feccf597e433d82f90fa8ec146ba3d3e931da","observation_id":"b97f4a7b-0dbd-4738-aa1f-76de91858788","resolution":{"observed_at":"2026-08-07T14:24:06.907686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:02.183604Z","title":"Chu, Howard chu on lightning memory-mapped database, IEEE Soft- ware 36 (6) (2019) 96–100.doi:10.1109/MS.2019.2936273","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.183604Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:6e4d5b05450e1c66df30dcb0457ce5aeb881401c0cd261993b91aac0e90b773e","observation_id":"657c85b3-bd2b-42d5-aa8d-744e2377e846","resolution":{"observed_at":"2026-08-07T14:24:02.183604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:06.631497Z","title":"Zhang, K","venue":null,"work_id":"ace5e33e-ede0-45dd-8d71-9f49c9aec613","year":2018},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.246308Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:ce0ca516b8d0c6a432d80124601b43e916b3a83c02fc92af226ec7231ba2f00f","observation_id":"d6d44d36-cc52-4043-915d-e8f1f799e65b","resolution":{"observed_at":"2026-08-07T14:24:06.715852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:06.429925Z","title":"Pascanu, T","venue":null,"work_id":"9b24f5ff-f5bc-4670-ac87-2741e8c38824","year":2013},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.298821Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:c6d08b593e4b2d6b115f8b7a1196fef74f0f0e38c75ebd058f8b133bfe72bd2e","observation_id":"0abecf9b-1314-4c10-af9e-c2d1198ec91a","resolution":{"observed_at":"2026-08-07T14:24:06.522769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:06.323116Z","title":null,"venue":null,"work_id":"901abc4e-28c4-435f-b282-366a0355185c","year":2015},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.356175Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:6dbf105fa05c490be5f72501040425713ace9acef03381bd6e670ceb6e4d57f2","observation_id":"f14f776b-07f1-4c25-9094-62683d3e14c1","resolution":{"observed_at":"2026-08-07T14:24:06.384126Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:06.169420Z","title":"Kamath, M","venue":null,"work_id":"50e284f8-bfac-423b-9342-b7e00ae43d60","year":2021},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.425363Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:c21f2c7aaed182c7f92989f6b777a69ef30d3ffa3c2fcfd8be378fd69ca742e2","observation_id":"d37c73cd-245b-4974-aa88-8b0a11904bc2","resolution":{"observed_at":"2026-08-07T14:24:06.249451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:02.470522Z","title":"Zhang, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.470522Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:312eb747406537b433dfa918b4a7c0e275b6c5b30db671f423a87de514657eff","observation_id":"187f4fd2-7bbd-43e5-901f-b3729b9139de","resolution":{"observed_at":"2026-08-07T14:24:02.470522Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:05.961312Z","title":"Zhang, Z","venue":null,"work_id":"db721785-3fca-40ad-a647-2bd724115562","year":2024},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.528517Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:0db8cc237658380704ce4c2adb12ec17f5ab481ce94b89d3930dc796ac299f9e","observation_id":"dbd738ab-6934-4fcb-bcfa-a17f2ecf76f8","resolution":{"observed_at":"2026-08-07T14:24:06.043579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:05.721375Z","title":"Everingham, L","venue":null,"work_id":"7d063d7b-6912-4808-b27d-3a95740ece65","year":2010},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.623529Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:4b006cba4cc3fe33566b3168e7f33a2258a9865d865cba237120d48aecfc48ac","observation_id":"a165994a-ccc8-433b-94f9-cdeec58b8462","resolution":{"observed_at":"2026-08-07T14:24:05.841465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:05.525907Z","title":null,"venue":null,"work_id":"c04f1c7b-434d-4f49-b7bf-37fe5faa623d","year":2014},"citing_paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:02.661925Z"},"links":{"citing_paper":"/paper/2505.19242"},"observation_digest":"sha256:c57b4956d0a87ce86c1bd5f2ddf774344b4d90b0bbc5a4b789203c8234c946a2","observation_id":"a7147e71-1754-48d6-a910-ef431c5cdf82","resolution":{"observed_at":"2026-08-07T14:24:05.605840Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19242","last_updated":"2025-05-25T17:42:53Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T10:01:36.282685Z","submitted_at":"2025-05-25T17:42:53Z","title":"Deformable Attentive Visual Enhancement for Referring Segmentation Using Vision-Language Model"},"reference_resolution":{"displayed":82,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":50,"verified_exact":11,"verified_fuzzy":18},"total_outbound_references":82},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 82 of 82 outbound references and 0 inbound Pith citation observations for arXiv:2505.19242."}