{"as_of":"2026-08-10T01:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e325d2132ce07e6386d44472b7bc9a0391f0cb0b805ba251b687f8a94719ee0f","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T08:06:03.952787Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.08397/citation-record","integrity":"/paper/2607.08397/integrity","json":"/paper/2607.08397/citation-record.json","paper":"/paper/2607.08397"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T22:57:42.500290Z","title":"Mask r-cnn","venue":null,"work_id":"aa4d890a-4e96-4754-b284-bc82da5c52de","year":2017},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:53a807bc834bfd3b385a88869ccf2a2e79ed26e6f468dbc784a4388ec2cd496e","observation_id":"282ad1da-d8cf-4097-a2a1-4eaf8d6b2722","resolution":{"observed_at":"2026-07-10T08:06:58.004109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:58.007181Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":"a6405132-e40f-4647-a787-208dd90e0ec0","year":2015},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:b8038ee7d5cee79f7947c0ea522c8df4c0b9411313d72f1a335c589a1ec8524b","observation_id":"1b581d76-036b-4b98-96b8-2eb8aed1d186","resolution":{"observed_at":"2026-07-10T08:06:58.008278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:58.010183Z","title":"Unet++: Redesigning skip connections to exploit multiscale features in image segmentation.IEEE transactions on medical imaging, 39(6):1856–1867, 2019","venue":null,"work_id":"0038fed4-e8e2-4fcc-83f0-431813144946","year":2019},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:e430e88b689d418e612cb072d32a202b4f5797c4c78cce8ea69bce20cdc3cc12","observation_id":"7aa5b9a2-a14e-4786-a682-b6de3adc0835","resolution":{"observed_at":"2026-07-10T08:06:58.011406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.943265Z","title":"Cris: Clip-driven referring image segmentation","venue":null,"work_id":"f7c5d22c-f162-4f90-b7b8-58302a5a804e","year":2022},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:c80e8ce87b07f1e365448d2bf497c7a767fc883cefb0fc7db1a820953c41e3ed","observation_id":"599f7808-fcea-457d-bb01-e8a9ab1253f1","resolution":{"observed_at":"2026-07-10T08:06:57.944429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.977775Z","title":"Autolaparo: A new dataset of integrated multi-tasks for image-guided surgical automation in laparoscopic hysterectomy","venue":null,"work_id":"81df69f8-146b-47a8-a044-a932e23bd97e","year":2022},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:8c56fb95b52c966e367eb910f4dd6303a8634e1cb9c243b9ce31f9784372f53b","observation_id":"bc09234c-27e1-4293-ae9f-f8fe8fb80c82","resolution":{"observed_at":"2026-07-10T08:06:57.979429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.980035Z","title":"Large-scale self-supervised video foundation model for intelligent surgery.npj Digital Medicine, 2026","venue":null,"work_id":"c795a2a5-e615-4b8f-8ed3-7a2a08c386e3","year":2026},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:8ed8bf8e483ea9c048ec70558cdc70b650a2954a27c1bcba1f2d9d45478ca396","observation_id":"a84c8009-8959-4a16-81cc-3f33b1054b1b","resolution":{"observed_at":"2026-07-10T08:06:57.981729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.982340Z","title":"Gynsurg: A comprehensive gynecology laparoscopic surgery dataset","venue":null,"work_id":"c1b4ba0c-e51e-4395-a920-01f2c4c3de71","year":2025},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:69abc2169131eb794735309c7ba080ba16faad12a4f3fc2adf494e1f859bf026","observation_id":"f9b6d2f4-8dcd-4252-923a-46fa831e3fa4","resolution":{"observed_at":"2026-07-10T08:06:57.983796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.995307Z","title":"Egosurgery-hts: A dataset for egocentric hand–tool segmentation in open surgery videos.Healthcare Technology Letters, 12(1):e70049, 2025","venue":null,"work_id":"2101dd08-271a-423b-988d-6faca3e04c6a","year":2025},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:72f39a00de9d97c7ef8be25190a5bdc81716c594804050b444c94032f091baf7","observation_id":"521af013-97c0-4ebf-8186-80bfacbf1408","resolution":{"observed_at":"2026-07-10T08:06:57.996750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.996498Z","title":"Lisa: Reasoning segmentation via large language model","venue":null,"work_id":"44756a85-9a74-4dc5-9af1-1cfc39998d27","year":2024},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:c1f981d38ef911b9784670e08c18ed0f6c444048ec5062f53c9e599591f73465","observation_id":"130d67f4-a0d2-47ce-a9b4-a2cffe66051e","resolution":{"observed_at":"2026-07-10T08:06:57.997722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.999948Z","title":"Segment everything everywhere all at once.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"a46cf250-64a7-4420-bfa9-f940a0aad507","year":2024},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:8536eb45f81e1143071c5619c2f476405091404b53a472ce1d417c39fdda8d41","observation_id":"204dd83a-57d9-4555-b341-d04b1a9fc8f1","resolution":{"observed_at":"2026-07-10T08:06:58.001212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.971596Z","title":"Surgical scene segmentation using semantic image synthesis with a virtual surgery environment","venue":null,"work_id":"ad252811-4f47-493c-b805-0eb1ba2d33d4","year":2022},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:a098555c25a1c6712ff035c3ca1e87f96d74364e6fe0a9988df77b490d3f7ca3","observation_id":"7d81f4d3-1a5c-4f2d-97a3-3e83a20ebefd","resolution":{"observed_at":"2026-07-10T08:06:57.973052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.12453","last_updated":"2020-12-23T02:23:15Z","snapshot_observed_at":"2026-07-06T10:27:10.375609Z","submitted_at":"2020-12-23T02:23:15Z","title":"CholecSeg8k: A Semantic Segmentation Dataset for Laparoscopic Cholecystectomy Based on Cholec80","version":1},"cited_work":{"arxiv_id":"2012.12453","doi":"10.48550/arxiv.2012.12453","metadata_source":"pith","pith_arxiv_id":"2012.12453","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cholecseg8k: a semantic segmen- tation dataset for laparoscopic cholecystectomy based on cholec80","venue":"cs.CV","work_id":"dec916da-33db-4c38-a114-d2b85c47af57","year":2020},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"cited_paper":"/paper/2012.12453","citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:2c216b9df07879676b2377850fbacd28a44246956a7be8825af58b41e4194e8a","observation_id":"e95f69d0-b3b8-43f2-9ac6-e2f89bba3bea","resolution":{"observed_at":"2026-07-10T08:06:57.771168Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.976162Z","title":"Kvasir-instrument: Diagnostic and therapeutic tool segmentation dataset in gastrointestinal endoscopy","venue":null,"work_id":"101a3707-cf47-466f-a615-7f4f0a965ad6","year":2021},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:f0e348a6fc19cd05d365b7f24021e16776f6ac144b1776311a6cf4dd1a17dd92","observation_id":"b42e9a3f-a769-44e8-83a8-e8bf77f7ada9","resolution":{"observed_at":"2026-07-10T08:06:57.977383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.988940Z","title":"Garcia-Peraza-Herrera, Lucas Fidon, Claudia D’Ettorre, Danail Stoyanov, Tom Vercauteren, and Sébastien Ourselin","venue":null,"work_id":"70b74032-16e8-48f4-a380-329c77345647","year":2021},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:e3b6ae150f384b097d53e366f9f823500966e3145a1021172c42b556fc0cc92e","observation_id":"6da756cb-6965-4db6-b7f8-6a0d5c895ec7","resolution":{"observed_at":"2026-07-10T08:06:57.990565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.967207Z","title":"The dresden surgical anatomy dataset for abdominal organ segmentation in surgical data science.Scientific Data, 10(1):1–8, 2023","venue":null,"work_id":"0fdf309b-5964-4960-b814-09505c5ea8ac","year":2023},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:047ad24390698820d6d09d331ec59b3f80496b7c093d3595d318d2da5ecdfab5","observation_id":"b4e14e46-d4dd-402d-9905-9940bc800bbf","resolution":{"observed_at":"2026-07-10T08:06:57.968782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.966945Z","title":"2017 robotic instrument segmentation challenge","venue":null,"work_id":"17812a1c-7c70-44f3-9693-beb953c87507","year":2017},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:c49511270ae9acd408e71430c4c7db02616396839c7673cc82c9a87b1860831c","observation_id":"b75eafec-1b25-4e16-943c-63a9515bb5ad","resolution":{"observed_at":"2026-07-10T08:06:57.968109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.960886Z","title":"2018 robotic scene segmentation challenge, 2020","venue":null,"work_id":"d8958976-96c3-44e9-b795-a1e750feeb90","year":2018},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:f1cd899d07d9d39dd070ff009a833faff915d55a20027b0d4bf3ff621adce5f3","observation_id":"b9d891a6-147b-44a2-a759-a1a4077ac726","resolution":{"observed_at":"2026-07-10T08:06:57.962076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00496","last_updated":"2024-01-23T23:30:57Z","snapshot_observed_at":"2026-08-02T18:08:38.646548Z","submitted_at":"2023-12-31T13:32:18Z","title":"SAR-RARP50: Segmentation of surgical instrumentation and Action Recognition on Robot-Assisted Radical Prostatectomy Challenge","version":2},"cited_work":{"arxiv_id":"2401.00496","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.00496","snapshot_observed_at":"2026-07-10T08:06:57.763274Z","title":"arXiv preprint arXiv:2401.00496 (2023) 10 C","venue":"cs.CV","work_id":"19126299-b1af-49fb-a760-0f18e72033d3","year":2023},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"cited_paper":"/paper/2401.00496","citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:7d5104346ee33d14a3f41a972a0c734c661786bdc95e2f40c0e730ac961707df","observation_id":"79fa4c4c-f47f-4688-a4d1-85a8353775f4","resolution":{"observed_at":"2026-07-10T08:06:57.764766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.978000Z","title":"Generating large labeled data sets for laparoscopic image processing tasks using unpaired image-to-image translation","venue":null,"work_id":"4ecd534c-848e-4111-83b8-dcc4621ff05f","year":2019},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:8a6028306b91bba7cd3b41fc3f9abc3cf1bb53e49b2b6a8188e79524e4e92810","observation_id":"6dfc9388-bfdb-4bf1-a485-935d75507aea","resolution":{"observed_at":"2026-07-10T08:06:57.979255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.965148Z","title":"Opencv.Dr","venue":null,"work_id":"ab2c1aa2-f256-4ecc-a9c5-f673c33d2bce","year":2000},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:073ab04bf2bace2c932a5d710c088d7f4abe0c63f3943813edb775f6c50a5f33","observation_id":"19b9c102-d234-41a5-8c7a-21e117154f5f","resolution":{"observed_at":"2026-07-10T08:06:57.966578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:58.008462Z","title":"Image segmentation using text and image prompts","venue":null,"work_id":"a1828f63-125e-4b9e-8053-8fa1e79512eb","year":2022},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:8bb31b820424a49a15d9e864f7bacafdd191bf6bf33f7fa2c7d65faae6563aca","observation_id":"96807ec7-b5ea-4d08-b67d-d85ede60c7c5","resolution":{"observed_at":"2026-07-10T08:06:58.009661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.953373Z","title":"Locate then segment: A strong pipeline for referring image segmentation","venue":null,"work_id":"a334534b-a8c0-4ad1-949b-e0785fc4a020","year":2021},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:cfad5f3c5a79153ce3c4659ccbde391b9c94ceed3379619df6d809e48d7cc6fa","observation_id":"3be1f700-359f-486c-ac57-818e4e912179","resolution":{"observed_at":"2026-07-10T08:06:57.954624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.949462Z","title":"Vision-language transformer and query generation for referring segmentation","venue":null,"work_id":"7cd8c0cf-9ca7-4907-a422-9470a0063f75","year":2021},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:a9e10f2b5f503ed1e749cdca9889c7884778c7de91694e9063cb866baa8bec02","observation_id":"4c6c29c4-2161-484e-9a1e-c89d8f4cef12","resolution":{"observed_at":"2026-07-10T08:06:57.950723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:58.011958Z","title":"Language as queries for referring video object segmentation","venue":null,"work_id":"1a563d6f-9252-4ae5-a395-39bf59965ffb","year":2022},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:92bd80970d06adf8f66a9378e224253680355f43a6130ad25b0c6fc3c88beaf9","observation_id":"ccb14a81-4fe8-4e66-bd3a-d44acef5fce2","resolution":{"observed_at":"2026-07-10T08:06:58.013099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:58.005303Z","title":"Cross-modal progressive comprehension for referring segmentation.IEEE Transactions on Pattern Analysis and Machine Intelligence, 44(9):4761–4775, 2021","venue":null,"work_id":"19a881ae-d896-4d44-ae51-1c88f0e025e6","year":2021},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:d6b4177e895ebb23bdcd36f2d3a525debfb4cc1727ba9c7637762daab0f7bbda","observation_id":"fd6096d6-4e8c-4961-9531-a3f12c3d840e","resolution":{"observed_at":"2026-07-10T08:06:58.006699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.951086Z","title":"Attention is all you need.Advances in Neural Information Processing Systems","venue":null,"work_id":"7a0c19b7-253b-4851-a9e7-634bad097c17","year":2017},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:05fa8d3177c49d9e1eb70984240d9582fd2eae1a58ceadee7a512b85bbca3902","observation_id":"d76418fc-b71c-45a5-913d-8d958631d0a6","resolution":{"observed_at":"2026-07-10T08:06:57.952805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.954970Z","title":"Learning to segment every referring object point by point","venue":null,"work_id":"e5ce293c-eb46-4543-b5e5-ee1127e6e2fa","year":2023},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:e752235672997092e7e3ece1c22e68a9150ab66740eafeed515000ed43497ee6","observation_id":"4c3ea094-6a9d-4209-b5f8-2c11e2c7107f","resolution":{"observed_at":"2026-07-10T08:06:57.956798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.969443Z","title":"End-to-end referring video object segmentation with multimodal transformers","venue":null,"work_id":"abd51517-520f-4d8c-9824-ad02b234396c","year":2022},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:7253a9b1a5b981e7c7b16fd702d585b8665fe295d6d0b461211b4a3daafd438b","observation_id":"c1d8892f-320d-4141-84fc-4ab7bb11c395","resolution":{"observed_at":"2026-07-10T08:06:57.971024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":"2401.14159","doi":"10.48550/arxiv.2401.14159","metadata_source":"pith","pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","venue":"cs.CV","work_id":"42c46ece-c4e8-4d5e-abae-f8d5b4208995","year":2024},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:a2915665789b8432ff96ba96a60ac25b29dec77a7cf0feddc5137bd79059d236","observation_id":"dfcfd05a-15b0-4619-8a2b-85e10a32e24c","resolution":{"observed_at":"2026-07-10T08:06:57.772683Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.984523Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"f5366ac8-80a2-4ab6-8fcb-c4327ceb34bd","year":2021},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:83f7d1cb722447e963b401ba5e23bad3fd924b3878d9ed6da3bc2e5969f38820","observation_id":"943885a4-b794-4316-8f4b-9b8953b3f8ca","resolution":{"observed_at":"2026-07-10T08:06:57.986086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20076","last_updated":"2025-03-10T12:34:24Z","snapshot_observed_at":"2026-08-06T23:39:09.398813Z","submitted_at":"2024-06-28T17:38:18Z","title":"EVF-SAM: Early Vision-Language Fusion for Text-Prompted Segment Anything Model","version":5},"cited_work":{"arxiv_id":"2406.20076","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.20076","snapshot_observed_at":"2026-07-10T08:06:57.772386Z","title":"Evf-sam: Early vision-language fusion for text-prompted segment anything model","venue":"cs.CV","work_id":"9c74bfe1-f3f0-49c7-b929-3627d1d4fc12","year":2024},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"cited_paper":"/paper/2406.20076","citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:d7c0ec2e54ae140dc1004b7977194ee976ff8c873ac9754799fa53d4b0e44a5b","observation_id":"5523097c-b5eb-4508-b58f-4697d7e5016d","resolution":{"observed_at":"2026-07-10T08:06:57.773790Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.957276Z","title":"Lavt: Language-aware vision transformer for referring image segmentation","venue":null,"work_id":"e5503a10-0b3b-430a-bd69-84ff6166bbb7","year":2022},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:355dcb9b11f816e8cdd500f5ad38f6487bfaf8467b3290ccfff846227364294e","observation_id":"67ddaccf-e939-4e1b-b55a-cd721494a5a4","resolution":{"observed_at":"2026-07-10T08:06:57.958471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:fc1bae0610117ef4dae629b0367ca684f146a38db705a483795a6a7bc259496c","observation_id":"c5231bfd-ed68-4847-b442-e3f4f12beb83","resolution":{"observed_at":"2026-07-10T08:06:57.776223Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.981576Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"1a247343-7abe-4143-8e5b-c906a73bcf37","year":2022},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:cbb03a187b0a07073c6740c1453d31478cf4170bb44a1b08e08006e9424f4cb1","observation_id":"6d33da0f-cdc6-44d3-ba54-b183506c0481","resolution":{"observed_at":"2026-07-10T08:06:57.982806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:58.003432Z","title":"Solo: A simple framework for instance segmentation.IEEE transactions on pattern analysis and machine intelligence, 44(11):8587–8601, 2021","venue":null,"work_id":"b2f822f0-bb57-4ec9-86b5-9bea9b457449","year":2021},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:7514490c23249407b628cb917e2cde96aef01b8c121fcc354bc95f67ab5dc680","observation_id":"046f9981-340d-41c7-9101-4df4c5a50e8f","resolution":{"observed_at":"2026-07-10T08:06:58.004800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:58.015648Z","title":"Masked-attention mask transformer for universal image segmentation","venue":null,"work_id":"7a704e79-2e4d-4dca-967d-ce1929c66f01","year":2022},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:73d68dde9de34fc0de1e9920bed2c3459dbd22d2d7be33bd2d7a68816bb2ad90","observation_id":"a450bb88-2dad-4b1b-89f9-095bab375de4","resolution":{"observed_at":"2026-07-10T08:06:58.016865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.993426Z","title":"Incorporating temporal prior from motion flow for instrument segmentation in minimally invasive surgery video","venue":null,"work_id":"6422dd6e-2504-4ead-97ca-f7da4f865a0b","year":2019},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:eac51b8e91d4969e955588061d97323e37141f4d5dafa4e8bbedea8d479ab863","observation_id":"fbd97e61-1a8b-42bf-9a9c-f5fc04185cec","resolution":{"observed_at":"2026-07-10T08:06:57.994733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:58.006583Z","title":"Isinet: an instance-based approach for surgical instrument segmentation","venue":null,"work_id":"1b890998-9176-462c-83fa-59a95b3cd189","year":2020},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:45b8f47864e7ba825ce60c7b0df858a76d2aa447eda4a0337277cd92e68dbef4","observation_id":"b52b3610-963e-4a07-8824-3d89f23cb37a","resolution":{"observed_at":"2026-07-10T08:06:58.007738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.12668","last_updated":"2020-04-27T09:34:05Z","snapshot_observed_at":"2026-07-06T09:15:27.027977Z","submitted_at":"2020-04-27T09:34:05Z","title":"OR-UNet: an Optimized Robust Residual U-Net for Instrument Segmentation in Endoscopic Images","version":1},"cited_work":{"arxiv_id":"2004.12668","doi":null,"metadata_source":"pith","pith_arxiv_id":"2004.12668","snapshot_observed_at":"2026-07-10T08:06:57.769028Z","title":"OR-UNet: an Optimized Robust Residual U-Net for Instrument Segmentation in Endoscopic Images","venue":"eess.IV","work_id":"1daf9837-73d1-4e68-859e-54467620fb60","year":2020},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"cited_paper":"/paper/2004.12668","citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:342f3a8bb9971ebf3511831e6d7675fe3ab37fbf9814f14b64b88e2842a31afc","observation_id":"ccfccb18-e0b8-49d0-9628-27d5ab8d107b","resolution":{"observed_at":"2026-07-10T08:06:57.770322Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:58.001086Z","title":"Modeling context in referring expressions","venue":null,"work_id":"663fdee3-6317-45e8-a69f-437ea84e1b16","year":2016},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:1c541a0738cf5ae2a9e0c962211b7686b1482c353168331061a05e5f8a546efe","observation_id":"df18082d-d5a5-4de1-b22d-4cf7fc9b2470","resolution":{"observed_at":"2026-07-10T08:06:58.002294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.999220Z","title":"Modeling context between objects for referring expression understanding","venue":null,"work_id":"32aa7771-9a9b-4ed6-a281-87e9b8516410","year":2016},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:521f755bcb0beb2591323793d9b118f6719abf852555f39dec37d6baa0842d26","observation_id":"cff97927-0398-4590-ac96-fac041c63ef7","resolution":{"observed_at":"2026-07-10T08:06:58.000526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.937473Z","title":"Segmentation from natural language expressions","venue":null,"work_id":"2fba84af-8006-4ce0-8211-6d8efbc5f9c7","year":2016},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:387edb2a46ee1760397d00e1bf2ca180274fd36fb75456e922eef1b4e3014898","observation_id":"f76a055f-0d71-4f52-8f66-4824672f4df3","resolution":{"observed_at":"2026-07-10T08:06:57.938690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.937328Z","title":"Referring image segmentation via recurrent refinement networks","venue":null,"work_id":"fd1161fc-da81-494e-9ee0-1bc657c0adea","year":2018},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:c802bad5c558ce5a2a6dfe32d4d50b3fefa268a842bcc24fd35826037bcecf89","observation_id":"1ff77ea9-4e13-403a-91b4-f0286800b3cd","resolution":{"observed_at":"2026-07-10T08:06:57.938867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.992758Z","title":"Recurrent multimodal interaction for referring image segmentation","venue":null,"work_id":"1864af1d-930a-4a20-bac4-859192acd344","year":2017},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:893393d15a14e265d99d1ce3fd451bc7a8a8e745b16a07461dbe7f4308fe5b5d","observation_id":"f6bc52ca-5207-488f-8b6c-4b3cfdaa96c3","resolution":{"observed_at":"2026-07-10T08:06:57.993904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.923556Z","title":"Key-word-aware network for referring expression image segmentation","venue":null,"work_id":"e351984a-293f-4c4e-8799-2ea6ed1d69cf","year":2018},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:6965b757992b3a131ea92960a8887f433fff7cda75dd8aecdd3ab92641354185","observation_id":"3eedb82a-13c7-47ed-b9f8-56c3b1c2fbe9","resolution":{"observed_at":"2026-07-10T08:06:57.925297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.918868Z","title":"Cross-modal relationship inference for grounding referring expressions","venue":null,"work_id":"6afaa696-3d74-471e-9312-821714fd2349","year":2019},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:e297b2d984d5be4edfe616100ab8c6f362a6ef2888386d4563b5fdb5e2c865ea","observation_id":"103b6e85-57fa-45a5-ae23-fe8c7bbef252","resolution":{"observed_at":"2026-07-10T08:06:57.920492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:58.013690Z","title":"Restr: Convolution-free referring image segmentation using transformers","venue":null,"work_id":"c7c27e0a-b982-49be-8a21-b5c714637f77","year":2022},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:e13415f5ce9c66019d7ff6103201342de6bc0186f130b07984d50cc657e2f058","observation_id":"c9b236f9-1478-4b34-953f-1bcb5457d330","resolution":{"observed_at":"2026-07-10T08:06:58.015094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.933489Z","title":"Structured attention network for referring image segmentation.IEEE Transactions on Multimedia, 24:1922–1932, 2021","venue":null,"work_id":"e3d06e34-9707-48c5-b01c-2c8520e89fc3","year":1922},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:8be684b3c79e80ed925fd4fe496614b38b1e3442fa3cbffd1af44d8845b0606e","observation_id":"3f02fb82-1ce5-4c0c-848f-cee798896dcf","resolution":{"observed_at":"2026-07-10T08:06:57.934829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.945345Z","title":"Contrastive grouping with transformer for referring image segmentation","venue":null,"work_id":"d7ece47c-7533-4c7f-8153-aca5a626cb40","year":2023},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:526082ee06cc88486d7d3b67b22d4a076b9c1e8be4ee599bafb0688366bf79b8","observation_id":"e28e5f76-2d7d-4cdc-9ddf-437e947bc0f8","resolution":{"observed_at":"2026-07-10T08:06:57.947147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.991229Z","title":"Dynamic graph attention for referring expression comprehension","venue":null,"work_id":"4d1e7736-b286-45d6-a32b-90d99ad3a940","year":2019},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:a695b8d4d09ced42256a82c83ae35e50233c31cd5f98a036e9a283427325666c","observation_id":"3300050f-c96b-448f-ab54-777d8635a882","resolution":{"observed_at":"2026-07-10T08:06:57.992881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:58.017443Z","title":"Graph-structured referring expression reasoning in the wild","venue":null,"work_id":"1f8f6de7-d7bc-48e6-99b9-3f0b9e0f3644","year":2020},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:b631a2c2e3e5722b60c7fb7e2d5ac63df5bc24d6b959aa9ac03589a419358a71","observation_id":"9f3bb297-f2a5-4cfd-9e01-e40f39502b0c","resolution":{"observed_at":"2026-07-10T08:06:58.018571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.985359Z","title":"Relationship-embedded representation learning for grounding referring expressions.IEEE Transactions on Pattern Analysis and Machine Intelligence, 43(8):2765–2779, 2020","venue":null,"work_id":"d699dae0-d0e3-407d-ab40-c004e9e20640","year":2020},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:1d3cd2c660fdddb3c981989497f186e8ba2d7ff69ce50ace0185888c8b11eec1","observation_id":"a1d0abad-e460-4d97-85bf-35aaae053cf9","resolution":{"observed_at":"2026-07-10T08:06:57.986852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.943526Z","title":"Bottom-up shift and reasoning for referring image segmentation","venue":null,"work_id":"3c0adaa2-9d3f-483c-9655-c4f0331344f1","year":2021},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:f61953415c6c919fec8033b77f52dbf10e7e49c5fa8f802a5b4ae3ab44aee13f","observation_id":"ef644967-faba-4cab-9207-d54dd84263d2","resolution":{"observed_at":"2026-07-10T08:06:57.944813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.13419","last_updated":"2022-12-27T09:13:19Z","snapshot_observed_at":"2026-08-02T23:34:26.669113Z","submitted_at":"2022-12-27T09:13:19Z","title":"Position-Aware Contrastive Alignment for Referring Image Segmentation","version":1},"cited_work":{"arxiv_id":"2212.13419","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.13419","snapshot_observed_at":"2026-07-10T08:06:57.757837Z","title":"Position-Aware Contrastive Alignment for Referring Image Segmentation","venue":"cs.CV","work_id":"6232e073-53fa-4554-acce-15219b855a85","year":2022},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"cited_paper":"/paper/2212.13419","citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:21c6993b1cc55f7d6402ee39bedf4aeba60998bc9526f234419fddbff75c1977","observation_id":"749f50f2-f0c6-44aa-acf7-4ce0f87c47d0","resolution":{"observed_at":"2026-07-10T08:06:57.759339Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.928289Z","title":"Vlt: Vision-language transformer and query genera- tion for referring segmentation.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(6):7900– 7916, 2022","venue":null,"work_id":"ba69ec5c-40e9-4f48-bf20-c8c392e2a5a6","year":2022},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:7d8e252d6c67d5581819f76c9855e6a44d71797915000a68725ffb09b80af6f9","observation_id":"1a8c2d3f-dff1-4837-b7d8-a71a0864daaf","resolution":{"observed_at":"2026-07-10T08:06:57.929961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T08:06:57.997304Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"774dc1e0-b3d1-4be5-90fa-8bac4990c179","year":2021},"citing_paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-10T08:06:03.952787Z"},"links":{"citing_paper":"/paper/2607.08397"},"observation_digest":"sha256:23c12bc426894d0c0732196cac10197c71de8c80e53cca67094145d0fce14faf","observation_id":"a495e82b-4e95-431e-a751-b0b632a4777e","resolution":{"observed_at":"2026-07-10T08:06:57.998656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.08397","last_updated":"2026-07-09T12:21:06Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T16:27:25.843893Z","submitted_at":"2026-07-09T12:21:06Z","title":"Attribute Retrieving for Open-Vocabulary Endoscopic Compositional Referring Segmentation"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":7,"verified_fuzzy":49},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2607.08397."}