{"as_of":"2026-08-20T02:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7a8bd5bd7d7475bbcacbb3449968bad1bb1acca77e23af0c75afa31b99a64167","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T21:12:07.539556Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T03:40:26.565029Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T17:48:46.259474Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"cited_work":{"arxiv_id":"2511.16618","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2511.16618","snapshot_observed_at":"2026-07-29T02:25:10.326992Z","title":"Sam2s: Segment anything in surgical videos via semantic long- term tracking.arXiv preprint arXiv:2511.16618, 2025","venue":null,"work_id":"8e6187fb-014b-4f62-9fce-6d99ab534ace","year":2025},"citing_paper":{"arxiv_id":"2606.17279","last_updated":"2026-06-15T20:40:45Z","snapshot_observed_at":"2026-08-12T23:43:13.694949Z","submitted_at":"2026-06-15T20:40:45Z","title":"Training LLMs with Reinforcement Learning over Digital Twin Representations for Reasoning-Intensive Surgical VideoQA","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T03:40:26.565029Z"},"links":{"cited_paper":"/paper/2511.16618","citing_paper":"/paper/2606.17279"},"observation_digest":"sha256:41552b5642cd171bc7b6077d6e66eee1d4c75da5450e05115b6494058704e4a0","observation_id":"902c354f-823e-47d2-9653-11eb33a6a783","resolution":{"observed_at":"2026-07-29T02:25:10.326992Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2511.16618/citation-record","integrity":"/paper/2511.16618/integrity","json":"/paper/2511.16618/citation-record.json","paper":"/paper/2511.16618"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:02.857466Z","title":"Deep learning for surgical instrument recog- nition and segmentation in robotic-assisted surgeries: a sys- tematic review.Artificial Intelligence Review, 58(1):1, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:02.857466Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:b2e6dc3ec62a84ac6842195e6565b9173b92a2eed099d198bd658f1b2f268885","observation_id":"f9e5af25-d0e8-41fa-b52b-f17266a48fbe","resolution":{"observed_at":"2026-08-03T21:12:02.857466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:02.935821Z","title":"Cholecinstanceseg: A tool instance segmentation dataset for laparoscopic surgery.Scientific Data, 12(1):825, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:02.935821Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:cae3a6227af04cd004ca891cad5d79e63f7037119b131fae915ed5f064882c16","observation_id":"f8f2e0c1-243e-4836-957d-87b70b40bfb5","resolution":{"observed_at":"2026-08-03T21:12:02.935821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.13815","last_updated":"2021-12-27T18:06:12Z","snapshot_observed_at":"2026-08-16T17:31:46.150254Z","submitted_at":"2021-12-27T18:06:12Z","title":"Temporally Constrained Neural Networks (TCNN): A framework for semi-supervised video semantic segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.13815","snapshot_observed_at":"2026-08-03T21:12:03.024171Z","title":"Temporally constrained neural networks (tcnn): A framework for semi-supervised video semantic segmentation.arXiv preprint arXiv:2112.13815, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:03.024171Z"},"links":{"cited_paper":"/paper/2112.13815","citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:31d5d0a12d604c422426e661c8e94ffdba55471433d06c478be55c53ce46668d","observation_id":"74509df7-e127-46c1-83e0-d7921bde478c","resolution":{"observed_at":"2026-08-03T21:12:03.024171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:03.087470Z","title":"A multi-centre polyp detection and segmentation dataset for generalisability assessment.Scientific Data, 10(1):75, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:03.087470Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:df223fbbcd052ebf428cad4db4da882f88ce060ab5dab2b21249e4947c505986","observation_id":"3c0e700d-83ad-4b8c-8c51-7afdc4323fea","resolution":{"observed_at":"2026-08-03T21:12:03.087470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.06426","last_updated":"2019-02-21T17:01:02Z","snapshot_observed_at":"2026-08-14T17:15:06.830535Z","submitted_at":"2019-02-18T07:08:36Z","title":"2017 Robotic Instrument Segmentation Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.06426","snapshot_observed_at":"2026-08-03T21:12:03.135925Z","title":"2017 robotic instrument segmentation challenge.arXiv preprint arXiv:1902.06426, 2019","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:03.135925Z"},"links":{"cited_paper":"/paper/1902.06426","citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:787d09940a044c1ddd22e33133f7f368537086f8f4fef90ca88301386a487d16","observation_id":"cd41ac32-1df3-4e41-af6d-4d5d755562fb","resolution":{"observed_at":"2026-08-03T21:12:03.135925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.11190","last_updated":"2020-08-03T01:55:24Z","snapshot_observed_at":"2026-08-18T20:49:18.953792Z","submitted_at":"2020-01-30T06:37:07Z","title":"2018 Robotic Scene Segmentation Challenge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.11190","snapshot_observed_at":"2026-08-03T21:12:03.258472Z","title":"2018 robotic scene segmentation challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:03.258472Z"},"links":{"cited_paper":"/paper/2001.11190","citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:4a87a6737308c8f5b61a22f755514d9eafceb169e1beb135e6091aacde5eacc0","observation_id":"1b713460-6f3d-488c-9995-0b5a51ca235a","resolution":{"observed_at":"2026-08-03T21:12:03.258472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:03.387757Z","title":"Matis: Masked-attention transformers for surgical instrument segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:03.387757Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:264658d90294bde2225ceae1bacc1ccea8f3f5ff66adc8c50b8fbbed82501a60","observation_id":"b2bb9bc7-4309-40e5-a53d-3d716f92ae7e","resolution":{"observed_at":"2026-08-03T21:12:03.387757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:03.546631Z","title":"Pixel-wise recognition for holistic surgical scene understanding.arXiv, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:03.546631Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:e7eb8ce5a9c9351e2f017de8deb36bc18284a82f7f915e170fbfc008bed108aa","observation_id":"1847944e-7dc9-4d96-9ad3-0b5495a6501b","resolution":{"observed_at":"2026-08-03T21:12:03.546631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:03.678232Z","title":"Wm-dova maps for accurate polyp highlighting in colonoscopy: Validation vs","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:03.678232Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:959d2ff1e95e18c01b520c15aa43b610a45f46d96a87624e9bc16475748b2ce6","observation_id":"bb11c067-8efe-44b9-9b80-a49ff863809c","resolution":{"observed_at":"2026-08-03T21:12:03.678232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:03.787652Z","title":"The dresden surgical anatomy dataset for abdominal organ segmentation in surgi- cal data science.Scientific Data, 10(1):1–8, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:03.787652Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:2a0834a675bacb5b095b1880ca9590c81fd6e8e91807ca5cb868064288ef8733","observation_id":"00208e69-7843-4d05-aa50-a0cd51a7628d","resolution":{"observed_at":"2026-08-03T21:12:03.787652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:03.847941Z","title":"Xmem: Long- term video object segmentation with an atkinson-shiffrin memory model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:03.847941Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:dc716f1a9543d155ccd5617cd885b9df4502644afcb0f5b86bd36dd9625e7b93","observation_id":"3d95805f-3d08-4d3f-875e-c6bf15af9706","resolution":{"observed_at":"2026-08-03T21:12:03.847941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:03.910811Z","title":"Putting the object back into video object segmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:03.910811Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:06fd3442af43e49021594bde89ffcfca52307f478650ba5fa87fa27e9ad31173","observation_id":"fbf5854a-889a-4906-8088-e9c8f274d106","resolution":{"observed_at":"2026-08-03T21:12:03.910811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:03.952399Z","title":"Mosev2: A more challenging dataset for video object segmentation in complex scenes.arXiv preprint arXiv:2508.05630, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:03.952399Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:ea43a6f3cfaaca360fd95323de264aba31cbb595f3cc750b97ad5235c16ed45c","observation_id":"727689ab-d726-43c1-ab63-fcf88767dda2","resolution":{"observed_at":"2026-08-03T21:12:03.952399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:04.012442Z","title":"Sam2long: Enhancing sam 2 for long video segmentation with a training-free memory tree","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:04.012442Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:e0613f03da24758a9c692d1a6fd8a0219a7eb2f9bbe070d1436c1fdaf45ee466","observation_id":"40ed8da1-a8d5-44fa-95b3-946c4684ff65","resolution":{"observed_at":"2026-08-03T21:12:04.012442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:04.070011Z","title":"Patch-based adaptive weighting with segmenta- tion and scale (pawss) for visual tracking in surgical video","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:04.070011Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:7e1e6ee9a94981907083979ccd1d77638b2a1b15c0306848eff728eeead0a946","observation_id":"6e330f1d-be37-451d-b6ad-cfc6be4813df","resolution":{"observed_at":"2026-08-03T21:12:04.070011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:04.141724Z","title":"Spatio-temporal represen- tation decoupling and enhancement for federated instru- ment segmentation in surgical videos.arXiv preprint arXiv:2506.23759, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:04.141724Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:b0fe542f13b57256294538d288c569137e4f2cf553a735680d5abb1bbbcb1bd4","observation_id":"8f6aa669-3deb-4a98-89a5-dd4d204197ab","resolution":{"observed_at":"2026-08-03T21:12:04.141724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:04.201914Z","title":"Deep learning for video object segmentation: a review.Artificial Intelligence Review, 56(1):457–531, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:04.201914Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:5cd4be518e750d647f45614fadfcab974f7149306f0b1c1a1b9edd35fdd1a293","observation_id":"a37cdca1-9ad8-4c6e-a7a2-77cf2cfabbef","resolution":{"observed_at":"2026-08-03T21:12:04.201914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:04.288806Z","title":"Image compositing for segmentation of surgical tools without manual annotations.IEEE transactions on medical imaging, 40(5):1450–1460, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:04.288806Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:b5f6cafa67a31c1f5709b23aa0ef13a8a6c694f1e5b7c4bdeb024b9471f23189","observation_id":"3f8a0a57-de02-45ff-9afb-fd2ab25754a5","resolution":{"observed_at":"2026-08-03T21:12:04.288806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:04.370697Z","title":"Softseg: Advantages of soft versus binary training for image segmentation.Medical image analysis, 71:102038, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:04.370697Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:6c8435b0de37fce7e531e2575275d8a63bd4c1cf8f5d9af72c58861a163cfa1f","observation_id":"7bd23acf-0db5-4915-b5c8-68e8ae1faf0e","resolution":{"observed_at":"2026-08-03T21:12:04.370697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:04.414645Z","title":"Detection, segmentation, and 3d pose es- timation of surgical tools using convolutional neural net- works and algebraic geometry.Medical Image Analysis, 70: 101994, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:04.414645Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:1ee9d6f93c673856e9538ab9ccd1795d1282b1ccfdeab50112b49b9b47a243b8","observation_id":"504f777b-7417-498e-a223-b0da66e3f35d","resolution":{"observed_at":"2026-08-03T21:12:04.414645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:04.488077Z","title":"Interac- tive video object segmentation using global and local trans- fer modules","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:04.488077Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:cd050cd072fa44c0752d3326d2be59c22bea8f6181bd319a0f983d62a3558de7","observation_id":"22b9d0c8-2e4e-4af2-8134-110d42c5bcad","resolution":{"observed_at":"2026-08-03T21:12:04.488077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:04.573439Z","title":"Lvos: A benchmark for long-term video object segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:04.573439Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:9383528a55a4224f49df1d23400ed20d50f3c05223828c93c8ce6cebc1fbf389","observation_id":"3a05c61a-bc18-4ab0-a56e-ab8844313cbd","resolution":{"observed_at":"2026-08-03T21:12:04.573439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:04.657152Z","title":"Lvos: A benchmark for large- scale long-term video object segmentation.IEEE Transac- tions on Pattern Analysis and Machine Intelligence, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:04.657152Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:9c8374de3fd31cd0d5e5e67ba39a35abd0e7ca4044db400f693c814bb070b925","observation_id":"5c24f91d-77b2-4514-83ac-2b4c290eefe4","resolution":{"observed_at":"2026-08-03T21:12:04.657152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.12453","last_updated":"2020-12-23T02:23:15Z","snapshot_observed_at":"2026-08-16T18:56:31.430401Z","submitted_at":"2020-12-23T02:23:15Z","title":"CholecSeg8k: A Semantic Segmentation Dataset for Laparoscopic Cholecystectomy Based on Cholec80","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.12453","snapshot_observed_at":"2026-08-03T21:12:04.739163Z","title":"Cholecseg8k: a semantic segmentation dataset for laparoscopic cholecystectomy based on cholec80.arXiv preprint arXiv:2012.12453, 2020","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:04.739163Z"},"links":{"cited_paper":"/paper/2012.12453","citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:6cbf43d2a6f566a5e4ae668ba90aead08a4af7346a32dc7eb38bff193de125c9","observation_id":"1a820113-e8ee-45a1-b4ab-443be46990d3","resolution":{"observed_at":"2026-08-03T21:12:04.739163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:04.818831Z","title":"Domain and content adaptive convolution based multi- source domain generalization for medical image segmenta- tion.IEEE Transactions on Medical Imaging, 42(1):233– 244, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:04.818831Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:7c5a1af10f4b1fb75569d1205195b176d2c1d5833c98ffd0fe8b8368958c73e7","observation_id":"105801d1-081b-4045-a115-6ccf08f14e4a","resolution":{"observed_at":"2026-08-03T21:12:04.818831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:04.870355Z","title":"Kvasir-seg: A segmented polyp dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:04.870355Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:3fba2c7e2c456ee9a8dc1facd6e08dd5f682f46851ac975da21a8793fd1d5f99","observation_id":"f38708f9-c6fe-4e69-aa47-a196dc159168","resolution":{"observed_at":"2026-08-03T21:12:04.870355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:04.954607Z","title":"Exploring intra-and inter-video relation for surgical semantic scene segmentation.IEEE Transactions on Medical Imaging, 41(11):2991–3002, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:04.954607Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:efb899248881a17dabb0b33cc407cdf8e9678475c16f7fbf2b273e8d7d82cfff","observation_id":"337687a8-e161-417e-8a5c-73da2ad6684d","resolution":{"observed_at":"2026-08-03T21:12:04.954607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:05.015315Z","title":"Segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:05.015315Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:0854d39fb6444f9b148b3b1e8572b40dc82e6dbfb3768042bcc3f56485827232","observation_id":"a3074429-dafb-4c91-b399-07b0c6193e1f","resolution":{"observed_at":"2026-08-03T21:12:05.015315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:05.127043Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:05.127043Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:f37935d4bac81b2bf95f3dfd354dc563f92b295a271cabda46e71cfec7fe0736","observation_id":"b83f2659-3beb-4dd7-bbce-985e76426350","resolution":{"observed_at":"2026-08-03T21:12:05.127043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:05.202395Z","title":"Open-vocabulary semantic segmentation with mask-adapted clip","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:05.202395Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:9dab44792f15cbda9db4a1cbe0b686336632ce2189d970fa66290cdcee9a5cf1","observation_id":"a2143051-8be0-4244-8c12-f02ef0c5484a","resolution":{"observed_at":"2026-08-03T21:12:05.202395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:05.258193Z","title":"Video object segmentation with adaptive feature bank and uncertain-region refinement.Advances in Neural Informa- tion Processing Systems, 33:3430–3441, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:05.258193Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:db57da20d04a22724fdbccc5dc2c7ad83dbb0e31fe4d96ab8d96a1151a5f3a20","observation_id":"5bee79b3-b99c-4392-a10b-391692ebe92d","resolution":{"observed_at":"2026-08-03T21:12:05.258193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:05.343825Z","title":"Focal loss for dense object detection","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:05.343825Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:9504a7acbcd3ba8a77f4945db9acd4e5b0307d9dbf9ce61d17fc86b982f38b27","observation_id":"07fe755e-e08b-460a-91d4-ee4a87d7108c","resolution":{"observed_at":"2026-08-03T21:12:05.343825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:05.425484Z","title":"Surgical sam 2: Real-time segment anything in surgical video by efficient frame pruning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:05.425484Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:49773d0cb27f18d0a108029fd4f2b78298cb82fde4d4541246be2bd320a77e1c","observation_id":"7669acdc-8e09-45a4-b5ab-c2e860b2463a","resolution":{"observed_at":"2026-08-03T21:12:05.425484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08581","last_updated":"2025-05-13T13:56:10Z","snapshot_observed_at":"2026-08-19T17:54:17.852122Z","submitted_at":"2025-05-13T13:56:10Z","title":"ReSurgSAM2: Referring Segment Anything in Surgical Video via Credible Long-term Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08581","snapshot_observed_at":"2026-08-03T21:12:05.507774Z","title":"Resurgsam2: Referring segment anything in surgical video via credible long-term tracking.arXiv preprint arXiv:2505.08581, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:05.507774Z"},"links":{"cited_paper":"/paper/2505.08581","citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:39bc99d7559075d26808a7429101b4784f730faef7569788a7896e73fed57977","observation_id":"9121928a-c066-43f9-8931-f02add9b1640","resolution":{"observed_at":"2026-08-03T21:12:05.507774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:05.580364Z","title":"Learning high-quality dynamic memory for video object segmentation.IEEE Transactions on Pattern Analysis and Machine Intelligence, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:05.580364Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:af10d5d9a73f50d9b889e34b947cdd0cd2e8264de676b6691c1056090fa89970","observation_id":"a593f9d3-ea9b-49e0-b295-51b6589df999","resolution":{"observed_at":"2026-08-03T21:12:05.580364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12429","last_updated":"2024-10-25T17:28:43Z","snapshot_observed_at":"2026-08-16T14:33:14.319224Z","submitted_at":"2023-12-19T18:56:44Z","title":"The Endoscapes Dataset for Surgical Scene Segmentation, Object Detection, and Critical View of Safety Assessment: Official Splits and Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12429","snapshot_observed_at":"2026-08-03T21:12:05.663088Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:05.663088Z"},"links":{"cited_paper":"/paper/2312.12429","citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:ab410636960f0ee31cc48a882823283370abde3002f622dd5a818c7f13b09d64","observation_id":"1d3cf7cc-2a6d-4716-99d6-6d0d7c8131cf","resolution":{"observed_at":"2026-08-03T21:12:05.663088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:05.743286Z","title":"Pyramid attention aggregation network for semantic segmentation of surgical instruments","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:05.743286Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:1f72baca1c41cdb6cebc776fd929f33e245e7ede90655837cbdf460ce88514a3","observation_id":"59888796-a2f5-4906-8c78-d347431207d3","resolution":{"observed_at":"2026-08-03T21:12:05.743286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:05.837827Z","title":"Surginet: Pyramid attention aggregation and class-wise self- distillation for surgical instrument segmentation.Medical Image Analysis, 76:102310, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:05.837827Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:2d8e47a09f9a3208eaa637e49e653f20c712019939bd38de00461a67a45e1610","observation_id":"c688eb31-da70-471b-9046-ac9eb3d6cd63","resolution":{"observed_at":"2026-08-03T21:12:05.837827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:05.901934Z","title":"Video object segmentation using space-time memory networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:05.901934Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:837d1dbd3d754aac7747da95f0006ab943e2afde5478536709fa008b8735bb72","observation_id":"e28a8af9-2099-41f4-b01a-f94ff16eef3d","resolution":{"observed_at":"2026-08-03T21:12:05.901934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:05.947673Z","title":"Mvd-net: Semantic segmentation of cataract surgery using multi-view learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:05.947673Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:c83e9b046cb86ac9b402b2193a58faea8ef660d439699e34295b6c64b65a3802","observation_id":"eb09073c-733a-4f40-b7f7-e4a0f3ba02b3","resolution":{"observed_at":"2026-08-03T21:12:05.947673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00496","last_updated":"2024-01-23T23:30:57Z","snapshot_observed_at":"2026-08-17T18:34:35.479564Z","submitted_at":"2023-12-31T13:32:18Z","title":"SAR-RARP50: Segmentation of surgical instrumentation and Action Recognition on Robot-Assisted Radical Prostatectomy Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00496","snapshot_observed_at":"2026-08-03T21:12:06.012090Z","title":"Sar-rarp50: Segmentation of surgical instrumentation and action recognition on robot-assisted radical prostatectomy challenge.arXiv preprint arXiv:2401.00496, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:06.012090Z"},"links":{"cited_paper":"/paper/2401.00496","citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:30c42db81fd2c5e9137e1ce4c283a45248a36ee47065db3b247316053f7552d0","observation_id":"bbc16f62-d5ab-4b3c-ad61-6af75f7cc695","resolution":{"observed_at":"2026-08-03T21:12:06.012090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:06.066615Z","title":"Structure matters: Revisiting boundary refinement in video object seg- mentation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:06.066615Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:8407c9e39e20a3eaff2a2501729b80e51f6937654dbf6a7021012789ce9aa49a","observation_id":"7a6cacfb-6bfd-41b4-8f10-8bd1d86c27b9","resolution":{"observed_at":"2026-08-03T21:12:06.066615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:06.147869Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:06.147869Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:c58e3a9afb6b5cdefc2555f9d3eac369a9412057e9814a75274e8f64ed462213","observation_id":"4c8def3f-de2b-40e6-b3c8-12c4c96f3789","resolution":{"observed_at":"2026-08-03T21:12:06.147869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-03T21:12:06.211859Z","title":"Sam 2: Segment anything in images and videos.arXiv preprint arXiv:2408.00714, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:06.211859Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:0d73ad1477e0e08053b3dfa71ca5e2cd8ff3525aa6f3c26e181c48bb04adcbfa","observation_id":"e2be5e63-9615-4e78-8a23-7d33ef297f87","resolution":{"observed_at":"2026-08-03T21:12:06.211859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:06.282241Z","title":"Towards real-time multiple surgical tool tracking.Computer Methods in Biomechanics and Biomedical Engineering: Imaging & Visualization, 9(3): 279–285, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:06.282241Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:e8c08b09d98c8e60778bf9e1df687b2e6a0debb9b81624c3a1133e36053360ee","observation_id":"956af7f3-636a-46c6-b0fb-9fda72b282eb","resolution":{"observed_at":"2026-08-03T21:12:06.282241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:06.386636Z","title":"FA Davis, 2011","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:06.386636Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:f9fd449a5a7c56b7ec312930afe687358d93cfca3f1d84bfdd1168d06f684bca","observation_id":"1831f7ef-4053-4449-aaaf-a2a76a70d8a2","resolution":{"observed_at":"2026-08-03T21:12:06.386636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:06.559018Z","title":"Towards holistic surgical scene understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:06.559018Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:73db9264561510c8f4b7bd0dd4dc47973f24d3fab9367733591be07f531fc959","observation_id":"75ab87ee-b5e6-467e-b90e-c27b3232368a","resolution":{"observed_at":"2026-08-03T21:12:06.559018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:06.667391Z","title":"A distractor-aware memory for visual object tracking with sam2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:06.667391Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:f4842e8e31e7dbecbf8a9f6f09f59c03871398eb45c52ebe7dd81abc7e7d7585","observation_id":"f5052a61-e353-4e7f-b49b-9838ec1ef2a4","resolution":{"observed_at":"2026-08-03T21:12:06.667391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:06.753317Z","title":"Autolaparo: A new dataset of integrated multi-tasks for image-guided surgical automation in laparoscopic hysterectomy","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:06.753317Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:23edd09b5866917f79694bfa0f636905d350140d3e9a972f546b1382675526d6","observation_id":"48ec7216-17db-4641-bdc0-e66c91c3d6b6","resolution":{"observed_at":"2026-08-03T21:12:06.753317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:06.914161Z","title":"Scribbleprompt: fast and flexible interactive segmen- tation for any biomedical image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:06.914161Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:acb9ea847647f35bd67e82768eff3766fbb36a6943be19f919be0bd9683e4a7f","observation_id":"100ee813-66d0-499d-bf59-2323d51fd4c4","resolution":{"observed_at":"2026-08-03T21:12:06.914161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11922","last_updated":"2024-11-30T22:32:34Z","snapshot_observed_at":"2026-08-19T20:51:39.895760Z","submitted_at":"2024-11-18T05:59:03Z","title":"SAMURAI: Adapting Segment Anything Model for Zero-Shot Visual Tracking with Motion-Aware Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11922","snapshot_observed_at":"2026-08-03T21:12:07.077803Z","title":"Samurai: Adapting segment anything model for zero-shot visual tracking with motion-aware memory.arXiv preprint arXiv:2411.11922,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:07.077803Z"},"links":{"cited_paper":"/paper/2411.11922","citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:e77244bf365858a99c08a12164b6942918582b71721b5a42a3d91ec0b22c3fae","observation_id":"9e220242-c34f-4058-bf0a-10d6acb5ee61","resolution":{"observed_at":"2026-08-03T21:12:07.077803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:07.168173Z","title":"Decoupling features in hierar- chical propagation for video object segmentation.Advances in Neural Information Processing Systems, 35:36324–36336,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:07.168173Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:debd8e3637bb5fa74463de74c73deecc667d8b623a7540c7a0fbb6999e6e113e","observation_id":"3a0f717b-0602-4cfd-996a-214190fb733d","resolution":{"observed_at":"2026-08-03T21:12:07.168173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:07.292236Z","title":"Surgicalsam: Efficient class prompt- able surgical instrument segmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:07.292236Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:59ec61a7b5839dc0b8698bb1fdfd2d28160922dc35bb8f40d4c1b8796f6b9261","observation_id":"a8856b6f-4ad7-4c9e-a0cb-507dae8478ac","resolution":{"observed_at":"2026-08-03T21:12:07.292236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:12:07.455629Z","title":"Sur- gai3","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:07.455629Z"},"links":{"citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:be467463bded1ce8db2320a0721e35542646416bb91bbe386960d185c4dc22de","observation_id":"bf38a46c-4f22-4ac5-9915-2e6b1a0d8a88","resolution":{"observed_at":"2026-08-03T21:12:07.455629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00874","last_updated":"2024-12-04T23:51:25Z","snapshot_observed_at":"2026-08-16T13:29:07.203381Z","submitted_at":"2024-08-01T18:49:45Z","title":"Medical SAM 2: Segment medical images as video via Segment Anything Model 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00874","snapshot_observed_at":"2026-08-03T21:12:07.539556Z","title":"Medical sam 2: Seg- ment medical images as video via segment anything model 2.arXiv preprint arXiv:2408.00874, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T21:12:07.539556Z"},"links":{"cited_paper":"/paper/2408.00874","citing_paper":"/paper/2511.16618"},"observation_digest":"sha256:dbf1be6a31a263d91e3f43942f162b23e4c904abd7b9b1f486e2e960702d9552","observation_id":"9e7a47d7-c2e7-4e64-92fc-b8d33693db6c","resolution":{"observed_at":"2026-08-03T21:12:07.539556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2511.16618","last_updated":"2026-07-28T09:58:43Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T21:41:06.029484Z","submitted_at":"2025-11-20T18:18:49Z","title":"SurgSLOT: Segment Anything in Surgical Videos via Semantic Long-term Tracking"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":55,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 1 inbound Pith citation observation for arXiv:2511.16618."}