{"as_of":"2026-08-20T23:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e8740a86a22520ad901d9f4d6b2699074d8b79ae598e16fe26761f315306f39e","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:54:39.775138Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.04317/citation-record","integrity":"/paper/2507.04317/integrity","json":"/paper/2507.04317/citation-record.json","paper":"/paper/2507.04317"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:36.418592Z","title":"The Rise of Minimally Invasive Surgery: 16 Year Analysis of the Progres- sive Replacement of Open Surgery with Laparoscopy","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:36.418592Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:90caac877654eb28c8e2c334784517141cd5fd71a78eaeee3de3baf4195368ed","observation_id":"2117ba29-dd76-46d0-82d0-6a17c09db356","resolution":{"observed_at":"2026-08-06T19:54:36.418592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:42.043933Z","title":"Minimally Invasive Versus Open Lumbar Fusion: A Comparison of Blood Loss, Surgical Complications, and Hospital Course","venue":null,"work_id":"66500799-e9ff-4c60-9bea-36d3ca38512e","year":2015},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:36.509950Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:374e085ac385166297eedf1038e9ddece2dcce5a834aa9201e9ec4f08084f45c","observation_id":"e840957b-2bbc-40dd-b3ee-f36ba8c2f330","resolution":{"observed_at":"2026-08-06T19:54:42.047071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.7917","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.661137Z","title":"Minimally invasive spine surgery decreases postoperative pain and inflammation for patients with lumbar spinal stenosis","venue":null,"work_id":"67152303-7e84-488b-ab57-887b6f81c062","year":2019},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:36.621300Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:2f073e7e4562eea0247cbee8d750b9fae08bcdda575d78b06e5dab1118e733f8","observation_id":"1e707feb-d3bc-4f31-ba03-45f5c30d3b5d","resolution":{"observed_at":"2026-08-06T19:54:41.703990Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.4240/wjgs.v16.i8.2484","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Impact of minimally invasive surgery on immune function and stress response in gastric cancer patients,","venue":"World Journal of Gastrointestinal Surgery","work_id":"143a9a8d-dfd7-4d00-b7b3-46cdf6f4e817","year":2024},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:36.695558Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:0aec8f799bb8ff12969911dd4610d9724b3457fa4dc55a998e9b5f4dd479d945","observation_id":"abf04d50-8f7c-44c1-9f9c-ee3633988201","resolution":{"observed_at":"2026-08-06T19:54:40.521398Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:42.034461Z","title":"Does Minimally Invasive Mitral Valve Repair Mean Less Postoperative Pain? The Annals of Thoracic Surgery","venue":null,"work_id":"b3ec4f51-a774-400a-87ca-b46bc1253311","year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:36.776684Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:3149281055447ae1963f94564df94acfb63041f9dfbac7b351ee09e556696226","observation_id":"cb75ee7a-963d-49b0-9713-9573bee20b8b","resolution":{"observed_at":"2026-08-06T19:54:42.038038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/ags3.12513","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Artificial intelligence- based computer vision in surgery: Recent advances and future perspectives","venue":"Annals of Gastroenterological Surgery","work_id":"845679f5-0093-418d-8995-b305100734bd","year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:36.912310Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:3853a682ad273c7a0c23d2aba8c89102ca8daca5c09c59d3d71f76887e9ef979","observation_id":"d9179218-0874-4549-82ec-eb3ce6fa54d7","resolution":{"observed_at":"2026-08-06T19:54:40.050597Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:42.024599Z","title":"Digital tools and innovative healthcare solutions: Serious games and gamification in surgical training and patient care,","venue":null,"work_id":"480189b5-9e50-40c7-8f01-f266d7278d55","year":2024},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.008340Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:1f4a62991c8cb51d15e123dac174322e3a6c9489b1563d2acbefe13273615418","observation_id":"25af26d1-712d-4713-a02f-d9949f90754c","resolution":{"observed_at":"2026-08-06T19:54:42.028193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:37.105444Z","title":"Computer Vi- sion in the Operating Room: Opportunities and Caveats,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.105444Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:fae33a34cd3173368a16ba075a669ad78b3f8577389fe1e9767bd41b52e090d2","observation_id":"44b2a0fd-c657-46e0-a8f5-ec408c927e32","resolution":{"observed_at":"2026-08-06T19:54:37.105444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:42.014953Z","title":"Novel applications of deep learning in surgical training,","venue":null,"work_id":"91de5f84-8e58-42b1-baa7-fe61e351f97b","year":2024},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.214496Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:d0b646b368ac52bacd7f3101d9cd1df3da71c10286659f07e4639fb74a2636e9","observation_id":"0077143e-e4ba-4a2c-98a6-5254897f68c5","resolution":{"observed_at":"2026-08-06T19:54:42.018836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1117/12.2512994","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Segmentation of surgical instruments in laparoscopic videos: training dataset generation and deep-learning- based framework","venue":null,"work_id":"4855837f-5526-405c-99a8-299f57b64da5","year":2019},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.311029Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:7de941f98fb3a7267dd6018b0304b56979270dba53bb2d961d34fbd3ab74da7a","observation_id":"3c2da3fb-b184-4fd9-b2f4-82a52808428e","resolution":{"observed_at":"2026-08-06T19:54:39.932588Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.6262","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.266097Z","title":"Analyzing Surgical Technique in Diverse Open Surgical Videos With Multitask Machine Learning","venue":null,"work_id":"b3edc1dd-5ead-434d-b909-bbd60095a66e","year":2024},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.361710Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:92f8473ab20b9f02adc65940ba410048e22a5bde6c51d9f5900fdd93a7836f73","observation_id":"390df135-3634-4202-92a0-9bc6a6caa469","resolution":{"observed_at":"2026-08-06T19:54:41.373039Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:37.458766Z","title":"Deep learning for surgical instrument recognition and segmentation in robotic- assisted surgeries: a systematic review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.458766Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:7b5cd833c90725d1638f2dccdc0dae688538c9789a2ca575e130ff4b14e92c91","observation_id":"8f1658a4-c4dd-4fd5-aff4-6cee07a33272","resolution":{"observed_at":"2026-08-06T19:54:37.458766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.00681","last_updated":"2021-05-05T02:09:53Z","snapshot_observed_at":"2026-08-17T20:40:23.036498Z","submitted_at":"2021-05-03T08:33:53Z","title":"S3Net: A Single Stream Structure for Depth Guided Image Relighting","version":2},"cited_work":{"arxiv_id":"2105.00681","doi":null,"metadata_source":"pith","pith_arxiv_id":"2105.00681","snapshot_observed_at":"2026-08-06T19:54:40.985344Z","title":"S3Net: A Single Stream Structure for Depth Guided Image Relighting","venue":"cs.CV","work_id":"7977ec04-2f0c-40bd-af52-7ade75c1b141","year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.554130Z"},"links":{"cited_paper":"/paper/2105.00681","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:b0ed259f76cdc1bd415566fe7a232b22bb887562a0fde5bddc22a12780b42fe5","observation_id":"35aea0e0-ff84-4499-a0b7-e2eca6c05464","resolution":{"observed_at":"2026-08-06T19:54:41.059211Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:37.614443Z","title":"MATIS: Masked-Attention Transformers for Surgical Instrument Segmentation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.614443Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:397be3cfc26ac8c9d8c4539e871f31b158d4989a787b9e4fce2052efba1323e4","observation_id":"99a1ef7c-0936-4140-9bc3-db122fee9307","resolution":{"observed_at":"2026-08-06T19:54:37.614443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1505.04597","last_updated":"2015-05-18T11:28:37Z","snapshot_observed_at":"2026-08-15T21:30:31.645090Z","submitted_at":"2015-05-18T11:28:37Z","title":"U-Net: Convolutional Networks for Biomedical Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.04597","snapshot_observed_at":"2026-08-06T19:54:37.724288Z","title":"U-Net: Convolutional Net- works for Biomedical Image Segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.724288Z"},"links":{"cited_paper":"/paper/1505.04597","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:83d44a62d153e21f8f2eba5b09cdbaeb7aafd21c27fc3ad437298d62719518c4","observation_id":"7bce4d50-ca52-4ea8-bba0-cd240d8adb59","resolution":{"observed_at":"2026-08-06T19:54:37.724288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-08-08T05:14:59.435033Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-06T19:54:37.801314Z","title":"Segment Anything,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.801314Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:09382a244094b227dc5ac0acfb61ee3c9f9e57c3bf72209b97a79bc3a490fd0a","observation_id":"90ea689a-faf3-4615-a24b-d5a35a4b2819","resolution":{"observed_at":"2026-08-06T19:54:37.801314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11968","last_updated":"2023-04-28T03:21:27Z","snapshot_observed_at":"2026-08-17T08:48:49.593119Z","submitted_at":"2023-04-24T10:04:06Z","title":"Track Anything: Segment Anything Meets Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11968","snapshot_observed_at":"2026-08-06T19:54:37.920077Z","title":"Track Anything: Segment Anything Meets Videos,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.920077Z"},"links":{"cited_paper":"/paper/2304.11968","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:37fd78d680a6857a113039920a3557e1a0dc7e4bde1057df4c85e775ae6c291b","observation_id":"68a3a034-4946-4916-8007-372c479b0fe2","resolution":{"observed_at":"2026-08-06T19:54:37.920077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03048","last_updated":"2023-10-04T01:15:21Z","snapshot_observed_at":"2026-08-16T15:35:32.915462Z","submitted_at":"2023-05-04T17:59:36Z","title":"Personalize Segment Anything Model with One Shot","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03048","snapshot_observed_at":"2026-08-06T19:54:37.985039Z","title":"Personalize Segment Anything Model with One Shot,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:37.985039Z"},"links":{"cited_paper":"/paper/2305.03048","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:93da318a897dc8b3515dae2f2752a962e60f45591e79d89336c0a6789a5533a7","observation_id":"8c1a4ef5-9eec-4c0d-9f44-d0b04046bd4a","resolution":{"observed_at":"2026-08-06T19:54:37.985039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08746","last_updated":"2023-12-21T11:56:08Z","snapshot_observed_at":"2026-08-16T15:07:57.153175Z","submitted_at":"2023-08-17T02:51:01Z","title":"SurgicalSAM: Efficient Class Promptable Surgical Instrument Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08746","snapshot_observed_at":"2026-08-06T19:54:38.058935Z","title":"Sur- gicalSAM: Efficient Class Promptable Surgical Instrument Segmen- tation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.058935Z"},"links":{"cited_paper":"/paper/2308.08746","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:6c0ad91d0a09aa83d09bd9565e82e79b17898147968c93f4cb57c94658790ca4","observation_id":"47166685-3f7f-4e81-b84a-36d59a0de644","resolution":{"observed_at":"2026-08-06T19:54:38.058935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00499","last_updated":"2024-07-09T05:59:35Z","snapshot_observed_at":"2026-08-16T15:27:35.803151Z","submitted_at":"2023-06-01T09:49:11Z","title":"DeSAM: Decoupled Segment Anything Model for Generalizable Medical Image Segmentation","version":2},"cited_work":{"arxiv_id":"2306.00499","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.00499","snapshot_observed_at":"2026-08-06T19:54:40.678248Z","title":"DeSAM: Decoupled Segment Anything Model for Generalizable Medical Image Segmentation","venue":"eess.IV","work_id":"6768613d-a25f-4d41-a557-54f0f7fac46e","year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.119846Z"},"links":{"cited_paper":"/paper/2306.00499","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:b8b3f9da8f29847d643d95bb3d5c3511239864aca4d6faa5be3b3f60b156b7ca","observation_id":"8b2d5209-9f4b-4426-a4b5-b39643efa823","resolution":{"observed_at":"2026-08-06T19:54:40.737497Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:42.004947Z","title":"Segmentation of Brain Tumor in MRI Scans Using Deep Learning,","venue":null,"work_id":"4b7f39f9-26ca-45f3-91f7-852c2068da9b","year":2019},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.176682Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:fd55f6e966e6540c942bff38ecffc4e4cf05ae6a26ce9321981850fba9798785","observation_id":"6ca32da9-a389-4dc0-ada0-f386306c3a1c","resolution":{"observed_at":"2026-08-06T19:54:42.009253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.995867Z","title":"Object Segmentation for Robotic Grasping in Cluttered Environments,","venue":null,"work_id":"e009132c-990b-46db-9bdd-866017a65819","year":2020},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.222626Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:2679693f8af6dd087b76fbe634be0919a0ce1d840758208ff0e2e57378678f30","observation_id":"dfad9add-cf04-4e0a-af08-ce02c1967b2a","resolution":{"observed_at":"2026-08-06T19:54:41.999178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.986234Z","title":null,"venue":null,"work_id":"b4b81409-d3f0-482e-b622-fd7b13a718ac","year":1989},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.298859Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:894dbfa6ee0c53ebafff1c604fb4b290352a74fdfda1eb8e58caef4f7b82bafc","observation_id":"7ffc26f5-106a-482c-b3ff-ab7ede30b769","resolution":{"observed_at":"2026-08-06T19:54:41.990053Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.975657Z","title":"U-Net: Convolutional Net- works for Biomedical Image Segmentation,","venue":null,"work_id":"33e5da71-ca32-4771-9c68-00d0b8ca60d8","year":2015},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.367241Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:df7ff7830f720c04badaa55652fbee350c2d0eea5c39b0b40e64a4a8124e295a","observation_id":"adef43a9-599e-418d-ab4c-3df53f4e30c7","resolution":{"observed_at":"2026-08-06T19:54:41.979282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.965753Z","title":"Dermatologist-level Classification of Skin Cancer with Deep Neural Networks,","venue":null,"work_id":"19527a1f-6048-46bf-8969-197090d92305","year":2017},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.422482Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:8a78ec84bfc252642e6705da39694569348bcb031edb321c1e725eb7ee9f7d61","observation_id":"cd236959-7812-4941-a8a6-645aea318a2f","resolution":{"observed_at":"2026-08-06T19:54:41.969121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.955460Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale,","venue":null,"work_id":"3d580f83-3ff7-40e6-befa-77879d1bc0b3","year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.504328Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:0bafdc832cd15304bfb6d5629aae898671fec2d3deb8e55ec66142d6cae16b7e","observation_id":"75542f48-5d49-4c9e-8448-a8a09cd935a5","resolution":{"observed_at":"2026-08-06T19:54:41.958834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.945802Z","title":"UNETR: Transformers for 3D Medical Image Segmentation,","venue":null,"work_id":"ad89be04-b891-48a1-acea-6f554b8dedee","year":2022},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.554434Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:426f9e28b368918d5303a63b94b46d2743f9b6dd831753576cc26c6f519f871d","observation_id":"0249064e-633a-4538-b228-f5458cc3ea1f","resolution":{"observed_at":"2026-08-06T19:54:41.949426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.936731Z","title":"Segmenter: Transformer for Semantic Segmentation,","venue":null,"work_id":"50c790fb-afcd-45bd-8477-d4e9f9e84b5a","year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.642902Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:811730e88d1ff430a042f82a3ef7ce49b06162a68bfa9c93017574bae2e5a0b4","observation_id":"5b6fb987-135f-4aae-8a98-215a47502110","resolution":{"observed_at":"2026-08-06T19:54:41.940035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.927223Z","title":"SETR: Vision Transformers for Semantic Segmenta- tion,","venue":null,"work_id":"38f52139-cd83-48a0-bdbf-9fdfb509441b","year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.711349Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:fe2414b50044277a77718e99bf8af77de9246b9c1e0a923a79b869f00fb0a074","observation_id":"9aabc543-ad8c-4e53-ac0d-295c36843cf0","resolution":{"observed_at":"2026-08-06T19:54:41.931108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.04306","last_updated":"2021-02-08T16:10:50Z","snapshot_observed_at":"2026-08-19T08:02:16.487223Z","submitted_at":"2021-02-08T16:10:50Z","title":"TransUNet: Transformers Make Strong Encoders for Medical Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.04306","snapshot_observed_at":"2026-08-06T19:54:38.788847Z","title":"TransUNet: Transformers Make Strong Encoders for Medical Image Segmentation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.788847Z"},"links":{"cited_paper":"/paper/2102.04306","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:ef421dcf6c797dabf785410e7dd7d37cad04bd94f1d720a24bcbbd696245a592","observation_id":"7987409b-511c-49b8-aecc-825abd67b3e6","resolution":{"observed_at":"2026-08-06T19:54:38.788847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.918147Z","title":"Prostate Segmentation Using Hybrid Transformer-CNN Models,","venue":null,"work_id":"d7fd08e7-9a79-4524-b120-ac2bc4a75506","year":2022},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.860587Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:2c84ae2c5e40535dd0c61e205fd3b8f53a4c007635b7d3637c5d99a548c28c95","observation_id":"e28d11a5-1c1c-47ef-a1c7-cc8832845087","resolution":{"observed_at":"2026-08-06T19:54:41.921510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.908326Z","title":"SegFormer: Simple and Efficient Design for Semantic Segmentation with Transformers,","venue":null,"work_id":"39878cdf-5108-42f5-9c61-68d5f59bbb93","year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.933296Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:0861ae178ce6221ce9c1e220a44a982507a9cc2736ad17743e5c58fbc3010b7c","observation_id":"a22052e9-ca01-4c1c-ac99-554585ccbf2a","resolution":{"observed_at":"2026-08-06T19:54:41.911912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.898821Z","title":"Learning Transferable Visual Models From Natural Language Supervision,","venue":null,"work_id":"48ada8bd-10c9-4a64-bc99-fd610d76d198","year":2021},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:38.973501Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:87f391910156327ed11b665541b683a6459b8682c9ead7b5bce119c1a1d3fc01","observation_id":"a3ea7f50-0ca6-4116-ad0c-b6be99fe7bcb","resolution":{"observed_at":"2026-08-06T19:54:41.902071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.889813Z","title":"Zero-Shot Medical Image Segmentation Using CLIP,","venue":null,"work_id":"bce65951-ddf9-40de-b97b-eba40c4bb75a","year":2022},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.055174Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:7f927c1a832aadcdbdad9928f4b7693399ba4d69fd96fb6b5e344543e6b54516","observation_id":"d2e2828d-c010-48b9-8b01-ecc11a1d32ab","resolution":{"observed_at":"2026-08-06T19:54:41.892960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12086","last_updated":"2022-02-15T05:43:32Z","snapshot_observed_at":"2026-08-20T06:46:31.583175Z","submitted_at":"2022-01-28T12:49:48Z","title":"BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12086","snapshot_observed_at":"2026-08-06T19:54:39.134498Z","title":"BLIP: Bootstrapped Language-Image Pre-training for Uni- fied Vision-Language Understanding and Generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.134498Z"},"links":{"cited_paper":"/paper/2201.12086","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:d66401597e184a89917a0a9c0aa229430378b74288754fbdab90cde792fbdda4","observation_id":"82005ae4-b23d-42ac-82a1-731b1d9e7fdf","resolution":{"observed_at":"2026-08-06T19:54:39.134498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.880355Z","title":"Vision-Language Models for Surgical Assistance: A Case Study in Laparoscopic Surgery,","venue":null,"work_id":"dd5be1bb-9eb9-4732-83c9-83880d97ede9","year":2023},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.187275Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:6f4b0b4e14734aad119dd44ad8006304cbddec03ff8d6e5fa637abe370842efe","observation_id":"e729320c-5e81-46c6-826b-12aa82db4804","resolution":{"observed_at":"2026-08-06T19:54:41.883869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05709","last_updated":"2020-07-01T00:09:08Z","snapshot_observed_at":"2026-08-15T20:49:51.676387Z","submitted_at":"2020-02-13T18:50:45Z","title":"A Simple Framework for Contrastive Learning of Visual Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05709","snapshot_observed_at":"2026-08-06T19:54:39.253513Z","title":"A Sim- ple Framework for Contrastive Learning of Visual Representa- tions,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.253513Z"},"links":{"cited_paper":"/paper/2002.05709","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:53c386d7d05593398a50ec265eeefc0a9e8dddd91117fd41ac535be77ae73e78","observation_id":"e7b64698-c1fa-4a9a-90a6-d5d75302b32b","resolution":{"observed_at":"2026-08-06T19:54:39.253513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.870488Z","title":null,"venue":null,"work_id":"def97390-6126-452d-a364-ce613bc3e219","year":2018},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.290513Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:3f5f9011f837296153646d1984ff55e44d2296dcd778dcb66c6a9ea9c7c1098e","observation_id":"ff1cb08c-ef96-4deb-93f3-b108fd2d6c7c","resolution":{"observed_at":"2026-08-06T19:54:41.873504Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.861497Z","title":"Bengio, J","venue":null,"work_id":"824aab65-3ac7-402f-b998-054964ba8ebc","year":2009},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.293640Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:b6fc45967821807044493caf2860ce87e78d4bbbdf57d5381fafb3557739b8ec","observation_id":"33b2d0cc-3a45-4735-bdfa-7134e1ab2c12","resolution":{"observed_at":"2026-08-06T19:54:41.864639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.852281Z","title":null,"venue":null,"work_id":"9d8b49b1-4d1d-4586-b7ab-df9c439c1a71","year":1948},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.296444Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:f8a5050791647e59bbe3d921be37cd6bec29eeaff8902210f112dbe4d8b41ebe","observation_id":"2401e4fa-5dd6-4921-9085-1544e41ea93f","resolution":{"observed_at":"2026-08-06T19:54:41.855599Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.843715Z","title":null,"venue":null,"work_id":"488e85a6-3337-45b8-bfd9-209814886621","year":1948},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.299542Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:76788ab08ea8e59479e182c1c24d507f15b2b4d144672ce79d2b565bf9bb128c","observation_id":"5d322b65-fc5c-4360-a88b-59fa85212615","resolution":{"observed_at":"2026-08-06T19:54:41.846544Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:54:41.782189Z","title":null,"venue":null,"work_id":"f6e1fbdc-9d9c-41a9-9d33-c70894f4ba05","year":1945},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.371567Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:9247c9b8695684a897657f1fed6c0d27da4a2494f6788b931ca974705b716501","observation_id":"948c36f6-0bf7-4b09-a206-9aaf7fa157f3","resolution":{"observed_at":"2026-08-06T19:54:41.838084Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T19:54:39.576293Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.576293Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:72141c2850389937a8b5e6e1bd4464d022f5fbcfdb933aecbeb066d7a315178b","observation_id":"5510acdb-cf12-4d28-9857-db19e3aeb287","resolution":{"observed_at":"2026-08-06T19:54:39.576293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.06426","last_updated":"2019-02-21T17:01:02Z","snapshot_observed_at":"2026-08-14T17:15:06.830535Z","submitted_at":"2019-02-18T07:08:36Z","title":"2017 Robotic Instrument Segmentation Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.06426","snapshot_observed_at":"2026-08-06T19:54:39.650058Z","title":"2017 Robotic Instrument Segmentation Challenge,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.650058Z"},"links":{"cited_paper":"/paper/1902.06426","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:92b3c22d85e56325d056110df77fc3832fddb6f9774df428290ead1883012836","observation_id":"2d750b7f-142f-4b80-ab8d-c9fcc45cab0f","resolution":{"observed_at":"2026-08-06T19:54:39.650058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.11190","last_updated":"2020-08-03T01:55:24Z","snapshot_observed_at":"2026-08-18T20:49:18.953792Z","submitted_at":"2020-01-30T06:37:07Z","title":"2018 Robotic Scene Segmentation Challenge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.11190","snapshot_observed_at":"2026-08-06T19:54:39.708182Z","title":"2018 Robotic Scene Segmentation Challenge,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.708182Z"},"links":{"cited_paper":"/paper/2001.11190","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:53b6ae54d1456ae117af5995c1e0845dbaef419c113a6264ecfc79a9e52352b4","observation_id":"7c870053-8de5-4233-98ce-0a35e8877fa6","resolution":{"observed_at":"2026-08-06T19:54:39.708182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05533","last_updated":"2020-07-10T16:20:56Z","snapshot_observed_at":"2026-08-13T22:09:55.979852Z","submitted_at":"2020-07-10T16:20:56Z","title":"ISINet: An Instance-Based Approach for Surgical Instrument Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.05533","snapshot_observed_at":"2026-08-06T19:54:39.775138Z","title":"ISINet: An Instance-Based Approach for Surgical Instrument Segmentation,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:39.775138Z"},"links":{"cited_paper":"/paper/2007.05533","citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:b8e80f4e796156b11d6ab46441f5325b1bb7c506438780a1e1b103cc76ae8df2","observation_id":"57f94bbd-4bde-4189-9a01-818d4e014975","resolution":{"observed_at":"2026-08-06T19:54:39.775138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.athoracsur.2022.11.009","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Available from: https://www.sciencedirect.com/science/article/pii/S0003497522014308","venue":"The Annals of Thoracic Surgery","work_id":"d7a7884c-349a-4b5b-b955-0b20570872fb","year":2022},"citing_paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning","version":1},"reference_index":1178,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:36.837067Z"},"links":{"citing_paper":"/paper/2507.04317"},"observation_digest":"sha256:8f8b41c878059457253e0ab0c698b98162084885bd220a6305e48b979a1f39d7","observation_id":"1e1e431b-1c3e-4fd2-9a2c-83023199ec02","resolution":{"observed_at":"2026-08-06T19:54:40.323228Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.04317","last_updated":"2025-07-06T09:53:31Z","latest_version":1,"primary_category":"eess.IV","snapshot_observed_at":"2026-08-15T13:40:17.323684Z","submitted_at":"2025-07-06T09:53:31Z","title":"CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":8,"verified_fuzzy":18},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2507.04317."}