{"as_of":"2026-08-12T13:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a11e680b5de1c5be4b3544526a40638eccc0874b0eb2e462176b81e7118f2175","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:58:30.055411Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:21:40.759357Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T20:21:44.721684Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"cited_work":{"arxiv_id":"2501.09555","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.09555","snapshot_observed_at":"2026-08-06T20:21:44.721684Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","venue":"cs.CV","work_id":"c34537a7-eced-4b7f-97c3-d93ba8777f45","year":2025},"citing_paper":{"arxiv_id":"2507.03295","last_updated":"2025-08-11T07:31:41Z","snapshot_observed_at":"2026-08-09T05:20:32.617384Z","submitted_at":"2025-07-04T04:54:47Z","title":"CPKD: Clinical Prior Knowledge-Constrained Diffusion Models for Surgical Phase Recognition in Endoscopic Submucosal Dissection","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:21:40.759357Z"},"links":{"cited_paper":"/paper/2501.09555","citing_paper":"/paper/2507.03295"},"observation_digest":"sha256:3b7f4693704f792987ec6a6edd0e645fb66eb12b356bfc89d143d12764ad780d","observation_id":"26345b51-1f17-4046-8379-ddeed7f4d3a3","resolution":{"observed_at":"2026-08-06T20:21:44.820536Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.09555/citation-record","integrity":"/paper/2501.09555/integrity","json":"/paper/2501.09555/citation-record.json","paper":"/paper/2501.09555"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:31.295187Z","title":null,"venue":null,"work_id":"936d917d-e1a6-42b7-b510-46ac0a58fb42","year":2005},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.586616Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:04382ea659971e747edbb17584d5247949f7eb2791d9a873ab47e09f845c45ce","observation_id":"43ea087c-64f4-4113-ad3d-894f4d3fe015","resolution":{"observed_at":"2026-08-10T19:58:31.353065Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:31.148374Z","title":null,"venue":null,"work_id":"f0dbd401-b0c8-40dc-b1e3-89f099371bbd","year":2020},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.593947Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:189fa591ad0ed33f1abb4880db09e5d46e801717abce103d11ac5b2143b3cb6b","observation_id":"b8aaaa07-3a72-45e2-bf3c-230500716579","resolution":{"observed_at":"2026-08-10T19:58:31.199339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:31.136054Z","title":null,"venue":null,"work_id":"e20bdf02-de35-4cab-9281-4108f033de9e","year":2021},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.601216Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:0b641c84a213e76012e6f30b4591603cd02e866529b1beaabd9fc2c4b3040c3f","observation_id":"6fa50221-dd08-49a9-bb00-1583b5ef32ed","resolution":{"observed_at":"2026-08-10T19:58:31.140077Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:31.122207Z","title":"I can’t believe there’s no im- ages! learning visual tasks using only language supervision, in: Pro- ceedings of the IEEE /CVF International Conference on Computer Vi- sion, pp","venue":null,"work_id":"4aa23376-22ad-48f7-b68d-38d66dcdb45d","year":2023},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.608083Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:815536d10182a1547fd2b0fb16388d4c751c5a526e78dfe6d23b4d4c5a79b8e9","observation_id":"a853ea1a-95ba-4cd3-bd33-906fad56707c","resolution":{"observed_at":"2026-08-10T19:58:31.126610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:31.019710Z","title":"A k-means clustering algorithm","venue":null,"work_id":"62b9b6fc-8b58-4c54-93ca-406c56341b0e","year":1979},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.615929Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:5ab93bdd88a121438944f7dc12df726602459235361f75ec6d321c550ff8559b","observation_id":"418a45d2-4161-48c8-8203-beedaefa8e8c","resolution":{"observed_at":"2026-08-10T19:58:31.082359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:31.005365Z","title":null,"venue":null,"work_id":"c04a34b6-ebed-40ec-8e44-ebbdce4d660e","year":null},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.621377Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:30efc7703fd6b6b208bff7a4bcb7cf1dfaecf793f01a0b8b29966767dc484d21","observation_id":"a0b99eda-ff0c-46c0-a332-8f39729378e6","resolution":{"observed_at":"2026-08-10T19:58:31.010264Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.794557Z","title":"Latent graph representations for critical view of safety assessment","venue":null,"work_id":"d47b6dd1-7a93-4b0c-bf1e-faea88a84abf","year":2023},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.629723Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:e5215273cee759e1f1417c4f8369d16201621b0d3c161d5299a53bf0533cba38","observation_id":"5c524ee1-4658-4400-a9e4-d589fd2efd31","resolution":{"observed_at":"2026-08-10T19:58:30.846622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:29.634023Z","title":"Text-only training for image captioning using noise-injected CLIP, in: Goldberg, Y ., Kozareva, Z., Zhang, Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.634023Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:5471db46afdabcf6e0ac34f6970cfcb9ea3f9a9c24e56033127b9f816c3b80f8","observation_id":"2e5fd39c-03ab-4f00-9e12-a4e80447c76a","resolution":{"observed_at":"2026-08-10T19:58:29.634023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.781337Z","title":"Rendezvous: Attention mechanisms for the recognition of surgical action triplets in endoscopic videos","venue":null,"work_id":"e3ee6c2f-589f-48b2-92b6-10fb559d9ae5","year":2022},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.638762Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:3ef69528990119bda34faf80e78a585ec6fb08da87542fde2223837b859bccc1","observation_id":"6d73ad59-8501-4043-b93b-da954d441220","resolution":{"observed_at":"2026-08-10T19:58:30.785614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.755958Z","title":"Machine and deep learning for workflow recognition during surgery","venue":null,"work_id":"2709c69b-27ca-4c5a-8f5e-d110c3bde111","year":2019},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.687621Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:255c0797f87cf4463525a706fbb5ce00476f525953671188357ea200882977f8","observation_id":"1965676f-65cc-4e1d-861d-8a14eeab5c6e","resolution":{"observed_at":"2026-08-10T19:58:30.771197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.693558Z","title":"Bleu: a method for automatic evaluation of machine translation, in: Proceedings of the 40th annual meeting of the Association for Computational Linguistics, pp","venue":null,"work_id":"18e908b7-464a-43ab-893f-e85f210f8947","year":2002},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.744728Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:8f42acba945af11941f392cd9c36d4f1957f23b952c3ffc70c8934ed5a37f5e6","observation_id":"392f555d-026f-4d63-ab46-717e82c9a4de","resolution":{"observed_at":"2026-08-10T19:58:30.729598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02413","last_updated":"2017-06-07T23:37:44Z","snapshot_observed_at":"2026-07-06T05:46:01.107746Z","submitted_at":"2017-06-07T23:37:44Z","title":"PointNet++: Deep Hierarchical Feature Learning on Point Sets in a Metric Space","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.02413","snapshot_observed_at":"2026-08-10T19:58:29.793971Z","title":"Pointnet ++: Deep hierar- chical feature learning on point sets in a metric space","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.793971Z"},"links":{"cited_paper":"/paper/1706.02413","citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:459747107668797f2b5387afc37036c0c2d81d1b6794dd8824b1bc935241123b","observation_id":"e2cf401d-bf9f-4012-8792-6b0356b881e3","resolution":{"observed_at":"2026-08-10T19:58:29.793971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.669846Z","title":"Learning transferable visual models from natural language supervision, in: Inter- national conference on machine learning, PMLR","venue":null,"work_id":"a9f4fffa-6a74-4ab7-bc18-91fd36f55cc6","year":2021},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.878254Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:9cb6a4460ec45e39cd3378db6e1cfc97a47d54cc9dd49859f8c0e87cca360b33","observation_id":"b32e7f4e-248b-41db-9aaf-452cdd0926e2","resolution":{"observed_at":"2026-08-10T19:58:30.674429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.650995Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"353b0ceb-94cd-4fe2-bf4b-6e434b10fcb9","year":2019},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.894306Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:0be40ea91386df2faa77aedf6d3c231e7d12392938416b83c7db5f35e4edebb7","observation_id":"74c254b5-b088-4852-b8c6-6c829984cf24","resolution":{"observed_at":"2026-08-10T19:58:30.660063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.517226Z","title":"Ima- genet large scale visual recognition challenge","venue":null,"work_id":"cb49dd36-0a63-42fb-9355-dee6cc0eed33","year":2015},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.964339Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:30c43f18f76c764b2ca3a1f99a645cae543357e606fc0ef2ecac6ea6e47ed5e5","observation_id":"4c83c0dd-4217-4d19-a01f-f2ba4154141d","resolution":{"observed_at":"2026-08-10T19:58:30.578523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.502430Z","title":"Surgical- vqa: Visual question answering in surgical scenes using transformer, in: MICCAI, pp","venue":null,"work_id":"2dbce859-83db-4bfe-882a-3b6ada0f5e97","year":2022},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.974247Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:407ad0656a89f0fee73a7e08088ec212b46233e8a9cccee637317fe243d93bb2","observation_id":"02577e59-e60e-4716-a404-478873dcb6e5","resolution":{"observed_at":"2026-08-10T19:58:30.507813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.488232Z","title":"Endonet: a deep architecture for recognition tasks on laparoscopic videos","venue":null,"work_id":"d39ca369-01bc-4a96-92a8-d583be130597","year":2016},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.983824Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:1e09546ef97b41f836a1f45856dab9e7798f73cbfada3c799d242964b85ea408","observation_id":"354a920a-9b7b-4a31-8ada-460a1a272f25","resolution":{"observed_at":"2026-08-10T19:58:30.493209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.472494Z","title":"Cider: Consensus-based image description evaluation, in: Proceedings of the IEEE conference on computer vision and pattern recognition, pp","venue":null,"work_id":"3abadff0-002a-409f-b133-1d7006ac9a06","year":2015},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.002057Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:1259ccc3386613d84c0446ecfb1631bee3d4640e083d841bb37b536e621d2280","observation_id":"ccb0c833-738d-4f41-be2f-6b9ce11161c8","resolution":{"observed_at":"2026-08-10T19:58:30.477714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.08472","last_updated":"2021-09-17T11:21:34Z","snapshot_observed_at":"2026-07-06T11:48:42.000083Z","submitted_at":"2021-09-17T11:21:34Z","title":"ActionCLIP: A New Paradigm for Video Action Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.08472","snapshot_observed_at":"2026-08-10T19:58:30.021304Z","title":"Actionclip: A new paradigm for video action recognition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.021304Z"},"links":{"cited_paper":"/paper/2109.08472","citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:9c2a4bf60b612015a96f2d3d091ffd76b336835968f3f3a5470984317ec47997","observation_id":"63691d2c-6679-47e0-9330-9d243bc9096f","resolution":{"observed_at":"2026-08-10T19:58:30.021304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.418886Z","title":"Visual-language prompt tuning with knowledge-guided context optimization, in: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition, pp","venue":null,"work_id":"c0a5c2c6-7b25-4883-a942-39fb1ca69320","year":2023},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.029323Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:d4fe96436adcbada817e80acd750e59d1008fc1f499ab874cffc7b356dbc4296","observation_id":"17fb5981-f75b-4346-a199-e060373369e2","resolution":{"observed_at":"2026-08-10T19:58:30.444666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.351089Z","title":"Anticipation for sur- gical workflow through instrument interaction and recognized signals","venue":null,"work_id":"9f072381-e0fb-4f39-bcb2-1bd9d1a08d3f","year":2022},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.033568Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:5061967e0d8ece2985df558eb1567bd66fd0c75bd49ef39671d8b50a379a67ec","observation_id":"988509e9-faa8-45f5-82e9-50d5c03521be","resolution":{"observed_at":"2026-08-10T19:58:30.377144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.263458Z","title":"Advancing surgical vqa with scene graph knowledge","venue":null,"work_id":"f85f5fbd-b40e-4d7d-bd5f-d6ae492717da","year":null},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.037780Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:e700cc411f1117f94c5c08001d3b525ab9c2ffbd0ffe6f3b899e336cd43ca79b","observation_id":"7f9cb348-5232-45bd-b0a1-1272a58a5e48","resolution":{"observed_at":"2026-08-10T19:58:30.302547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.195718Z","title":null,"venue":null,"work_id":"8c0b6e55-3256-4130-b7c1-a2b7cf2579b1","year":null},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.042669Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:4406e1a09579af2c910043c93d85e71263949557e9f88d0da8c94aba08de954a","observation_id":"70e91694-db7f-421d-960c-bd6c8c9f1a1b","resolution":{"observed_at":"2026-08-10T19:58:30.229130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00263","last_updated":"2025-03-13T15:21:36Z","snapshot_observed_at":"2026-08-07T21:24:04.922825Z","submitted_at":"2024-09-30T22:21:05Z","title":"Procedure-Aware Surgical Video-language Pretraining with Hierarchical Knowledge Augmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00263","snapshot_observed_at":"2026-08-10T19:58:30.046785Z","title":"Procedure-aware surgical video-language pretraining with hierarchical knowledge aug- mentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.046785Z"},"links":{"cited_paper":"/paper/2410.00263","citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:7003913ed7897b7c398d12d0756df35991472a12587bb64c620f7a30fee7e854","observation_id":"e5781e70-2e2d-45da-8ec0-44300e107a4b","resolution":{"observed_at":"2026-08-10T19:58:30.046785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15220","last_updated":"2025-06-16T19:07:50Z","snapshot_observed_at":"2026-07-06T15:59:30.956483Z","submitted_at":"2023-07-27T22:38:12Z","title":"Learning Multi-modal Representations by Watching Hundreds of Surgical Video Lectures","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15220","snapshot_observed_at":"2026-08-10T19:58:30.051097Z","title":"Learning multi-modal representations by watching hundreds of surgical video lectures","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.051097Z"},"links":{"cited_paper":"/paper/2307.15220","citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:ea103126dcd706c91c2d809d0052c16610257588e96a9c3cd5a6fbac8cbd1db4","observation_id":"4e77adc0-8dd8-4725-a0f8-b9346ea271ca","resolution":{"observed_at":"2026-08-10T19:58:30.051097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.157304Z","title":"Conditional prompt learn- ing for vision-language models, in: Proceedings of the IEEE /CVF con- ference on computer vision and pattern recognition, pp","venue":null,"work_id":"d566e963-e5ff-430d-9484-8eebf6bc43c7","year":2022},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:30.055411Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:fb8fd6ba0a5d76d9eba410556dd847d8c022550d4096e47b3940765e59c38770","observation_id":"94e025d8-1456-4453-8894-67f4ca9e9abc","resolution":{"observed_at":"2026-08-10T19:58:30.164155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T19:58:30.894554Z","title":"MedIA 76, 102306","venue":null,"work_id":"e3f69baa-bb5b-4015-910b-f21521a9eb5f","year":null},"citing_paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T19:58:29.625621Z"},"links":{"citing_paper":"/paper/2501.09555"},"observation_digest":"sha256:cd67e237e88a7beedd1afa7952712dc7f31490c7ca1c36b190ea442f7db3d73d","observation_id":"53533d37-a7f8-4f09-b947-26b9992524d3","resolution":{"observed_at":"2026-08-10T19:58:30.945144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.09555","last_updated":"2025-03-03T13:05:35Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T19:51:32.416171Z","submitted_at":"2025-01-16T14:18:06Z","title":"Text-driven Adaptation of Foundation Models for Few-shot Surgical Workflow Analysis"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":17},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 1 inbound Pith citation observation for arXiv:2501.09555."}