{"as_of":"2026-08-18T11:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a511659317840bcdafe017b7f603a2fd9cefbf94d4555e6228b419cf261cb794","coverage":[{"denominator":89,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":89,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T18:55:31.923309Z","state":"measured"},{"denominator":91,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":91,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-15T11:44:19.622453Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.03740","snapshot_observed_at":"2026-07-13T14:28:05.261852Z","title":"Singular value few-shot adaptation of vision-language models.arXiv preprint arXiv:2509.03740, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.01313","last_updated":"2026-07-13T21:14:32Z","snapshot_observed_at":"2026-08-05T01:00:36.896864Z","submitted_at":"2026-04-01T18:36:47Z","title":"ScatterPrism: convergence for generative simulation and inverse problems in particle and nuclear physics","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T14:28:05.261852Z"},"links":{"cited_paper":"/paper/2509.03740","citing_paper":"/paper/2604.01313"},"observation_digest":"sha256:465a9033fdbc43b9cf8949db44460fd84706afbf7b5be174cbc9c62e4bfcbc7c","observation_id":"baf27cc9-8c02-47e6-abc2-ae8384a5f797","resolution":{"observed_at":"2026-07-13T14:28:05.261852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.03740","snapshot_observed_at":"2026-07-15T11:44:19.622453Z","title":"Singular value few-shot adaptation of vision-language models.arXiv preprint arXiv:2509.03740, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.01313","last_updated":"2026-07-13T21:14:32Z","snapshot_observed_at":"2026-08-05T01:00:36.896864Z","submitted_at":"2026-04-01T18:36:47Z","title":"ScatterPrism: convergence for generative simulation and inverse problems in particle and nuclear physics","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-15T11:44:19.622453Z"},"links":{"cited_paper":"/paper/2509.03740","citing_paper":"/paper/2604.01313"},"observation_digest":"sha256:93cfa72adebdb1532a3b53486eb5f25c1117596ed0ca61fd07f54021037204f3","observation_id":"0a9495d9-c15b-4821-81e6-d1717c0a38cd","resolution":{"observed_at":"2026-07-15T11:44:19.622453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.03740/citation-record","integrity":"/paper/2509.03740/integrity","json":"/paper/2509.03740/citation-record.json","paper":"/paper/2509.03740"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:e246edba24720679e6a1c1d42fac756a46bf1f49ad40406b410d6b7129f7ba96","observation_id":"533fa2e6-2a97-4732-8b0f-eb7a2e0426e5","resolution":{"observed_at":"2026-05-18T18:56:45.916910Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Intrinsic dimensionality explains the effective- ness of language model fine-tuning","venue":null,"work_id":"c7ca823b-cbc4-4434-9af8-4886a0ba0b9e","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:a027c7160ed6d57eab49575f29f04211064fd0a7c51d8139fa1890d981aaf38c","observation_id":"c3f8c7d6-08ba-4149-a1c2-b0923d858767","resolution":{"observed_at":"2026-05-18T18:56:47.210595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dataset of breast ultrasound images.Data in brief, 28:104863","venue":null,"work_id":"2971f7e6-6b88-4aef-bd30-1d8c628b8748","year":2020},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:59a0f360dd2ec1f600cf4bb1155bd48fa473816aaad291765dd74b9d2fc94427","observation_id":"5bd780ac-28da-411c-9e1c-df236f5bf61e","resolution":{"observed_at":"2026-05-18T18:56:47.204613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proker: A kernel perspective on few-shot adaptation of large vision-language models","venue":null,"work_id":"d45fa24c-b55a-4483-a39a-671eda50df9e","year":2025},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:8223e4ff9967799f65441dce9d30a5cca16c9dcbcb06452d254f7561f2f8d3d0","observation_id":"f7a7e6f8-a2b6-4899-a0e7-0ac1b7b0e47e","resolution":{"observed_at":"2026-05-18T18:56:47.213372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Xcoop: Explainable prompt learning for computer- aided diagnosis via concept-guided context optimization","venue":null,"work_id":"fb12b2fb-2f29-44af-8f56-6c8ad3e9b309","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:0052c0afe3c4fb8e7989b911c2d105e6a446dcadb2907c9640f1d40b28f9af19","observation_id":"a7c657f1-a313-4395-832b-2c72490e374a","resolution":{"observed_at":"2026-05-18T18:56:47.216208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Making the most of text semantics to improve biomedical vision–language processing","venue":null,"work_id":"f88b303a-9d2d-490e-8447-cea71a76d257","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:cbb50fb56721f5d1ace942be07967944b5d0bc3770123f91318372387271cb94","observation_id":"e1600481-7bca-4497-90d7-5522b6956893","resolution":{"observed_at":"2026-05-18T18:56:47.221616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Borkowski, Marilyn M","venue":null,"work_id":"70c377e7-2607-4dfd-90c0-2c1a6ab23701","year":2019},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:61cbc32196bc0880b15fb04ce505ef476f65acc20db353a5556f70d8f876bb71","observation_id":"f264135b-7f71-4abe-a227-2b418334a2d0","resolution":{"observed_at":"2026-05-18T18:56:47.224047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Food-101–mining discriminative components with random forests","venue":null,"work_id":"53378af0-8fea-4a08-9724-6d0bda8b23a7","year":2014},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:cac30d375e6ba0c3f42c7761a23110c350bb8ee9562973abd3b77d35e77833a1","observation_id":"89e889f9-4682-4010-8ef0-6915abbec4f6","resolution":{"observed_at":"2026-05-18T18:56:47.207538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Domain-controlled prompt learning","venue":null,"work_id":"a9bc90db-e59c-48c0-8c17-965ea58dad6b","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:b87aa37a2ca7add9010b4071be4926220612bf1067f5f42ef8a89248ecb906a4","observation_id":"7e686aec-4dc5-49b5-8282-66ce42749e1f","resolution":{"observed_at":"2026-05-18T18:56:47.226901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Knee osteoarthritis severity grading dataset","venue":null,"work_id":"8d861c9f-6e79-48f1-9216-6736a403a7e0","year":2018},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:5a5009819e646444112d584d2a81817bffcdef556404f08d28e560a068e3172a","observation_id":"7e377c8e-3d36-4d0d-ab44-3ed399f3dbfc","resolution":{"observed_at":"2026-05-18T18:56:47.218850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"gscorecam: What objects is clip looking at? InProceedings of the Asian Conference on Computer Vision, pages 1959–1975","venue":null,"work_id":"1b239923-6dc7-4363-b88e-549ee5e2da69","year":1959},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:9ab895360d4b5c7f0eb5a13ee44e574877e2b972cde052acc73aa14650f2c925","observation_id":"ad5324b2-bca9-42d1-956d-113092f67dc9","resolution":{"observed_at":"2026-05-18T18:56:47.229799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adapt- former: Adapting vision transformers for scalable visual recognition.Advances in Neural Information Processing Systems, 35:16664–16678","venue":null,"work_id":"ae2e9cba-5852-4370-a637-12b6644dae2c","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:3e4b589514e98cc204a23b38ac5211265eb016ccb5f5f69eb3591a68e7e8f651","observation_id":"afae3172-4b95-478c-a933-adeed5e78d7d","resolution":{"observed_at":"2026-05-18T18:56:47.232827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Describing textures in the wild","venue":null,"work_id":"44bc7e8d-6f56-4f97-97e9-27dedea34088","year":2014},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:fa8ca9a8fae71b181340fd9a69a50c60433c32a1c2a89ee7e8604ccea7db05f2","observation_id":"06b09df2-4f47-4ce4-b2ad-65ac6694efc6","resolution":{"observed_at":"2026-05-18T18:56:47.353160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.03368","last_updated":"2019-03-29T17:36:27Z","snapshot_observed_at":"2026-08-15T04:41:37.630801Z","submitted_at":"2019-02-09T04:18:10Z","title":"Skin Lesion Analysis Toward Melanoma Detection 2018: A Challenge Hosted by the International Skin Imaging Collaboration (ISIC)","version":2},"cited_work":{"arxiv_id":"1902.03368","doi":"10.48550/arxiv.1902.03368","metadata_source":"pith","pith_arxiv_id":"1902.03368","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Skin Lesion Analysis Toward Melanoma Detection 2018: A Challenge Hosted by the International Skin Imaging Collaboration (ISIC)","venue":"cs.CV","work_id":"a1680554-54cc-449f-aa92-0acb940cad0a","year":2019},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/1902.03368","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:c65abc37c3b9f6d66cc9996d610d48dec6d4aa313751292ec48c15452bc189cc","observation_id":"06c553b8-a234-4820-8fc1-d11b13efda97","resolution":{"observed_at":"2026-05-18T18:56:46.005598Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"626a8742-f2ae-4c4f-b0bf-57332d680e9a","year":2009},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:772baabeb0f8067cf288bb9e21c49f1fa12d9df0d600483e40fb66e5ab7513ca","observation_id":"1faa7fc3-e9bc-4eda-a62b-fd20924fc40c","resolution":{"observed_at":"2026-05-18T18:56:47.287912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Does clip benefit visual question answering in the medical domain as much as it does in the general domain?","venue":null,"work_id":"2c121ac9-1ca2-4dfb-ba40-6836d2985eb1","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:2e06f6da907cd76870a369e547d58ff2e87de4c35ea71d8412a43335aee09e9d","observation_id":"cf7df616-77bc-401a-97b4-8c0e47ead3f2","resolution":{"observed_at":"2026-05-18T18:56:47.322030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning generative visual models from few training examples: An incremental bayesian approach tested on 101 object categories","venue":null,"work_id":"18553849-69a1-4558-a674-10c12c1e6ffc","year":2004},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:47437e563e5443eb1c5a4442e6af9db5beb8c5adc4916e5eb7ea2d313c0371de","observation_id":"5c29083d-9b4c-4835-ac0b-c8dfb8c3735c","resolution":{"observed_at":"2026-05-18T18:56:47.350251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05916","last_updated":"2024-03-29T03:40:47Z","snapshot_observed_at":"2026-08-16T14:53:43.711561Z","submitted_at":"2023-10-09T17:59:04Z","title":"Interpreting CLIP's Image Representation via Text-Based Decomposition","version":4},"cited_work":{"arxiv_id":"2310.05916","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05916","snapshot_observed_at":"2026-06-29T18:53:51.518085Z","title":"arXiv preprint arXiv:2310.05916 , year=","venue":null,"work_id":"6f05eb6e-ec45-4976-b969-554c4549e425","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2310.05916","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:e8f4ea7dc5b6cde6bf058b2ca135ef4c110a8e4eec08ad543a498f76f9350fd1","observation_id":"3de5c3cf-6734-4c7e-9a89-c8653d1bf5e7","resolution":{"observed_at":"2026-05-18T18:56:45.986297Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Clip-adapter: Better vision-language models with feature adapters.International Journal of Computer Vision, 132(2):581–595","venue":null,"work_id":"62f08d41-45a1-4c34-a525-cba3b3144f75","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:0d009fefa5efd7b104c1b9de3c8f266c3741de4a5b08cc93fc02371b08e6d6e5","observation_id":"09320d8d-2820-446e-a2ef-006b27c87890","resolution":{"observed_at":"2026-05-18T18:56:47.318883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet auto-annotation with segmentation propagation.International Journal of Computer Vision, 110(3):328–348","venue":null,"work_id":"8cc0bb19-35b7-42a4-a217-f494ebb83d4a","year":2014},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:11af54bc2cce562a83abc9ca35b11040cfd27397baeba40c5b3e1af016db0760","observation_id":"cd24fc75-0ef6-436e-bf35-98e08c13cdce","resolution":{"observed_at":"2026-05-18T18:56:47.325531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Parameter-efficient transfer learning with diff pruning","venue":null,"work_id":"adc7123d-54c7-448d-94db-30087bd5273d","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:085d31e7514d91e8eb4e33ebdc6900ed2c8fc088cc178ce338671952faa9abc4","observation_id":"ff3c9753-c886-4443-bfef-71701186333c","resolution":{"observed_at":"2026-05-18T18:56:47.301065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Eurosat: A novel dataset and deep learning benchmark for land use and land cover classification.J-STARS, 12(7):2217–2226","venue":null,"work_id":"2b562199-3961-4ef6-9701-8c2ee2680cea","year":2019},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:4f92e681cd3a8e3c6dabb506570444231223ee4beb17a7904dcbed6e1c97e9d8","observation_id":"6643ec43-d686-4ae1-b4b6-acad9d134468","resolution":{"observed_at":"2026-05-18T18:56:47.242050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The many faces of robustness: A critical analysis of out-of-distribution generalization","venue":null,"work_id":"e2ab86bd-e56e-4cba-a3f4-8d55772fed76","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:7b565694c175a72a5c725230ebf407dfbc292001af1b41ed47f21a3400922af4","observation_id":"2a0abd87-4ade-406f-a9e5-8d9c2a3d2105","resolution":{"observed_at":"2026-05-18T18:56:47.269137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Natural adversarial examples","venue":null,"work_id":"ef5db202-2583-4f39-b5f6-2b536b6c611f","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:a19e1f86bc3c05c0bb1ba441a982a29bd2f52245a1ce5b1cf976d45838b24962","observation_id":"7e64ccd8-cc37-4477-8870-f72972af9a48","resolution":{"observed_at":"2026-05-18T18:56:47.304103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nxmtransformer: semi-structured sparsification for natural language understanding via admm.Advances in neural information processing systems, 34: 1818–1830","venue":null,"work_id":"bdcf259c-d7ab-4d3b-9b4b-549584b35eb2","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:138f7be15b5be1c739eb13e44e0129faa9b5d26c2634dd9bbe56764bbd57011f","observation_id":"a6f78296-1742-41c6-952e-951b39fd0229","resolution":{"observed_at":"2026-05-18T18:56:47.250902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Parameter-efficient transfer learning for nlp","venue":null,"work_id":"9bf15398-914e-4009-a697-7f47778450ec","year":2019},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:a321ab9dc3115849597d8d20976177383b8ce957b5779221d58e60908e676bf3","observation_id":"ff141ef5-a5b6-4053-82d2-c7e61a7fe838","resolution":{"observed_at":"2026-05-18T18:56:47.291333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"25554bdc-ad4e-4740-a325-6b1a85176ade","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:254e8662636b9c8139f36d63861110d44b24102aec517541dcbd26f064e81972","observation_id":"0e94d59a-5196-450f-b1c0-b81017d33df0","resolution":{"observed_at":"2026-05-18T18:56:47.294577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lp++: A surprisingly strong linear probe for few-shot clip","venue":null,"work_id":"d36cdbf3-1ba3-4313-a8c0-9a8ba97984fe","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:53d06bc42a0759a90dafd1afc5ba0b1d95b6194a4e9e980f882265d08fd63bd9","observation_id":"5db304b2-26a3-4684-b42a-a4b648a4d4e3","resolution":{"observed_at":"2026-05-18T18:56:47.244975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vision transformer and explainable transfer learning models for auto detection of kidney cyst, stone and tumor from ct-radiography.Scientific Reports, 12(1):1–14","venue":null,"work_id":"b2463c29-59d4-44f4-93c3-159be6761826","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:888d8561ddd1efea8b7e4e713f6e58db70de5ecafc07adbba0253cda8dd313a6","observation_id":"d19ffe23-ef9d-4776-b362-0dfad662f787","resolution":{"observed_at":"2026-05-18T18:56:47.307575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling up visual and vision-language representation learning with noisy text supervision","venue":null,"work_id":"b10103e9-d2b4-42cc-988e-048bfec3fb55","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:d43c8fa883906f123a48c0ddac150bebcdcb8e848e5ecb9762e89de08e98d3e5","observation_id":"9f248b4f-9ca5-480e-8979-d96c9d015bac","resolution":{"observed_at":"2026-05-18T18:56:47.402750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual prompt tuning","venue":null,"work_id":"3ebbbac0-1d46-44bf-9d78-f3a1602493df","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:e0412654750df509ecfe21395c67ec07f9957669b3de0047c7cad5363cf045a2","observation_id":"fc2f5acf-8726-447c-9c49-67fe7ab6a40e","resolution":{"observed_at":"2026-05-18T18:56:47.356565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compacter: Efficient low-rank hypercomplex adapter layers","venue":null,"work_id":"096dbe1b-8e7d-469d-b711-fa489b137da6","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:7bed66d5b66e5aec1bd037ff5d3067db4ebe4580f1b4ceac20b0883559bd5cdc","observation_id":"2c9eb32a-2a68-46e4-a067-916104d3b9e8","resolution":{"observed_at":"2026-05-18T18:56:47.374775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-class texture analysis in colorectal cancer histology.Scientific reports, 6(1):1–11","venue":null,"work_id":"8b5739b0-9cf3-4dfa-8480-2b4097e3d109","year":2016},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:403b0afd9e242d3a2a3e78babed70bcc663dac4c77232cd04ce1444ede37e170","observation_id":"3857d8ed-b090-4a9e-aeff-a1b4d4081332","resolution":{"observed_at":"2026-05-18T18:56:47.406018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kermany, Michael Goldbaum, et al","venue":null,"work_id":"7d34f052-f1b9-4050-9665-1f7e9292d47c","year":2018},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:c21430bcd4c75805b870d48d09306a739d1e43ef8ee2002a520f51e8a46680cb","observation_id":"848acc46-63f5-455d-b75c-038a2aa792f6","resolution":{"observed_at":"2026-05-18T18:56:47.341224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Maple: Multi-modal prompt learning","venue":null,"work_id":"7fd85f7d-214c-44c5-a803-9594bf4b12f3","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:92c6300f8318d147ef9718f83f0e61dae2304d93a2e45047cda2b4893ac97883","observation_id":"a3fb7660-8c44-4ab4-b78a-07d91a053063","resolution":{"observed_at":"2026-05-18T18:56:47.265750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-regulating prompts: Foundational model adaptation without forgetting","venue":null,"work_id":"8de62095-c484-4f53-b8aa-f49b7abe161d","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:3c814daef0f24d66a9b313245e4f0c76a715aa4c7f61c76393ba9e7c7f2dec53","observation_id":"e339d494-6064-40bc-8a42-8aa9288e9ece","resolution":{"observed_at":"2026-05-18T18:56:47.247873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Medclip-sam: Bridging text and image towards universal medical image segmentation","venue":null,"work_id":"ede98ce7-fd43-441a-b87e-8757cc6dfa24","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:807d29d9d24bd1bf4b5b33fc9e2982622cb164d973579e089cbcbecea0b99ff4","observation_id":"07a9159c-0162-459f-af3d-b3032a8304ab","resolution":{"observed_at":"2026-05-18T18:56:47.281463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Medclip-samv2: Towards universal text-driven medical image segmentation.Medical Image Analysis, page 103749","venue":null,"work_id":"9d667efd-d1c3-464d-99d7-36bcc42f7db6","year":2025},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:4bdffdce86e75274f7e5befa2197b1a9c226cc88c0776b91db0aeca5e42de0b7","observation_id":"88b295f4-746b-4068-8972-e2af30dfa4ab","resolution":{"observed_at":"2026-05-18T18:56:47.378519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Biomedcoop: Learning to prompt for biomedical vision-language models","venue":null,"work_id":"27cf78bc-85dd-4035-a2d8-4d319afe24a0","year":2025},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:5532f6fa4e97b1ce98e7f95eb2b3aadeb243696e3a23f58dbc511eb630ef07cd","observation_id":"6eaddcca-d63a-4f28-90af-e405d2d32914","resolution":{"observed_at":"2026-05-18T18:56:47.272112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3d object representations for fine-grained categorization","venue":null,"work_id":"50c0433d-7cba-418a-acd1-e8d67f3cd1ae","year":2013},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:de93a0a6ec710cfa1979b077c9a3e422a608db53154c1af5e802804233a702e6","observation_id":"f92e7d54-d7a0-48c5-b7ea-f62b4824189a","resolution":{"observed_at":"2026-05-18T18:56:47.274957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Automatic no-reference quality assessment for retinal fundus images using vessel segmentation","venue":null,"work_id":"52d8202e-9f7f-4123-b951-411152d373bb","year":2013},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:3cfe0e513e181a310247aaf3bcebb5dfb013bdd59b4913d15df4609d766e61a5","observation_id":"804ac4b9-b880-45a3-95c7-c728914c3814","resolution":{"observed_at":"2026-05-18T18:56:47.371205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-08-16T20:01:36.160048Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":"2104.08691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-07-04T14:59:55.372222Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","venue":"cs.CL","work_id":"1056ba8e-7b3f-4811-be8e-9a3ed9269acb","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:5ae4761c073eb8abaf91f59c76e2fe7118aa058d0cca6cabaf2398724aa8eba6","observation_id":"1f86f39d-fc62-47f8-be3f-d44616a2fe8f","resolution":{"observed_at":"2026-05-18T18:56:45.944281Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Measuring the intrinsic dimension of objective landscapes","venue":null,"work_id":"cd027969-fa8a-442c-a11d-aaa9bae1373d","year":2018},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:3edfd71fd937d21a4bb337b43baab84b2ab57f2f24bd38deee924d582dd2eac2","observation_id":"e9cbea95-8d88-4b83-bfa9-7f072393afc0","resolution":{"observed_at":"2026-05-18T18:56:47.382172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prefix-tuning: Optimizing continuous prompts for generation","venue":null,"work_id":"d9e0c736-e362-41c8-8d9f-cd8f477aebe2","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:1dbc5f7ebff9bb5548965adcbd0978f639523e132361c14668decd65ea2cdee6","observation_id":"7c3c92b4-c35e-4d7f-9856-dc309bed2e3c","resolution":{"observed_at":"2026-05-18T18:56:47.359999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15647","last_updated":"2024-11-22T05:02:26Z","snapshot_observed_at":"2026-08-16T17:56:59.385553Z","submitted_at":"2023-03-28T00:06:38Z","title":"Scaling Down to Scale Up: A Guide to Parameter-Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2303.15647","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.15647","snapshot_observed_at":"2026-07-01T13:55:46.477835Z","title":"Scaling down to scale up: A guide to parameter-efficient fine-tuning.arXiv preprint arXiv:2303.15647","venue":null,"work_id":"57ac9386-0e04-45d3-8cb8-7bf370819655","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2303.15647","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:2519c6cf203bc957bfe14f83a84e2ff4f75258d716c0e255990d237a8447f54e","observation_id":"33523daa-722b-4eb3-862f-fc3862b74efc","resolution":{"observed_at":"2026-05-18T18:56:45.955971Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling & shifting your features: A new baseline for efficient model tuning.Advances in Neural Information Processing Systems, 35:109–123","venue":null,"work_id":"c399df37-6c60-4c5f-a2d6-84cbbe2d0ef3","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:0875fa18c9e0aab6c8c5674723364641911bfe1d796bd727eecd0ff47af9958b","observation_id":"54b8b752-c796-4766-b965-cb93a83d2494","resolution":{"observed_at":"2026-05-18T18:56:47.367429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:dc549bb1f20a05e059d6eafdad9de94539a018afe660ecb395d9791ad071a14e","observation_id":"a102ab94-6038-4da3-8024-47decc624aca","resolution":{"observed_at":"2026-05-18T18:56:45.966402Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-08-12T17:35:23.022229Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":"1306.5151","doi":null,"metadata_source":"pith","pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-07-11T03:07:53.092922Z","title":"Fine-Grained Visual Classification of Aircraft","venue":"cs.CV","work_id":"ed360110-3ce4-4959-8c74-1785cd9e537d","year":2013},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:88c22d1ebac988bf4d4b97e7284e6781408dc2c310287479ea94b1f44c7a5f37","observation_id":"559ef509-3203-4482-8681-104cec7aa161","resolution":{"observed_at":"2026-05-18T18:56:45.933854Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pissa: Principal singular values and singular vectors adaptation of large language models.Advances in Neural Information Processing Systems, 37:121038– 121072","venue":null,"work_id":"64891882-b8c2-4827-b54b-96e9d1295168","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:c9a749710d34bdd1c6761f3380db98fb111aaf6adf27279f0d67351b92ae8fdd","observation_id":"9d8a16cc-e3e4-44bb-870d-1edd4cadbf2c","resolution":{"observed_at":"2026-05-18T18:56:47.431612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Brain tumor mri dataset","venue":null,"work_id":"e59e874e-2729-4b94-b855-bd7955c8575b","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:f02e91fe1ca5ff5d5fbf954c8fc140f8d4b7a1a8a98ae00af38c882db720d52a","observation_id":"0d89dcde-e896-4c8e-a3b3-6c1bd6e7ee2e","resolution":{"observed_at":"2026-05-18T18:56:47.392730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Automated flower classification over a large number of classes","venue":null,"work_id":"3183fc6f-7894-48bd-ae7e-742be52d5128","year":2008},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:1372d0057990cf0969e00b11af9bdfd01c00763781b0d024ec146f49c90d0afb","observation_id":"099d17cc-ff7f-418e-9568-957d33f24a30","resolution":{"observed_at":"2026-05-18T18:56:47.363462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cats and dogs","venue":null,"work_id":"266638aa-d69f-49fd-9159-e524ee72b234","year":2012},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:f52e2f9e0644757c2fac56c71ad0b1a1819c2b8e7a9e8570ae9d8b38a1e55f08","observation_id":"e5a3e79e-60c6-470c-b931-458d8bb16c04","resolution":{"observed_at":"2026-05-18T18:56:47.343904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sam-parser: Fine-tuning sam efficiently by parameter space reconstruction","venue":null,"work_id":"89023af8-2b1a-4366-9ac8-c9b0dcf2b24e","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:68f02271f707c70a94300624ce6f8321ac00aedf24825d15b009d8aa3c756aee","observation_id":"57344476-a5b9-4655-8890-990c062fb486","resolution":{"observed_at":"2026-05-18T18:56:47.428096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adapterfusion: Non-destructive task composition for transfer learning","venue":null,"work_id":"b6eb2c23-2165-41b4-a09c-929c24763aaf","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:a00bfc3901944c87c1759b965b84b7c4434f5eeb3412e897ca3ae541f6248ff1","observation_id":"2f8b8c00-1516-4a18-8b5a-c4a8856af946","resolution":{"observed_at":"2026-05-18T18:56:47.409357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kvasir: A multi-class image dataset for computer aided gastrointestinal disease detection","venue":null,"work_id":"071ef338-eaa1-4dbc-a3a1-3dc6abc46bf4","year":2017},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:f13316b2b03de546f7497a357e78757a2b054d8aaf2e05e14ea8bbfb56862d56","observation_id":"9bacc35b-6a1c-4d7e-9ad8-13494526dbdb","resolution":{"observed_at":"2026-05-18T18:56:47.335223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Indian diabetic retinopathy image dataset (idrid)","venue":null,"work_id":"cdd9a66f-ea45-4fc0-95a9-3643053cc755","year":2018},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:50ca7334833ed40a2c6ab3065c207e3d13f40f850a691f2da20e084ad19ebed8","observation_id":"f06d3db4-87b9-46b0-aaf4-2e091ccf1c4b","resolution":{"observed_at":"2026-05-18T18:56:47.332151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"3f12e730-f5de-4a93-a333-3d4c8a48fc98","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:e61a7d8f235675b654f5003f0fa6015a19a55efe401aa6b4f177196567728f33","observation_id":"20b7b154-83be-4e12-9c7e-099de07a6b0f","resolution":{"observed_at":"2026-05-18T18:56:47.315131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ae559e59-1152-41d3-9bd1-9c2f6fa9f8ca","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:a85a2d787ca3f1c126dcf3113edfe057d067ac3e1530564bc1cd5c958218e0ad","observation_id":"8ff708a2-cfa4-4723-8a60-f63f337c2806","resolution":{"observed_at":"2026-05-18T18:56:47.421054Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23903","last_updated":"2025-09-08T19:18:30Z","snapshot_observed_at":"2026-08-13T12:55:43.443766Z","submitted_at":"2025-06-30T14:33:44Z","title":"Grounding DINO-US-SAM: Text-Prompted Multi-Organ Segmentation in Ultrasound with LoRA-Tuned Vision-Language Models","version":3},"cited_work":{"arxiv_id":"2506.23903","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23903","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Groundingdino-us-sam: Text-prompted multi-organ segmentation in ultrasound with lora-tuned vision-language models.arXiv preprint arXiv:2506.23903","venue":null,"work_id":"a62dec88-a168-4f50-bf81-558984f35a25","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2506.23903","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:9410111b52de23e3ca27ae22bc411d44c3acb97bddfac138cadd75aac70064f3","observation_id":"29388302-d5d5-42ac-aeaf-d3d24ff0706d","resolution":{"observed_at":"2026-05-18T18:56:45.939464Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning multiple visual domains with residual adapters.Advances in neural information processing systems, 30","venue":null,"work_id":"d388ec50-5100-4de4-ae62-0cbcaf2a7dec","year":2017},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:d4c082b9958945a528c3aba01cbe568d141d411686385e3879a8c7a8d23109fd","observation_id":"96520538-42d3-4598-a398-2305c7cd0a57","resolution":{"observed_at":"2026-05-18T18:56:47.328652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Do imagenet classifiers generalize to imagenet? InICML, pages 5389–5400","venue":null,"work_id":"2b8a7eed-1330-4332-8c6b-97aadf530d54","year":2019},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:7bb6c1832b6970453e90056df6b1784bd6eb31950c685fc7f4d94d0e6f60009e","observation_id":"494ba83a-a8fe-44af-b5a8-3b56be0ac8bb","resolution":{"observed_at":"2026-05-18T18:56:47.412437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-16T21:21:44.768787Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":"1212.0402","doi":"10.48550/arxiv.1212.0402","metadata_source":"pith","pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","venue":"cs.CV","work_id":"5dfb46e7-e952-409d-a3c7-ba7f20aebad6","year":2012},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:f54e59bffa3b7354f4fe94d31186374cb138db94158d01279506af48a91d7705","observation_id":"8906ab95-3df8-4330-bb77-388259b533ec","resolution":{"observed_at":"2026-05-18T18:56:45.995918Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18082","last_updated":"2025-07-30T17:39:30Z","snapshot_observed_at":"2026-08-15T18:14:56.108751Z","submitted_at":"2025-07-24T04:17:06Z","title":"TextSAM-EUS: Text Prompt Learning for SAM to Accurately Segment Pancreatic Tumor in Endoscopic Ultrasound","version":3},"cited_work":{"arxiv_id":"2507.18082","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18082","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Textsam-eus: Text prompt learning for sam to accurately segment pancreatic tumor in endoscopic ultrasound","venue":null,"work_id":"e9ff42ae-2cbd-457b-aaa2-e4d149e25085","year":2025},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2507.18082","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:f627c35dc25d1bc2ee7707255acdecbf75ebe9421fb3660729f92afdfc33ae38","observation_id":"b31418e6-5658-4dfb-b608-ea00b4d1a65c","resolution":{"observed_at":"2026-05-18T18:56:45.976425Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Singular value fine-tuning: Few-shot segmentation requires few-parameters fine-tuning.Advances in neural information processing systems, 35:37484–37496","venue":null,"work_id":"0e5bb6a9-855f-4e56-9e0d-6443e0af05a6","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:874f662446a4a1cc4088401136fbc9cb34fce380e58ed43ebe6a8e36b8f48d2a","observation_id":"355a03de-17ab-438b-91ea-a62309c57547","resolution":{"observed_at":"2026-05-18T18:56:47.297840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tahir, Muhammad E.H","venue":null,"work_id":"cc356d06-ba1d-436a-a6d9-11a5e3b61f08","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:c474d4e622102696786ff9eb0a7239c319a39ae5d54d5494891d634f75664394","observation_id":"df5a1dae-dbd3-42bc-9b12-de1d5d8a7b0f","resolution":{"observed_at":"2026-05-18T18:56:47.311173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The ham10000 dataset, a large collection of multi-source dermatoscopic images of common pigmented skin lesions.Scientific data, page 180161","venue":null,"work_id":"4e508c27-5746-47c6-a2d6-77785e0bb6e0","year":2018},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:a9560cb8178d0722007b693118a1ddcf579eaac9e515e5f492ddcb353976400f","observation_id":"42838e99-fa3f-4039-afa0-b9a5367f1c94","resolution":{"observed_at":"2026-05-18T18:56:47.399269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visualizing data using t-sne.Journal of Machine Learning Research, 9(86):2579–2605","venue":null,"work_id":"eeb6c841-2b8d-45d1-8867-09c6ac4609d2","year":2008},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:2a2a1ce916346d3581ecdd8ea016d99ac45accaa577e0c5cff9efd35d92b2a50","observation_id":"03f9afa4-48c9-4f1d-8146-041e45b14650","resolution":{"observed_at":"2026-05-18T18:56:47.347057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning robust global representations by penalizing local predictive power","venue":null,"work_id":"ecf4de79-f488-485d-91bc-327cd349b747","year":2019},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:7c4a6d126886216bd83120659abac7991bd74e6faef0ab4476252755f2a17b41","observation_id":"af41b729-3a1f-4d52-a684-c727f05b3b30","resolution":{"observed_at":"2026-05-18T18:56:47.389438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04087","last_updated":"2024-02-06T15:45:27Z","snapshot_observed_at":"2026-08-16T14:20:58.080026Z","submitted_at":"2024-02-06T15:45:27Z","title":"A Hard-to-Beat Baseline for Training-free CLIP-based Adaptation","version":1},"cited_work":{"arxiv_id":"2402.04087","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04087","snapshot_observed_at":"2026-07-02T02:16:26.839820Z","title":"A hard-to-beat baseline for training-free clip-based adaptation","venue":null,"work_id":"e66f1a81-77d0-4425-ba54-9cd5fb06a222","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2402.04087","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:7f0d28e07cb546867b81fa1c6629126fcdc7458c92720ec53b55ba64e483d4a9","observation_id":"3510163b-0c1e-4881-af56-20a4047bb684","resolution":{"observed_at":"2026-05-18T18:56:45.991085Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sun database: Large- scale scene recognition from abbey to zoo","venue":null,"work_id":"622c83d4-39f5-44b8-94b9-3e56773b13fa","year":2010},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:a84020bafd5b7015c4584d25ee209f4b61b4ac04d3d854d44c06e0fb2bd4801f","observation_id":"47e6cc0f-0091-4217-bda3-6c3a2360a648","resolution":{"observed_at":"2026-05-18T18:56:47.396029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in med- ical image segmentation: A comprehensive review of traditional, deep learning and hybrid approaches","venue":null,"work_id":"cd6d2ac4-15cd-4fe2-95e1-71b17d11024a","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:a5d553627aae214ef5805ab87fa33523b43e54fdd5da13f4467a5170a547f2c3","observation_id":"f5ab602a-0f48-4b9d-9200-e3ad7e12a684","resolution":{"observed_at":"2026-05-18T18:56:47.284669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual-language prompt tuning with knowledge-guided context optimization","venue":null,"work_id":"2f44f35e-6984-4b45-a3cf-6c995c64ed3d","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:94a0c17fba11cef247aaa7c5c32402824fad10d30997921a662deecea4378754","observation_id":"10250800-a55d-4352-a870-2c3a762d6421","resolution":{"observed_at":"2026-05-18T18:56:47.424576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual-language prompt tuning with knowledge-guided context optimization","venue":null,"work_id":"b7b711c3-ae6a-45e5-837b-7c2c1c8a3242","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:27bf4e48ba3e895c5940123e5c8f6259e6eade18266ff66a142e23202fbe3d3e","observation_id":"ccc4f19b-234e-4dd4-aefd-60517db83e46","resolution":{"observed_at":"2026-05-18T18:56:47.259551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tcp: Textual-based class-aware prompt tuning for visual- language model","venue":null,"work_id":"e1c9b9d7-f843-472f-bb8c-7655ef34d58a","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:2ff0163e42a84750bd5051fff2f09d763b6143fef029a7af59edfccd610cb1b0","observation_id":"b484a3ea-ecfb-4502-aa04-990bb8029f37","resolution":{"observed_at":"2026-05-18T18:56:47.338267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bitfit: Simple parameter-efficient fine-tuning for transformer-based masked language-models","venue":null,"work_id":"0b8c3ade-aed3-42cc-b280-f95b813145df","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:f8049ccbf72a5bed043b6a279e7b78513a22f6416a2321f33918ba7e6982f605","observation_id":"0dfb92f4-efb6-4d72-b6cf-8cfa9ed3b615","resolution":{"observed_at":"2026-05-18T18:56:47.415789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Low-rank few-shot adaptation of vision-language models","venue":null,"work_id":"fae8a566-28ce-44aa-95a0-6e899efebb45","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:f50cb966faadae7665680747cda1b4920af64c04a4adb2b91310b6b39dc4b716","observation_id":"aadc4da3-3bcf-4e96-8d0b-22be2be15e5d","resolution":{"observed_at":"2026-05-18T18:56:47.278196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10512","last_updated":"2023-12-20T20:56:14Z","snapshot_observed_at":"2026-08-12T23:46:47.414754Z","submitted_at":"2023-03-18T22:36:25Z","title":"AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2303.10512","doi":"10.48550/arxiv.2303.10512","metadata_source":"pith","pith_arxiv_id":"2303.10512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning","venue":"cs.CL","work_id":"6fa49657-348b-42dd-b870-8758c71af878","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2303.10512","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:5ef5200fb73a8e77b1943f0ab1f64330bcbb72b88d982591daa8212e4641c52b","observation_id":"52ab96e8-5928-43c6-a84d-6a19a4021378","resolution":{"observed_at":"2026-05-18T18:56:45.960924Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-15T03:08:21.348842+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T03:08:21.348842+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.03930","last_updated":"2021-11-15T04:58:28Z","snapshot_observed_at":"2026-08-16T17:43:33.186967Z","submitted_at":"2021-11-06T18:09:22Z","title":"Tip-Adapter: Training-free CLIP-Adapter for Better Vision-Language Modeling","version":2},"cited_work":{"arxiv_id":"2111.03930","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.03930","snapshot_observed_at":"2026-07-08T10:54:49.125621Z","title":"Deep sets","venue":"cs.CV","work_id":"e9b1d13c-a8ca-43ed-af63-fd1158065caf","year":2021},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2111.03930","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:c63e821e7d4d903962e46275e213d7109df90f9ec28343ba6965408edb579b17","observation_id":"a849a1f4-8681-46ac-8484-ba68e78fe3b8","resolution":{"observed_at":"2026-05-18T18:56:45.928999Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.16199","last_updated":"2024-09-18T23:54:36Z","snapshot_observed_at":"2026-08-13T10:46:50.834601Z","submitted_at":"2023-03-28T17:59:12Z","title":"LLaMA-Adapter: Efficient Fine-tuning of Language Models with Zero-init Attention","version":3},"cited_work":{"arxiv_id":"2303.16199","doi":"10.48550/arxiv.2303.16199","metadata_source":"pith","pith_arxiv_id":"2303.16199","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA-Adapter: Efficient Fine-tuning of Language Models with Zero-init Attention","venue":"cs.CV","work_id":"5c44e6f5-82ca-4461-9fc1-d630f3bfa3e1","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2303.16199","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:ba1dc29adb5dde5e2074a3526f513654a23f2a6e79f7e39a49fc63896ecbda22","observation_id":"40a5174e-b514-49f2-aa00-8c6b4542e7f7","resolution":{"observed_at":"2026-05-18T18:56:45.981251Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lungren, Tristan Naumann, Sheng Wang, and Hoifung Poon","venue":null,"work_id":"08dd2b3f-a9bd-4974-a1f0-8971f7a36a46","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:5558851f6bb5a291be58ef51afe62ba7f9bc9e29f1e6c3c67e5fb898e12ec435","observation_id":"ca41c26c-dc8c-40e7-9617-b73f38d2ae1d","resolution":{"observed_at":"2026-05-18T18:56:47.256698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07353","last_updated":"2025-03-26T13:32:28Z","snapshot_observed_at":"2026-08-16T14:35:27.100627Z","submitted_at":"2023-12-12T15:21:57Z","title":"CLIP in Medical Imaging: A Survey","version":6},"cited_work":{"arxiv_id":"2312.07353","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.07353","snapshot_observed_at":"2026-06-29T22:34:01.827945Z","title":"Clip in medical imaging: A comprehensive survey.arXiv preprint arXiv:2312.07353","venue":null,"work_id":"1836b9f2-1d92-464e-bd67-9cee09c7ad9e","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2312.07353","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:e408e1732615e4617d5b6d1e53a565732c71fccb42ca193a2630a90860f50e7f","observation_id":"806eeee6-c2aa-4d2f-b038-901fa6512f73","resolution":{"observed_at":"2026-05-18T18:56:45.950305Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Conditional prompt learning for vision-language models","venue":null,"work_id":"7e221471-a623-4b2f-867d-db641600b9d9","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:d16c4cfc5525efd8424d6d6c2347feb4b052f9235a9e17ecb63c149464985e9e","observation_id":"4e9ca3b1-a490-4053-8039-86b405908467","resolution":{"observed_at":"2026-05-18T18:56:47.239075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to prompt for vision-language models.IJCV, 130(9):2337–2348","venue":null,"work_id":"42735762-c7f0-428b-bd1a-5a4b586763fd","year":2022},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:bd3f3fa102237adb98a835ec11a6cc2bc6848cf7526fd606e2edae6216a3dc2a","observation_id":"c2cc51d0-6579-4e96-88a4-364789f79080","resolution":{"observed_at":"2026-05-18T18:56:47.385678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prompt-aligned gradient for prompt tuning","venue":null,"work_id":"6cbd12b8-bd62-41ee-91e6-2dfce709fb06","year":2023},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:9ec7875226c1be5d3dea11abb1b86bda37b9be2249a17165a9b2ac1be8e77406","observation_id":"3f436a21-1d8f-405b-b6a6-050776f648fe","resolution":{"observed_at":"2026-05-18T18:56:47.235685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prompt-aligned gradient for prompt tuning","venue":null,"work_id":"06deaa3f-6322-43c2-b9ce-3790b71cf0df","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:5fa5d2347347352fc31fb95561d8e3f00ce8bf4db4cb67a8664dd2785671e487","observation_id":"8340cb08-a5da-4d24-afa8-15818451c3d6","resolution":{"observed_at":"2026-05-18T18:56:47.253761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12048","last_updated":"2024-02-19T11:02:05Z","snapshot_observed_at":"2026-08-16T14:17:22.875988Z","submitted_at":"2024-02-19T11:02:05Z","title":"Model Tailor: Mitigating Catastrophic Forgetting in Multi-modal Large Language Models","version":1},"cited_work":{"arxiv_id":"2402.12048","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.12048","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"a photo of a [CLASS]","venue":null,"work_id":"604649cc-7631-422b-9066-73f0113d3de8","year":2024},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"cited_paper":"/paper/2402.12048","citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:5b03699fb260ae1d9f60a619a044393b9ecd778864b50a2012ba82b1c05ea5ac","observation_id":"67a79dec-01b7-4218-a42c-1fd1f76fbb1c","resolution":{"observed_at":"2026-05-18T18:56:45.971143Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"L\" denotes layer while “H","venue":null,"work_id":"684b3991-b0a0-4bee-ae71-23bec968dbb8","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:5a86f7d257d4d2c55da86488a4649a891883143a87e70e94d0acbd90f658fb9b","observation_id":"64d032c1-3714-4f25-bf8c-d60eab6850b5","resolution":{"observed_at":"2026-05-18T18:56:47.262907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8194.3993","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9cea223d-93a6-4a9b-9b9b-8b36cd69520f","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:6530b705f34aad055fa321ed4c18742e3a573ee35d1fa864c88eac592ad4ba3a","observation_id":"a87230f2-2d21-4041-ac90-83530fe0aa92","resolution":{"observed_at":"2026-05-18T18:56:46.000619Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5896.8494","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7324eac8-a9c2-492c-b8eb-93643d861c83","year":null},"citing_paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-18T18:55:31.923309Z"},"links":{"citing_paper":"/paper/2509.03740"},"observation_digest":"sha256:92f984c14a6f2ac6e5a90feeb4afb427658218d6d0b889247129fa3ac3220ff1","observation_id":"cb6afaba-a9dc-477b-8248-38c532fc32df","resolution":{"observed_at":"2026-05-18T18:56:45.922830Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03740","last_updated":"2026-04-22T16:33:26Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T21:47:37.241619Z","submitted_at":"2025-09-03T22:00:23Z","title":"CLIP-SVD: Efficient and Interpretable Vision-Language Adaptation via Singular Values"},"reference_resolution":{"displayed":89,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":1,"unresolved":0,"verified_exact":16,"verified_fuzzy":70},"total_outbound_references":89},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 89 of 89 outbound references and 2 inbound Pith citation observations for arXiv:2509.03740."}