{"as_of":"2026-08-16T16:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:691e0709157b12ede2d7ad19e87c62099063cd76defec2c6162a9f99e6664aee","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T18:11:15.917325Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:24:43.465367Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T13:10:08.576468Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08176","snapshot_observed_at":"2026-08-06T00:56:08.109161Z","title":"Textrefiner: Internal visual feature as efficient refiner for vision-language models prompt tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04101","last_updated":"2026-07-02T07:16:12Z","snapshot_observed_at":"2026-08-11T23:49:30.119553Z","submitted_at":"2025-08-06T05:44:01Z","title":"NEARL: Interacted Query Adaptation with Orthogonal Regularization for Medical Vision-Language Understanding","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:08.109161Z"},"links":{"cited_paper":"/paper/2412.08176","citing_paper":"/paper/2508.04101"},"observation_digest":"sha256:09660a0759542dd60f8c52ebeadbe72fcd5e00697db41fee36178997b87d1fda","observation_id":"bd0a43ef-fbcd-40e7-a94b-edbccd0d9847","resolution":{"observed_at":"2026-08-06T00:56:08.109161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08176","snapshot_observed_at":"2026-08-15T17:24:43.465367Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12861","last_updated":"2025-08-18T12:00:09Z","snapshot_observed_at":"2026-08-15T17:15:52.425621Z","submitted_at":"2025-08-18T12:00:09Z","title":"Cross-Domain Few-Shot Learning via Multi-View Collaborative Optimization with Vision-Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T17:24:43.465367Z"},"links":{"cited_paper":"/paper/2412.08176","citing_paper":"/paper/2508.12861"},"observation_digest":"sha256:95cae21b80dc841750c122386e2451501534d8c94b1dcaa3d0c31001e16528bb","observation_id":"c8820b49-43d7-4388-be14-cbd3c587cc08","resolution":{"observed_at":"2026-08-15T17:24:43.465367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"cited_work":{"arxiv_id":"2412.08176","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.08176","snapshot_observed_at":"2026-08-05T13:10:08.576468Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","venue":"cs.CV","work_id":"b8a0de48-61aa-4a9e-9f80-68c0a9883e68","year":2024},"citing_paper":{"arxiv_id":"2509.00905","last_updated":"2025-09-03T01:19:20Z","snapshot_observed_at":"2026-08-14T18:20:37.602495Z","submitted_at":"2025-08-31T15:37:48Z","title":"Spotlighter: Revisiting Prompt Tuning from a Representative Mining View","version":2},"reference_index":3492,"source":"pdf_text","source_observed_at":"2026-08-05T13:10:08.459814Z"},"links":{"cited_paper":"/paper/2412.08176","citing_paper":"/paper/2509.00905"},"observation_digest":"sha256:855cba2b5a5e4419fff514e1bccec714c8f9b58fcc0021966a7aa4b3f2f4bb37","observation_id":"16e6e79f-f76e-41ff-a211-4485e1f0b307","resolution":{"observed_at":"2026-08-05T13:10:08.593689Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.08176/citation-record","integrity":"/paper/2412.08176/integrity","json":"/paper/2412.08176/citation-record.json","paper":"/paper/2412.08176"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.577503Z","title":null,"venue":null,"work_id":"26b61638-b801-469b-a37a-60de1de06149","year":2014},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.663696Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:3d42c00faa9d3fc8f17bbcb597e205d860bc1624557d42bcc33fbede06afd191","observation_id":"25ae6db3-bc86-451d-930a-c2d5aeef73e8","resolution":{"observed_at":"2026-08-11T18:11:16.581550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.669682Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.669682Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:7d0fcb7c2cd8e2e9398cd80e1e9f1e06ad38273e67e88e83bdc30bd5cac41c5f","observation_id":"c1550171-d1b6-478f-9359-02446b30d15a","resolution":{"observed_at":"2026-08-11T18:11:15.669682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.675111Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.675111Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:f7e4e2f668bece38ad60097e6d9cb28595ff792db59a7c58b35e626675c6c3d7","observation_id":"5238e3c1-98ec-40b1-9b10-496548810ceb","resolution":{"observed_at":"2026-08-11T18:11:15.675111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.681514Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.681514Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:15f7009e6aebba9b7b9a76bb74dd52e7612958a3a41c68da12cb8b85ae707de5","observation_id":"e1d14ff0-69c9-49f2-952e-e4df69638201","resolution":{"observed_at":"2026-08-11T18:11:15.681514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.539309Z","title":null,"venue":null,"work_id":"ed7bfe76-b61d-401a-be3f-e670f77684da","year":2021},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.686104Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:7af1754b8d1495ce2a71f450ffdd40a85bf2a0ef35d3e0438e52d2cf6b8c03e7","observation_id":"5766a579-2b48-4a47-b574-472185059dea","resolution":{"observed_at":"2026-08-11T18:11:16.543895Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.526115Z","title":null,"venue":null,"work_id":"077ddbf5-8d70-4134-b7bc-6f614adb67d4","year":2004},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.690880Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:f1fd0fed3a175719eed47c59d37df77e42f2827928a8dccabbbbae9083640a11","observation_id":"de1e65a6-9e61-4c9c-aad7-2f7d5ba1508e","resolution":{"observed_at":"2026-08-11T18:11:16.530797Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.514499Z","title":null,"venue":null,"work_id":"ae64176a-8e2c-4d0f-be9e-0acf707d669a","year":2024},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.696550Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:243a4099a92af3c2978a96de003c8a766557f96183bd23a9692648d36bca47b8","observation_id":"65b42e01-8556-405a-af3b-ae8e71db1eb7","resolution":{"observed_at":"2026-08-11T18:11:16.517942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.701124Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.701124Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:4b8b77270d5610be8da56b6601106cee21c3249be4f2e196b1405a798e9bdef8","observation_id":"6bdf90bd-c53a-4441-a1ce-e36ede58d42d","resolution":{"observed_at":"2026-08-11T18:11:15.701124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06727","last_updated":"2022-12-13T16:55:12Z","snapshot_observed_at":"2026-08-16T16:08:57.411307Z","submitted_at":"2022-12-13T16:55:12Z","title":"What do Vision Transformers Learn? A Visual Exploration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06727","snapshot_observed_at":"2026-08-11T18:11:15.705533Z","title":"G.; and Goldstein, T","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.705533Z"},"links":{"cited_paper":"/paper/2212.06727","citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:ee6788e660a88d8357eef33bc7504c651f9feea94c67cb7dd986ad2f4f705340","observation_id":"2cce258a-b3d5-4d64-8f1f-73f2da46dd00","resolution":{"observed_at":"2026-08-11T18:11:15.705533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.710755Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.710755Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:7b33642eb4a6c8828e81d6b1c96bf1dd7cead03f5e6ef18072e0063bc367bf41","observation_id":"ed661d16-8c25-49c2-b801-723728da001b","resolution":{"observed_at":"2026-08-11T18:11:15.710755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.715338Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.715338Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:e5f983007692c7f74ccca1cd09e42414484c44c99a4f8ebc9b890dcddafa7282","observation_id":"8016d61e-e89e-4c6e-bb8e-0ff30881c2de","resolution":{"observed_at":"2026-08-11T18:11:15.715338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.719408Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.719408Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:1e08d618e9d6aeea8ada4a1a25d8b3a36f3924762fbe62be9c7d866a5f992a99","observation_id":"be0daf9f-7e6f-4359-aecc-2f1de2e26c3a","resolution":{"observed_at":"2026-08-11T18:11:15.719408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.722576Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.722576Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:d547293341da2d8f9d7f103d46c9ad1b2b7a1193af9e5bc376936c49a76f98cc","observation_id":"57231101-ba19-41cb-9d82-48352056411a","resolution":{"observed_at":"2026-08-11T18:11:15.722576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.726037Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.726037Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:c1ab9fa66e4f86536c1c8afd17f2afb66d013680a046a992b1dca529a3783e72","observation_id":"bfa0db05-2029-4e5b-bd76-f6c601243932","resolution":{"observed_at":"2026-08-11T18:11:15.726037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.729360Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.729360Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:3b2301f03e169cac47c6803a50eecbde72f0bf0af9f751d346592665e02c9ec3","observation_id":"a3639a85-e0f7-4e57-b128-d66f34f0ae81","resolution":{"observed_at":"2026-08-11T18:11:15.729360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.448668Z","title":"U.; Rasheed, H.; Maaz, M.; Khan, S.; and Khan, F","venue":null,"work_id":"2ff5387c-1cd4-4ee7-bb43-6ed1a4ce9c07","year":2023},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.737638Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:a74526ff8fe49086f98ee60dd2f035b2cacec348cb9db2a3c712db3da97fd401","observation_id":"16c47667-687d-4580-a394-f5536722f823","resolution":{"observed_at":"2026-08-11T18:11:16.452785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.435324Z","title":"U.; Wasim, S","venue":null,"work_id":"f6f89c40-eb22-4683-83fc-a6f37ad5d294","year":2023},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.741356Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:fb17ef54c2c44ee64b655c4fbf0a55b671a6b0de18ae355bf4e32f2557ca2e9f","observation_id":"ea9e2d02-0b58-4e3d-8282-ae74c0d4e3ab","resolution":{"observed_at":"2026-08-11T18:11:16.439800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.421448Z","title":null,"venue":null,"work_id":"2e33e358-f34e-46fa-8bb7-3fec1f44ba89","year":2022},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.745580Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:ab5eb137df32aa6a21cc7bbeef7a8b1ac84c36b87edda5e8631de0ebb22b8490","observation_id":"31e6aa00-2d09-428f-b41d-5b86a4102b16","resolution":{"observed_at":"2026-08-11T18:11:16.426190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.405361Z","title":null,"venue":null,"work_id":"cbd338dc-8eb7-4c4c-8758-66b5dc0b0578","year":2022},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.749477Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:54dd16e74aaf9e94e657eb8a007b1a42b8f87b61de445b99dd73fb240430260a","observation_id":"c3383af4-8d19-442d-bd54-d9ad23c69b2c","resolution":{"observed_at":"2026-08-11T18:11:16.412578Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.756670Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.756670Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:7b80301ac2175918c59439bf3fb92996be86da835050f6df1e95fd388f363f73","observation_id":"cf37852f-79da-479c-bf60-dc34c0f255be","resolution":{"observed_at":"2026-08-11T18:11:15.756670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.383836Z","title":null,"venue":null,"work_id":"e6315a49-b6de-4df8-a4c5-04692c1b6afd","year":2024},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.761131Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:e3dda6c2d0508fac1dc24ba8670ca3ea28c21fd6f5bf236f2d1e67a951ceed0a","observation_id":"d24ba9eb-66ae-4304-a849-fa1d2acec016","resolution":{"observed_at":"2026-08-11T18:11:16.387381Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.766408Z","title":"Q.; Belongie, S.; Koltun, V.; and Ranftl, R","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.766408Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:eac9ae597b40c1f22d42d84d8fbcc4a5010b2cdd0c21fa99bf664b15c70f9c96","observation_id":"fd0d1185-0823-44ff-9653-b97659909d9a","resolution":{"observed_at":"2026-08-11T18:11:15.766408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.358685Z","title":null,"venue":null,"work_id":"84002360-2e76-46e0-9f8f-fe06c93e7599","year":2024},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.771780Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:94dc11f6f17d3b5d2065d4e3e38501759a4e49fb62bfb60158216310e0e3af1b","observation_id":"4b551dca-99ca-4b01-b9ff-2ab54f35b3f9","resolution":{"observed_at":"2026-08-11T18:11:16.363861Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.345286Z","title":null,"venue":null,"work_id":"e634e77c-bad2-4296-961d-24087993bea5","year":2024},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.777334Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:ab36c235407b2161c72def8e56a93e24e31c0b1662afcd4a93c50004bc3165c5","observation_id":"f56f9cfa-c9c5-42f7-97e9-24eab66983e6","resolution":{"observed_at":"2026-08-11T18:11:16.349645Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.783553Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.783553Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:fb7a5db7f7a7874322863e8269d366147febfdaa385dc8229f2a8f9e0cb33ea6","observation_id":"fa2d9bcb-2504-408c-aa00-1ace1448ceed","resolution":{"observed_at":"2026-08-11T18:11:15.783553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.320237Z","title":null,"venue":null,"work_id":"6829ad41-ceb2-487a-823c-398417ae195d","year":2023},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.788917Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:ad88cda2030f944bd644dabe47e216e9ec4ccf6f70e6a233a315b5263585a9fe","observation_id":"ce7d9b08-2976-471a-a486-5e68ae04c929","resolution":{"observed_at":"2026-08-11T18:11:16.326425Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-08-12T17:35:23.022229Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-08-11T18:11:15.793104Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.793104Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:ccee1476997ea4d35395e2f52bfe33986bd90bc03a58ea61b2797bf78abf64ce","observation_id":"af3867e1-39f4-45b6-8996-5605d8778898","resolution":{"observed_at":"2026-08-11T18:11:15.793104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.304698Z","title":null,"venue":null,"work_id":"1abf8d56-8814-40f6-89ec-cbf919717b5a","year":2008},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.799684Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:804a4cc94155b28123f81544a4436ec35181bde83161de006cc8e610576d5efa","observation_id":"dff1d068-e0ea-4443-8940-8a9e2c1b49a5","resolution":{"observed_at":"2026-08-11T18:11:16.310798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.289208Z","title":"M.; Vedaldi, A.; Zisserman, A.; and Jawahar, C","venue":null,"work_id":"fd205e2c-1ecf-4679-a42c-990250239c2d","year":2012},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.805088Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:2e7b7cbcbdd2290a56bbecb73b69075656b59691ea65c2a09faeff69a19f4525","observation_id":"51001551-4951-41bb-98ee-433d425b7600","resolution":{"observed_at":"2026-08-11T18:11:16.294609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.810153Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.810153Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:d1460e8fa29bb577734cbd662ed358eff2296b53dcecf80441dd4b6a1d326ebc","observation_id":"6faffe06-d454-4f65-afe3-657168d9a654","resolution":{"observed_at":"2026-08-11T18:11:15.810153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.816030Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.816030Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:1561f2a2caffe79722085514adadaa1a91fdb787ec11de389b51f94abf3b59eb","observation_id":"d7a8e049-c25c-40f4-8f99-09ab9909709a","resolution":{"observed_at":"2026-08-11T18:11:15.816030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.251464Z","title":null,"venue":null,"work_id":"ae15690c-3b41-4132-ad57-44ae67c2fb5f","year":2024},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.820629Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:f755ee3efe9f5f5841184c5d8a42c64c27730ecb53ef5c1c405308a0fbaa5620","observation_id":"45277a3d-9b03-40e9-872d-9f93f65c8485","resolution":{"observed_at":"2026-08-11T18:11:16.255691Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.236291Z","title":"R.; Cogswell, M.; Das, A.; Vedantam, R.; Parikh, D.; and Batra, D","venue":null,"work_id":"9c8c352b-142c-4ac6-8e0c-48ed33a3ae69","year":2020},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.825371Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:320584eabfc6e1ae6b57c12486cb2ec571c2c8ea8781216b3cf21cc464f7ded4","observation_id":"5b49fe9c-7d40-4183-9178-dff3a2d191eb","resolution":{"observed_at":"2026-08-11T18:11:16.241234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.222805Z","title":"E.; Keutzer, K.; and Darrell, T","venue":null,"work_id":"752b4971-aa34-4ba9-9ee9-3648e53f3e03","year":2024},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.830606Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:1bd25201d1d65ad4ea7aacbfbc98aa8fd5dc73166ccbf10c59a00b88356ef3ea","observation_id":"ca7d26e9-580f-4287-98ce-67457f16f3be","resolution":{"observed_at":"2026-08-11T18:11:16.226920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-08-15T13:34:03.745436Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-11T18:11:15.835694Z","title":"R.; and Shah, M","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.835694Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:06d89e0132ae2863e7a523e1dec0dbc846abb8d0e36df80830da97fd44cc6550","observation_id":"be7eec54-af36-4fbf-afaf-6f7d1f20db6e","resolution":{"observed_at":"2026-08-11T18:11:15.835694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.210895Z","title":null,"venue":null,"work_id":"3f24b856-7493-4225-9459-7ff29fd1df12","year":2024},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.841353Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:c339b2d81e0a928b5bd7d03767c1684cea8a2419a8775db0cafe5132ecf20f38","observation_id":"09537a50-0fec-4257-9d60-0f40ab5813d7","resolution":{"observed_at":"2026-08-11T18:11:16.214904Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-11T18:11:15.846292Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.846292Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:3410a5ecfd968ee540754d50e0b5366b3d1136a7e3ed2d10130ca956169de752","observation_id":"a16ee0a6-9789-42b4-87e6-1d7cb5d7b175","resolution":{"observed_at":"2026-08-11T18:11:15.846292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T18:11:15.853012Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.853012Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:f540ef81a9a4c55c344262ae63d4ed21a00a27ad3a695c9ae61c27e719511bd5","observation_id":"26fe66fb-d19b-4cfa-9a6e-bf482299a9b0","resolution":{"observed_at":"2026-08-11T18:11:15.853012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.858036Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.858036Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:83fb55126efb7151057e1244316bba037497f0f4a403c531e6b42f8346bf8b1c","observation_id":"ba1633fe-3380-43c7-9a43-1be6da3b0854","resolution":{"observed_at":"2026-08-11T18:11:15.858036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.189125Z","title":null,"venue":null,"work_id":"58f6bd14-4b65-4a08-b336-5ce80319ff82","year":2023},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.863215Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:97813b072b161fa8c26dc08abb093b323f6e111068c2af97fd1ffb801a1e472e","observation_id":"45dd8cef-ec28-49ce-ac91-af607e02e7e1","resolution":{"observed_at":"2026-08-11T18:11:16.193975Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.176679Z","title":"A.; Hays, J.; Torralba, A.; and Oliva, A","venue":null,"work_id":"f5bf9de0-7c3d-43d4-bd5f-333d1c81e841","year":2016},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.868701Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:4c55a3c47e3d53bda90695e06221258e64e6109b700445da4bb3d944f85f0f2e","observation_id":"aae814b7-45f1-40a0-9107-c188d615eb83","resolution":{"observed_at":"2026-08-11T18:11:16.181230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.163288Z","title":null,"venue":null,"work_id":"3c555556-acb6-49c5-8663-0afcaf04777e","year":2024},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.873157Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:d40de200b05c9862f487950fc329a12d6831cc50534b1104d6a65da0b80a0ef1","observation_id":"a3954589-5606-4e57-affb-942025290e20","resolution":{"observed_at":"2026-08-11T18:11:16.167134Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.877026Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.877026Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:d9b7dad5de62638e5f0b932552ca9015bec6b51e7dde75986e1990304af12ef5","observation_id":"128bd95a-b63e-4203-ae69-fc3f259ad420","resolution":{"observed_at":"2026-08-11T18:11:15.877026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.141132Z","title":null,"venue":null,"work_id":"6adf7fbb-d339-4b0c-82df-ddb1b6e8fdb7","year":2023},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.881028Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:2b7d0b2e2923c2a21c13692b6570ed248928f7e12cd8efe4e1d47ff7859be76b","observation_id":"68966d31-2525-4f46-83d9-1310f9f0611f","resolution":{"observed_at":"2026-08-11T18:11:16.144551Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.128693Z","title":"D.; and Fergus, R","venue":null,"work_id":"d5ebc5a8-175e-4d4c-94f3-2305834713ce","year":2014},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.884181Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:7cfa48df3a10e18a9b3606f39361c0bf9089a95a939a6ff7579b669d1a7f501c","observation_id":"abed297c-45b8-458f-8765-b831cb8f5fb3","resolution":{"observed_at":"2026-08-11T18:11:16.132649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.887454Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.887454Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:fac654cfb24fb2fae3df1b158640d42b87d481c9db8d1e66de1d7c5982f1fade","observation_id":"0adc49db-2cc3-4053-b49e-763bade50c17","resolution":{"observed_at":"2026-08-11T18:11:15.887454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.892014Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.892014Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:8263cd5bd70b9829c07ef5fbf42b450462c84945d93f38729066717d8efc8166","observation_id":"c5b1b06e-77be-437a-9f39-d6f6ffc4119f","resolution":{"observed_at":"2026-08-11T18:11:15.892014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.087361Z","title":null,"venue":null,"work_id":"faeb3f15-0e3f-4636-b8e3-762e8544741d","year":2024},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.895914Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:3d6c40003533a7acca2b9b5a927e88b635d0560973d456b96e32b750e25022e7","observation_id":"93801221-5be3-4a92-88ba-b6d4711ea786","resolution":{"observed_at":"2026-08-11T18:11:16.093227Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.074608Z","title":"C.; and Liu, Z","venue":null,"work_id":"a6422b29-6f4c-4027-bdd6-e8d429d63304","year":2022},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.900205Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:3bafc50bae861b3b34845e45c58f4205f5b40c207593e2cee206bee053253c02","observation_id":"887f88ae-6e46-4a61-abe0-6e32298b7fcc","resolution":{"observed_at":"2026-08-11T18:11:16.078820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.062258Z","title":"C.; and Liu, Z","venue":null,"work_id":"4a587b15-ff82-4f0b-a806-95d30c615cf9","year":2022},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.903830Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:b6eb017b4214b8a71acb886c06202da4e40012266ccf086b266a58e74541a5c6","observation_id":"3318f0bc-2967-4736-bfc0-2c06d5965ba5","resolution":{"observed_at":"2026-08-11T18:11:16.066046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:16.048563Z","title":null,"venue":null,"work_id":"8e6de461-8abd-4132-86fb-e6481e7d62d0","year":2023},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.907990Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:cc4c2e9c051523c0c939aef0eff04dbd82ee62875ec274b0d0c0b23ff295da11","observation_id":"09ea8abe-63a1-4fec-8399-60d161c29981","resolution":{"observed_at":"2026-08-11T18:11:16.053453Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.912753Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.912753Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:d3ad14674ed35ad306cc31d8f5d0a23addd8e4ec8ad3f1a5022fe17525fbe68e","observation_id":"1ee70389-555b-4610-9e34-70f53a5d9c43","resolution":{"observed_at":"2026-08-11T18:11:15.912753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:11:15.917325Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T18:11:15.917325Z"},"links":{"citing_paper":"/paper/2412.08176"},"observation_digest":"sha256:9aa1b71510b98474d4abcbd3debff194539ea06a9f44e2a3902e810249bf96b4","observation_id":"6b36e065-f1cb-4610-9b71-6066e6c14c82","resolution":{"observed_at":"2026-08-11T18:11:15.917325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.08176","last_updated":"2024-12-11T08:07:12Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T18:05:02.380779Z","submitted_at":"2024-12-11T08:07:12Z","title":"TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 3 inbound Pith citation observations for arXiv:2412.08176."}