{"as_of":"2026-08-09T09:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:05bd78a15d786230ce3b44648241aee3eb6a999cc26becbf89dccc7358795477","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T23:04:14.351521Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.30968/citation-record","integrity":"/paper/2605.30968/integrity","json":"/paper/2605.30968/citation-record.json","paper":"/paper/2605.30968"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-04T18:05:27.145522Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":"1504.00325","doi":"10.48550/arxiv.1504.00325","metadata_source":"pith","pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","venue":"cs.CV","work_id":"b3d6fb46-4169-4a28-8f7e-2ca6774211da","year":2015},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:2b9653ff8cae5e082954a2b23fff552c449041a15119049800a476ac80c40d49","observation_id":"2b563439-ea02-4ae3-898b-1aec1e37d9fe","resolution":{"observed_at":"2026-07-01T19:16:00.174405Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.05612","last_updated":"2018-07-29T19:11:57Z","snapshot_observed_at":"2026-07-06T05:51:36.145913Z","submitted_at":"2017-07-18T13:51:32Z","title":"VSE++: Improving Visual-Semantic Embeddings with Hard Negatives","version":4},"cited_work":{"arxiv_id":"1707.05612","doi":null,"metadata_source":"pith","pith_arxiv_id":"1707.05612","snapshot_observed_at":"2026-07-11T01:37:42.930624Z","title":"VSE++: Improving Visual-Semantic Embeddings with Hard Negatives","venue":"cs.LG","work_id":"8108d0b9-b9f5-4be3-b715-0e4324fe7506","year":2017},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"cited_paper":"/paper/1707.05612","citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:659885675664df10f0d7481410710d42afdf88cb57b7a7fd84179ca7d336fa28","observation_id":"fbc31ecb-526e-434e-8303-1d2d37adcf6a","resolution":{"observed_at":"2026-07-01T19:16:00.157696Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:04:14.351521Z","title":"Learning generative visual models from few training examples: An incremen- tal bayesian approach tested on 101 object categories","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:9b3a79ef2e8a592deada2255c37ee5179bd65790032ba1d5c83bb62da83a1711","observation_id":"0e81e320-1d72-430d-9fba-7448eabe7cdf","resolution":{"observed_at":"2026-06-28T23:04:14.351521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":"1312.6114","doi":"10.2139/ssrn.4269703","metadata_source":"pith","pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Auto-Encoding Variational Bayes","venue":"stat.ML","work_id":"97d95295-30e1-42b4-bbf6-85f0fa4edb44","year":2013},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:eec3589544b8e9e7db07437752561c261b5888872553df08a15a2d4f4e1b3364","observation_id":"bdb8f07f-9cad-4f81-bdd2-46f9bd55d584","resolution":{"observed_at":"2026-07-01T19:16:00.170432Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.5151","last_updated":"2013-06-21T14:31:57Z","snapshot_observed_at":"2026-07-06T03:16:28.287173Z","submitted_at":"2013-06-21T14:31:57Z","title":"Fine-Grained Visual Classification of Aircraft","version":1},"cited_work":{"arxiv_id":"1306.5151","doi":null,"metadata_source":"pith","pith_arxiv_id":"1306.5151","snapshot_observed_at":"2026-07-11T03:07:53.092922Z","title":"Fine-Grained Visual Classification of Aircraft","venue":"cs.CV","work_id":"ed360110-3ce4-4959-8c74-1785cd9e537d","year":2013},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"cited_paper":"/paper/1306.5151","citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:013e60a8f6d4ac97b74df7d94a692ed8ff31a275fff20b9b8ddfffb70ab96409","observation_id":"10bebb61-460d-4435-82e2-c612871c838d","resolution":{"observed_at":"2026-07-01T19:16:00.171923Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.15020","last_updated":"2021-03-24T06:43:05Z","snapshot_observed_at":"2026-08-09T00:41:21.192356Z","submitted_at":"2020-04-30T17:59:17Z","title":"Crisscrossed Captions: Extended Intramodal and Intermodal Semantic Similarity Judgments for MS-COCO","version":3},"cited_work":{"arxiv_id":"2004.15020","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2004.15020","snapshot_observed_at":"2026-07-01T19:16:00.166462Z","title":"Crisscrossed captions: Extended intramodal and intermodal semantic similarity judgments for ms-coco","venue":null,"work_id":"42b85099-f866-425b-b13b-85a72327f907","year":2004},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"cited_paper":"/paper/2004.15020","citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:7f711b0ec369275437466da32286ca7126c2234f36ac9b4fa31e28d0108c4e96","observation_id":"c973190d-b69f-430a-9a31-e1af1bca4a65","resolution":{"observed_at":"2026-07-01T19:16:00.168002Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01195","last_updated":"2024-08-03T18:48:43Z","snapshot_observed_at":"2026-07-06T15:36:56.786182Z","submitted_at":"2023-06-01T23:20:47Z","title":"Consistency-guided Prompt Learning for Vision-Language Models","version":4},"cited_work":{"arxiv_id":"2306.01195","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.01195","snapshot_observed_at":"2026-07-03T04:17:37.195049Z","title":"Consistency-guided prompt learning for vision-language models","venue":null,"work_id":"03f9afdf-fd38-4feb-ba11-61026b1044ea","year":2023},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"cited_paper":"/paper/2306.01195","citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:97c0d54f38a3c1bfaa5b083c0a14c8debb8c54a991c83582bc8577358bfa829b","observation_id":"38b61483-6ae9-48e5-b3c7-05dc67544cc1","resolution":{"observed_at":"2026-07-01T19:16:00.162367Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":"1212.0402","doi":"10.48550/arxiv.1212.0402","metadata_source":"pith","pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","venue":"cs.CV","work_id":"5dfb46e7-e952-409d-a3c7-ba7f20aebad6","year":2012},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:3016d5b629adffd92f276af1086c5b6e1531228ba2fe61568a6290411cda22f3","observation_id":"2e8fe5c2-f876-46cf-a546-4b863c1a7096","resolution":{"observed_at":"2026-07-01T19:16:00.159049Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:04:14.351521Z","title":"Probvlm: Probabilistic adapter for frozen vison-language models","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:55573af03ea2c04aaa7e5bb656136254c6e02fc84667ba33cfcdfe5505a70364","observation_id":"b8a1df95-1f29-4a19-9706-7db4a60409b8","resolution":{"observed_at":"2026-06-28T23:04:14.351521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19621","last_updated":"2025-08-27T06:59:10Z","snapshot_observed_at":"2026-08-06T17:39:48.062789Z","submitted_at":"2025-08-27T06:59:10Z","title":"Towards Instance-wise Personalized Federated Learning via Semi-Implicit Bayesian Prompt Tuning","version":1},"cited_work":{"arxiv_id":"2508.19621","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19621","snapshot_observed_at":"2026-07-01T19:16:00.174110Z","title":"Towards instance-wise personalized fed- erated learning via semi-implicit bayesian prompt tuning","venue":null,"work_id":"c150e350-3476-4281-9056-9ad4c9c79683","year":null},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"cited_paper":"/paper/2508.19621","citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:3a437c6e9a721d334f289e99bede0d2156223eec1b3f02eba21c922500c79327","observation_id":"85604e52-8341-4db0-863f-673c1eb56d2c","resolution":{"observed_at":"2026-07-01T19:16:00.175678Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:04:14.351521Z","title":"C., and Liu, Z","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:b29662ae37213c1198482453a83c5ca84f94b41a38c6b66b0683745fe18e13be","observation_id":"2e869e0b-8e4b-4480-923e-6131f33a2db7","resolution":{"observed_at":"2026-06-28T23:04:14.351521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:04:14.351521Z","title":"Upadhyay et al.(Upadhyay et al.,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:4b0770e43a2b2dba393d6b06553ac6eac3a0c0b90ab5eb7bbc4040e100e97a3b","observation_id":"8cc7b580-0128-408f-bf6a-9a7b7cd755d7","resolution":{"observed_at":"2026-06-28T23:04:14.351521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:04:14.351521Z","title":"Collectively, these approaches expand the set of potential results, constructing a richer semantic retrieval space","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:f1f1af4037c90b8f772c5385546eb57ef45987eb06e85e231d144b94ba1b54b1","observation_id":"c8176680-ae13-416e-aa11-3f3aba5675ad","resolution":{"observed_at":"2026-06-28T23:04:14.351521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:04:14.351521Z","title":"We employ a 16-shot setting and use the template ”a photo of a <category>” for the word embeddings","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:2ac3305f4c96b5796949b100d71359506409b4eaae103b9975289e8da1a48cf2","observation_id":"ed0e5583-2841-40a2-9fc2-87fbf0dc992a","resolution":{"observed_at":"2026-06-28T23:04:14.351521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:04:14.351521Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:455101c3a4172d5ff778ea93d8316b99f61818e0a04f11e6ac711fdf4bdd9c54","observation_id":"4c5c5e61-3753-4fce-a9cb-435a77b34b69","resolution":{"observed_at":"2026-06-28T23:04:14.351521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0077.2380","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T19:16:00.171687Z","title":"the sample may not actually be a negative sample","venue":null,"work_id":"b3a8d1f5-22dc-440a-a105-a44b76420958","year":2039},"citing_paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T23:04:14.351521Z"},"links":{"citing_paper":"/paper/2605.30968"},"observation_digest":"sha256:fa110521afd6f34dbce648ca2431774869b3bd624362adb1eba4dd17558617aa","observation_id":"11ceda50-bd12-426f-8f46-7c4d4f6081d3","resolution":{"observed_at":"2026-07-01T19:16:00.173027Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.30968","last_updated":"2026-05-29T08:08:15Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T10:46:45.261355Z","submitted_at":"2026-05-29T08:08:15Z","title":"Variational Adapter for Cross-modal Similarity Representation"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":8,"verified_fuzzy":0},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2605.30968."}