{"as_of":"2026-08-13T09:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a3bc9b047c831963cd97562ee30933db87c52aba4fff052eab08e828e4f05309","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T18:38:19.006394Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T12:03:15.421544Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.01859","last_updated":"2023-11-01T18:43:34Z","snapshot_observed_at":"2026-07-06T16:14:13.509663Z","submitted_at":"2023-09-04T23:26:11Z","title":"NLLB-CLIP -- train performant multilingual image retrieval model on a budget","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01859","snapshot_observed_at":"2026-08-12T18:38:19.006394Z","title":"Nllb-clip–train performant multilin- gual image retrieval model on a budget","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11927","last_updated":"2025-04-26T15:33:50Z","snapshot_observed_at":"2026-08-13T04:17:28.513272Z","submitted_at":"2024-11-18T09:19:30Z","title":"FLAME: Frozen Large Language Models Enable Data-Efficient Language-Image Pre-training","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T18:38:19.006394Z"},"links":{"cited_paper":"/paper/2309.01859","citing_paper":"/paper/2411.11927"},"observation_digest":"sha256:3e9dc9acca518934ecef13724840b0ea26fb430328085cf7e412ca6389ee707e","observation_id":"ee888382-854d-4e60-8872-239e223ef6e8","resolution":{"observed_at":"2026-08-12T18:38:19.006394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01859","last_updated":"2023-11-01T18:43:34Z","snapshot_observed_at":"2026-07-06T16:14:13.509663Z","submitted_at":"2023-09-04T23:26:11Z","title":"NLLB-CLIP -- train performant multilingual image retrieval model on a budget","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01859","snapshot_observed_at":"2026-08-11T17:37:15.349401Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.08802","last_updated":"2025-04-24T16:22:33Z","snapshot_observed_at":"2026-08-13T06:43:38.583907Z","submitted_at":"2024-12-11T22:28:12Z","title":"jina-clip-v2: Multilingual Multimodal Embeddings for Text and Images","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-11T17:37:15.349401Z"},"links":{"cited_paper":"/paper/2309.01859","citing_paper":"/paper/2412.08802"},"observation_digest":"sha256:4e3ea32ce4b30d1c872812dd852cb48a9ce9cc3146dfbf130ad8571f8e3c8cca","observation_id":"3ea58816-7331-405f-bffe-61faed31980b","resolution":{"observed_at":"2026-08-11T17:37:15.349401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01859","last_updated":"2023-11-01T18:43:34Z","snapshot_observed_at":"2026-07-06T16:14:13.509663Z","submitted_at":"2023-09-04T23:26:11Z","title":"NLLB-CLIP -- train performant multilingual image retrieval model on a budget","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01859","snapshot_observed_at":"2026-08-06T12:08:23.507484Z","title":"Nllb-clip–train performant multilingual image retrieval model on a budget.arXiv preprint arXiv:2309.01859,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22062","last_updated":"2025-08-01T06:40:13Z","snapshot_observed_at":"2026-08-10T12:44:14.015550Z","submitted_at":"2025-07-29T17:59:58Z","title":"Meta CLIP 2: A Worldwide Scaling Recipe","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T12:08:23.507484Z"},"links":{"cited_paper":"/paper/2309.01859","citing_paper":"/paper/2507.22062"},"observation_digest":"sha256:3852799873d2aa58ba585880a0cbc04dea267d45c2aa94f78ddb3c23f48dc609","observation_id":"bfcc85ce-9b18-495c-a5e2-93236e1e3618","resolution":{"observed_at":"2026-08-06T12:08:23.507484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01859","last_updated":"2023-11-01T18:43:34Z","snapshot_observed_at":"2026-07-06T16:14:13.509663Z","submitted_at":"2023-09-04T23:26:11Z","title":"NLLB-CLIP -- train performant multilingual image retrieval model on a budget","version":3},"cited_work":{"arxiv_id":"2309.01859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01859","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2309.01859 (2023)","venue":null,"work_id":"06a679c9-471f-4e35-97f2-c0d4629d80a9","year":2023},"citing_paper":{"arxiv_id":"2509.22123","last_updated":"2026-05-13T12:28:55Z","snapshot_observed_at":"2026-08-08T13:18:54.000166Z","submitted_at":"2025-09-26T09:46:13Z","title":"Multilingual Vision-Language Models, A Survey","version":2},"reference_index":147,"source":"pdf_text","source_observed_at":"2026-05-18T13:02:08.000814Z"},"links":{"cited_paper":"/paper/2309.01859","citing_paper":"/paper/2509.22123"},"observation_digest":"sha256:1c4744e5bedfe2a7020b3120b9ea31dbef1eed0384db1061aa5e66d6cd156ae9","observation_id":"eb258d51-6265-4ba0-9445-e2436af2db3b","resolution":{"observed_at":"2026-05-18T13:02:37.476330Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01859","last_updated":"2023-11-01T18:43:34Z","snapshot_observed_at":"2026-07-06T16:14:13.509663Z","submitted_at":"2023-09-04T23:26:11Z","title":"NLLB-CLIP -- train performant multilingual image retrieval model on a budget","version":3},"cited_work":{"arxiv_id":"2309.01859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01859","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2309.01859 (2023)","venue":null,"work_id":"06a679c9-471f-4e35-97f2-c0d4629d80a9","year":2023},"citing_paper":{"arxiv_id":"2605.18029","last_updated":"2026-05-18T08:20:13Z","snapshot_observed_at":"2026-07-06T23:28:55.079333Z","submitted_at":"2026-05-18T08:20:13Z","title":"What Matters for Grocery Product Retrieval with Open Source Vision Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T11:59:53.366287Z"},"links":{"cited_paper":"/paper/2309.01859","citing_paper":"/paper/2605.18029"},"observation_digest":"sha256:6c1a7c4e1cb5121fb5e8544d670e6343ad78fe53e3eea582bdfba49b0b7b7310","observation_id":"baf27459-fa3c-41ec-90c0-c141257415ca","resolution":{"observed_at":"2026-05-20T12:03:15.423032Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01859","last_updated":"2023-11-01T18:43:34Z","snapshot_observed_at":"2026-07-06T16:14:13.509663Z","submitted_at":"2023-09-04T23:26:11Z","title":"NLLB-CLIP -- train performant multilingual image retrieval model on a budget","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01859","snapshot_observed_at":"2026-07-31T14:32:40.798062Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28211","last_updated":"2026-07-30T13:49:16Z","snapshot_observed_at":"2026-08-07T05:26:06.844507Z","submitted_at":"2026-07-30T13:49:16Z","title":"Scaling Vision-Language Models Is Not Enough to Mitigate Bias","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-31T14:32:40.798062Z"},"links":{"cited_paper":"/paper/2309.01859","citing_paper":"/paper/2607.28211"},"observation_digest":"sha256:5fa00c263cee83e1b14cd7de20913d49b02a03af164704d3086d2b1050fc01a9","observation_id":"dcf2fa81-0db3-49c5-be59-2d5edf534902","resolution":{"observed_at":"2026-07-31T14:32:40.798062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2309.01859/citation-record","integrity":"/paper/2309.01859/integrity","json":"/paper/2309.01859/citation-record.json","paper":"/paper/2309.01859"},"outbound":[],"paper":{"arxiv_id":"2309.01859","last_updated":"2023-11-01T18:43:34Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T16:14:13.509663Z","submitted_at":"2023-09-04T23:26:11Z","title":"NLLB-CLIP -- train performant multilingual image retrieval model on a budget"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2309.01859."}