{"as_of":"2026-08-22T20:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0480ed362f63def555efd4edfca8725114268a8524cb80f6dea9593041cf9c17","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:53:11.939212Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T10:48:12.685530Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-08-12T15:54:23.943323Z","title":"Synthclip: Are we ready for a fully synthetic CLIP training? CoRR, abs/2402.01832, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13842","last_updated":"2025-03-08T06:01:01Z","snapshot_observed_at":"2026-08-20T21:12:51.676578Z","submitted_at":"2024-11-21T05:02:13Z","title":"Detecting Human Artifacts from Text-to-Image Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T15:54:23.943323Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2411.13842"},"observation_digest":"sha256:c99918d8a0b455fed2d3e7dd99d6d3a8b33b3ec0b497ae453cc252be39df5924","observation_id":"533042dc-19f2-473e-b73a-4ff3112f0ca8","resolution":{"observed_at":"2026-08-12T15:54:23.943323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-08-12T12:57:11.786071Z","title":"Synthclip: Are we ready for a fully synthetic clip training? arXiv preprint arXiv:2402.01832, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16828","last_updated":"2024-11-25T18:49:02Z","snapshot_observed_at":"2026-08-18T16:28:57.019152Z","submitted_at":"2024-11-25T18:49:02Z","title":"CLIPS: An Enhanced CLIP Framework for Learning with Synthetic Captions","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T12:57:11.786071Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2411.16828"},"observation_digest":"sha256:2fdeeb50226e2633beb132b2b81ab126641db1c0daf0bfab3b638cf7da949191","observation_id":"c0e496eb-6e35-46fc-8f0d-99aa2501f4af","resolution":{"observed_at":"2026-08-12T12:57:11.786071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-08-11T22:19:06.677484Z","title":"Syn- thclip: Are we ready for a fully synthetic clip training? arXiv:2402.01832, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03561","last_updated":"2024-12-04T18:56:04Z","snapshot_observed_at":"2026-08-19T02:06:41.029992Z","submitted_at":"2024-12-04T18:56:04Z","title":"FLAIR: VLM with Fine-grained Language-informed Image Representations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T22:19:06.677484Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2412.03561"},"observation_digest":"sha256:01272884bf7370a7a6ca0e7fcf8a50e1c3357023afbfea6f70f3a2d27d12071d","observation_id":"52124baa-6b8b-42e8-b189-139e8a6fbad9","resolution":{"observed_at":"2026-08-11T22:19:06.677484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-08-11T15:59:08.758322Z","title":"Synthclip: Are we ready for a fully synthetic clip training? arXiv preprint arXiv:2402.01832, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.10372","last_updated":"2024-12-13T18:59:40Z","snapshot_observed_at":"2026-08-13T21:19:28.765174Z","submitted_at":"2024-12-13T18:59:40Z","title":"UniMed-CLIP: Towards a Unified Image-Text Pretraining Paradigm for Diverse Medical Imaging Modalities","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T15:59:08.758322Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2412.10372"},"observation_digest":"sha256:8fa74c5a8892bf2ecd3a11aa66ee08a671541a8f91a14741aa58775cb5813ba8","observation_id":"d8389e0c-e372-4135-ac8b-baa433e4e47c","resolution":{"observed_at":"2026-08-11T15:59:08.758322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-08-10T20:08:46.086165Z","title":"Synthclip: Are we ready for a fully synthetic clip training? arXiv preprint arXiv:2402.01832, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09425","last_updated":"2025-05-13T06:30:11Z","snapshot_observed_at":"2026-08-15T04:34:33.617262Z","submitted_at":"2025-01-16T09:55:42Z","title":"Vision-Language Models Do Not Understand Negation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T20:08:46.086165Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2501.09425"},"observation_digest":"sha256:d1109d1a2e5e212904d0b9ca91dcb6756512f14429da492b5b9bf8d7fbb50ba0","observation_id":"6ad3e1d3-2a2b-4509-be2f-5b1e12a3db5e","resolution":{"observed_at":"2026-08-10T20:08:46.086165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-08-16T00:53:11.939212Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02527","last_updated":"2025-05-05T10:08:31Z","snapshot_observed_at":"2026-08-17T14:16:15.956014Z","submitted_at":"2025-05-05T10:08:31Z","title":"Text to Image Generation and Editing: A Survey","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-16T00:53:11.939212Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2505.02527"},"observation_digest":"sha256:04352651d58ca86a124cecf3dcb69585c0a610a49f827618f4454c74b3dd865f","observation_id":"283a3990-1b58-48a9-b4ec-aacb7867103f","resolution":{"observed_at":"2026-08-16T00:53:11.939212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-08-15T21:10:42.098029Z","title":"SynthCLIP: Are we Ready for a fully synthetic CLIP training? arXiv preprint arXiv:2402.01832, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10551","last_updated":"2025-05-15T17:57:38Z","snapshot_observed_at":"2026-08-19T04:33:27.254516Z","submitted_at":"2025-05-15T17:57:38Z","title":"Does Feasibility Matter? Understanding the Impact of Feasibility on Synthetic Training Data","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:10:42.098029Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2505.10551"},"observation_digest":"sha256:36fac8c164ed56f95cc0220559050cb2d504c8cd3528ae606084cdd4180e89f3","observation_id":"ad1547ba-d7d5-4064-8d4f-818eb3ad9b28","resolution":{"observed_at":"2026-08-15T21:10:42.098029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-08-15T20:53:04.823604Z","title":"Synthclip: Are we ready for a fully synthetic clip training? arXiv preprint arXiv:2402.01832, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11703","last_updated":"2025-05-16T21:17:55Z","snapshot_observed_at":"2026-08-18T01:46:47.472985Z","submitted_at":"2025-05-16T21:17:55Z","title":"LoFT: LoRA-fused Training Dataset Generation with Few-shot Guidance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:53:04.823604Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2505.11703"},"observation_digest":"sha256:cf951a5e6eedf532c4ce0051b849aca24f4056695f2e9a7845c5b76e190afb91","observation_id":"f189a9a1-a2f0-40c3-a29b-22b4c06021fe","resolution":{"observed_at":"2026-08-15T20:53:04.823604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-08-06T17:47:52.167649Z","title":"Synthclip: Are we ready for a fully synthetic clip training? arXiv preprint arXiv:2402.01832, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10095","last_updated":"2025-07-29T02:40:10Z","snapshot_observed_at":"2026-08-20T11:53:49.986496Z","submitted_at":"2025-07-14T09:31:34Z","title":"FIX-CLIP: Dual-Branch Hierarchical Contrastive Learning via Synthetic Captions for Better Understanding of Long Text","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:47:52.167649Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2507.10095"},"observation_digest":"sha256:3bcfcdc76942b2edef9a3b32aa9c6eb4976ce45fdad18a4f8c857d96697c2a7f","observation_id":"f37346fa-c5ac-44bc-a306-54ab2c5f6b8a","resolution":{"observed_at":"2026-08-06T17:47:52.167649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-08-06T16:26:35.118609Z","title":"Synthclip: Are we ready for a fully synthetic CLIP training? CoRR, abs/2402.01832, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13568","last_updated":"2025-07-29T03:29:57Z","snapshot_observed_at":"2026-08-15T01:43:23.716876Z","submitted_at":"2025-07-17T23:08:29Z","title":"LoRA-Loop: Closing the Synthetic Replay Cycle for Continual VLM Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:35.118609Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2507.13568"},"observation_digest":"sha256:063a852fc655a8694cb422c13fce21969d4f15613f81da75b940129c1f1868d7","observation_id":"a64db165-4b06-40ab-9da7-53b8db24df41","resolution":{"observed_at":"2026-08-06T16:26:35.118609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-08-15T18:16:07.549980Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18616","last_updated":"2025-07-24T17:53:26Z","snapshot_observed_at":"2026-08-15T18:07:14.505762Z","submitted_at":"2025-07-24T17:53:26Z","title":"SynC: Synthetic Image Caption Dataset Refinement with One-to-many Mapping for Zero-shot Image Captioning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T18:16:07.549980Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2507.18616"},"observation_digest":"sha256:6b06ca7e0cec9b8fae5f8963ae140a9ca9e766cb777cb718bffa73bd449d0347","observation_id":"5f3c9538-f74d-4d05-9f59-31ead1a057f0","resolution":{"observed_at":"2026-08-15T18:16:07.549980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-08-05T14:59:19.534128Z","title":"Synthclip: Are we ready for a fully synthetic clip training?arXiv preprint arXiv:2402.01832 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20691","last_updated":"2025-08-28T11:50:22Z","snapshot_observed_at":"2026-08-22T04:22:49.456170Z","submitted_at":"2025-08-28T11:50:22Z","title":"MobileCLIP2: Improving Multi-Modal Reinforced Training","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T14:59:19.534128Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2508.20691"},"observation_digest":"sha256:ac3c4d6382450247ea818e1f5bc2b5c21dd1e01e8e50c35790742e878a119b59","observation_id":"12f769d8-6a91-41b1-a6d5-849af14f027a","resolution":{"observed_at":"2026-08-05T14:59:19.534128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":"2402.01832","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Synthclip: Are we ready for a fully synthetic clip training?","venue":null,"work_id":"a6b1f7e7-8e1d-4ab8-a603-61c4f6780aba","year":2024},"citing_paper":{"arxiv_id":"2605.18608","last_updated":"2026-05-18T16:18:17Z","snapshot_observed_at":"2026-08-15T12:24:21.975546Z","submitted_at":"2026-05-18T16:18:17Z","title":"Dance Across Shifts: Forward-Facilitation Continual Test-Time Adaptation through Dynamic Style Bridging","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T10:47:38.553051Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2605.18608"},"observation_digest":"sha256:9d98a04a5f0122fef365ce602d0ec39be843672b6931c9b66cca3ef5e20a5457","observation_id":"1d2997d0-b020-4c3b-aa80-20b27da50999","resolution":{"observed_at":"2026-05-20T10:48:12.687472Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-07-12T08:12:18.373103Z","title":"Synthclip: Are we ready for a fully synthetic clip training?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02637","last_updated":"2026-07-02T15:34:46Z","snapshot_observed_at":"2026-08-16T22:52:08.587619Z","submitted_at":"2026-07-02T15:34:46Z","title":"Post-Generation Curation of Synthetic Images via Homogeneous-Heterogeneous Splitting","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-12T08:12:18.373103Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2607.02637"},"observation_digest":"sha256:680d20f38ea9ec206a4f36b94fb12e863fa2e643d6c9dda685514903cd35ef8a","observation_id":"aa85cf8d-ae67-46d6-a24b-86508a331053","resolution":{"observed_at":"2026-07-12T08:12:18.373103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-08-01T04:11:50.033852Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22924","last_updated":"2026-08-18T01:51:12Z","snapshot_observed_at":"2026-08-21T23:10:45.411309Z","submitted_at":"2026-07-24T21:25:58Z","title":"Layering Virtual Try-On","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T04:11:50.033852Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2607.22924"},"observation_digest":"sha256:2dfaffdac883f4431e83121d4c01126716fd71b02f191df72a1f1fc93a27ba80","observation_id":"b8cba59d-ac8a-488c-aace-88a105b6e8b3","resolution":{"observed_at":"2026-08-01T04:11:50.033852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01832","snapshot_observed_at":"2026-08-05T01:00:04.332094Z","title":"Synthclip: Are we ready for a fully synthetic clip training?arXiv preprint arXiv:2402.01832, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00440","last_updated":"2026-08-01T04:39:59Z","snapshot_observed_at":"2026-08-20T00:44:15.747297Z","submitted_at":"2026-08-01T04:39:59Z","title":"Poplar: A Scalable Pipeline for Human-Centric Image Dataset Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T01:00:04.332094Z"},"links":{"cited_paper":"/paper/2402.01832","citing_paper":"/paper/2608.00440"},"observation_digest":"sha256:fda3e0426e7b22b05443e2b6ea7d8edd89ecbc6b455c67eaf89fc151960b541e","observation_id":"676a826c-444a-4a82-92ff-51bf0dcb583b","resolution":{"observed_at":"2026-08-05T01:00:04.332094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.01832/citation-record","integrity":"/paper/2402.01832/integrity","json":"/paper/2402.01832/citation-record.json","paper":"/paper/2402.01832"},"outbound":[],"paper":{"arxiv_id":"2402.01832","last_updated":"2024-07-18T10:21:29Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-22T03:18:42.742616Z","submitted_at":"2024-02-02T18:59:58Z","title":"SynthCLIP: Are We Ready for a Fully Synthetic CLIP Training?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2402.01832."}