{"as_of":"2026-08-09T14:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dea95d85c7b4698ee8c895909dce858426ad6da1497141ac34416b99ef76b8d5","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T20:48:50.796941Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T00:57:30.385197Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":"2209.15639","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-07-03T00:57:30.385197Z","title":"F-vlm: Open-vocabulary object detection upon frozen vision and language models","venue":null,"work_id":"2e2ab981-0561-40ab-a804-85d58df32d35","year":2022},"citing_paper":{"arxiv_id":"2410.10238","last_updated":"2026-04-07T07:54:13Z","snapshot_observed_at":"2026-07-06T19:32:51.287674Z","submitted_at":"2024-10-14T07:56:51Z","title":"ForgeryGPT: A Multimodal LLM for Interpretable Image Forgery Detection and Localization","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-23T19:06:10.198724Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2410.10238"},"observation_digest":"sha256:afa926efd28b3291937187e91fee53f9da44fffdf1af29709744cbaddfc266f3","observation_id":"8d60dfa5-91b3-41c9-b0c4-b2c62c7767e0","resolution":{"observed_at":"2026-05-23T19:08:21.153909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-08-08T20:48:50.796941Z","title":"F-vlm: Open-vocabulary object detec- tion upon frozen vision and language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-08T20:41:48.070033Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.796941Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:47db5dd8b4138e572174aacdca532cdedfbc1e3bc594958d5b3877b13416ad97","observation_id":"1b2a88f8-3331-4f65-b549-d1edd7db2922","resolution":{"observed_at":"2026-08-08T20:48:50.796941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-08-07T05:35:01.342025Z","title":"arXiv preprint arXiv:2209.15639 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07627","last_updated":"2025-06-09T10:45:35Z","snapshot_observed_at":"2026-08-07T06:32:54.058652Z","submitted_at":"2025-06-09T10:45:35Z","title":"Event-Priori-Based Vision-Language Model for Efficient Visual Understanding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:35:01.342025Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2506.07627"},"observation_digest":"sha256:3b2e222aa7c4f44da07fe275bfda8c24308637f6904c3b27d1ac2140328bb3dd","observation_id":"0ca67499-01c0-4d60-bf2d-62371bd9eb94","resolution":{"observed_at":"2026-08-07T05:35:01.342025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-08-06T21:51:53.789728Z","title":"F-vlm: Open-vocabulary object detection upon frozen vision and language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23283","last_updated":"2025-06-29T15:14:55Z","snapshot_observed_at":"2026-08-08T07:28:03.599688Z","submitted_at":"2025-06-29T15:14:55Z","title":"MoMa: Modulating Mamba for Adapting Image Foundation Models to Video Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:51:53.789728Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2506.23283"},"observation_digest":"sha256:a4f4ad40eeefd60afdfa6312279339cd06c6df4ba13ecde5e6252047f29e177b","observation_id":"11c6d7db-7c34-4bcf-985a-a185bbf26bb1","resolution":{"observed_at":"2026-08-06T21:51:53.789728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-08-06T21:37:05.649074Z","title":"F-vlm: Open-vocabulary object detection upon frozen vision and language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23785","last_updated":"2025-06-30T12:27:35Z","snapshot_observed_at":"2026-08-06T23:32:11.173462Z","submitted_at":"2025-06-30T12:27:35Z","title":"Visual Textualization for Image Prompted Object Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:37:05.649074Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2506.23785"},"observation_digest":"sha256:6cca76b70984ad668947562e2e4ebc34115aef451e2ef38abaea6beab65bed8a","observation_id":"d737176b-afa7-4a34-9af7-dd51e16057d7","resolution":{"observed_at":"2026-08-06T21:37:05.649074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-08-06T18:56:34.997383Z","title":"F-vlm: Open-vocabulary object detec- tion upon frozen vision and language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06973","last_updated":"2025-07-09T16:03:07Z","snapshot_observed_at":"2026-08-06T23:32:04.641052Z","submitted_at":"2025-07-09T16:03:07Z","title":"Free on the Fly: Enhancing Flexibility in Test-Time Adaptation with Online EM","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:56:34.997383Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2507.06973"},"observation_digest":"sha256:f88af9c47f16580e3179d51c641b06bfe574cbf049383e9b0f50d2c23913ab03","observation_id":"8502811c-3294-447e-bbca-22dea30b1f8f","resolution":{"observed_at":"2026-08-06T18:56:34.997383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-08-04T20:10:13.751010Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08820","last_updated":"2025-09-10T17:52:09Z","snapshot_observed_at":"2026-08-08T10:18:47.878914Z","submitted_at":"2025-09-10T17:52:09Z","title":"RoboChemist: Long-Horizon and Safety-Compliant Robotic Chemical Experimentation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-04T20:10:13.751010Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2509.08820"},"observation_digest":"sha256:839db08a3f55217cd89185a8e6ff6868b63cbf37eac51f078b10ddb019b0d261","observation_id":"e53dd32a-761f-4aab-8c2e-f630c24a0e52","resolution":{"observed_at":"2026-08-04T20:10:13.751010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":"2209.15639","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-07-03T00:57:30.385197Z","title":"F-vlm: Open-vocabulary object detection upon frozen vision and language models","venue":null,"work_id":"2e2ab981-0561-40ab-a804-85d58df32d35","year":2022},"citing_paper":{"arxiv_id":"2602.22394","last_updated":"2026-04-14T12:53:45Z","snapshot_observed_at":"2026-07-06T22:47:06.893212Z","submitted_at":"2026-02-25T20:42:35Z","title":"Vision Transformers Need More Than Registers","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T19:08:50.579190Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2602.22394"},"observation_digest":"sha256:5a871a9238095f2f7f116fbb3aba0f8416dc2e6d9485488e15277a39e64ebbc1","observation_id":"7e2b9157-c2d9-4404-8f4c-878f438e33d2","resolution":{"observed_at":"2026-05-15T19:10:15.693447Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-07-13T19:38:38.452093Z","title":"arXiv preprint arXiv:2209.15639 (2022) 4","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.23455","last_updated":"2026-06-30T04:40:05Z","snapshot_observed_at":"2026-08-06T23:32:08.126065Z","submitted_at":"2026-03-24T17:26:55Z","title":"DetPO: In-Context Learning with Multi-Modal LLMs for Few-Shot Object Detection","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T19:38:38.452093Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2603.23455"},"observation_digest":"sha256:75fae6d300959d03b07107f95af4de564104ee69ee7854142898bbc31ebe33ff","observation_id":"8a814cf7-50f5-4028-9b0e-aff1988a1a85","resolution":{"observed_at":"2026-07-13T19:38:38.452093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":"2209.15639","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-07-03T00:57:30.385197Z","title":"F-vlm: Open-vocabulary object detection upon frozen vision and language models","venue":null,"work_id":"2e2ab981-0561-40ab-a804-85d58df32d35","year":2022},"citing_paper":{"arxiv_id":"2603.25383","last_updated":"2026-04-22T09:05:30Z","snapshot_observed_at":"2026-07-06T22:50:37.468743Z","submitted_at":"2026-03-26T12:34:18Z","title":"CLIP-RD: Relative Distillation for Efficient CLIP Knowledge Distillation","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T00:20:36.975106Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2603.25383"},"observation_digest":"sha256:9d65beda5ee0c1de06a4ea9da4857e27c3adbf96e52c9a5ab60a13ea00ce4ffc","observation_id":"5250254f-74f3-4963-822f-782bcacb2188","resolution":{"observed_at":"2026-05-15T00:23:22.867231Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":"2209.15639","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-07-03T00:57:30.385197Z","title":"F-vlm: Open-vocabulary object detection upon frozen vision and language models","venue":null,"work_id":"2e2ab981-0561-40ab-a804-85d58df32d35","year":2022},"citing_paper":{"arxiv_id":"2605.27116","last_updated":"2026-05-26T14:53:14Z","snapshot_observed_at":"2026-07-06T23:36:53.330986Z","submitted_at":"2026-05-26T14:53:14Z","title":"COVD: Continual Open-Vocabulary Object Detection with Novel Concept Injection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T18:07:07.563662Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2605.27116"},"observation_digest":"sha256:435b2e37c25c4ee9bd96ccd15b8fb9d82eddc49f1f049cedd2889922acd2043b","observation_id":"82cf2875-9aa2-4a1b-ab96-f9de1362501c","resolution":{"observed_at":"2026-06-29T18:13:48.896059Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":"2209.15639","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-07-03T00:57:30.385197Z","title":"F-vlm: Open-vocabulary object detection upon frozen vision and language models","venue":null,"work_id":"2e2ab981-0561-40ab-a804-85d58df32d35","year":2022},"citing_paper":{"arxiv_id":"2605.28271","last_updated":"2026-05-27T10:17:56Z","snapshot_observed_at":"2026-08-08T07:17:34.816961Z","submitted_at":"2026-05-27T10:17:56Z","title":"LV-OSD: Language-Vision-Complementary Open-Set Object Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T13:44:59.042817Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2605.28271"},"observation_digest":"sha256:4550dd57110311859b0a929650493fb75953d4ae02505d9b281ee5c5c18af819","observation_id":"b7aeed7d-d168-43ee-adea-6bbe2b876d95","resolution":{"observed_at":"2026-06-29T13:53:28.953364Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":"2209.15639","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-07-03T00:57:30.385197Z","title":"F-vlm: Open-vocabulary object detection upon frozen vision and language models","venue":null,"work_id":"2e2ab981-0561-40ab-a804-85d58df32d35","year":2022},"citing_paper":{"arxiv_id":"2606.05916","last_updated":"2026-06-04T09:23:08Z","snapshot_observed_at":"2026-08-06T17:05:26.813562Z","submitted_at":"2026-06-04T09:23:08Z","title":"Unveiling the Unknown: Open Vocabulary Object Detection with Scene Graphs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-28T01:55:35.172193Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2606.05916"},"observation_digest":"sha256:fda55eeb4fd79ec2366cbb766022590367462a3f5301aa138ac9cd74f990f147","observation_id":"9024ba1f-423c-43e9-b086-b71fa430e75e","resolution":{"observed_at":"2026-07-02T12:46:56.506522Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":"2209.15639","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-07-03T00:57:30.385197Z","title":"F-vlm: Open-vocabulary object detection upon frozen vision and language models","venue":null,"work_id":"2e2ab981-0561-40ab-a804-85d58df32d35","year":2022},"citing_paper":{"arxiv_id":"2606.06978","last_updated":"2026-06-05T07:09:52Z","snapshot_observed_at":"2026-07-06T23:46:42.693840Z","submitted_at":"2026-06-05T07:09:52Z","title":"CL-CLIP: CLIP-Based Continual Learning Framework with Cost-Volume Category Decoupling for Object Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T22:13:34.998844Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2606.06978"},"observation_digest":"sha256:ec98722433a9f621babd6d6108e4bdd18046b954f36a95f0f6a2cd0518a67942","observation_id":"6104abcd-75d2-436b-9cad-c2f0d142fb0c","resolution":{"observed_at":"2026-07-02T17:07:12.573132Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":"2209.15639","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-07-03T00:57:30.385197Z","title":"F-vlm: Open-vocabulary object detection upon frozen vision and language models","venue":null,"work_id":"2e2ab981-0561-40ab-a804-85d58df32d35","year":2022},"citing_paper":{"arxiv_id":"2606.09360","last_updated":"2026-06-08T11:34:32Z","snapshot_observed_at":"2026-07-31T08:23:57.018074Z","submitted_at":"2026-06-08T11:34:32Z","title":"ExDet: Open-Domain Open-Vocabulary Detection with Cross-modal Extrapolation and Rectification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T16:53:37.521755Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2606.09360"},"observation_digest":"sha256:237fb72b1c765af5914dc873432ebffb7d04563df58f8ac9f22da8e35e4e1bf4","observation_id":"0497d85d-65e7-40e6-9c95-cb26c5bbe59e","resolution":{"observed_at":"2026-07-03T00:57:30.386919Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2209.15639/citation-record","integrity":"/paper/2209.15639/integrity","json":"/paper/2209.15639/citation-record.json","paper":"/paper/2209.15639"},"outbound":[],"paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2209.15639."}