{"as_of":"2026-08-10T03:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3726a3428d54c34889b61b33679f516c94f96296c00dfc4ef782c22d8e471551","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":23,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T19:44:58.769327Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T12:59:53.224246Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":"2205.06230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-07-04T12:59:53.224246Z","title":"Simple open-vocabulary object detection with vision transformers","venue":null,"work_id":"4a029835-bd63-4b98-ab43-d2ff7887490d","year":2022},"citing_paper":{"arxiv_id":"2212.12130","last_updated":"2026-05-15T03:31:02Z","snapshot_observed_at":"2026-07-06T14:34:19.510288Z","submitted_at":"2022-12-23T03:54:59Z","title":"Learning to Detect and Segment for Open Vocabulary Object Detection","version":7},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-24T10:24:52.653023Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2212.12130"},"observation_digest":"sha256:1927adc48e1c2021cdce1679381626b3685016400a0e0c241cf678363c52d5ed","observation_id":"4390f54e-8a0f-49fa-b181-681292ccbac0","resolution":{"observed_at":"2026-05-24T10:26:08.081039Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":"2205.06230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-07-04T12:59:53.224246Z","title":"Simple open-vocabulary object detection with vision transformers","venue":null,"work_id":"4a029835-bd63-4b98-ab43-d2ff7887490d","year":2022},"citing_paper":{"arxiv_id":"2302.11550","last_updated":"2023-02-22T18:47:51Z","snapshot_observed_at":"2026-08-05T16:16:51.134330Z","submitted_at":"2023-02-22T18:47:51Z","title":"Scaling Robot Learning with Semantically Imagined Experience","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-17T18:59:10.352342Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2302.11550"},"observation_digest":"sha256:469f431bcd86f309e79df3f5456073e9c6873f593addb79e974505fdba64ad95","observation_id":"02396885-aa78-4762-a020-785b413ac54b","resolution":{"observed_at":"2026-05-17T18:59:10.537117Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":"2205.06230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-07-04T12:59:53.224246Z","title":"Simple open-vocabulary object detection with vision transformers","venue":null,"work_id":"4a029835-bd63-4b98-ab43-d2ff7887490d","year":2022},"citing_paper":{"arxiv_id":"2303.08128","last_updated":"2023-03-14T17:57:47Z","snapshot_observed_at":"2026-08-02T12:31:34.577778Z","submitted_at":"2023-03-14T17:57:47Z","title":"ViperGPT: Visual Inference via Python Execution for Reasoning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-17T18:15:14.382011Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2303.08128"},"observation_digest":"sha256:a28d6957d53ebe307be5362e1010abf0de5859c1cbb1c50342e922be0f38fea0","observation_id":"16406840-911c-49fa-937c-63d6a09e9e8b","resolution":{"observed_at":"2026-05-17T18:15:14.467897Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":"2205.06230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-07-04T12:59:53.224246Z","title":"Simple open-vocabulary object detection with vision transformers","venue":null,"work_id":"4a029835-bd63-4b98-ab43-d2ff7887490d","year":2022},"citing_paper":{"arxiv_id":"2307.05973","last_updated":"2023-11-02T06:53:37Z","snapshot_observed_at":"2026-08-05T01:03:23.456778Z","submitted_at":"2023-07-12T07:40:48Z","title":"VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T08:57:22.299028Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2307.05973"},"observation_digest":"sha256:69063a7573091aa9daa3e0ccceca9d24e79bb9cb201d98aa2c868c8ec56dfe96","observation_id":"6d977316-3239-4058-9c0e-ba4d79384867","resolution":{"observed_at":"2026-05-13T08:57:22.432656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":"2205.06230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-07-04T12:59:53.224246Z","title":"Simple open-vocabulary object detection with vision transformers","venue":null,"work_id":"4a029835-bd63-4b98-ab43-d2ff7887490d","year":2022},"citing_paper":{"arxiv_id":"2409.01652","last_updated":"2024-11-12T04:33:26Z","snapshot_observed_at":"2026-07-29T23:37:00.228879Z","submitted_at":"2024-09-03T06:45:22Z","title":"ReKep: Spatio-Temporal Reasoning of Relational Keypoint Constraints for Robotic Manipulation","version":2},"reference_index":135,"source":"pdf_text","source_observed_at":"2026-05-16T08:25:17.847571Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2409.01652"},"observation_digest":"sha256:db50fa1ae3513927277e8fbdfb72b0acd072c15b82fa040ca749e683e095edc6","observation_id":"b8595cab-c45a-41f0-aefc-813690d76004","resolution":{"observed_at":"2026-05-16T08:25:18.076777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-08-08T19:44:58.769327Z","title":"Simple open-vocabulary object detection with vision transformers. arxiv 2022,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05343","last_updated":"2025-02-07T21:30:17Z","snapshot_observed_at":"2026-08-08T19:39:40.565841Z","submitted_at":"2025-02-07T21:30:17Z","title":"Towards Wearable Interfaces for Robotic Caregiving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T19:44:58.769327Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2502.05343"},"observation_digest":"sha256:181671f92ac7dbea576b8f973ca7cf9dc5692e9cdd43cad60b9c32eaedb2d279","observation_id":"e6ecb145-e739-4e74-aab4-a03d0c1ea565","resolution":{"observed_at":"2026-08-08T19:44:58.769327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-08-08T00:03:16.785000Z","title":"Simple open-vocabulary object detection with vision trans- formers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.08643","last_updated":"2025-02-18T16:45:59Z","snapshot_observed_at":"2026-08-09T11:31:44.840528Z","submitted_at":"2025-02-12T18:57:22Z","title":"A Real-to-Sim-to-Real Approach to Robotic Manipulation with VLM-Generated Iterative Keypoint Rewards","version":2},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-08T00:03:16.785000Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2502.08643"},"observation_digest":"sha256:b6ccd02e891b423d5fee6ce6479dfbac2a3c6082505d64f9f3ca068f27341855","observation_id":"ba198215-cfb9-4245-bf64-39ee441b0aff","resolution":{"observed_at":"2026-08-08T00:03:16.785000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-08-07T20:56:19.716820Z","title":"arXiv:2205.06230 [cs.CV] https://arxiv.org/abs/2205.06230 Anran Qi, Yulia Gryaditskaya, Tao Xiang, and Yi-Zhe Song","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09608","last_updated":"2025-05-06T06:15:34Z","snapshot_observed_at":"2026-08-08T01:01:27.364461Z","submitted_at":"2025-02-13T18:56:05Z","title":"Instance Segmentation of Scene Sketches Using Natural Image Priors","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T20:56:19.716820Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2502.09608"},"observation_digest":"sha256:62f151bc4924d522ff163014e25a6eda3f3f92d1baf1f13bb15e02fc4482b7d9","observation_id":"c44236f6-515c-496e-babc-54a3a18326fc","resolution":{"observed_at":"2026-08-07T20:56:19.716820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-08-07T11:18:52.175515Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02917","last_updated":"2025-06-03T14:18:37Z","snapshot_observed_at":"2026-08-07T11:10:03.233054Z","submitted_at":"2025-06-03T14:18:37Z","title":"Text-guided Generation of Efficient Personalized Inspection Plans","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T11:18:52.175515Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2506.02917"},"observation_digest":"sha256:85242485c4d142ad459c95c2f927611c6902e2171fd06834ee8f048c7a2124ed","observation_id":"1f3e67f5-1ce7-4381-899d-3a31c5f6a8b8","resolution":{"observed_at":"2026-08-07T11:18:52.175515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-08-06T21:48:55.316835Z","title":"Simple open-vocabulary object detection with vision transformers, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23418","last_updated":"2025-06-29T22:41:27Z","snapshot_observed_at":"2026-08-08T07:48:39.269731Z","submitted_at":"2025-06-29T22:41:27Z","title":"Why Settle for Mid: A Probabilistic Viewpoint to Spatial Relationship Alignment in Text-to-image Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T21:48:55.316835Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2506.23418"},"observation_digest":"sha256:faaacbe813d05b4f5b1453b7e8d674638796d6e20aa384c4b5ee39eb384bee2a","observation_id":"9970ec12-3997-4701-9dba-82053fae0d7e","resolution":{"observed_at":"2026-08-06T21:48:55.316835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-08-06T17:47:23.658360Z","title":"Simple open-vocabulary object detection with vision transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10015","last_updated":"2025-07-17T11:10:58Z","snapshot_observed_at":"2026-08-09T01:12:51.382558Z","submitted_at":"2025-07-14T07:51:01Z","title":"(Almost) Free Modality Stitching of Foundation Models","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T17:47:23.658360Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2507.10015"},"observation_digest":"sha256:4be188803135f08029178896d88198b3313fb33404c4e649cddcd24fcb5313e4","observation_id":"62e13818-c8a8-4a18-bca9-4b17d6e68fa4","resolution":{"observed_at":"2026-08-06T17:47:23.658360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-08-05T23:31:48.438137Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05323","last_updated":"2025-08-07T12:28:08Z","snapshot_observed_at":"2026-08-09T08:35:55.462063Z","submitted_at":"2025-08-07T12:28:08Z","title":"Textual Inversion for Efficient Adaptation of Open-Vocabulary Object Detectors Without Forgetting","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T23:31:48.438137Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2508.05323"},"observation_digest":"sha256:c490a3e133b5dfdb0bd34f8e6f2c8a5c65bba3b2653ad75fdfd6b126153e450f","observation_id":"1107d941-b2ec-4791-b94d-1aab7698439f","resolution":{"observed_at":"2026-08-05T23:31:48.438137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-08-05T17:54:40.668517Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.15481","last_updated":"2025-08-21T11:57:37Z","snapshot_observed_at":"2026-08-08T15:27:25.380560Z","submitted_at":"2025-08-21T11:57:37Z","title":"On Evaluating the Adversarial Robustness of Foundation Models for Multimodal Entity Linking","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T17:54:40.668517Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2508.15481"},"observation_digest":"sha256:e7e3c2267e6bbedcff4fe196669e4eb2439dd8512fcf6c84931858dfdcad79ed","observation_id":"bf7986f6-73c8-488f-a28d-b700b392df51","resolution":{"observed_at":"2026-08-05T17:54:40.668517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-08-05T12:28:46.082206Z","title":"Simple open-vocabulary object detection with vision transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.01605","last_updated":"2025-09-01T16:36:23Z","snapshot_observed_at":"2026-08-09T00:21:58.386383Z","submitted_at":"2025-09-01T16:36:23Z","title":"TransForSeg: A Multitask Stereo ViT for Joint Stereo Segmentation and 3D Force Estimation in Catheterization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T12:28:46.082206Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2509.01605"},"observation_digest":"sha256:5e55cb27277eb27fb243bd9418073fae4e2c14fbc4417e8cf2033b4fb3dfdddd","observation_id":"1fcdf4d8-a6a9-4990-af59-072fef2a708d","resolution":{"observed_at":"2026-08-05T12:28:46.082206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":"2205.06230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-07-04T12:59:53.224246Z","title":"Simple open-vocabulary object detection with vision transformers","venue":null,"work_id":"4a029835-bd63-4b98-ab43-d2ff7887490d","year":2022},"citing_paper":{"arxiv_id":"2512.06171","last_updated":"2026-04-23T10:42:33Z","snapshot_observed_at":"2026-08-07T18:51:13.316673Z","submitted_at":"2025-12-05T21:49:58Z","title":"Automated Annotation of Shearographic Measurements Enabling Weakly Supervised Defect Detection","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-17T00:19:31.834944Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2512.06171"},"observation_digest":"sha256:38760e0b294e0fb3563a40d9ef6b97ee780741e62b5c84e8c43322b26494c726","observation_id":"11d4df83-795a-45c9-97b3-1e29731f0613","resolution":{"observed_at":"2026-05-17T00:21:23.698939Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":"2205.06230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-07-04T12:59:53.224246Z","title":"Simple open-vocabulary object detection with vision transformers","venue":null,"work_id":"4a029835-bd63-4b98-ab43-d2ff7887490d","year":2022},"citing_paper":{"arxiv_id":"2603.20554","last_updated":"2026-04-03T09:27:25Z","snapshot_observed_at":"2026-08-02T07:31:13.808863Z","submitted_at":"2026-03-20T23:06:23Z","title":"When Negation Is a Geometry Problem in Vision-Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T07:45:21.028636Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2603.20554"},"observation_digest":"sha256:28f7cec478b18759402fba3107dabae21fbaa66bbf805dca8d4a3a5cae3b94fa","observation_id":"d643fb03-7aea-4702-a6fe-1494012bb72a","resolution":{"observed_at":"2026-05-15T07:49:51.019505Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":"2205.06230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-07-04T12:59:53.224246Z","title":"Simple open-vocabulary object detection with vision transformers","venue":null,"work_id":"4a029835-bd63-4b98-ab43-d2ff7887490d","year":2022},"citing_paper":{"arxiv_id":"2604.25358","last_updated":"2026-04-28T08:25:32Z","snapshot_observed_at":"2026-07-06T23:11:16.247497Z","submitted_at":"2026-04-28T08:25:32Z","title":"Benchmarking Layout-Guided Diffusion Models through Unified Semantic-Spatial Evaluation in Closed and Open Settings","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-07T16:58:28.380188Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2604.25358"},"observation_digest":"sha256:d842e15fbef3e849e01ac6569a8b48301da9cc7c3eff8cbe5abc8ccea7693472","observation_id":"678c51e9-fb8b-468b-b31e-feacfa06adc4","resolution":{"observed_at":"2026-05-11T23:26:21.800655Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":"2205.06230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-07-04T12:59:53.224246Z","title":"Simple open-vocabulary object detection with vision transformers","venue":null,"work_id":"4a029835-bd63-4b98-ab43-d2ff7887490d","year":2022},"citing_paper":{"arxiv_id":"2605.19410","last_updated":"2026-05-19T06:04:23Z","snapshot_observed_at":"2026-07-06T23:30:06.876413Z","submitted_at":"2026-05-19T06:04:23Z","title":"Vision Harnessing Agent for Open Ad-hoc Segmentation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-20T05:52:40.429412Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2605.19410"},"observation_digest":"sha256:afb11f98f24c383c464e241fcd857a137e510bfdeee3e6e63b3db94117bfe99e","observation_id":"b756cb49-806c-4ca7-b550-3bd9cb039bb5","resolution":{"observed_at":"2026-05-20T05:53:04.521733Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":"2205.06230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-07-04T12:59:53.224246Z","title":"Simple open-vocabulary object detection with vision transformers","venue":null,"work_id":"4a029835-bd63-4b98-ab43-d2ff7887490d","year":2022},"citing_paper":{"arxiv_id":"2605.28271","last_updated":"2026-05-27T10:17:56Z","snapshot_observed_at":"2026-08-08T07:17:34.816961Z","submitted_at":"2026-05-27T10:17:56Z","title":"LV-OSD: Language-Vision-Complementary Open-Set Object Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T13:44:59.042817Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2605.28271"},"observation_digest":"sha256:bfdaee48922dc90d770761fc40d34f69bc61f385dc392b8d10ecf473936174fc","observation_id":"7fb8cad5-9bb0-4a2a-a481-d87715022c2e","resolution":{"observed_at":"2026-06-29T13:53:28.950038Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":"2205.06230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-07-04T12:59:53.224246Z","title":"Simple open-vocabulary object detection with vision transformers","venue":null,"work_id":"4a029835-bd63-4b98-ab43-d2ff7887490d","year":2022},"citing_paper":{"arxiv_id":"2606.09360","last_updated":"2026-06-08T11:34:32Z","snapshot_observed_at":"2026-07-31T08:23:57.018074Z","submitted_at":"2026-06-08T11:34:32Z","title":"ExDet: Open-Domain Open-Vocabulary Detection with Cross-modal Extrapolation and Rectification","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T16:53:37.521755Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2606.09360"},"observation_digest":"sha256:5a7a872f978fb85179894b54a9eb6005725bb9cbda4e43dc423ea97fe4ec097b","observation_id":"1db1c5c9-aee2-495b-9fc8-37ad18d75aa1","resolution":{"observed_at":"2026-07-03T00:57:30.393879Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":"2205.06230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-07-04T12:59:53.224246Z","title":"Simple open-vocabulary object detection with vision transformers","venue":null,"work_id":"4a029835-bd63-4b98-ab43-d2ff7887490d","year":2022},"citing_paper":{"arxiv_id":"2606.26734","last_updated":"2026-06-26T22:08:10Z","snapshot_observed_at":"2026-08-08T16:00:23.593832Z","submitted_at":"2026-06-25T08:16:42Z","title":"Robust Onion: Peeling Open Vocab Object Detectors Under Noise","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T05:33:25.373918Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2606.26734"},"observation_digest":"sha256:5f4261e4018c18d6eb09c686136c4bd85868916681ff0c2ddcc4b6aadf5671a4","observation_id":"e625aa90-c184-4d32-8cd7-9810d78e45cf","resolution":{"observed_at":"2026-07-04T12:59:53.225566Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":"2205.06230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-07-04T12:59:53.224246Z","title":"Simple open-vocabulary object detection with vision transformers","venue":null,"work_id":"4a029835-bd63-4b98-ab43-d2ff7887490d","year":2022},"citing_paper":{"arxiv_id":"2606.26734","last_updated":"2026-06-26T22:08:10Z","snapshot_observed_at":"2026-08-08T16:00:23.593832Z","submitted_at":"2026-06-25T08:16:42Z","title":"Robust Onion: Peeling Open Vocab Object Detectors Under Noise","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T00:42:36.605869Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2606.26734"},"observation_digest":"sha256:e1b77166579923b90458b70d3a6f9561d689afba3869e26ee877ace959726bd6","observation_id":"7d817ee3-a392-40d6-979f-ea2f0edb6a97","resolution":{"observed_at":"2026-07-01T16:15:50.015989Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers","version":2},"cited_work":{"arxiv_id":"2205.06230","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.06230","snapshot_observed_at":"2026-07-04T12:59:53.224246Z","title":"Simple open-vocabulary object detection with vision transformers","venue":null,"work_id":"4a029835-bd63-4b98-ab43-d2ff7887490d","year":2022},"citing_paper":{"arxiv_id":"2606.30613","last_updated":"2026-06-29T17:48:01Z","snapshot_observed_at":"2026-07-07T00:04:25.385438Z","submitted_at":"2026-06-29T17:48:01Z","title":"Sequential Planning via Anchored Robotic Keypoints","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T04:59:12.363425Z"},"links":{"cited_paper":"/paper/2205.06230","citing_paper":"/paper/2606.30613"},"observation_digest":"sha256:b00c273bbdb2584aba5cd7d0e3991e4f8d4f2cb51bf5453f9228803713905328","observation_id":"e9114509-68cf-441d-943b-a20f343a5371","resolution":{"observed_at":"2026-06-30T05:04:20.301670Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2205.06230/citation-record","integrity":"/paper/2205.06230/integrity","json":"/paper/2205.06230/citation-record.json","paper":"/paper/2205.06230"},"outbound":[],"paper":{"arxiv_id":"2205.06230","last_updated":"2022-07-20T12:24:25Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T13:09:25.356940Z","submitted_at":"2022-05-12T17:20:36Z","title":"Simple Open-Vocabulary Object Detection with Vision Transformers"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 23 inbound Pith citation observations for arXiv:2205.06230."}