{"as_of":"2026-08-13T06:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b3c6c1df6d86f40a73642693072c73fbe9ba57ecb7afd04b3c063d4daebd3f8d","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:11:25.746289Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:11:22.983604Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:11:25.945105Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"cited_work":{"arxiv_id":"2506.00333","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00333","snapshot_observed_at":"2026-08-07T12:11:25.945105Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","venue":"cs.CV","work_id":"c47c338e-bf0a-40f8-b295-50dee1fd5c2e","year":2025},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:22.983604Z"},"links":{"cited_paper":"/paper/2506.00333","citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:669d735b825fd987ba0a09ee1ff06aeb7346babd87d084bbf34d8506de53f2ed","observation_id":"ea5fb744-e34e-43cf-8c0f-435f1654b4f4","resolution":{"observed_at":"2026-08-07T12:11:25.995481Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00333/citation-record","integrity":"/paper/2506.00333/integrity","json":"/paper/2506.00333/citation-record.json","paper":"/paper/2506.00333"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"cited_work":{"arxiv_id":"2506.00333","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00333","snapshot_observed_at":"2026-08-07T12:11:25.945105Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","venue":"cs.CV","work_id":"c47c338e-bf0a-40f8-b295-50dee1fd5c2e","year":2025},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:22.983604Z"},"links":{"cited_paper":"/paper/2506.00333","citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:669d735b825fd987ba0a09ee1ff06aeb7346babd87d084bbf34d8506de53f2ed","observation_id":"ea5fb744-e34e-43cf-8c0f-435f1654b4f4","resolution":{"observed_at":"2026-08-07T12:11:25.995481Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:30.241857Z","title":null,"venue":null,"work_id":"c18df27c-f05c-4301-b51f-73e65fc480de","year":null},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.087268Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:50f1d0a24ec553f4d4dbd5aa4e7d80d3f16a3834dbb7f8636996d934d08e231b","observation_id":"1af24e8a-27cb-482b-b97e-205e9ac0198a","resolution":{"observed_at":"2026-08-07T12:11:30.356093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:29.984161Z","title":"a {Class Name}","venue":null,"work_id":"5e2c3450-3828-4e12-bbbe-9138c8c10189","year":null},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.161571Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:4cb2ee20d93b46e35e71ec250b9d5d7f0034275ada927fd5cd21c03e77f2287a","observation_id":"816ce4c2-bbb5-44d4-a34f-b7cd1a255011","resolution":{"observed_at":"2026-08-07T12:11:30.095869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:29.785399Z","title":"Storage Box","venue":null,"work_id":"0e4bdc4f-d8b2-4794-b811-93f1fc90945b","year":null},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.270329Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:86335f57a2192b840135a5a182a8e4b938a426d9ff9c03cacf871aff27ce639f","observation_id":"bfa57c94-eb9e-4e60-b324-cf032e51038a","resolution":{"observed_at":"2026-08-07T12:11:29.885945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:29.542684Z","title":"Inspired by our Ora- cle results—where removing distracting classes yields large gains—we introduce V ocAda, aplug-and-playmodule foroff- the-shelfOvOD detectors","venue":null,"work_id":"fec6e021-8a57-4c8b-b559-0aa4779f1ed3","year":null},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.381545Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:0f929d898e8fab16c04be1e9a846631e1b6b9f4814925ca15093acc0cabd2098","observation_id":"d3193821-eb74-4ee8-831b-770c0c929c5c","resolution":{"observed_at":"2026-08-07T12:11:29.700201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:29.318533Z","title":"Seeing the unseen: Visual common sense for semantic placement,","venue":null,"work_id":"fca26abc-5759-4003-9012-6559b8b4f03f","year":2024},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.459038Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:77e5318cda31dfae5f05389cc130ee0da5d376502c14cb9e1e3adc6885384742","observation_id":"d08d66a7-25a4-4a65-8853-701b03823871","resolution":{"observed_at":"2026-08-07T12:11:29.416710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:29.141683Z","title":"Mask r-cnn,","venue":null,"work_id":"7ef19d62-96d7-4715-b82d-e08a7c8557cc","year":2017},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.534081Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:5abdef447634b1d88051eacfa483a258f5af9fec2fb5f5ce64004f3f56276646","observation_id":"f096de54-b746-439a-bdee-5bfb6aea849c","resolution":{"observed_at":"2026-08-07T12:11:29.217007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.02767","last_updated":"2018-04-08T22:27:57Z","snapshot_observed_at":"2026-08-06T11:09:16.409556Z","submitted_at":"2018-04-08T22:27:57Z","title":"YOLOv3: An Incremental Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.02767","snapshot_observed_at":"2026-08-07T12:11:23.644738Z","title":"Yolov3: An incremental improvement,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.644738Z"},"links":{"cited_paper":"/paper/1804.02767","citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:06dd2a9d23b371d27f2e48727837642d2d683f21a2dbe0ad9b5e16376fd6bd7a","observation_id":"07b9fff2-34dd-43dc-9581-485aff2f3dc8","resolution":{"observed_at":"2026-08-07T12:11:23.644738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.941363Z","title":"Learning Transferable Visual Models From Natural Language Supervision,","venue":null,"work_id":"3ed3b9c4-93ce-42fc-aeda-60fbbcf2872c","year":2021},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.722337Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:a64dcfe10d6026d137046160f783f00e1e3ba415c923a8f759b7159ffcf5833e","observation_id":"7c45c2b7-feee-4980-b379-94fa58a1a19c","resolution":{"observed_at":"2026-08-07T12:11:29.043208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.861036Z","title":"Detecting Twenty-thousand Classes using Image-level Supervision,","venue":null,"work_id":"4728b991-6c0d-4e47-ad48-532844d3a153","year":2022},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.828062Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:3be5a72564855d12a0b91204ad55126460eec53a8cd0641e0e5ec07bff79873f","observation_id":"54aaa979-d26a-4c68-841f-99ff800a4f9c","resolution":{"observed_at":"2026-08-07T12:11:28.934056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.743176Z","title":"LLaV A-NeXT: Improved reasoning, OCR, and world knowledge,","venue":null,"work_id":"3f731e01-688f-435d-a7cd-14ded7f3156d","year":2024},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:23.921430Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:b519b69de344b75ad37b14659e1724923c95b45d980e6ebddb05dd9e5e8ec93c","observation_id":"3d556e66-bc85-4205-8d96-35c5f49e5109","resolution":{"observed_at":"2026-08-07T12:11:28.794646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.589343Z","title":"Learning object-language alignments for open-vocabulary object detec- tion,","venue":null,"work_id":"02872a98-ca77-4f72-897b-840cc2b52d1f","year":2023},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.004108Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:3b935520566ec7f823f75797fff5dc2653148bd9e179f9f00e90244aed7c47e7","observation_id":"c30e048f-d147-4a02-a264-1c25c41e1e73","resolution":{"observed_at":"2026-08-07T12:11:28.680919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.439056Z","title":"CoDet: Co-Occurrence Guided Region-Word Alignment for Open-V ocabulary Object Detection,","venue":null,"work_id":"ae8329d4-c0e4-4458-a663-5e05bcf7ff8f","year":2023},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.151619Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:714a18cf2f3f404562616c568a2a9560981f512864730cf42bea642d6d46ce39","observation_id":"168ad95c-3ade-4fbd-9a01-ab47ef738621","resolution":{"observed_at":"2026-08-07T12:11:28.504905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.294040Z","title":"Microsoft COCO: Common Objects in Context,","venue":null,"work_id":"fbb9253b-b258-4622-97e7-7599cdaeeded","year":2014},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.262699Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:63d423e19aa004c380d7d6ddd9ba6aadcb22dfef8d5ea10ee5199c621565410a","observation_id":"3e00f64e-8355-48a4-b369-ffcf983341ec","resolution":{"observed_at":"2026-08-07T12:11:28.368384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.183599Z","title":"Objects365: A large-scale, high-quality dataset for object detection,","venue":null,"work_id":"4fc39b5a-44ab-44a8-b197-25cd873e1722","year":2019},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.346139Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:b44cba995577fbfc9dbabf65162d5ed587b954ce80542c445dd939eb456ea862","observation_id":"42eecc17-515a-4d29-9c5d-ad778e9434e5","resolution":{"observed_at":"2026-08-07T12:11:28.231753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09220","last_updated":"2024-04-15T02:47:01Z","snapshot_observed_at":"2026-08-11T16:57:28.355541Z","submitted_at":"2023-07-18T12:52:49Z","title":"A Survey on Open-Vocabulary Detection and Segmentation: Past, Present, and Future","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09220","snapshot_observed_at":"2026-08-07T12:11:24.449511Z","title":"A Survey on Open-V ocabulary Detection and Segmentation: Past, Present, and Future,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.449511Z"},"links":{"cited_paper":"/paper/2307.09220","citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:0ac519b4e4637724273e4fad9aa5d4c0f623a7323204b86db8bd730209dd150a","observation_id":"683fc60c-b58d-4226-af5e-2421db00953c","resolution":{"observed_at":"2026-08-07T12:11:24.449511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:28.022055Z","title":"LVIS: A Dataset for Large V ocabulary Instance Segmentation,","venue":null,"work_id":"f2bb6d14-5c42-4f59-b2c2-f153ebb16182","year":2019},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.561964Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:011b0f3335f1950a55ed53e9850ad16cdc92bef0a62ea646a81d385eed1caeb5","observation_id":"b7b253ed-edaf-4d33-96ea-72293accf513","resolution":{"observed_at":"2026-08-07T12:11:28.088310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:27.884961Z","title":"ImageNet: a Large-Scale Hierarchical Image Database,","venue":null,"work_id":"fa529286-975d-48e8-83f3-60c5dbdfe153","year":2009},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.673069Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:fdd30511d3205ac472edaf5b7db2df96e0b550956da088cdb87d2c6f328272cf","observation_id":"b17ad004-3731-40dc-84a2-81f253c9aab8","resolution":{"observed_at":"2026-08-07T12:11:27.950594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:27.740355Z","title":"RegionCLIP: Region- based Language-Image Pretraining,","venue":null,"work_id":"72b8cb1d-1229-4f3e-9407-44a8a921faf2","year":2022},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.783852Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:5b01ce69a24a90401d7f0ef3d6cc4270e7e12049bb61c09fedf56737b64a7892","observation_id":"83602ec1-0e50-4222-a102-0fe68b95f13d","resolution":{"observed_at":"2026-08-07T12:11:27.809183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:27.567742Z","title":"SHiNe: Semantic hierarchy nexus for open-vocabulary object detection,","venue":null,"work_id":"77c1adde-4332-4c83-9baa-30da1e6c5ce4","year":2024},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.891021Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:08159100cce3ae94eb83fe58c8233496647aa2cff23ad7f2ec643afab2bc7794","observation_id":"96c0984f-ee3c-49f2-9618-e71ac387a121","resolution":{"observed_at":"2026-08-07T12:11:27.641700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:27.374637Z","title":"mplug-owl2: Revolutionizing multi-modal large language model with modal- ity collaboration,","venue":null,"work_id":"0538af7f-c982-4cb8-b125-eb9b5c6da776","year":2024},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:24.967515Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:28fed8a2ef5ee2640df91b6275e8fb376780588dda6085270c1158fef1ab9e9d","observation_id":"4efe6322-3c98-4dc0-8f7b-80e52192f052","resolution":{"observed_at":"2026-08-07T12:11:27.489417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:27.191640Z","title":"spaCy: Industrial-strength Natural Language Processing in Python,","venue":null,"work_id":"f03d2399-425d-4276-92bb-e183fde77dc1","year":2020},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.076611Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:61685f506539cc3614b45ef93fd9ca18729cc4ba53a9c3bed3d4d399153cb16f","observation_id":"a8d7c058-8878-41ea-b27e-1ade7af4dba0","resolution":{"observed_at":"2026-08-07T12:11:27.278684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:27.043254Z","title":"Introducing meta llama 3: The most capable openly available llm to date,","venue":null,"work_id":"0f6a77bd-75f6-4dec-a2c5-a12bf699fd15","year":2024},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.187191Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:8f7eaa33986e7f96173d61becbaa82ddadd76f3d23aa45c0abc91e8c3db24d54","observation_id":"88623871-c9dc-4db9-867d-29c632c270ff","resolution":{"observed_at":"2026-08-07T12:11:27.108763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:26.826082Z","title":"Swin Transformer: Hierarchical Vision Transformer using Shifted Windows,","venue":null,"work_id":"398bc65f-390d-4e4a-8a2f-84c67d0a372b","year":2021},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.260169Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:3f031e9ef62ac8698240b4920cd32ecd2fe048b317367b06921cd030b97873f5","observation_id":"1a00f052-a281-4861-b9c6-1c77e65a859f","resolution":{"observed_at":"2026-08-07T12:11:26.945534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:26.609004Z","title":null,"venue":null,"work_id":"05e7c43c-7f5a-442b-80bd-a10210e137ef","year":1998},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.342440Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:3d4a1491835f380d54a40dfc839bcd0648d4c00707b3947e50d6b7f018853387","observation_id":"11c7a68e-bc20-473a-9adc-fc1031150e0b","resolution":{"observed_at":"2026-08-07T12:11:26.702182Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15200","last_updated":"2023-11-16T07:11:02Z","snapshot_observed_at":"2026-08-13T05:43:22.615348Z","submitted_at":"2023-10-23T08:13:33Z","title":"Open-Set Image Tagging with Multi-Grained Text Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15200","snapshot_observed_at":"2026-08-07T12:11:25.418349Z","title":"Open-set image tagging with multi-grained text supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.418349Z"},"links":{"cited_paper":"/paper/2310.15200","citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:51ebff616d4855a5a9816eb064acbf61cc3d1a9064e33748aeb6d6dc32e77c33","observation_id":"f6307555-cb22-48a7-be0c-7d5b246b061a","resolution":{"observed_at":"2026-08-07T12:11:25.418349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:26.454855Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks,","venue":null,"work_id":"94000b1a-8ab8-4293-a4c5-d15eb81d7808","year":2019},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.509368Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:85b971c3d7229cc8820b2dff602ed3b13d2514cb3365750145429bd49c3c6009","observation_id":"687284bf-9488-4727-9463-48b700796cba","resolution":{"observed_at":"2026-08-07T12:11:26.527236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T12:11:25.578752Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.578752Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:5d53baeaa083b4b2f8c24a3e32602186da4e2c8e9c04c67594fb285ad321bcf9","observation_id":"e3239dfc-aac5-420b-8faa-d5adaa4a9286","resolution":{"observed_at":"2026-08-07T12:11:25.578752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:26.267829Z","title":"ChatGPT: A Large-Scale GPT-3.5-Based Model,","venue":null,"work_id":"1dc56106-a8aa-4625-91d9-2fc4b7be5911","year":2022},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.654814Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:271bc0c7c4204bf091a0fe96b67d6d31292a826895f2c75fc1da759752a0ff0d","observation_id":"86df7a91-60ef-4800-a018-0277ba9ea0aa","resolution":{"observed_at":"2026-08-07T12:11:26.356184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:26.077315Z","title":"Visual Classification via Description from Large Language Models,","venue":null,"work_id":"f36931ff-b24b-4cbf-80cc-83a94ba2ebd4","year":2023},"citing_paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:25.746289Z"},"links":{"citing_paper":"/paper/2506.00333"},"observation_digest":"sha256:db2c0659851110ad78875e0e1925bcaa130bf22ed2e18f3fd86a2f03cf1141c5","observation_id":"0fa20980-9495-435e-85d9-9823f47d5ec5","resolution":{"observed_at":"2026-08-07T12:11:26.150864Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00333","last_updated":"2025-05-31T01:15:29Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T12:05:10.488735Z","submitted_at":"2025-05-31T01:15:29Z","title":"Test-time Vocabulary Adaptation for Language-driven Object Detection"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 1 inbound Pith citation observation for arXiv:2506.00333."}