{"as_of":"2026-08-19T20:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:85ca379ae72a26a8ca2ae7c820d1d989281a81988e8a88ecffcadc142840723b","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T18:40:31.593414Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.11357/citation-record","integrity":"/paper/2411.11357/integrity","json":"/paper/2411.11357/citation-record.json","paper":"/paper/2411.11357"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.245756Z","title":"Rethinking classification and localization for object detection,","venue":null,"work_id":"b8b9672b-b894-48eb-be2b-9c4c4b3fcff0","year":2020},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.384449Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:7da530dc32a6627eaae929e7d751930245348997bea928579fd84f4982a06d9e","observation_id":"25c38486-7002-44ca-88af-0fce42ea6183","resolution":{"observed_at":"2026-08-12T18:40:32.249481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.234642Z","title":"Weakly Supervised Object Localization and Detection: A Survey,","venue":null,"work_id":"5d14326e-3be5-408f-9304-8788a4125550","year":2022},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.388839Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:e6be9d47ea3bc2baefc9558fe3adec989d96eb3ec75354cb6fb21318e6baf47b","observation_id":"1a45e63f-8df1-45fa-94b3-46061e2dcc76","resolution":{"observed_at":"2026-08-12T18:40:32.238579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.223735Z","title":"Locnet: Improving localization accuracy for object detection,","venue":null,"work_id":"ee6113a0-e98d-46fb-a1c2-3247f4b57398","year":2016},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.392895Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:a72d69d35487b749ba437312098658adbbcced8b93e5533496b8057fc7bbfd93","observation_id":"dab8f01a-35a0-490d-a3c3-b4dcbf8d4bb6","resolution":{"observed_at":"2026-08-12T18:40:32.227479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.212483Z","title":"Weakly-supervised semantic segmentation by iteratively mining common object features,","venue":null,"work_id":"d5b77075-6a2b-47a7-8630-ca104675a132","year":2018},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.396763Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:5d301c85b742fe6c50be47ce5bf578e3988c46960f90ffda301316b0ce8849b3","observation_id":"abf28d22-f4eb-4bdb-a7e1-38b1062b1de6","resolution":{"observed_at":"2026-08-12T18:40:32.216211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.202069Z","title":"Object localization and border detection criteria design in edge-based image segmentation: automated learning from examples,","venue":null,"work_id":"162b1bcf-5e20-48a0-99e3-75a933b254a3","year":2000},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.401163Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:7ac3a0757982ddf3b8c2149adab405c6b67091830b1c9682664f963b1bffac3b","observation_id":"582ad278-d086-47f1-ac94-0c09fc2f56ba","resolution":{"observed_at":"2026-08-12T18:40:32.205756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15420","last_updated":"2024-07-22T06:49:56Z","snapshot_observed_at":"2026-08-18T10:49:48.070987Z","submitted_at":"2024-07-22T06:49:56Z","title":"Local All-Pair Correspondence for Point Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15420","snapshot_observed_at":"2026-08-12T18:40:31.405182Z","title":"Local All-Pair Correspondence for Point Tracking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.405182Z"},"links":{"cited_paper":"/paper/2407.15420","citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:e4eeab8fba9b6fb380919dd178c82150636fd1303e6a93ea9a17052b49ada0ae","observation_id":"02d02ad8-61bf-426a-b4ef-85b268c516c9","resolution":{"observed_at":"2026-08-12T18:40:31.405182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.190609Z","title":"UcoSLAM: Simultaneous localization and mapping by fusion of keypoints and squared planar markers,","venue":null,"work_id":"eefc60e3-7879-4fdf-a33f-dac483fa2757","year":2020},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.409640Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:b39e2b34b99e8dbb759d765c40f92b20dfc4be78ef2968d322931b461398feab","observation_id":"eaa4b888-bb22-4828-a4c3-7b2140b9a49a","resolution":{"observed_at":"2026-08-12T18:40:32.194211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.180400Z","title":"UA V-Satellite View Synthesis for Cross-View Geo-Localization,","venue":null,"work_id":"f8ece0c7-1443-4997-a983-d32ca1e5a129","year":2022},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.413062Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:957470306066d119cabacd4408d4064e287192b1f05e7336aaacb4fe4adfaf2e","observation_id":"9ccaeb53-836f-4849-91df-a0f927e46e87","resolution":{"observed_at":"2026-08-12T18:40:32.183959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.169539Z","title":"Gaussian yolov3: An accurate and fast object detector using localization uncertainty for autonomous driving,","venue":null,"work_id":"1c50b62f-d452-4140-a0c1-4999af6686c8","year":2019},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.416503Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:77a32194f9a45655492492d6a1528f51f93ea2010801c472de87398fffcc147d","observation_id":"6966c382-2553-42ce-bc5b-e908e3cf0196","resolution":{"observed_at":"2026-08-12T18:40:32.173769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.158477Z","title":"Localization and navigation in autonomous driving: Threats and countermeasures,","venue":null,"work_id":"7473b124-8d0a-4c05-9f4a-df43f22ba967","year":2019},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.419817Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:8d9b203edf27143c1cd2058b6281b8db743f69adff4f8ea62595f29b2194fb63","observation_id":"56abf6fa-aed8-45ae-8710-55b6fb2b48ba","resolution":{"observed_at":"2026-08-12T18:40:32.162420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.147330Z","title":"Fusion- driven deep feature network for enhanced object detection and tracking in video surveillance systems,","venue":null,"work_id":"81555219-6c04-4a43-ad67-05dc2120dff8","year":2024},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.423307Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:5bc0d92f183b28fb748b60eca15c466f48df662d6c1e80d05556b9b36646e729","observation_id":"7d066a73-cfb3-4861-8852-d385f34639f9","resolution":{"observed_at":"2026-08-12T18:40:32.151311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.135901Z","title":"Automatic detection of mind wandering from video in the lab and in the classroom,","venue":null,"work_id":"c28f3c13-4df9-4ecf-b433-8a32e43f2282","year":2019},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.426764Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:cafdd2df6cde5a6bde2116ceee5622c856fdff13a41e0c6b9b2014760d920077","observation_id":"59cf57e2-95b8-4a22-8356-e0c74c04b2d3","resolution":{"observed_at":"2026-08-12T18:40:32.139793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.125098Z","title":"Multi- scale hypergraph-based feature alignment network for cell localization,","venue":null,"work_id":"cc7ed0b4-fb0b-45f6-956f-9e37f2270958","year":2024},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.430314Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:b950a964ef53c74d69e7ef499df39563a4cc6e4c1d77c184c276374776097f71","observation_id":"d2d10738-5a69-4cd8-8d9f-39d62d8c96b4","resolution":{"observed_at":"2026-08-12T18:40:32.128840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.114152Z","title":"Few-Shot Object Detection: A Survey,","venue":null,"work_id":"ea81b8cf-c982-4646-99a0-a46d4f4f9314","year":2022},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.433678Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:46fca683187fe934e9bd3365058aef19b47e84340e2f6ba7b409107d1f0195aa","observation_id":"82e57a31-c844-476b-9fd9-0c4b0ae2b762","resolution":{"observed_at":"2026-08-12T18:40:32.118175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.102194Z","title":"Generalized few-shot object detection without forgetting,","venue":null,"work_id":"9a40b75b-2b20-494b-82a8-673234cabb41","year":2021},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.437006Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:1eb32f8bf695526b7d6307447f0d44f593ad4b04f21e5256d7654af1fb0b6f2b","observation_id":"4004df54-5753-4bef-95a3-bfff7c7daf2f","resolution":{"observed_at":"2026-08-12T18:40:32.106416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.091744Z","title":"Semantic relation reasoning for shot-stable few-shot object detection,","venue":null,"work_id":"152f53e1-1464-43b8-976f-ddfb3a5f29ad","year":2021},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.440661Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:9dce9db99d198a67a741fcac59c6116b2debece177c5a76aab06473c875d910e","observation_id":"19b372d4-d66d-4e76-a0f5-2b7c46086ce4","resolution":{"observed_at":"2026-08-12T18:40:32.095441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.080999Z","title":"Learning to Detect Unseen Object Classes by Between-Class Attribute Transfer,","venue":null,"work_id":"43910183-e239-47ed-bd35-da9e010ce4d8","year":2009},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.444359Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:4d4aa92ab162689c9874588f00abd90b1f94f6e84748e6a23e928a4491104019","observation_id":"4512e386-bf90-4b0f-8818-6f6188bfe16d","resolution":{"observed_at":"2026-08-12T18:40:32.085003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.069783Z","title":"Zero-Shot Learning Through Cross-Modal Transfer,","venue":null,"work_id":"30eb6d83-61b5-410b-921a-06502bce7a1b","year":2013},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.447814Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:7cb42c6283e039b0aa7a9046d2bce986ff42e1e1bf2443933088265033d52a3e","observation_id":"79f04e36-6596-4425-82b6-708082b99f00","resolution":{"observed_at":"2026-08-12T18:40:32.073932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.047447Z","title":"Vlcounter: Text-Aware Visual Representation for Zero-Shot Object Counting,","venue":null,"work_id":"bf3b2656-4c3b-4351-ae2b-e0f02a7c792d","year":2024},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.454819Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:8f827cc201a094d3bb786292f3d114b21a7d6f4f7f024f2135f5d4bd4d3f5cc5","observation_id":"0815ad82-3d96-4305-9e7f-a2b17aa7f439","resolution":{"observed_at":"2026-08-12T18:40:32.051311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.036437Z","title":"Clip-Count: Towards Text-Guided Zero-Shot Object Counting,","venue":null,"work_id":"bdbdf111-df0b-4679-87c0-7240589945e7","year":2023},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.458520Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:bc921da677016ceda5c513e0e12611222473b84e478b79eb5b613f58e5e865dd","observation_id":"c0d25a48-e34f-430e-949a-fa5244e8442e","resolution":{"observed_at":"2026-08-12T18:40:32.040412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04619","last_updated":"2025-03-10T20:54:29Z","snapshot_observed_at":"2026-08-16T13:36:44.078474Z","submitted_at":"2024-07-05T16:20:48Z","title":"CountGD: Multi-Modal Open-World Counting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04619","snapshot_observed_at":"2026-08-12T18:40:31.462147Z","title":"CountGD: Multi-Modal Open-World Counting,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.462147Z"},"links":{"cited_paper":"/paper/2407.04619","citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:8592d46400f5584a01c173b220284e976a485a3230389f784edd5510663b2fe2","observation_id":"8a50631c-de76-488c-a71a-5c9c86fdcd48","resolution":{"observed_at":"2026-08-12T18:40:31.462147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.026113Z","title":"Point Segment and Count: A Generalized Framework for Object Counting,","venue":null,"work_id":"b4460331-f4d8-4ef7-8042-365eb3156b32","year":2024},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.466350Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:80e65f7b04471274511aea01513d8c57c67ff6e8f736ff94ea311a6785452716","observation_id":"fa90de4b-1ec7-45e1-a70b-0a07d647f149","resolution":{"observed_at":"2026-08-12T18:40:32.029713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.014979Z","title":"Metric learning with back- ground noise class for few-shot detection of rare sound events,","venue":null,"work_id":"ee1a19ba-9011-49a3-a05f-b736dbed5479","year":2020},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.470036Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:340c6a518b966e82a24f80b5413319c56d0d589bd024a8871d038bfe060e12c6","observation_id":"65f560cc-8cee-42d8-ab28-3a613c01803b","resolution":{"observed_at":"2026-08-12T18:40:32.018966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.003853Z","title":"Towards Zero-Shot Learning: A Brief Review and an Attention-Based Embedding Net- work,","venue":null,"work_id":"0a547cb7-aa41-4e2f-9757-d13685215136","year":2022},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.473512Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:4dd86c9df81022ac5bd26c81b30befbe2f7517d0ac1fad2dec2b39ae75e2f006","observation_id":"02daf71e-6380-4e2a-8201-72c4de316d05","resolution":{"observed_at":"2026-08-12T18:40:32.008124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.992616Z","title":"Learning transferable visual models from natural language supervi- sion,","venue":null,"work_id":"40273579-c9e8-4be8-89fb-0eda2727ed54","year":2021},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.477010Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:c4fd8eeb08d222a26229161564bd7411610c4599d524cf8b6cb600ab37fd8c6f","observation_id":"87ae936c-cfca-4972-a0c1-af5131562765","resolution":{"observed_at":"2026-08-12T18:40:31.996694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.982348Z","title":"Self-support few-shot semantic segmentation,","venue":null,"work_id":"69c817fb-ec53-46c8-9a32-96b6f5a94f5f","year":2022},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.480519Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:85b335ee81bae4abde3087ed7e5e5a704b107101fc4461048c49ea79f6dc2f45","observation_id":"9f4f222b-abe4-4de4-806d-27aac6c57d60","resolution":{"observed_at":"2026-08-12T18:40:31.985869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.971101Z","title":"Point in, box out: Beyond count- ing persons in crowds,","venue":null,"work_id":"63ce23d5-c898-422a-8c06-b2894957a067","year":2019},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.483678Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:28d0993d408c10a0fc6a81c5371b8997bf9467a88ddd3ede42e3d6d88be70153","observation_id":"070cdae7-7498-477f-882b-e2d70da349ba","resolution":{"observed_at":"2026-08-12T18:40:31.975373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.959802Z","title":"Small instance detection by integer programming on object density maps,","venue":null,"work_id":"03992232-c043-4713-a2da-86a7fa8db3db","year":2015},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.487449Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:44c87f70a2392e6c091d0bcd8ff59973b8e024a29e02bf244b9a6f535b37211f","observation_id":"a1a7f095-0419-40a9-9d60-8ef8c59b95e1","resolution":{"observed_at":"2026-08-12T18:40:31.963728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.948172Z","title":"Dense point prediction: A simple baseline for crowd counting and localization,","venue":null,"work_id":"aa983ced-3220-48b2-8ccb-245a950f444d","year":2021},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.490886Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:fed6a654ab48c78f51bb8ec088558aa4b0d92118ba96e36d59e9c71b4b873ad2","observation_id":"7d8da1b7-6ada-4b25-8487-3f25191c5319","resolution":{"observed_at":"2026-08-12T18:40:31.952004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.935338Z","title":"Recurrent Attentive Zooming for Joint Crowd Counting and Precise Localization,","venue":null,"work_id":"c581d90f-c90b-44a2-befe-973f004ee643","year":2019},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.494109Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:72f1772d735ad6f70027a4f593099a77883b69f02060914f46cb683c7a135e7a","observation_id":"fb4cf2f8-b6c6-4d51-ae3b-5f2fc193ffa9","resolution":{"observed_at":"2026-08-12T18:40:31.940043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.922811Z","title":"DeGPR: Deep Guided Posterior Regularization for Multi- Class Cell Detection and Counting,","venue":null,"work_id":"b712bee0-73de-403a-aba7-f578f8005cd0","year":2023},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.497225Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:ae686b8dbe361e4adf0f16d28447e7dc81b8b94bdb7bda01c8fd56d8a8ebdfe2","observation_id":"e51da5af-14fb-4847-aaed-d9f79116facc","resolution":{"observed_at":"2026-08-12T18:40:31.926734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.910967Z","title":"Rethinking counting and localization in crowds: A purely JOURNAL OF LATEX CLASS FILES, VOL. XX, NO. X, NOV .2024 11 point-based framework,","venue":null,"work_id":"883e664c-95dd-4b67-bf6b-7336501c3aa3","year":2024},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.500647Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:0336506e9616b92dcc90403dd6712377b2b5c8339b3c554296d9f31b6e62c93f","observation_id":"ec83b9bc-0038-4c88-a19c-11375222a0c6","resolution":{"observed_at":"2026-08-12T18:40:31.914995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.899785Z","title":"Locally-Enriched Cross-Reconstruction for Few-Shot Fine-Grained Image Classification,","venue":null,"work_id":"4a89ba8b-ce16-4cec-b930-ddcafb6645b7","year":2023},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.504102Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:b483258b7b75ef2fc9733f61685f10e281c5b905e1b8d37cc43be330d888b0fd","observation_id":"3b83ad35-2804-4329-b02c-fb9a28e86b97","resolution":{"observed_at":"2026-08-12T18:40:31.903961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.888877Z","title":"Cross-Modal Contrastive Pre- training for Few-Shot Skeleton Action Recognition,","venue":null,"work_id":"c4a78844-c617-4081-aa14-21bfc47c85a2","year":2024},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.507655Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:2e2bf2da395d18302d2cf62c3f826011faf338ad0d3ac2c315029e2f2c81f559","observation_id":"79b329eb-92d4-4eec-a6f1-e7dbc90a5f30","resolution":{"observed_at":"2026-08-12T18:40:31.892728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.878374Z","title":"Learning to count everything,","venue":null,"work_id":"1bc38d2e-6bb8-46ef-870f-5515bfabe5e1","year":2021},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.511301Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:e7d566693e2a5c2fb947d2b273b4772cc5f14a064fedbd0d32136ff6e9c640e8","observation_id":"59f775f9-18ab-499d-a9e1-20fd121412ad","resolution":{"observed_at":"2026-08-12T18:40:31.882092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.867188Z","title":"Few-Shot Object Counting and Detection,","venue":null,"work_id":"baa580a3-9c28-4351-83ee-2893a2b09d98","year":2022},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.515136Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:c6a5f26a404dcf271f08df327333fea9f4137c7d478594e1645ac95197b5b191","observation_id":"831cff04-6c27-4a04-980f-91dde6894986","resolution":{"observed_at":"2026-08-12T18:40:31.871057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.856175Z","title":"Few-shot object counting with similarity-aware feature enhancement,","venue":null,"work_id":"4e7c34b4-0076-4ac8-b7c3-b6b685e690a0","year":2023},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.518720Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:3e2884041ee9f0c687e2e17dce3c75a436ae5f1e4ccdd19b8a539db3e9f88d99","observation_id":"7cdcf1f7-af60-4c10-9573-62e729c79333","resolution":{"observed_at":"2026-08-12T18:40:31.860081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12466","last_updated":"2024-06-05T08:10:26Z","snapshot_observed_at":"2026-08-19T20:13:17.298094Z","submitted_at":"2024-03-19T05:50:48Z","title":"Few-shot Object Localization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12466","snapshot_observed_at":"2026-08-12T18:40:31.522297Z","title":"Few-shot Object Localization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.522297Z"},"links":{"cited_paper":"/paper/2403.12466","citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:5c8a485bb65a8dc119cd243ef04c6fd38b56fd90435b8e97afcc07ac561c0274","observation_id":"cafd06df-d404-442a-ac89-9246c3e67260","resolution":{"observed_at":"2026-08-12T18:40:31.522297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.845486Z","title":"Dense center-direction regres- sion for object counting and localization with point supervision,","venue":null,"work_id":"8e2cc7e7-80f7-4c9f-9b5c-149f3b29583d","year":2024},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.526344Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:8b0417c3dff6a55d4998516bcdaea5f06934379c595f30b223caf8b9b16bb1e1","observation_id":"3ffc1154-6e12-4eac-87d6-c942471506d5","resolution":{"observed_at":"2026-08-12T18:40:31.849313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.834828Z","title":"Zero-Shot Action Recognition with Transformer-based Video Semantic Embedding,","venue":null,"work_id":"998374b8-27a0-4ffb-9488-732b692f04a4","year":2023},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.529778Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:e9c2142f152dac3b0fde8d397e87e428454eeadb09130e75c9607db0d479339d","observation_id":"6bad06dc-8264-4f07-90d8-c521969ca7e2","resolution":{"observed_at":"2026-08-12T18:40:31.838464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:32.058576Z","title":"Dynamic Momentum Adaptation for Zero-Shot Cross-Domain Crowd Counting,","venue":null,"work_id":"12681067-9bc0-4592-8a7b-32f8455382d1","year":2021},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.533386Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:fe4c362c9a329fb2c7c75a44b4c993a9d9a90cfe137cd498185e01fe0f9979b3","observation_id":"eecdbb2d-6f46-4355-a081-124dd2df3596","resolution":{"observed_at":"2026-08-12T18:40:32.062449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.824013Z","title":"Focal Inverse Distance Trans- form Maps for Crowd Localization,","venue":null,"work_id":"bf38bf5e-c60e-4ef4-ba26-1ebf3ca28e46","year":2023},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.537005Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:1536125d364dc274105cbfd65d83a179f62bd6e0f8508666c9931993d71a7cfb","observation_id":"f5a060e3-29fd-4db4-bf94-3003603a8771","resolution":{"observed_at":"2026-08-12T18:40:31.827917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.813749Z","title":"Segment Anything,","venue":null,"work_id":"2b01444b-9669-4bdd-9f5a-b08dba3ba2e5","year":2023},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.540710Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:8a31c4afea2a37fa2fd5f6012a753fd55d53201fb99b31a965512e662468c93b","observation_id":"d566283c-0717-4328-b5d3-902f0c4e5f8b","resolution":{"observed_at":"2026-08-12T18:40:31.817497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-08-19T16:02:58.628969Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-12T18:40:31.544526Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.544526Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:84228db6139682d67bca059b8e5e0671b5d02bf3e3efb29ff1f3cff70528c737","observation_id":"05c4a5ad-8e8e-445a-abc6-c7847030acfc","resolution":{"observed_at":"2026-08-12T18:40:31.544526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.803226Z","title":"Learning To Count Everything,","venue":null,"work_id":"aeba2aea-bc00-415b-b051-774567e4f94f","year":2021},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.548582Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:6d4788862c05f50e627f7828c7e154a64edd6cdd7a3c6ebf7f310c3813a41a46","observation_id":"891d782f-48f9-4aa7-9573-a74e05b3c27c","resolution":{"observed_at":"2026-08-12T18:40:31.806725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.792653Z","title":"Represent, Compare, and Learn: A Similarity-Aware Framework for Class-Agnostic Counting,","venue":null,"work_id":"36ec9de1-f424-4a64-96bb-54972a35502a","year":2022},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.552695Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:eb6842850860b8508e00f85db663bf927803d4deae25b56a91317908a78e5b28","observation_id":"ad4a1940-9305-4fe6-82bb-72d75aaf4626","resolution":{"observed_at":"2026-08-12T18:40:31.796598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.04164","last_updated":"2022-10-12T01:09:38Z","snapshot_observed_at":"2026-08-16T19:00:15.272176Z","submitted_at":"2020-12-08T02:17:19Z","title":"Learning Independent Instance Maps for Crowd Localization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.04164","snapshot_observed_at":"2026-08-12T18:40:31.556362Z","title":"Learning Independent In- stance Maps for Crowd Localization,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.556362Z"},"links":{"cited_paper":"/paper/2012.04164","citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:89478d561603ae3175d54c2621b67aaa77d7cd54a205ab99e2c83e05c814989a","observation_id":"ea831c92-c5d6-43df-9e3d-93001413e18f","resolution":{"observed_at":"2026-08-12T18:40:31.556362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.781357Z","title":"Crowd Localization From Gaussian Mixture Scoped Knowledge and Scoped Teacher,","venue":null,"work_id":"e476d32d-cdf7-439e-8c9a-1a749b8179e3","year":2023},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.560303Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:cd8161f8abd9736e7e0bfdbcfeb8772eb99ade80df990950c50df66cb43da077","observation_id":"c04558e6-a129-40b0-8811-5df6d3d08e87","resolution":{"observed_at":"2026-08-12T18:40:31.785368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.770206Z","title":"Counting and Locating Anything: Class-agnostic Few-shot Object Counting and Localization,","venue":null,"work_id":"a99368bf-046c-44ee-ad74-31d110dc977e","year":2023},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.564079Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:6e2b70fc67a7c3a27a037a3a81f842fc1c83b8db7028ce46106e63d84cd83a67","observation_id":"2a900363-4ef4-4f6b-9144-065ee60f799b","resolution":{"observed_at":"2026-08-12T18:40:31.774081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.757290Z","title":"STEERER: Resolving Scale Variations for Counting and Localization via Selective Inheritance Learning,","venue":null,"work_id":"3eb5a522-d55c-46db-a455-1758dc105a1a","year":2023},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.567706Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:617f9775ef02a69c70e09426b3e991acedbf245d9ed97664e7caa4b64a3ba658","observation_id":"a5d1cfd5-de10-4f7d-8a60-7456d7483c6e","resolution":{"observed_at":"2026-08-12T18:40:31.761775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.744824Z","title":"An End-to-End Transformer Model for Crowd Localization,","venue":null,"work_id":"79221dc7-9131-4468-9c76-54bf59dc97f3","year":2022},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.571186Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:52dcfe72df1fdf48eadc6886e57a1ce2341acaa82cdc74081b52c9d19bb1a482","observation_id":"fd5ee9a3-9a46-4b23-8aba-1ae51104a27a","resolution":{"observed_at":"2026-08-12T18:40:31.748930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2139/ssrn.4882210","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.621831Z","title":"Dynamic Example Network for Class Agnostic Counting and Localization,","venue":null,"work_id":"e48e3cd8-9abf-4f46-a041-75c703748e6c","year":null},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.574958Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:fcfdd3cc54a9696722468a8c5120ec047fb46029f5ef8936603f644aadd641e8","observation_id":"a85785ca-c98c-43c9-9c9f-907c8776e867","resolution":{"observed_at":"2026-08-12T18:40:31.627960Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.733416Z","title":"Locate, Size, and Count: Accurately Resolving People in Dense Crowds via Detection,","venue":null,"work_id":"9036f424-e675-46ae-8ad8-28c6ba2c5aaa","year":2021},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.578957Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:8a6eb28bf55f819c9d061116922a70360ee05309c071a21af44636845f88b847","observation_id":"9a7cc080-5271-47c3-b124-332a81f561a0","resolution":{"observed_at":"2026-08-12T18:40:31.737230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.722151Z","title":"A Low-Shot Object Counting Network With Iterative Prototype Adaptation,","venue":null,"work_id":"217032bb-38bf-4f16-baed-dc89a4dd8621","year":2023},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.582789Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:a10e1927301a31dcf277fe0af9aaff051b979fc72f1da69e4071916011de04bf","observation_id":"328749ee-6a6b-494d-90e0-ed2c283d304e","resolution":{"observed_at":"2026-08-12T18:40:31.726286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.710963Z","title":"Faster R-CNN: Towards real- time object detection with region proposal networks,","venue":null,"work_id":"f2af8752-3d40-4b94-9749-943ce62edbf3","year":2016},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.586283Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:eed3aca5fd84454386f6bcf20c6eb65feeeee2a457525f3e3a2c7e6674e7d412","observation_id":"ee9a36f4-1850-43ed-8c4b-1e3b9356e812","resolution":{"observed_at":"2026-08-12T18:40:31.714889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.699422Z","title":"Finding tiny faces,","venue":null,"work_id":"a597c779-6f65-42ac-8cb9-ee4509758254","year":2017},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.589823Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:a6aba8efd576b11f16d61b412d50a8b3d6249e5ca327182f75728a5efef2489b","observation_id":"bd120384-4a6c-45f8-89f0-8beb5bc09ee5","resolution":{"observed_at":"2026-08-12T18:40:31.703298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:40:31.687222Z","title":"Recurrent attentive zooming for joint crowd counting and precise localization,","venue":null,"work_id":"6271968b-8f51-4980-ba7b-2ecd09ef84a9","year":2019},"citing_paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T18:40:31.593414Z"},"links":{"citing_paper":"/paper/2411.11357"},"observation_digest":"sha256:b324aa210127c7dc3adc25bcbf202383fb6adf9b932f294bc1056871fd5826fe","observation_id":"cf486604-913d-431a-88cc-4af6a2e2a5fa","resolution":{"observed_at":"2026-08-12T18:40:31.691379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.11357","last_updated":"2024-11-18T08:03:11Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T10:50:27.783092Z","submitted_at":"2024-11-18T08:03:11Z","title":"Text-guided Zero-Shot Object Localization"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":1,"verified_fuzzy":51},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2411.11357."}