{"as_of":"2026-08-10T13:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f5c624b09807a6eb417fe710fe27c3d471552150476e504e9bd55649b0389cf7","coverage":[{"denominator":105,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T23:02:05.250519Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.30846/citation-record","integrity":"/paper/2605.30846/integrity","json":"/paper/2605.30846/citation-record.json","paper":"/paper/2605.30846"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Foundation models defining a new era in vision: A survey and outlook.IEEE Trans","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:afbf260ad9054826735d9048e7e65eb43f04e7793cddb78521ed864bc2af7ca0","observation_id":"73248dd2-901e-4f40-ad0f-fd85cb03a06e","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Vision foundation models in remote sensing: A survey.IEEE Geosci","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:8268d985ff6ecb230aef758c0a9bf82fed327078ab48e0251cb135cf550b3c80","observation_id":"10512b7e-d9c7-4bc0-b955-99280e73f8bc","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11432","last_updated":"2021-11-22T18:59:55Z","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:55Z","title":"Florence: A New Foundation Model for Computer Vision","version":1},"cited_work":{"arxiv_id":"2111.11432","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.11432","snapshot_observed_at":"2026-07-04T20:00:08.247992Z","title":"Florence: A New Foundation Model for Computer Vision","venue":"cs.CV","work_id":"99823072-36a8-4b10-9ef5-a7f91da74650","year":2021},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"cited_paper":"/paper/2111.11432","citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:e8cd37a6950007c66c80fb1f2a41b9dca8d9e950d9b999efb9ac2ae3687a5c7b","observation_id":"4ea42d82-df68-432a-891f-ff8252dc7af2","resolution":{"observed_at":"2026-06-28T23:02:46.008216Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"VLCounter: Text-aware visual representa- tion for zero-shot object counting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:806a5b42d887278f108dcddc36b61a6cbc5ecbf80bdabb872c4b8013ae816572","observation_id":"01c9a90a-8d45-4ff1-a909-6b456130d444","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Zero-Shot Object Counting With Good Exemplars","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:975c0fd198c0769e53e04732fcc987f150827019b62478003e422535de7de457","observation_id":"20c458c8-8055-48bc-bd42-2955734d5bc7","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"CountGD: Multi-modal open-world counting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:ccfd6fe280f48ef470234ccd9652b82492a1d74b695e6334072d7a1cfcf4c8cd","observation_id":"397cc9fe-75a6-4798-ad28-f642806aecc7","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"CountGD++: Generalized prompting for open-world counting","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:7d93125b764f07b971b60da0b454e87c25d5c394bad29f4960b848dc1a4b670e","observation_id":"c1cbcbdb-d25b-4222-a971-874860292aab","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Deep learning in crowd counting: A survey.CAAI Trans","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:377f43007d60f6d9757dae7089f08165db10861c15bae837ac446272d20fa642","observation_id":"49817d3c-4e01-4dd4-b1c2-0ac0db384f0b","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Zero-shot object counting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:d0a921b98c330c482191f4be29ff145847dad3108967b40deebd58feb67ba990","observation_id":"2771b7a9-bd77-430e-b918-20e6281c0652","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Rethinking counting and localization in crowds: A purely point-based framework","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:0666fd8e5808c6f297748401d9ba4033bf0f6c5525ec7e88b1faaab02860824e","observation_id":"481abecf-4fd6-43bb-8207-dad07e18da89","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Learning To Count Anything: Reference-less class-agnostic counting with weak supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:49e449a7493e5588676661190c9c99f6ac1e072db3c42df5af21b9232458f78f","observation_id":"26939b3e-2fdf-4b76-b68f-adc708abefdc","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Learning To Count Everything","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:bcd41540febc6fcc84326d1c071239c6437b0585d67e5df96dd371edd6cafc3e","observation_id":"23749e2d-ff83-4650-b73e-fb61f8a20ff3","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Few-shot Object Counting and Detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:f624c4b25b32e9e8cc064284211a4e7aa24e794fa101bcbc17bda1a19c9a5f42","observation_id":"2d9123f4-7777-4c14-9478-0b9e5b916810","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Single-image crowd counting via multi-column convolutional neural network","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:e182bc72d8ad400dfa9d7b99d5fd91c42902376ac63b059fa7a646c6c6bd33fd","observation_id":"7e18ec9c-f9d3-4719-b9cb-6847029b03d0","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Improving Point-Based Crowd Counting and Localization Based on Auxiliary Point Guidance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:93ef9297fae93ae3545f322fa5f26ae4e764daf31e732c039216f499f781c464","observation_id":"d2e1628b-87de-4ea7-a668-68259c23d33f","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.14483","last_updated":"2021-09-29T15:13:10Z","snapshot_observed_at":"2026-08-03T11:16:52.181277Z","submitted_at":"2021-09-29T15:13:10Z","title":"CCTrans: Simplifying and Improving Crowd Counting with Transformer","version":1},"cited_work":{"arxiv_id":"2109.14483","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2109.14483","snapshot_observed_at":"2026-06-28T23:02:45.995606Z","title":"arXiv preprint arXiv:2109.14483 (2021)","venue":null,"work_id":"aea75738-0215-4bc9-a7d4-38469f9681ba","year":2021},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"cited_paper":"/paper/2109.14483","citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:a5a11cb66fb7d6e7e30795a66fc893ddf0c416d2ec07433d22f09da92410f1c4","observation_id":"943feaec-b273-499a-9a14-cc090b34f742","resolution":{"observed_at":"2026-06-28T23:02:45.997448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Microsoft COCO: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:83402df55449cfc89ed2b7b255ba8ef0d3cb8e0f67dd7c9c7f0ed6400abeb10e","observation_id":"45f5e7e5-0f51-4758-ab30-05134e8deaba","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:c1ba62812a85cc2800daf19ea1983a8aeefaf310258d71ca4b4c3db8f9d097cb","observation_id":"a5c87510-71e8-4492-b84b-9c3c0ad95711","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Sindagi, Rajeev Yasarla, and Vishal M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:311eadee2967546e58bd34013fc58d21d9c9806b60148457295a5425ae304b4d","observation_id":"76617ea3-6175-4fe9-9800-848d3efcd099","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"NuInsSeg: A fully annotated dataset for nuclei instance segmentation in H&E-stained histological images.Sci","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:5ca73aef05c877ef167701388aef0ed9d811d7dc878a38d4d1433b70e6df383d","observation_id":"cad2ac65-a0bd-4981-aa0c-b8b23c7e6d7b","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"A Dataset and a Technique for Generalized Nuclear Segmentation for Computational Pathology.IEEE Trans","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:962178af233e02410aea0c2f10fe76986ba8fc1be3f214f691172b1f49d1247e","observation_id":"1097ea59-66c1-4c66-a7fa-f223b8f02a8c","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"CellBinDB: A large-scale multimodal annotated dataset for cell segmentation with benchmarking of universal models.GigaScience, 14:giaf069, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:5ba8df3415d8c61dc7c88503cb366d7fed2e439e9be64290bd0bea1acc906d2a","observation_id":"95778287-93f4-4fa9-bb8b-3b1932b79170","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Objects365: A large-scale, high-quality dataset for object detection","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:8269d716e8beb37367b9bfcea3d497ee948bbf2e408b0182271e29994c6ef793","observation_id":"38bd68f5-7273-4cbd-8415-1c769f6337f7","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Detection and Tracking Meet Drones Challenge.IEEE Trans","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:c3c4266ad4d5bc8663cc4f36c3254d9eb6f4698e3e14ca6e11bb50ea94f32303","observation_id":"81e346db-c434-41bf-8fd0-fd2707a0d85b","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Ahmed Raza, Nasir M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:f5df78225a73e195bb388a0a8c09959880459fdc6aecdb789eb590005766125d","observation_id":"8b61b330-4886-440a-89a5-ba70ce98e126","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Venkatesh Babu","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:58a52eaf9ce183f7b215a37ead1afbedd28b608e6a4985c1457051e1ab2f6687","observation_id":"fb7d0e62-5fd9-47e0-9399-e931448acf10","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:6680d95809dd6052a8a7ed000970714aea5e7dcf3269c363b26046632f1674da","observation_id":"05aeb8db-6afe-4054-b911-1c01705590c7","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Distribution Matching for Crowd Counting","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:b980247126d0706bac685177114e398c85ea0ced950699bfda2eab8fc01ded8d","observation_id":"541199bc-66c0-4707-87bc-90c8c43f6850","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"CLIP-Count: Towards text-guided zero-shot object counting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:43eef94299481039d4742819cbceb42b9d2791af842b595907d1f0095e0e50a8","observation_id":"314b05a6-3b0b-4f47-b97e-a25eb0210b36","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Consistency-aware anchor pyramid network for crowd localization.IEEE Trans","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:ea09f737b1df75fc4e9d6625d40a0a62744b5588bcb626704d381494b179e25c","observation_id":"f75383a0-fbf2-4b4f-b333-95ba723d10b7","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Kevin Zhou, and Jie Chen","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:4e86c80fb1ab1b54f95aa55d60877de038e7dab9198e7f0bdfb5baeb246baec4","observation_id":"983734b4-49d3-4c9c-8f65-ac3c48b79b7c","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"TasselNet: Counting maize tassels in the wild via local counts regression network.Plant Methods, 13(1):79, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:d2d3f2eae6d5154dbbfb5aff8f4a10d831a1d8302715918804ee12f598e202e1","observation_id":"4daf316a-be6a-4710-af04-6ca96f2af244","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"LVIS: A dataset for large vocabulary instance segmentation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:5ab754682032e8da04b9c5e5c696f4981eafd1babff60cd178ad1b5db7bfd316","observation_id":"d1572d6c-4809-4ae2-96af-cb3f42e83ce4","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Plummer, Liwei Wang, Chris M","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:72357874f25d466e1e598198cc613499dd7451b46b1633e674873c4247838fee","observation_id":"91d7954f-f005-4635-82a0-a32aaac24223","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"SAM 3: Segment anything with concepts","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:0203dc0cefc767d024a9a376401bb9bd6dd8051b3be5e09bee1e730ecf31a777","observation_id":"3b8d06b8-2d47-40d5-b6b2-4b9689b3eb1d","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"End-to-End Object Detection with Transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:8b97e0c395bf2cc5cfe8e9726de8ecb9391e4c99ba0e10746c625b2fe0db1b7b","observation_id":"7187e3b9-ddc3-4f8c-966b-0d46a1ef3084","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"A Low-Shot Object Counting Network With Iterative Prototype Adaptation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:f9a1ff728fbd46b7e54835764c7ac300ede2226f8a72b1ba1e1dfe9d79dca428","observation_id":"6f4d578c-6829-4756-9b9c-976f21f15b24","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Open-World Text-Specified Object Counting","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:f8dddc453b1db9d7d67e527a89f52349e308145d7bce32d69be9b8e891962433","observation_id":"413186cf-90d8-46e5-89e7-f49abe0882c2","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"YOLO-Count: Differentiable object counting for text-to-image generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:744e73493343b2c921c6f91e909f85fda2cc6a7ff4d0c927fa51d6940a5ddfde","observation_id":"23e8355a-2bb2-43cc-941e-6e6c77853fe2","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:61e0b4cadebc8c4beccf0b595c398b4d1dbb4d66792a3a4f1d47d65b7d5caa2c","observation_id":"4629d0ce-d1a1-42f5-972e-d41f5f423404","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"CountSE: Soft exemplar open-set object counting","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:47c7c6491b780ffd407cbd6b6ed5b301403237e7956c3447008e5b67d6910fd7","observation_id":"ed020fda-f622-4682-ad1c-d1739aad766b","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Grounded Language-Image Pre-Training","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:3abb456419d55ca16411af9c0737f9a4e987a1f7199cadc21cae3b9133bfe00b","observation_id":"ba4e0e3b-aa11-4fbc-9f1c-6f74fc09ff3e","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"YOLO-World: Real- time open-vocabulary object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:5babd95abc621ef3e11aa379a2c5586dbac58c7c5962c7e168b8cb39402fb537","observation_id":"fa420fc3-1512-4b8f-85d8-04f38d0046f6","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Grounding DINO: Marrying DINO with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:93cecbe19a3875e8fba9b8b1ff2ffd9ceb1c78930192925e296a9a0f54bbc871","observation_id":"4be3b68e-02e4-4935-8707-558e813dd816","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"YOLOE: Real-time seeing anything","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:161446d80cd5e2ba8f6361a9f37ea6cacb75f8ec8c68b24000bef2a7bb05d4d1","observation_id":"508d78ff-6fb3-4708-a945-2c404eac34d2","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:5ac8142dc67e2e77a996eec338f44c370ddc7e5623ed0abc3e4e1be19103da5e","observation_id":"15e41cbc-a6db-4a63-9415-bb8a1fef83d7","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:687ec9e7821fab3cbd4e1eb049075f3eab8436ac37f29d7369ed88952d8de685","observation_id":"d9af2e24-0bbc-47e5-8c19-9ea49d8e249b","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Redesigning Multi-Scale Neural Network for Crowd Counting.IEEE Trans","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:6429c676c7b7a3856314e20582a2c2cf8150df993f5eefa622c7c8e42b2a124e","observation_id":"994c78b5-a877-45a3-82a0-9cda1a37373d","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"CSRNet: Dilated convolutional neural networks for understanding the highly congested scenes","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:ed363ab95245042dd9f01b05f9534030ee0d54eebd42af5441361cab3472887b","observation_id":"31587b49-fed6-40a2-9f3f-29d62363d540","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Scale Aggregation Network for Accurate and Efficient Crowd Counting","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:d1fa89576ecfcb5b767ab5c17909306a687af5b1775a74b2fa93377bf08d9a68","observation_id":"43d549f5-ee7b-4186-8227-00e798db2901","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Bayesian loss for crowd count estimation with point supervision","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:d0a51577cf73d2cddeb3eae13c5ec3e342ec5fe5dba1cc0eccc78bbe40524984","observation_id":"6ba006a7-16b5-4df6-8793-aa905500f58d","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"CounTR: Transformer-based generalised visual counting","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:f77456942c5d1427f44299fef9216c9d7467f41c4247604809f3f5ba97bf773d","observation_id":"9ba95bc5-fdef-4134-b59c-f851aa2d1700","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Point, Segment and Count: A generalized framework for object counting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:c9080b9a9fb83165c9fab13f76a288c78f176e541dec09c378f5dd84da38ae19","observation_id":"fb98ea10-afdb-4b4b-b1a7-130b0c000aa3","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"DA VE: A detect-and-verify paradigm for low-shot counting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:1172592f410bc546f2f0be1499a63bacf5d52366b4950d44a251513e960d169c","observation_id":"27c0ef15-3c02-4e31-9ad1-17e384a7a9f0","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Open-World Object Counting in Videos","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:de89b5a13dcfcd8c46ac10426a1fe42283cee3368bb68a7b0ca1e54a9bfc7682","observation_id":"3d8180e9-ed43-4047-89d5-182cabc4e506","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"NWPU-Crowd: A large-scale benchmark for crowd counting and localization.IEEE Trans","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:35167a78447cf96dd4341ec665032fd45aa99dad903fbbfc3401397dc3e816e1","observation_id":"5123dd28-3b19-4f34-8ade-b75c222f5da4","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Badhon, Curtis Pozniak, Benoit de Solan, Andreas Hund, Scott C","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:e48589070966cff07099e5f170c193eafdd793be865b5987a672bed1336e913d","observation_id":"ba91e2ed-3eb4-4d55-a254-59cdf5d414de","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"AGAR: A microbial colony dataset for deep learning detection, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:20cdbeae0d2b77da351fc82e5467fbf6c8dc1ca6f864655306d909742de2bbc2","observation_id":"44741175-71e9-4a7d-8004-97cc17e02782","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"OmniCount: Multi-label object counting with semantic-geometric priors","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:adc471b18be863ff2e87eed2e6ef85e5de107a995a1b84d2d5e798c1c1d5ec33","observation_id":"8669e0bc-53e9-461e-a9b1-433300dbb9ae","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"DOTA: A large-scale dataset for object detection in aerial images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:be8c6a1c61c7e3dea3967c6647c72d6c5c40663db100ac4439608088edac60e3","observation_id":"300a3687-5d10-406d-b265-3667f8847a54","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.07856","last_updated":"2018-02-22T00:26:46Z","snapshot_observed_at":"2026-08-07T04:58:32.725069Z","submitted_at":"2018-02-22T00:26:46Z","title":"xView: Objects in Context in Overhead Imagery","version":1},"cited_work":{"arxiv_id":"1802.07856","doi":"10.48550/arxiv.1802.07856","metadata_source":"pith","pith_arxiv_id":"1802.07856","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"xView: Objects in Context in Overhead Imagery","venue":"cs.CV","work_id":"68129a93-f9be-4e6c-b9b9-d3a4c258d2ed","year":2018},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"cited_paper":"/paper/1802.07856","citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:0bb68c42e211e10845ef65a07db0199143045822716716f00bd8e2b245c37719","observation_id":"23a9e17b-6e07-461b-8668-0c6a1b98ba71","resolution":{"observed_at":"2026-06-28T23:02:46.008990Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"The Cityscapes Dataset for Semantic Urban Scene Understanding","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:36d13ac577b596929af60f8b29fdcdab9c5408603cbce542aa31379b069150e8","observation_id":"d6bdd6c4-ce76-4c58-8dd8-f54ea06c09b6","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Jackson, Nabeel Khalid, Nicola Bevan, Timothy Dale, Andreas Dengel, Sheraz Ahmed, Johan Trygg, and Rickard Sjögren","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:d56ab8878aa6ac99b9a0159ca78c34816ea25b81607cc7915fe638bb964f4162","observation_id":"1147b502-7b45-441e-b7f8-209025241923","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"SoybeanNet: Transformer-based convolutional neural network for soybean pod counting from unmanned aerial vehicle (UA V) images.Comput","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:0c2eb8fd24d00929ca14e94d2908ee04f4f45145aa2d656f31379398ab2bb305","observation_id":"5232632a-9ca6-4de8-a8c3-4447aa11800e","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Learning Transferable Visual Models From Natural Language Supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:4f572cb8dc2ccdc87a8847e6d88dd48dae5e35d137678db0f66e8d566f322fc4","observation_id":"942c71d5-a1d9-453e-855e-62164b0f8771","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Berg, Wan-Yen Lo, Piotr Dollár, and Ross Girshick","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:15527a1821cf5d7fb24234d22473a0f13328d2662f652ccfa5109301c1128820","observation_id":"3ce50b1f-9224-4898-8dcb-9deee3bfeb7f","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"MedMNIST v2: A large-scale lightweight benchmark for 2D and 3D biomedical image classification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:31aba08790c0af2568977a85548ca9f5218a9cc7bc1a14c23949c95d8a1a406b","observation_id":"3f380b06-c22c-4986-87b2-bbda98ae15a9","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Landman, Geert Litjens, Bjoern Menze, Olaf Ronneberger, Ronald M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:69e23796fdad5945fc553c013ace359216cb6fca3df19dbbdd21ea61ed42fe31","observation_id":"1636098d-d0d7-4390-84d8-086bf5388de0","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"MSeg: A composite dataset for multi-domain semantic segmentation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:0edad86ab409939891f23c88363dc0b07066c17e59274573f9108a0cdb7832de","observation_id":"9dfbe512-ec2d-4c75-96b0-d0d1baee79fb","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"BigDetection: A large-scale benchmark for improved object detector pre-training","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:797767f1b692f6d6d366c76e13f9e6c5a2712c10d0d59a31791733a15800bfef","observation_id":"fb6970d8-a9a1-4283-9df3-74019330176e","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"rebar counting dataset","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:e2de2c416e5d409a8a608273d892cbfbe7521a8bb699592a53cd5828eb027c3f","observation_id":"0de2e9d9-9047-4057-ab94-37eff643b9ba","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:7c959b8c002c16bd516ec09e22880e431f0ca5cfc12be73aa2458864f1efec99","observation_id":"6621be59-1d3b-4f82-b2d2-3564d0621f97","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Object Detection in Optical Remote Sensing Images: A survey and a new benchmark.ISPRS J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:408d69c029cb18874ead5b5e950af9a9a0b9b3285af43af7c5abffe38df9cd92","observation_id":"9e12f41d-71e0-4df0-9036-4d5429d63b49","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Object Detection in Aerial Images: A large-scale benchmark and challenges.IEEE Trans","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:34c4fa6b51e7e98731858201915dc45cef9894d4a12f72ed7c3e256b0e9a7b4a","observation_id":"01084f7b-c8c2-407a-8dd8-017f1d0f95a3","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Learning RoI Transformer for Oriented Object Detection in Aerial Images","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:414cde3ed620f8c6a48107867e5a729af2f4e097c0f2cb509822a9cd520a0fb8","observation_id":"5069f87a-521c-4430-bc05-74cd9d22b34f","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Detection, Tracking, and Counting Meets Drones in Crowds: A benchmark","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:14d63e536b525a8177170a3b5d730fee119f6f4066382451dbee7247876c842b","observation_id":"3e6d0095-a388-4eda-acd5-7274e0bc0ecb","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"NWPU-MOC: A benchmark for fine-grained multicategory object counting in aerial images.IEEE Trans","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:ad38d2b0b5874e24eb662d39eb2ecb1f6644a972f2ba3098253902a9812a509c","observation_id":"01711227-aaac-4ad6-a3f1-df4d5678a4d1","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Multi-Class Geospatial Object Detection and Geographic Image Classification Based on Collection of Part Detectors.ISPRS J","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:b1ccb497e1a6603e05c08e0bcc91b35dfc1cad9f12a0e404c759629772babebc","observation_id":"189bac5c-8965-4eec-98c8-7d52c2ec8789","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"A Survey on Object Detection in Optical Remote Sensing Images.ISPRS J","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:4ccabe7f153845406b5e83ac7cec6688947d4a26fef859093af5e25b56591794","observation_id":"bd9436ac-ffbb-486f-add8-0570034495dd","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Learning Rotation-Invariant Convolutional Neural Networks for Object Detection in VHR Optical Remote Sensing Images.IEEE Trans","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:faf291f5e9ad9c5b710ed54ee91b312ad128a83d2e937c2fca8415cadb3730ae","observation_id":"8a51d06c-059e-4a0a-956b-023072611f4c","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Accurate Object Localization in Remote Sensing Images Based on Convolutional Neural Networks.IEEE Trans","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:85826df99e49e761fbcd2b6c5e5a7b04729dbd77dd65bd958708a7fce45cfc08","observation_id":"65e7db35-1ff0-4a37-a63d-03ba16d8f933","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Elliptic Fourier Transformation-Based Histograms of Oriented Gradients for Rotationally Invariant Object Detection in Remote-Sensing Images.Int","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:9cb7ab02f0a240a89f6278a8458c35dd318a4c28c415740194a627d727db20db","observation_id":"5be07e47-3077-4411-980b-46ed22b71a16","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04014","last_updated":"2025-02-06T12:16:22Z","snapshot_observed_at":"2026-08-09T18:22:00.494578Z","submitted_at":"2025-02-06T12:16:22Z","title":"Enhancing people localisation in drone imagery for better crowd management by utilising every pixel in high-resolution images","version":1},"cited_work":{"arxiv_id":"2502.04014","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04014","snapshot_observed_at":"2026-06-28T23:02:46.003582Z","title":"Enhancing People Localisation in Drone Imagery for Better Crowd Management by Utilising Every Pixel in High-Resolution Images.arXiv preprint arXiv:2502.04014, 2025","venue":null,"work_id":"ff7f98ed-1448-4dab-be73-3fe4b047cd03","year":2025},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"cited_paper":"/paper/2502.04014","citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:32c327cb1d994ea1a7182dbcbab3f6d42c9365f0e04d974bf31396d71818eee9","observation_id":"a93b901a-c493-43a8-b504-50a7ca2b85df","resolution":{"observed_at":"2026-06-28T23:02:46.005364Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"CoNIC Challenge: Pushing the frontiers of nuclear detection, segmentation, classification and counting.Med","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:1dc812effa83a5ce1e3286578060428d083031cefa3566704b6498a13fb6c45d","observation_id":"0383390d-2021-4c3c-9895-3a206b2dd435","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"EndoNuke: Nuclei detection dataset for estrogen and progesterone stained IHC endometrium scans.Data, 7(6):75, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:e884c6886ed1c0f44560be64197b81019f5a783cd2d9fc12bbaca5ef78046050","observation_id":"289dae04-9c41-4edd-9be4-35dcce3d1bc2","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Lizard: A large-scale dataset for colonic nuclear instance segmentation and classification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:48de04906b8ea052c6b46a2b87864004ed485ad4f7f11e4bcfecdfbf77cf3a22","observation_id":"7b2c7590-ba56-4308-8bf2-e8129c19f25c","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"A Multi-Organ Nucleus Segmentation Challenge.IEEE Trans","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:fc1603fbc3d95f54da6ff339f93e7af0592ea9356ace17527f50de37042f92cb","observation_id":"d3a05912-5813-45f6-84f0-2c51225f8ff6","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Atteya, Hagar Hussein, Kareem Hosny Mohammed, Ehab Hafiz, Maha A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:acc34d1e754dffa212079fd1fa1b07cac0d7557e469d2ac40ee6438bdaf607f1","observation_id":"bfbcf1e4-7cd1-4cc5-9f35-c7d48862ae8c","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.03072","last_updated":"2022-11-06T10:03:04Z","snapshot_observed_at":"2026-07-06T14:14:57.954649Z","submitted_at":"2022-11-06T10:03:04Z","title":"BriFiSeg: a deep learning-based method for semantic and instance segmentation of nuclei in brightfield images","version":1},"cited_work":{"arxiv_id":"2211.03072","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.03072","snapshot_observed_at":"2026-06-28T23:02:45.997582Z","title":"Lambert, and Bachir El Debs","venue":null,"work_id":"8b8e8e50-72b3-4980-bb46-f61650729cbd","year":2022},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"cited_paper":"/paper/2211.03072","citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:d32dedee7e463f9b031c8964f83a55c098ff777fccefaa75e5576cb423ce311c","observation_id":"d02d7a0e-f518-4898-ab3f-36f0296d8b40","resolution":{"observed_at":"2026-06-28T23:02:45.999375Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Learning To Count Objects in Images","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:92c9166e8972502bc52db3152eb4303882d07d030657399b703ded600c252146","observation_id":"0f876542-169f-44b6-81f6-78cddfe5660e","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Laine, Pedro M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:5167e31ed71514cbe9b861ff11a1a04eb036dee7dd44f855c39b218dfaa49ed1","observation_id":"b0919e59-4a8f-497d-b07d-b6a62c9b4c7f","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:2674a00c2594d18d182c8641d836dc28dc8bec8acef4405a668586ddf2f052df","observation_id":"1c5d6774-6ccd-4209-8046-d7ac6fc3ace4","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3383.0611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:46.001837Z","title":"people’s heads","venue":null,"work_id":"a38a8574-1d4c-42e5-86ba-f921ffe73eef","year":2026},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:25df5e861cd54df58778bb8acb8ce4eb603514573479d3b28860f25d868b7d2a","observation_id":"05bbedf0-488e-41b7-a654-fa396fc8df9d","resolution":{"observed_at":"2026-06-28T23:02:46.003533Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Some source datasets adopt standard COCO-style JSON annotations, such as Objects365-2020, FSCD-LVIS, and LIVECell","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:5dbb88f63df7b4b6124fde70360554a713598e327721f333f17420b1c645cf23","observation_id":"89b7ce42-a51b-40c0-a634-9b2eb5464713","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"VOC-style datasets use XML files to record the target category, bounding box, difficult flag, and related fields for each image","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:a7de8045f66829271c1542d238a6d39d2d38af3d4c92c3d52f6b5af5bd62d53c","observation_id":"03538ef8-8d7f-4d8f-bd95-e1fe6fb075ea","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"35439\": {","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:e26997266d94e99043107c659a35c9511fa9fdd15422d872bb7ee6f5087281e1","observation_id":"a8f73e8b-9396-4e86-9191-ea011c1ba80c","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Public datasets often adopt different naming conventions, such as differences in capitalization, singular/plural forms, spaces, underscores, and special characters","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:336d56bc2e68375d261bfbc4b2ba10d21f9d711de4027a87d19e631ef4abb696","observation_id":"9af3dd56-38c4-4565-beba-34ef26e517ec","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"one instance, one count","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:d75a53543edf4b2319bc5818fbc0b4e63dcea0d20228fe93fbfd21bb38bf954c","observation_id":"2f890884-7841-4bed-a439-0e9e291b3cf3","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"For category consolidation in a multi-source dataset, it is not appropriate to simply promote all subclasses to their parent class","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:6eec4b397a3edd010d155f13d5492f2d45b1f20f55760cf89feedb9a5ea09921","observation_id":"8fd56a71-b145-42b5-a32d-fe23ecfd3fa2","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T23:02:05.250519Z","title":"Since the dataset covers multiple visual domains, image resolutions vary substantially across data sources","venue":null,"work_id":null,"year":2048},"citing_paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-06-28T23:02:05.250519Z"},"links":{"citing_paper":"/paper/2605.30846"},"observation_digest":"sha256:df42a37b71c5629e9ed3f41006a1d3672698ab0aeca7b1458c2daf4fd2455a6b","observation_id":"2058c412-b5d3-4b52-9566-05c255a45aa4","resolution":{"observed_at":"2026-06-28T23:02:05.250519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.30846","last_updated":"2026-05-29T05:08:31Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T05:08:31Z","title":"Count Anything"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":94,"verified_exact":5,"verified_fuzzy":0},"total_outbound_references":105},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 105 outbound references and 0 inbound Pith citation observations for arXiv:2605.30846."}