{"as_of":"2026-08-16T22:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6a65d5bbfb1348192a958ad0c54ce76c7f898bde423e84ba10861f03256c687f","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:57:13.222445Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.04120/citation-record","integrity":"/paper/2508.04120/integrity","json":"/paper/2508.04120/citation-record.json","paper":"/paper/2508.04120"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.254857Z","title":"Multi-class vehicle detection using vdnet in heterogeneous traffic,","venue":null,"work_id":"780c66cb-1714-48bd-8fb5-96361afd892c","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.231412Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:db3d013ed6dc231df1c34d1cee491dae3fb6486f54769730196b40e85fad545e","observation_id":"77e4c71b-78a2-4ae5-89ff-79bea1c3333b","resolution":{"observed_at":"2026-08-06T00:57:15.259251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.239495Z","title":"A review of vehicle detection techniques for intelligent vehicles,","venue":null,"work_id":"338782bc-2ee7-4157-a92f-0921b44b45cb","year":2022},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.237405Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:ce4dc47b0f7d0117763843d95e318a785a3f010c85bc7255735d37744725f23a","observation_id":"a5f2a1c5-e8e1-48d9-96d5-08c0c0318e71","resolution":{"observed_at":"2026-08-06T00:57:15.244004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.224084Z","title":"Scale region recognition network for object counting in intelligent transportation system,","venue":null,"work_id":"40f0d008-128f-4b0e-b77f-7e2a66b628e1","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.243089Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:c2a18527278e8a66b6b9762802cdce9d90ba3e98d98f16a78f8b8704831964b4","observation_id":"86293777-3d39-472c-9a8c-d561f6c9fbcf","resolution":{"observed_at":"2026-08-06T00:57:15.229107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.208308Z","title":"Nwpu-moc: A benchmark for fine-grained multi-category object counting in aerial images,","venue":null,"work_id":"d27df358-056a-42b3-9059-1b955fb4819d","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.249271Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:6e1dba2a840f5e5cb9a952bc13c9da5bead593f8681f3d63e95d219bfef53fb0","observation_id":"8fbe0ba8-6292-40ab-a15e-9189c8f4465b","resolution":{"observed_at":"2026-08-06T00:57:15.212869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.192868Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers,","venue":null,"work_id":"019c7baa-ea4b-4475-8cea-3ae5c0521d26","year":2022},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.254777Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:89f6835b2c18cda47502b483b3e2e4d8791fc73d919b7a5744c1e7612995fddc","observation_id":"b75fee5b-fb9f-4128-a997-fcb22288b6fe","resolution":{"observed_at":"2026-08-06T00:57:15.197444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.177279Z","title":"Mutr3d: A multi- camera tracking framework via 3d-to-2d queries,","venue":null,"work_id":"01406bf6-74b1-428a-89b9-adda155c7ca5","year":2022},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.260146Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:b92e1ff23c239669c0bad5fa8aca9dffbc0b7310b40cf04015dabe6416f692b2","observation_id":"efea91c0-814a-4e69-9b7f-847f67c078fd","resolution":{"observed_at":"2026-08-06T00:57:15.181633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.162325Z","title":"Multimodality adaptive transformer and mutual learning for unsupervised domain adaptation vehicle re-identification,","venue":null,"work_id":"529578ad-6bb4-4469-bae1-707d7799d1e0","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.266277Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:0f3b43aa39088a1a0437a165e8845adf201478b6c5ddf0c9488699386f37a9fa","observation_id":"5544eb78-ec15-4ec9-ac74-7265e75d4cd5","resolution":{"observed_at":"2026-08-06T00:57:15.166860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10643","last_updated":"2024-01-19T11:45:10Z","snapshot_observed_at":"2026-08-16T14:26:11.389151Z","submitted_at":"2024-01-19T11:45:10Z","title":"A Comprehensive Survey on Deep-Learning-based Vehicle Re-Identification: Models, Data Sets and Challenges","version":1},"cited_work":{"arxiv_id":"2401.10643","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.10643","snapshot_observed_at":"2026-08-06T00:57:13.487930Z","title":"A Comprehensive Survey on Deep-Learning-based Vehicle Re-Identification: Models, Data Sets and Challenges","venue":"cs.CV","work_id":"2cdf9e1b-bf68-41e8-87c3-ed32e9f5c476","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.271161Z"},"links":{"cited_paper":"/paper/2401.10643","citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:22c0358e2a783402f8378a8a8c0606e944e4c958fe4b8f0f33a8b59f474d3366","observation_id":"e54d93aa-003e-43c0-8d9b-5175f3a372ca","resolution":{"observed_at":"2026-08-06T00:57:13.538232Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.146933Z","title":"Day-night cross-domain vehicle re-identification,","venue":null,"work_id":"c5f875f7-ca89-40e4-9038-36790eb0b4af","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.276441Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:eab60bb3488418509fa0bc90e0b7c8f11ab3cbb71b524863a52d415868111a38","observation_id":"fa194961-c767-45ea-a743-c169f1ad58f8","resolution":{"observed_at":"2026-08-06T00:57:15.152083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.130864Z","title":"Beyond human-level license plate super-resolution with progressive vehicle search and domain priori gan,","venue":null,"work_id":"794aaecc-3a50-47a7-be6b-a9c62a818c18","year":2017},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.281282Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:e36095841d629a3e65ceaeefe8254e7dd69056ef026371275fc83aae80154ca6","observation_id":"d1321cbc-305f-4fc1-9c7b-e3c2575e812e","resolution":{"observed_at":"2026-08-06T00:57:15.135935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.114098Z","title":"Pvss: A progressive vehicle search system for video surveillance networks,","venue":null,"work_id":"bf469362-8e5d-4659-a5f8-49f071a2a6c2","year":2019},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.286014Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:7b3c41d40dc01d2d9783ed49c4fc9ece7290e7c923d7d4dc42ae878a9da41b84","observation_id":"9e7599fe-a474-4501-af89-38618e0f96ac","resolution":{"observed_at":"2026-08-06T00:57:15.118946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.092469Z","title":"Person search by a bi-directional task-consistent learning model,","venue":null,"work_id":"630fc9be-2079-4fad-9e77-f1ad7200f733","year":2022},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.290655Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:7173f632b92bf9a0d959c0390ae91f9280f646955b74419f006493b22c632d65","observation_id":"84dfc2eb-2fb9-4a0c-a4d5-b031356ae5a9","resolution":{"observed_at":"2026-08-06T00:57:15.097224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.077351Z","title":"Person search challenges and solutions: A survey,","venue":null,"work_id":"b2b8b2df-7bba-4ff4-a415-e8b8524d852f","year":2021},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.295492Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:e8ca7fe44fa8704be3a306f4c196f8099aad029ac59b5b226df7a52fbe1960c5","observation_id":"2b506f3b-cf34-4e65-b276-020ae311342d","resolution":{"observed_at":"2026-08-06T00:57:15.081793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.062763Z","title":"Transg: transformer-based skeleton graph pro- totype contrastive learning with structure-trajectory prompted recon- struction for person re-identification,","venue":null,"work_id":"4c43e0dd-2f9c-4c1a-8542-e8a0d6523a4f","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.300184Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:8d56b9a71cf74be7a1566d7ee1331db88b6a6deae5f4aa99ebb636ff7b28522e","observation_id":"72f0277c-5dc1-494c-ae9b-83660e8c34fd","resolution":{"observed_at":"2026-08-06T00:57:15.067452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11165","last_updated":"2022-11-21T03:38:18Z","snapshot_observed_at":"2026-08-16T16:14:40.833468Z","submitted_at":"2022-11-21T03:38:18Z","title":"A Benchmark of Video-Based Clothes-Changing Person Re-Identification","version":1},"cited_work":{"arxiv_id":"2211.11165","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.11165","snapshot_observed_at":"2026-08-06T00:57:13.349846Z","title":"A Benchmark of Video-Based Clothes-Changing Person Re-Identification","venue":"cs.CV","work_id":"bf9699f7-dfe8-4e2a-81fe-32aa8a51024b","year":2022},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.304884Z"},"links":{"cited_paper":"/paper/2211.11165","citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:2828e81a4bd2372bc22d09e604014a3d2b16429b4d6f91e4b0435c1bfbe4cd19","observation_id":"c1570e1a-936a-4d08-ac0d-9f21c1080516","resolution":{"observed_at":"2026-08-06T00:57:13.407912Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.046548Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"67060b58-facb-4a99-a447-25fcf7bf4996","year":2021},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.310012Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:f1a29fe5e8425dd82369a56d12dba71c866523d5b3b1237c26d7cb79e2c76ac2","observation_id":"b3adc782-d87d-4874-b298-2d77375fd75e","resolution":{"observed_at":"2026-08-06T00:57:15.051778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:11.314736Z","title":"Learning to prompt for vision- language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.314736Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:a97022173d6a66360d9b0cbf8c2ffd7419f23729662d1eba6f9b62dcb888f1b1","observation_id":"b3e75e7c-0035-40d2-8787-d431a696675e","resolution":{"observed_at":"2026-08-06T00:57:11.314736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.019369Z","title":"Ensemblenet: A hybrid approach for vehicle detection and estimation of traffic density based on faster r-cnn and yolo models,","venue":null,"work_id":"61eb9772-aa0d-4e53-8d98-2cef8e6227ff","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.319484Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:6d983f71412a2f561a86c09e9f60e04ea6a3ab59b964b297bdbb1771d0a88127","observation_id":"dbe27b34-1781-4cff-9dbc-df301aecb3aa","resolution":{"observed_at":"2026-08-06T00:57:15.024212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:15.004070Z","title":"Robust and scalable vehicle re-identification via self-supervision,","venue":null,"work_id":"958d12f9-808b-40a7-bfea-1e5699eb3a42","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.325454Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:5bfe35604ac6843b8829e8d73c370dc639fb6b1bbfed67c2c52cc9ae43103bc1","observation_id":"d0fef22e-386b-4f42-b72d-ecbea8c1991b","resolution":{"observed_at":"2026-08-06T00:57:15.008888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.987875Z","title":"Influence of avc and hevc compression on detection of vehicles through faster r-cnn,","venue":null,"work_id":"4c27c6b0-bac9-494b-a08c-52041a4deadb","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.330772Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:8205aa7861742ab359c37126e4dddbc2fa09edb33e1c04b06f23cfb1cd182d90","observation_id":"046eda77-18f5-4b95-90bc-b81264651b1b","resolution":{"observed_at":"2026-08-06T00:57:14.992565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.973175Z","title":"Smart traffic management of vehicles using faster r-cnn based deep learning method,","venue":null,"work_id":"b35ed6e8-8e0e-4c24-a454-c3e97df53b5e","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.335880Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:7295c512c184626b837a114523f523faf7904c4f3ed4c6ed20ecf62a80573562","observation_id":"8d39570c-010f-4854-94ff-5ec06b1385ba","resolution":{"observed_at":"2026-08-06T00:57:14.977540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.958575Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks,","venue":null,"work_id":"47304c35-b698-4dd8-81f1-7fc39d1f9a86","year":2016},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.341060Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:89c4d8b90ec253ddc605a93c22535e05758c16e8f895e4f8b39bacba0ba01c3b","observation_id":"ab42f317-37c6-4f1a-9862-0cb8db617d6d","resolution":{"observed_at":"2026-08-06T00:57:14.963220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.943839Z","title":"Yolo-fa: Type-1 fuzzy attention based yolo detector for vehicle detection,","venue":null,"work_id":"86cff389-0f9b-4b00-99fe-cd91c3170733","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.346631Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:98548bc79f3426a2fd0ade6d4fb675cbdb91a5e2dadb6f601cbbcb1e1332cc62","observation_id":"c23d4ee3-2045-46c5-8e3d-bed96f631a6d","resolution":{"observed_at":"2026-08-06T00:57:14.948397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.928858Z","title":"Lvd-yolo: An efficient lightweight vehicle detection model for intelligent transportation systems,","venue":null,"work_id":"360a3d5a-e5f7-40f4-b9e6-72d22d813d92","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.351528Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:170fcb8a9cb54b911f2ea52098643237818accf23891c7bd68c4a3faa0d75ac9","observation_id":"886a2f04-fa0d-4582-84d0-405dc86c09e3","resolution":{"observed_at":"2026-08-06T00:57:14.933696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.912414Z","title":"You only look once: Unified, real-time object detection,","venue":null,"work_id":"9e7a2d0f-fa57-4d22-b909-120dbaf3e278","year":2016},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.356796Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:83d44b47fa5d12dae0935aff3c4b38cfdec9c284f99b12cb80f9c80a008b2fea","observation_id":"c26567ea-e1d9-467a-a7f4-39f0c0934f6f","resolution":{"observed_at":"2026-08-06T00:57:14.917124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.897096Z","title":"Ssd: Single shot multibox detector,","venue":null,"work_id":"0ba58ebc-3125-4f47-9356-6cd01c57002c","year":2016},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.361629Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:ac6c7189b89ed4be50f3a456adbf69e8cde2c0b6567744261c810e0a1fceed7a","observation_id":"e16c4558-b771-4354-9be6-31e77004e983","resolution":{"observed_at":"2026-08-06T00:57:14.902053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.882865Z","title":"Large-scale vehicle re-identification in urban surveillance videos,","venue":null,"work_id":"7cfe0c3f-7617-419f-ae0a-98fe80f91772","year":2016},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.367688Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:5651a5fa1efa1114f1de36c5661ed0b96ef2eae33d13e51cf7e1f81c00774a90","observation_id":"5ec42d5c-7e47-4754-9ce1-7f9c5679aa78","resolution":{"observed_at":"2026-08-06T00:57:14.887252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.867973Z","title":"Veri-wild: A large dataset and a new method for vehicle re-identification in the wild,","venue":null,"work_id":"e45ad5a1-8925-4acf-a8cb-7322bceb8d75","year":2019},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.372751Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:28c5017a9a549d75bbb11ad4634ddeae4f796771a129e317f3e8b54fff815462","observation_id":"55d996b4-a3df-48de-9685-b2c8cbd80f4c","resolution":{"observed_at":"2026-08-06T00:57:14.872638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.852873Z","title":"Learning coarse- to-fine structured feature embedding for vehicle re-identification,","venue":null,"work_id":"ff2221f3-d073-4666-bafd-636a75b529a1","year":2018},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.379612Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:b5869011d6bb10f2e438c2c82882eb71a8e82d55f08f5cd50de09f4ad2d9df94","observation_id":"660c0d1b-b769-4deb-afc6-7a043a229665","resolution":{"observed_at":"2026-08-06T00:57:14.857461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.838881Z","title":"Global-local discrimi- native representation learning network for viewpoint-aware vehicle re- identification in intelligent transportation,","venue":null,"work_id":"666bfb89-6056-44d6-b773-ca3a4acf9805","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.390589Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:2ae261523f0cc5f60c88f7fd6d90a50207195d905a9b0e71ef98dc0aa62a349a","observation_id":"2a224269-b579-448a-8da3-379cf9d3549f","resolution":{"observed_at":"2026-08-06T00:57:14.843269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.823600Z","title":"Hetero- geneous context interaction network for vehicle re-identification,","venue":null,"work_id":"9617e8aa-69fd-4b93-8565-644b074089cd","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.397449Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:7e28e1d5d15c94082103c3c33278292869e68d55014e65c2ea9e79562c0998c1","observation_id":"74773ea3-5f76-4a9a-b644-d91fb800088b","resolution":{"observed_at":"2026-08-06T00:57:14.827988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.808814Z","title":"Relation preserving triplet mining for stabilising the triplet loss in re-identification systems,","venue":null,"work_id":"0b67875d-d34f-43ff-ab74-09866e46e681","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.405481Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:7a40046afa52d1b8215423137eebf365443fd530298ca774794a66361d5993ff","observation_id":"2afb7192-eb57-4597-94ac-98621092ea5a","resolution":{"observed_at":"2026-08-06T00:57:14.813399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.794430Z","title":"Camera-aware differentiated clustering with focal contrastive learning for unsupervised vehicle re- identification,","venue":null,"work_id":"d4a92c0f-6b57-4802-85cf-f5e9d06d8d8b","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.417208Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:d8b75c93c752e7fdbf044f05fd762e2e69ef236e71a3e3b37ee6399996c3d2b3","observation_id":"92e3fab0-d349-4d32-bc5f-c8c3d1c083b5","resolution":{"observed_at":"2026-08-06T00:57:14.798836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.778938Z","title":"A shortly and densely connected convolutional neural network for vehicle re- identification,","venue":null,"work_id":"a5b141d0-30e9-4948-9851-0acf38bcc378","year":2018},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.431015Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:2a09c47c63fb28fdad2d43ba15c6d249c14914bab299a4f47b2893bb37333d73","observation_id":"84317f50-feb0-4d6a-9f8f-89ffed4c8df4","resolution":{"observed_at":"2026-08-06T00:57:14.784365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.764726Z","title":"Vehiclenet: Learning robust visual representation for vehicle re-identification,","venue":null,"work_id":"1715266f-f23f-4199-a647-4856e9336c55","year":2020},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.445183Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:4e9dc0e8f17adcf286bb184551141e7e52bf1d50a041d31bd0eb405577d0812e","observation_id":"9a720068-1310-4e1f-89c1-68abe1f783ac","resolution":{"observed_at":"2026-08-06T00:57:14.768925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.750393Z","title":"Vehicle re-identification based on keypoint segmentation of original image,","venue":null,"work_id":"4236898c-ea2f-4739-8354-548b25f68866","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.454943Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:13d8dd9b0f20747d8d94361ba2524ac5cbfe15bf4de02a7927ea5836fdf17601","observation_id":"c6e9c83a-2e7e-4443-a840-fa92b572b46f","resolution":{"observed_at":"2026-08-06T00:57:14.755275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.735779Z","title":"Git: Graph interactive transformer for vehicle re-identification,","venue":null,"work_id":"566c2d83-8971-47b8-bc23-4cbe4a56184e","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.464654Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:1b72b505fae7dc4d8d996d25d0c637377278f6d3f910d3f3c90af86a1d036886","observation_id":"5f084a48-d610-4031-82c3-bb5cf7e4bd8d","resolution":{"observed_at":"2026-08-06T00:57:14.740685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.721215Z","title":"Weakly supervised contrastive learning for unsupervised vehicle reidentification,","venue":null,"work_id":"7c496a35-8b1f-4666-ac62-789a80571da0","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.473754Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:eb1ed9eadfc5516c2b07a202d462485200af602ce2b587eb8a4bbf79110f0b9e","observation_id":"527c14fa-0821-48cf-a5da-9ea4ddfa8552","resolution":{"observed_at":"2026-08-06T00:57:14.725824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.706188Z","title":"A benchmark for vehicle re-identification in mixed visible and infrared domains,","venue":null,"work_id":"cf8890ef-b3c5-41c9-a041-8ff0a02e1c9d","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.487446Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:af9507a9254ca08cb530f8bd8d93bb012d806bb9e093a06fb8f04e7e64d0efd5","observation_id":"2f26efeb-314d-4c28-b5da-a0f3c1803d6b","resolution":{"observed_at":"2026-08-06T00:57:14.711242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.690934Z","title":"Attribute-based vehicle search in crowded surveillance videos,","venue":null,"work_id":"f7a835ce-b92a-4df9-b147-cd0a4ff71ed7","year":2011},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.497528Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:95576a1e22f401c06cae7dcb8c61ee5d0c96c22c1a5da086194f2fb56a8ed890","observation_id":"f2c8b5e4-2b86-43d3-bda0-7375fc9e50be","resolution":{"observed_at":"2026-08-06T00:57:14.695377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.676095Z","title":"Sbnet: Segmentation-based network for natural language-based vehicle search,","venue":null,"work_id":"3fdaee42-ec7e-4c11-9b82-4990a2493220","year":2021},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.509169Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:ca74aab3c13a53bd979c596c3a84bdd0ec94202c859d7990e5d0ecfb242af2c7","observation_id":"0c868741-1083-4149-b323-9b4f8369c98e","resolution":{"observed_at":"2026-08-06T00:57:14.680723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.661950Z","title":"Towards effective person search with deep learning: A survey from systematic perspective,","venue":null,"work_id":"4d9c8552-ebf4-48be-8932-bbbf7f2e3ba0","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.520822Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:5cce8f1455f46feee915f613fbd83feaa8878357605688d9a24d149e3a77f8ec","observation_id":"0b9d8d6b-4e7e-4213-b66a-6dc691b6a2fa","resolution":{"observed_at":"2026-08-06T00:57:14.666490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.648010Z","title":"Person search in a scene by jointly modeling people commonness and person uniqueness,","venue":null,"work_id":"b7378c31-029f-4d60-a9dc-1c77881f85dd","year":2014},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.530252Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:910b33fec42fe40d0f36363ce25fc97da429098448a29103e145e6293403a782","observation_id":"2ece48c2-d9f1-4bba-9b63-42ecaaf6f4fe","resolution":{"observed_at":"2026-08-06T00:57:14.652478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.634119Z","title":"Joint detection and identification feature learning for person search,","venue":null,"work_id":"7a8607f5-2d64-4129-a38d-094e77b46c43","year":2017},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.540302Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:9d60c2bba2783bee8d2747881edd806993c1c107153a530399268fd384330c5f","observation_id":"3cbc43af-75e5-4dc2-847a-231a584f69dd","resolution":{"observed_at":"2026-08-06T00:57:14.638484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.619770Z","title":"Person re-identification in the wild,","venue":null,"work_id":"6b2f38bf-b66a-4a6f-8219-98da0f509aac","year":2017},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.574038Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:23f174f8eecdb21bfe014f844ab5dd5df3c1aaf2f68c79235789be78ea02565c","observation_id":"ae511454-1de9-42c4-9932-46cd173d5897","resolution":{"observed_at":"2026-08-06T00:57:14.623974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.605647Z","title":"Tcts: A task- consistent two-stage framework for person search,","venue":null,"work_id":"0e572e25-8928-4757-9edb-7bdf180d8f43","year":2020},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.634015Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:c7d6ba4ba43293e2d5e2e466ff23af1539568197a9327cd3d4066c30edffc760","observation_id":"fa657e1d-4fe7-4a98-b916-41ef37295fb1","resolution":{"observed_at":"2026-08-06T00:57:14.609854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.591775Z","title":"Norm-aware embedding for efficient person search and tracking,","venue":null,"work_id":"f00ced81-89bd-4002-ab7b-46f3f2c4810b","year":2021},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.722226Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:1a0cc65c94ab61c2a859a73d194fca064414b2ab9cef0c90cfd5987280a7b871","observation_id":"ff18fa69-ff5a-4f3f-a211-a10f0ce3a432","resolution":{"observed_at":"2026-08-06T00:57:14.596083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.577144Z","title":"Bi-directional interaction network for person search,","venue":null,"work_id":"c8806210-2a2b-4a03-9c1e-1fd6c6687c56","year":2020},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.805568Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:92f336ad62a974875f95a9030ca4b4709797657524ad296b7bb2cddc5b15a246","observation_id":"ab1fdd2b-7b1a-4a35-b9f2-413a463a130f","resolution":{"observed_at":"2026-08-06T00:57:14.581520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.562722Z","title":"Sequential end-to-end network for efficient person search,","venue":null,"work_id":"5934cdf9-f889-4e4e-be4b-1032d233baef","year":2021},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:11.901556Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:10657abb7c16bfaf46d33aad532e32d28e92c262e1c55ce3e7e7455878810a4f","observation_id":"b48b4c75-dc1a-4c62-a894-0d9a7b07d8e0","resolution":{"observed_at":"2026-08-06T00:57:14.567082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.547588Z","title":"Joint discriminative representation learning for end-to-end person search,","venue":null,"work_id":"cfd291df-fa07-4a59-9db5-01f7a130663a","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:12.001523Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:7efdfa54c19e836e2c17f432af7a9351a3b2d1b37d5185837b7e04ffaba8a154","observation_id":"687bf323-4d0d-41c1-b963-c80c7114af3c","resolution":{"observed_at":"2026-08-06T00:57:14.552458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.533441Z","title":"Cdul: Clip- driven unsupervised learning for multi-label image classification,","venue":null,"work_id":"f8dc2cfd-9d59-49c3-8ccd-b5f331f125a1","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:12.081963Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:056a0133133a69b6f4235568f2b6d301c9957f2a9871b1ee834f146d05df0550","observation_id":"e857fc05-5695-4b79-80b4-ba2b1dcf6e1f","resolution":{"observed_at":"2026-08-06T00:57:14.537546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.517181Z","title":"Ov- track: Open-vocabulary multiple object tracking,","venue":null,"work_id":"222a6a3e-9366-43f7-bcf8-b640539499cb","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:12.202435Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:05299f4d6e8a74f8727746842052d48a9ec8df52b66e51f97b07d09a460f03b0","observation_id":"9e7f4076-c965-48e7-ad6c-7233b650855c","resolution":{"observed_at":"2026-08-06T00:57:14.522520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.501107Z","title":"Zegclip: Towards adapting clip for zero-shot semantic segmentation,","venue":null,"work_id":"06e6a734-3723-4a41-ac2f-041caebe75df","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:12.280512Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:da3f55a17108d56defd01c5bd8be436bde26dcdc8b1c0a00052aa3e05218d411","observation_id":"418d5ac1-c443-4a3f-ad4b-7d636e57d312","resolution":{"observed_at":"2026-08-06T00:57:14.505543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.484722Z","title":"Clip-reid: exploiting vision-language model for image re-identification without concrete text labels,","venue":null,"work_id":"12508ee6-da92-4d62-be1a-8d9cfbc3821c","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:12.354921Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:b2dd66f9f0cb4b2399f123a3006340a5e2ad1649012e4e26cdba91b37aafa0c3","observation_id":"efe659ab-b4ca-495c-a8fd-47f14365d6c6","resolution":{"observed_at":"2026-08-06T00:57:14.490922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.470054Z","title":"Unveiling the power of clip in unsupervised visible-infrared person re-identification,","venue":null,"work_id":"b71c4ad7-135e-47b8-aaab-e7d3da96c3c0","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:12.432667Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:4dae30e29af46a6305b860c3ff152acbd805c9cf0960c2cf9f641104fb6c0e83","observation_id":"7f6a0785-5228-4a00-9579-53d5271e84ef","resolution":{"observed_at":"2026-08-06T00:57:14.474680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.454667Z","title":"Attribute and state guided structural embedding network for vehicle re-identification,","venue":null,"work_id":"b1569ba2-a80a-40a7-8959-80305b21b631","year":2022},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:12.500824Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:c33ee40959a0774543ef7703cd9aad502dfb4dcae0c5a91d81935433bbec9671","observation_id":"d1af4d33-00d2-410e-8c7d-2d0d9fe12cb3","resolution":{"observed_at":"2026-08-06T00:57:14.459769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.439449Z","title":"Aivr- net: Attribute-based invariant visual representation learning for vehicle re-identification,","venue":null,"work_id":"6a24e0ef-f1b2-4d2b-ad7d-1f1546b36d91","year":2024},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:12.569634Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:7f2d72262b0b8bb34e32d8cc60fda0c919cffa3627dabc076471aab47dd4f858","observation_id":"8450882a-ffda-453c-908f-7b37ac5de76b","resolution":{"observed_at":"2026-08-06T00:57:14.444590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-06T00:57:12.665381Z","title":"Distilling the knowledge in a neural network,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:12.665381Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:0732379113da8d9282e17794221bfb1029c5add6fa091221c2a636c0faa30684","observation_id":"593adc5e-ca47-4393-a0db-f00b509cc9a6","resolution":{"observed_at":"2026-08-06T00:57:12.665381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:12.749901Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:12.749901Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:5487b86962ad7a43552c97443381028d8dd957ab988a678fb21874da90e1070e","observation_id":"3e95dc25-0d22-4a86-bc84-e8a8e25e9f97","resolution":{"observed_at":"2026-08-06T00:57:12.749901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.413331Z","title":"Msinet: Twins contrastive search of multi-scale interaction for object reid,","venue":null,"work_id":"0616eb6b-306f-42ad-aa0f-757035626dcd","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:12.839020Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:7db6de6966993c1b7d67f43fc2a2f1607d325e0c438a6162827354d7329b84ad","observation_id":"12e99a3f-f456-4148-8af1-9678d1c112f5","resolution":{"observed_at":"2026-08-06T00:57:14.418054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.319524Z","title":"Strength in diversity: Multi-branch representation learning for vehicle re-identification,","venue":null,"work_id":"6a7c110c-10b0-42a4-8a88-29a8d37b892a","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:12.932532Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:0d8ceb2f0a0fbc9845d2e8e8d088367f12eefebff96642bf3d5d050dfbfab818","observation_id":"95f533f9-0168-477c-b47d-b2007efa9aa9","resolution":{"observed_at":"2026-08-06T00:57:14.400362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:14.160136Z","title":"Cascade transformers for end-to-end person search,","venue":null,"work_id":"3f6e2978-3bbd-486d-a066-9d68f6d2707f","year":2022},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:13.001399Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:d655866ca4bdc5ca1de87c88fbc66c2b7c41048ad6b7b623309ed1fe6bc65e85","observation_id":"2d153c97-42c3-43de-95dc-a5992cfc621e","resolution":{"observed_at":"2026-08-06T00:57:14.224390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:13.947456Z","title":"Oimnet++: Prototypical normalization and localization-aware learning for person search,","venue":null,"work_id":"ef0ec4f8-a919-41fd-a70b-494a0dcf2f8b","year":2022},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:13.073276Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:a3580a2c1f81dfac5b86126450f2f5ec34c4c680a51aefceb1993a694abba146","observation_id":"a715fcba-bb64-4add-94c3-5f9b53874927","resolution":{"observed_at":"2026-08-06T00:57:14.054027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:13.779433Z","title":"Cityflow: A city-scale benchmark for multi-target multi-camera vehicle tracking and re-identification,","venue":null,"work_id":"6ef0e1a5-046c-4abb-a59b-2888dca98c8c","year":2019},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:13.142195Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:f3a9956e0eb8a2ccff409037b598584a22897be49ee32e4c4f15587a98c3ad50","observation_id":"58032fe7-5662-4eb4-a485-049478ab1aff","resolution":{"observed_at":"2026-08-06T00:57:13.834475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:57:13.637330Z","title":"Synthehicle: Multi-vehicle multi-camera tracking in virtual cities,","venue":null,"work_id":"2a91f3c0-dc88-4e80-a300-ff5880a28b34","year":2023},"citing_paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T00:57:13.222445Z"},"links":{"citing_paper":"/paper/2508.04120"},"observation_digest":"sha256:29b9a3c8dbc0849e2ac14b5da0e577058a6837019c8c79bd1c862cb33cf982b4","observation_id":"6fd93566-57bc-443f-bec9-f114d4746531","resolution":{"observed_at":"2026-08-06T00:57:13.691075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.04120","last_updated":"2025-08-06T06:36:44Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T00:57:10.788001Z","submitted_at":"2025-08-06T06:36:44Z","title":"CLIPVehicle: A Unified Framework for Vision-based Vehicle Search"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":2,"verified_fuzzy":60},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2508.04120."}