{"as_of":"2026-08-16T07:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a066b130c29988d30eb454fa85b5b233d998f4e18810492dea0e4686352784d6","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:40:34.320493Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T17:16:38.347066Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T15:15:47.200997Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"cited_work":{"arxiv_id":"2506.07375","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07375","snapshot_observed_at":"2026-07-01T15:15:47.200997Z","title":"Dino-codt: Multi-class collaborative detection and tracking with vision foundation models,","venue":null,"work_id":"1ee98816-06ed-4517-99e7-1dbfd9fcd5cc","year":2025},"citing_paper":{"arxiv_id":"2605.24025","last_updated":"2026-05-20T13:39:48Z","snapshot_observed_at":"2026-08-13T03:19:10.868373Z","submitted_at":"2026-05-20T13:39:48Z","title":"Towards Large Model Feature Coding","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-30T17:16:38.347066Z"},"links":{"cited_paper":"/paper/2506.07375","citing_paper":"/paper/2605.24025"},"observation_digest":"sha256:511d22b69876f1eaebae8f0d070985896d958214bc0ee4b71abace5186b79cb0","observation_id":"0b69c2fe-00b0-4969-9666-6d6c646795f0","resolution":{"observed_at":"2026-07-01T15:15:47.203056Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07375/citation-record","integrity":"/paper/2506.07375/integrity","json":"/paper/2506.07375/citation-record.json","paper":"/paper/2506.07375"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.668287Z","title":"Macim: Multi-agent collaborative implicit mapping,","venue":null,"work_id":"f16c23cb-a21a-4a9d-bed8-aa8144ade6c0","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.211083Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:bec29722988c3ed1aef3bdb0f30e9b8d068ad03425ed21bb1c86371eb1ff97e8","observation_id":"2b5301dd-9456-48e9-9533-b25143c47a6a","resolution":{"observed_at":"2026-08-07T05:40:34.672771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.657340Z","title":"Multi- view robust collaborative localization in high outlier ratio scenes based on semantic features,","venue":null,"work_id":"66f33bd3-e0da-4fda-8975-17d91e9585b9","year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.215096Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:a0fffc7b42c67b7abae98a93e51a042fac846b775e186e17230ba7605e2ab497","observation_id":"6ea01c9b-fe1e-4bf1-82a6-bcc05056754e","resolution":{"observed_at":"2026-08-07T05:40:34.661333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.645722Z","title":"Collaborative 3d object detection for autonomous vehicles via learnable communications,","venue":null,"work_id":"fa9a5a8f-2b54-43fb-b7cd-91a4f83a0460","year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.218896Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:b692355d1ccb978997915f6afd4a71ed838d44120346961d05c78ca275012cc2","observation_id":"46052037-7cb2-4f44-9dac-a65a0e12fe88","resolution":{"observed_at":"2026-08-07T05:40:34.649981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.634499Z","title":"F-cooper: Feature based cooperative perception for autonomous vehicle edge computing system using 3D point clouds,","venue":null,"work_id":"7b4288f0-b1c2-4cb1-95bb-cff0030a7802","year":2019},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.222572Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:03529b4b7aa9e8167b16effe1a2080b99c0115e18d1a4fd963c7209ab2f64143","observation_id":"76cd70cf-ded9-4f96-9fcc-0e36a1eafdd9","resolution":{"observed_at":"2026-08-07T05:40:34.638407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.622512Z","title":"V2x-vit: Vehicle-to-everything cooperative perception with vision transformer,","venue":null,"work_id":"e8c9a23d-bef2-464c-9384-57b1ea478131","year":2022},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.226335Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:7e73e3a15406055e8aa2e1bcb67edba71504306d63a6c1a29aa1b1118f08cf74","observation_id":"61d94fb0-4c2e-467c-9c89-9216a5cba8d6","resolution":{"observed_at":"2026-08-07T05:40:34.626578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.610350Z","title":"Robust collaborative perception against temporal information disturbance,","venue":null,"work_id":"8a6b2e1c-3ff3-47a1-a150-7a24d04b21f7","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.229942Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:4d8e23bd59101011be07ca3b1f771dd69388afb7cb2cc22ad4316ac1f5147b35","observation_id":"196c12cc-7354-4e7d-a49a-819f763f2194","resolution":{"observed_at":"2026-08-07T05:40:34.614498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.598826Z","title":"Opv2v: An open benchmark dataset and fusion pipeline for perception with vehicle-to- vehicle communication,","venue":null,"work_id":"6719d996-ad41-47d3-b558-7067943f4663","year":2022},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.233705Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:be9361f715570069aac6711ca29c50e1b5ea6a8e707ee7015ffd50989e2f689e","observation_id":"19248bbe-28b6-4f5a-abd5-3e3a26f92a3c","resolution":{"observed_at":"2026-08-07T05:40:34.603033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.586904Z","title":"V2x-real: a largs-scale dataset for vehicle-to-everything cooperative perception,","venue":null,"work_id":"7e9a0d1a-fb68-4a08-92f7-c74399c54e7b","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.237029Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:e833e3a4fd974024c3cb24101112055c0537fb31c58c34e540eaa88ad3cf798e","observation_id":"a08d0ef1-b5bc-4b8f-a21c-cf5635839a11","resolution":{"observed_at":"2026-08-07T05:40:34.590923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.575296Z","title":"Efficient vehicle- infrastructure collaborative perception based on vehicle re-identification and mini-icp algorithm,","venue":null,"work_id":"24cd1737-3833-4e60-bfff-7f2f323a4dcc","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.240502Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:37e48a2906ed2e27bddc438f3af093dbf578076e676cdea7f5ffcc57f7dea8b8","observation_id":"4b9605b7-ea3c-4b94-b2b4-2f71586ae24a","resolution":{"observed_at":"2026-08-07T05:40:34.579440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.563449Z","title":"V2vformer++: Multi-modal vehicle-to-vehicle cooperative perception via global-local transformer,","venue":null,"work_id":"73501111-a011-4961-a781-798e8ec5fee8","year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.244531Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:6e7890fc4944bdc96dd0479320b97df457932fff2af19902017296e3eabc38ea","observation_id":"76dae3d4-ea14-4eed-ab2c-cfb8affc30d9","resolution":{"observed_at":"2026-08-07T05:40:34.567721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.551789Z","title":"Probabilistic 3d multi-object cooperative tracking for autonomous driving via differ- entiable multi-sensor kalman filter,","venue":null,"work_id":"f0008f73-3a1c-418c-b62b-13f0ee8d44f3","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.248508Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:53037b00ff6f66c753220052b811320662a16aa24908d156f224032c80fe0a93","observation_id":"9dfe6f54-2c4d-4485-8a7b-ba506d9dfc29","resolution":{"observed_at":"2026-08-07T05:40:34.555765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.540323Z","title":"Fast-poly: A fast polyhedral algorithm for 3d multi-object tracking,","venue":null,"work_id":"61b4ae15-9b0c-4485-95f3-3cab73a990f0","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.251959Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:45e49030668302871813084235711fac47472d2bb43c4210485f3750f0d80848","observation_id":"e155cbf2-daf7-45dd-aced-6e6623e18aa9","resolution":{"observed_at":"2026-08-07T05:40:34.544883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.255319Z","title":"Dinov2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.255319Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:ddf9a36ef29878b677ce5438b88d578cf1146342eaf60de7ebe5c79dfa45574a","observation_id":"9432761f-44a0-4be3-9b00-0c1fceadbae5","resolution":{"observed_at":"2026-08-07T05:40:34.255319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.522334Z","title":"Conftrack: Kalman filter-based multi-person tracking by utilizing confidence score of detection box,","venue":null,"work_id":"8089a51c-24ef-4064-8c3e-ff1729789617","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.258655Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:7dfc7af5770454d18320dc8091538f3e480513bdc140538cff4fe5aefbf77a0e","observation_id":"f624ce42-f7eb-494d-9aa9-63712e2fa198","resolution":{"observed_at":"2026-08-07T05:40:34.526829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.511701Z","title":"AB3DMOT: A Baseline for 3D Multi-Object Tracking and New Evaluation Metrics,","venue":null,"work_id":"69ed27cb-97c0-442b-8c98-a32f03350087","year":2020},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.262058Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:cd3b96176bb3df1cac87f8ceca3deb929d0ac929e93b8e49a7eab92fe23c2a08","observation_id":"cebf673a-42ca-4075-8806-f74f819dd39f","resolution":{"observed_at":"2026-08-07T05:40:34.515377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.500725Z","title":"Cooper: Cooperative perception for connected autonomous vehicles based on 3d point clouds,","venue":null,"work_id":"311a3b47-cc73-4077-8be7-25d4cb386c17","year":2019},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.265540Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:8e43f5c6343df31c2563e30a7b47b0c966a2266463598e26a67e210455e5ae84","observation_id":"ed151d4c-4cc9-4ae6-a02c-a85b1d79b8e2","resolution":{"observed_at":"2026-08-07T05:40:34.504862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.490156Z","title":"Cooperative perception for 3d object detection in driving scenarios using infrastruc- ture sensors,","venue":null,"work_id":"1bc9fcc6-08d9-491f-82b2-40670a8bbea7","year":2020},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.268787Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:1fd7ddd99f63a79a8bb929e0273686e779b3f179643e06c0b1b83aee1566be43","observation_id":"0f93fc68-f10b-4343-bf64-02a2b7d5492a","resolution":{"observed_at":"2026-08-07T05:40:34.493930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.479668Z","title":"Object detection with discriminatively trained part-based models,","venue":null,"work_id":"3fd38ee3-1193-4ef5-b788-a30556cb5b83","year":2009},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.272296Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:d999f12772a52e6382d38fedf9353a0ecf07a1371d57546cf4b322ce3e8bf7e9","observation_id":"8c2bd0d3-f27e-43cc-8fcd-182cf2c2313b","resolution":{"observed_at":"2026-08-07T05:40:34.483349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.468531Z","title":"V2vnet: Vehicle-to-vehicle communication for joint perception and prediction,","venue":null,"work_id":"e67d3c0a-ddf7-4eb9-81d8-4d31b68dcce3","year":2020},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.275808Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:491547c769bb3b2bf3c4552c7dc48f0fdafb4b2ffd925e5af2cda6d11817b3dc","observation_id":"db46c5d3-0727-4d51-ba99-f5fd956ddfd3","resolution":{"observed_at":"2026-08-07T05:40:34.472138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.458705Z","title":"When2com: Multi-agent perception via communication graph grouping,","venue":null,"work_id":"d5655932-446f-4279-bf34-b4e64f77d471","year":2020},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.279304Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:ce32779ce553ca1a4bec99c658b7084632c00fc43b3ce23aad283efd6afd2672","observation_id":"70919f7d-2788-4877-9151-16ff2741f2fe","resolution":{"observed_at":"2026-08-07T05:40:34.462318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.447997Z","title":"Where2comm: Communication-efficient collaborative perception via spatial confidence maps,","venue":null,"work_id":"01d840d8-fb25-499e-9559-928d3b82709f","year":2022},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.282892Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:9129ac11fda61a1fb31167ef9891e22d38251e6c7648ca093c22e09fbeae5594","observation_id":"c6247b37-8490-4e69-92ec-7107cb736e5d","resolution":{"observed_at":"2026-08-07T05:40:34.451975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.436285Z","title":"Select2Col: Leveraging spatial-temporal importance of se- mantic information for efficient collaborative perception,","venue":null,"work_id":"afe80c5e-395b-47a2-ae1d-f1e70121ae0c","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.287427Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:4da1b610225723ccc542c7ebbc35b6d3cb24d6d8742b32def836d16ca7b1793c","observation_id":"a93995ce-711e-44e7-8a9a-b390ed3b736b","resolution":{"observed_at":"2026-08-07T05:40:34.440140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.424885Z","title":"Collaboration helps camera overtake lidar in 3D detection,","venue":null,"work_id":"848bd472-af79-4202-8d94-3a512ed558be","year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.291029Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:d9604179bd00e2cb28878ad98216e407fa2743ba9db4270f1a87a5f093a68e3b","observation_id":"8c23272c-eca5-41b7-9c14-c17c83e30b5d","resolution":{"observed_at":"2026-08-07T05:40:34.429101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.412632Z","title":"CoBEVT: Coop- erative bird’s eye view semantic segmentation with sparse transformers,","venue":null,"work_id":"3d74f0d6-22e0-42d5-8cae-7251f4aee8a2","year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.294531Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:94f419e169e4dc6946f4c34d1449f24ddb1438f822747c899c376485e6aa202a","observation_id":"3bfd63fd-eb56-4e60-8c1d-005c9d1142d9","resolution":{"observed_at":"2026-08-07T05:40:34.416560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.401087Z","title":"Dino-mot: 3d multi-object tracking with visual foundation model for pedestrian re- identification using visual memory mechanism,","venue":null,"work_id":"82ca47da-f773-488e-b6da-ac82556aff3c","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.298050Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:cd3d08c20c615c8f9175d101105b2811cf42dc3ced7ff92e9a06926a5bfc1077","observation_id":"60e952c7-2cf6-45d1-821f-63597aa63701","resolution":{"observed_at":"2026-08-07T05:40:34.405633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.389979Z","title":"Quasi- dense similarity learning for multiple object tracking,","venue":null,"work_id":"7764f366-5fc2-4ad7-bdff-8ce6f71674d2","year":2021},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.301589Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:928d314ec70e1fa240c18ee21c656db7fffb14f00ce25aebcb9fefafbb27416f","observation_id":"da138498-dd73-4482-b8de-70d866b18379","resolution":{"observed_at":"2026-08-07T05:40:34.393801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.305000Z","title":"Simple online and realtime tracking with a deep association metric,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.305000Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:bd8e624823481fbfb1ac0dad95330921054670111a7863b324fb3f7896b3f18c","observation_id":"8efa25b4-8d0c-4727-ba1c-f19f77ab9208","resolution":{"observed_at":"2026-08-07T05:40:34.305000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01806","last_updated":"2024-10-02T17:59:57Z","snapshot_observed_at":"2026-08-12T22:32:16.944742Z","submitted_at":"2024-10-02T17:59:57Z","title":"Samba: Synchronized Set-of-Sequences Modeling for Multiple Object Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01806","snapshot_observed_at":"2026-08-07T05:40:34.308502Z","title":"Samba: Synchronized set-of-sequences modeling for end-to-end multi- ple object tracking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.308502Z"},"links":{"cited_paper":"/paper/2410.01806","citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:c4de3c83d71bae1a9cc1cf8682d7bae73d23e621d8a1a8dcb4f065a9723d4031","observation_id":"35a5d8c5-29e5-44f7-80fe-e5d03df29023","resolution":{"observed_at":"2026-08-07T05:40:34.308502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.312606Z","title":"Bevfusion: Multi-task multi-sensor fusion with unified bird’s-eye view representation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.312606Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:2eb67efc9c8249f2962cc10247b9503d6ebedb98a3dff290927272c996f9d123","observation_id":"db7701ec-1e3c-44e4-b5ec-cf5b17b8708a","resolution":{"observed_at":"2026-08-07T05:40:34.312606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.363108Z","title":"Assignment algorithms for multi-robot multi- target tracking with sufficient and limited sensing capability,","venue":null,"work_id":"08bc4657-5dee-4f28-a7dc-6380017cc90d","year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.317016Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:98c9c68b48cf4cee29464752fa8f9dc368d195ed21b6302488bccb0b01fb705e","observation_id":"6bea7e56-2745-4e40-affe-c88c355105d8","resolution":{"observed_at":"2026-08-07T05:40:34.369522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.320493Z","title":"Anyloc: Towards universal visual place recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.320493Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:0d33b0f17e786a4ee398b34a5d6f9b76b84dbebc00991b464fa367cdc705c6d2","observation_id":"8c72fe63-1643-42b8-b629-f62576aa0ec5","resolution":{"observed_at":"2026-08-07T05:40:34.320493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T07:30:43.872031Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 1 inbound Pith citation observation for arXiv:2506.07375."}