{"as_of":"2026-08-11T22:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d88c4106ac91d933b32e2b09b83a6a4855791d3bb5b724bf2ebcf283e21b5e93","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:09:45.619182Z","state":"measured"},{"denominator":74,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":74,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01488/citation-record","integrity":"/paper/2608.01488/integrity","json":"/paper/2608.01488/citation-record.json","paper":"/paper/2608.01488"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.449122Z","title":"Joint feature learning and relation modeling for tracking: A one-stream framework,","venue":null,"work_id":"049015c2-346a-4d69-8754-a4e32bc45553","year":2022},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.378498Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:4b87422a39cfa046d6fd1ffc151d1e853992e1f599c3751b89d89a2e851c2caa","observation_id":"ed7c5e90-7d95-4826-b151-8d826f8327ff","resolution":{"observed_at":"2026-08-06T00:09:46.452760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.440420Z","title":"Hhtrack: Hyperspectral object tracking using hybrid attention,","venue":null,"work_id":"e073ffb6-1fa7-4b05-8416-de810babc571","year":2023},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.382756Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:1f5e996e0ff587b68408da1688ada5f1612daaee73b782c9c6876055d7b7a54d","observation_id":"775cfa2d-a4d0-423f-8221-f1413f4af10f","resolution":{"observed_at":"2026-08-06T00:09:46.443744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.431814Z","title":"Mixformer: End-to-end tracking with iterative mixed attention,","venue":null,"work_id":"e998cebc-4559-436a-83d2-24933988e5cb","year":2022},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.385862Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:fb15361b719ad75904392cfe35a43335ab59e0b9fa2105e51e26848784a7e473","observation_id":"87c2d92c-f04b-4c17-9362-e584e3a081e3","resolution":{"observed_at":"2026-08-06T00:09:46.434665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.421365Z","title":"Cafuser: Condition- aware multimodal fusion for robust semantic perception of driving scenes,","venue":null,"work_id":"33e694fa-590d-4551-be28-4913661ae87b","year":2025},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.389065Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:91a952da8743abee771634c95cee5abb567d56d9d7c2b08c08a0d5121008c1fc","observation_id":"5e16bc4a-d2f6-4058-a7b8-1f921940bd39","resolution":{"observed_at":"2026-08-06T00:09:46.425750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19138","last_updated":"2024-12-26T09:41:36Z","snapshot_observed_at":"2026-08-11T08:13:55.768880Z","submitted_at":"2024-12-26T09:41:36Z","title":"SUTrack: Towards Simple and Unified Single Object Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19138","snapshot_observed_at":"2026-08-06T00:09:45.392791Z","title":"Sutrack: Towards simple and unified single object tracking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.392791Z"},"links":{"cited_paper":"/paper/2412.19138","citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:596d8e780735a4f85b4f71e647c44f2a9fde0bc812f6b5dd8545775284c76c68","observation_id":"e90ff0d1-0956-49c5-b8a4-68706949d38d","resolution":{"observed_at":"2026-08-06T00:09:45.392791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.410794Z","title":"Single-model and any-modality for video object tracking,","venue":null,"work_id":"6b855eaa-ca8f-409f-afbf-feba11f6e4d1","year":2024},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.397068Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:7504b3bfd06babb59c31023e1675aed815a74ddc4f61e5a33591151752358867","observation_id":"817ff638-167c-4c3c-99b5-15fe748bf163","resolution":{"observed_at":"2026-08-06T00:09:46.415340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.401678Z","title":"Sdstrack: Self-distillation symmetric adapter learning for multi-modal visual object tracking,","venue":null,"work_id":"a36d61b3-05ce-4f4e-bac5-339109b8b976","year":2024},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.401020Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:f17d6f8c8a09d0f5a749c97329127756f95fd48b477b91d60f676479775d8f77","observation_id":"446034d2-3dd7-4431-978c-a4626007ebe3","resolution":{"observed_at":"2026-08-06T00:09:46.405405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.392508Z","title":"Cross-modality distillation for multi-modal tracking,","venue":null,"work_id":"4c326d9e-826c-4ebe-b0de-2f6ffd428ac7","year":2025},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.404136Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:60a73d9e2a26a13c35447e69cf647f521c0cee4df0b15f74daa878aa0f2233c0","observation_id":"d118faeb-1e07-4ae5-8151-0f675b966d4a","resolution":{"observed_at":"2026-08-06T00:09:46.396061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.383289Z","title":"Bi-directional adapter for multimodal tracking,","venue":null,"work_id":"018d74e7-4128-48d8-9a11-7e5dff8efc6b","year":2024},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.407190Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:ff447bb4621a3559402d4233f448abd4122111c628dd3621fdb7c70cd0da8d62","observation_id":"4b5320c6-bad2-49ce-9226-ab4053459c7a","resolution":{"observed_at":"2026-08-06T00:09:46.387135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.374628Z","title":"Visual prompt multi-modal tracking,","venue":null,"work_id":"4115f939-3ae6-44f4-8a34-4aa252f56ee0","year":2023},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.410544Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:83dfde2804af771d5c1d1e36b390b393e27f0e81e790409c03a1e142e2dea66a","observation_id":"d559e0fb-b9f3-4f9d-a453-34f3471397a4","resolution":{"observed_at":"2026-08-06T00:09:46.377836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.365626Z","title":"Onetracker: Unifying visual object tracking with foundation models and efficient tuning,","venue":null,"work_id":"44d9069b-1d8f-4da9-a0b9-0b2cb2e2a998","year":2024},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.414217Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:589c75f29e3e1d1b5116f09d2f829c54eefc1aa179f304c8c32b53e13228d607","observation_id":"70deafe0-b33f-4747-be2d-0c65987427b1","resolution":{"observed_at":"2026-08-06T00:09:46.369219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.346458Z","title":"Xtrack: Multimodal training boosts rgb-x video object trackers,","venue":null,"work_id":"49b582eb-93f1-4242-b973-86f397f7e5b7","year":2025},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.420278Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:4c3f60041121179e9b7c06d7d7d741876fe56e1d5d9e5c04c76033976afabcd1","observation_id":"c9835702-4470-4eba-970f-7c77eb0880fe","resolution":{"observed_at":"2026-08-06T00:09:46.350256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.356224Z","title":"What you have is what you track: Adaptive and robust multimodal tracking,","venue":null,"work_id":"44d5aa2b-4022-4213-ad01-f07608f97bf2","year":2025},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.423086Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:eb4a7fa1d098f16425e817b1ada69d50888f786eee3fb9c50896e35bbf46110f","observation_id":"8fa1deca-c807-4cb9-993f-b74e4e5d0ce3","resolution":{"observed_at":"2026-08-06T00:09:46.359847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15691","last_updated":"2024-12-20T09:10:17Z","snapshot_observed_at":"2026-08-11T11:08:41.914044Z","submitted_at":"2024-12-20T09:10:17Z","title":"Exploiting Multimodal Spatial-temporal Patterns for Video Object Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15691","snapshot_observed_at":"2026-08-06T00:09:45.426152Z","title":"Exploiting multimodal spatial-temporal patterns for video object tracking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.426152Z"},"links":{"cited_paper":"/paper/2412.15691","citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:6e48771d1ed1f32529851515ae94fb3e5d1fe8d684beb2b5bab52e72320aa6dc","observation_id":"c929f761-7a88-45eb-be0e-0b4ac9742667","resolution":{"observed_at":"2026-08-06T00:09:45.426152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.337899Z","title":"Mambaevt: Event stream-based visual object tracking using state space model,","venue":null,"work_id":"3dc7670a-c02e-45da-9928-42b641907241","year":2026},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.430147Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:0eb643337944751aa5ff9fc506a3e47c386f58dfd2790cd63b8a55efa2aed1f7","observation_id":"dd66aa32-c1a9-40e3-a804-24cd734a3ba9","resolution":{"observed_at":"2026-08-06T00:09:46.341068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.329461Z","title":"Self-supervised learning for rgb-d object tracking,","venue":null,"work_id":"848ec5dd-cc9f-4039-a31f-e53016f94276","year":2024},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.433146Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:31b7cc691baf71b32cdef5f55770ebff822ad430ea3e17e89fb1314a86a4d4f0","observation_id":"7214ca39-0f0e-4d41-8a2f-6fb2d2ceaa9f","resolution":{"observed_at":"2026-08-06T00:09:46.332736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.320038Z","title":"Fmtrack: Frequency-aware interaction and multi-expert fusion for rgb- t tracking,","venue":null,"work_id":"447efa68-b619-45e4-b6c5-dacf35d5f743","year":2026},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.436203Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:03fc70ad8d3c19e888ecb18467a92668eebf8510c82aba5b0aa873cfc9e38df6","observation_id":"f5b8edf8-eeeb-476b-824a-85f45f0ba6b0","resolution":{"observed_at":"2026-08-06T00:09:46.323840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.310684Z","title":"Cross-modal orthogonal high-rank augmentation for rgb-event transformer-trackers,","venue":null,"work_id":"fa85dbfa-6658-46d0-9bd8-1bfe7e21f807","year":2023},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.439383Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:9321d2b1ed8027d22448ed324277cf6de28393b20583129b029500ed0a068329","observation_id":"ce8ad603-1c64-4021-9df9-bcc73348e676","resolution":{"observed_at":"2026-08-06T00:09:46.313734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.301540Z","title":"Lighttrack: Finding lightweight neural networks for object tracking via one-shot architecture search,","venue":null,"work_id":"d560937c-4103-4c6b-9b13-df5e7f662da2","year":2021},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.443361Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:4fd6dd21c2e05d101e490bf6de024a37be483eb071722b497a4155ceb5e27380","observation_id":"a9601beb-feff-43f4-867d-678869979b27","resolution":{"observed_at":"2026-08-06T00:09:46.304813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.293002Z","title":"Litetrack: Layer pruning with asynchronous feature extraction for lightweight and efficient visual tracking,","venue":null,"work_id":"b61f2ade-36b0-4638-9fb3-0d824f211e15","year":2024},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.446218Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:90a477347fa338e2699072c51780f4d45a42fdaa304cf9a05ec695c5f53c59cd","observation_id":"009efb01-8016-4fa5-808d-5e09f57737cf","resolution":{"observed_at":"2026-08-06T00:09:46.296271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.284480Z","title":"Mixformerv2: Efficient fully transformer tracking,","venue":null,"work_id":"2d183c8f-60ff-4d5d-a600-471e9aa96b28","year":2023},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.449211Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:c0f2dcac95ecfdefd6af11a22c8da778ecd02c6ecc4de434c21e4418caf9118c","observation_id":"76fa55c8-7166-43cc-a878-a8cd58c622e0","resolution":{"observed_at":"2026-08-06T00:09:46.287585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.275840Z","title":"Emtrack: Efficient multimodal object tracking,","venue":null,"work_id":"93a9abb8-90af-45ca-b21f-5b75bfef2d25","year":2025},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.452399Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:ff282a6a23ad2748d7b5132f23d6866ddbcc4cbea45c487369c3bc2f6553854e","observation_id":"d24e43af-1b39-4176-b2e8-baab3af45435","resolution":{"observed_at":"2026-08-06T00:09:46.278871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.267222Z","title":"Exploring pruning-based efficient object tracking via hybrid knowledge distillation,","venue":null,"work_id":"d8acf66b-170f-462a-a65a-1b4953962eed","year":2026},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.455707Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:8ef7396c570c6c2d27a849218eb17e7f20d14352d5b42a918930d822c7ff90ae","observation_id":"5b718b61-3029-4be8-abe8-2e11c42da6a7","resolution":{"observed_at":"2026-08-06T00:09:46.270387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-06T00:09:45.458659Z","title":"Distilling the knowledge in a neural network,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.458659Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:c12dd0267fc290c47a66c52d0782e04958d7dd38bb0f118310e06652c9628cb1","observation_id":"6397810d-a8d0-4a47-a49c-23f481badfed","resolution":{"observed_at":"2026-08-06T00:09:45.458659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.258291Z","title":"Decoupled knowledge distillation,","venue":null,"work_id":"ab644fbe-bef6-489f-948c-0a2af3b61f15","year":2022},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.462727Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:d32e06287ad7da98766306960ddd22de0f12ca343b39533bb82a6ebe7a903bbd","observation_id":"60633b2c-997f-4567-85b3-ccda3a5951a2","resolution":{"observed_at":"2026-08-06T00:09:46.261525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.248625Z","title":"Relational knowledge distillation,","venue":null,"work_id":"5c9c31bc-a8a7-4401-a33b-fe57d0a7fc11","year":2019},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.466334Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:e1d6d9fd8383768cec8f7e8742bd0c4a6354a812760a44a546eca79f45225c42","observation_id":"e5f6d67e-3063-470b-b361-e1ee35c6f21b","resolution":{"observed_at":"2026-08-06T00:09:46.252503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.238735Z","title":"Relational knowledge distillation,","venue":null,"work_id":"497d8c80-44ad-49c3-b4d4-c89a17d463c8","year":2019},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.470367Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:f90600a12896600eb952ff7193d987a8898278fbeb31f07c7a043d705db97f08","observation_id":"c62ca8dc-aa47-44cc-91dc-376dae51ef60","resolution":{"observed_at":"2026-08-06T00:09:46.242536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.229674Z","title":"Learning from multiple teacher networks,","venue":null,"work_id":"c7aac06f-759b-4283-8c0a-57f0e9bdee57","year":2017},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.473211Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:7aa3be38afdd4f8afe14fab144bdd9e57dbf8a647959d51c3ace46e8f324f5ba","observation_id":"02a6d4e8-2988-4656-baec-a6ad88280aac","resolution":{"observed_at":"2026-08-06T00:09:46.233492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.220731Z","title":"Structured knowledge distillation for semantic segmentation,","venue":null,"work_id":"3414146d-10cf-49d3-a1b6-e509e06280a7","year":2019},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.476515Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:b3cd05efd6ea0fcac6ba1cc760288bc2c47fbee827a67523aaa38161170ab762","observation_id":"bf1a71c0-11a6-4f2d-b64e-aa61ebc4b7ad","resolution":{"observed_at":"2026-08-06T00:09:46.224347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.211524Z","title":"Double similarity distillation for semantic image segmentation,","venue":null,"work_id":"be7fdecd-9e6e-4224-b8dd-80d3c567099d","year":2021},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.480387Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:08dcef481179eeeaa72af281458dca8465d5b4c0b35e46144052e633c14c7ad3","observation_id":"ce128d14-3f1a-43e4-84e5-7ab19c03c3ba","resolution":{"observed_at":"2026-08-06T00:09:46.214993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.202974Z","title":"Prompting for multi-modal tracking,","venue":null,"work_id":"a58da4c5-a4e3-4027-900c-687e78957879","year":2022},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.483789Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:1226350c83c99636011ce00f060ef0ec92589ba5bbb8cd62e2cf0ed8e1526cfd","observation_id":"1845dbce-2641-4d24-9c7f-5d78031a9d75","resolution":{"observed_at":"2026-08-06T00:09:46.205993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.193684Z","title":"Siam R-CNN: Visual tracking by re-detection,","venue":null,"work_id":"519ff56d-2b9a-4aba-8fff-730dd76983e4","year":2020},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.486742Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:51218b7642afb93b52b0d5f0dd13678b837ff11c4eaf5daf16fee716beb5798a","observation_id":"ae711d23-1b69-4479-8a40-efc840626b4c","resolution":{"observed_at":"2026-08-06T00:09:46.197170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.185370Z","title":"Transformer tracking,","venue":null,"work_id":"a1b0c973-ea29-4be6-a521-eb52764b8448","year":2021},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.490016Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:4a84ac3de28ffd2023650f40bba5f6b307028e9dc543f2e784f62a3944b32ad3","observation_id":"5b9bcf1f-38db-401e-a9ca-93857f1ee7c0","resolution":{"observed_at":"2026-08-06T00:09:46.188404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.176516Z","title":"High-performance long-term tracking with meta-updater,","venue":null,"work_id":"697a44a3-0b87-401f-a389-947c77c66ff0","year":2020},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.492700Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:06df681de2a28387716f46cf96ec18a439cc2de6c9af6dd3bb4fc12430214b95","observation_id":"98426767-02ad-47f6-80f7-4b896535fe46","resolution":{"observed_at":"2026-08-06T00:09:46.179586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.167636Z","title":"Probabilistic regression for visual tracking,","venue":null,"work_id":"5a04b858-d2cb-4589-8452-1ce87595a189","year":2020},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.495709Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:1320f1bf1d16b169df4ab45db378a2a2f664212acfde4a77eb11f2237a32fe2e","observation_id":"6d7af632-8ad0-4cff-b5a1-31259946f8b0","resolution":{"observed_at":"2026-08-06T00:09:46.170762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.157886Z","title":"Vital: Visual tracking via adversarial learning,","venue":null,"work_id":"ac58fdda-5326-4b17-9ad7-11daaa92aeff","year":2018},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.499114Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:1c43b921f7b5fc330ae37fac2468fedd997b170220dcdeff6d5c14ab880f78dd","observation_id":"beaea6ca-00ea-4e26-bbe2-e0f71133dcc7","resolution":{"observed_at":"2026-08-06T00:09:46.162240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.149095Z","title":"Learning multi-domain convolutional neural networks for visual tracking,","venue":null,"work_id":"7be3b463-a18f-4dcd-88c4-0253ccb8a58f","year":2016},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.501878Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:38b7ead646daa88c734ed5a07deb2eeb8536e44a9ca8dc96207bba69a842faf1","observation_id":"77e3817e-642a-41c0-8ceb-9ee0075fca5b","resolution":{"observed_at":"2026-08-06T00:09:46.152519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.139918Z","title":"Atom: Accurate tracking by overlap maximization,","venue":null,"work_id":"84e2bdae-05d5-4847-86e0-f1d35d284e7c","year":2019},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.504621Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:bf8401eeed6ae0be9dabd8346b973077dd1481d8d83e0719934e6535f6947727","observation_id":"a71c6847-7eef-4bf6-afd6-1950873dc87e","resolution":{"observed_at":"2026-08-06T00:09:46.143466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.130073Z","title":"Learning spatio-temporal transformer for visual tracking,","venue":null,"work_id":"a1aa004a-1db9-41ad-be1e-b5b1f810b7a3","year":2021},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.508394Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:224d2e669ff4d279b25fc5ee3ec5cbc3793b4dd04394c9229b47abbef8f77f6d","observation_id":"46d6e2b3-afce-4768-b022-b443641ef28f","resolution":{"observed_at":"2026-08-06T00:09:46.133776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.120387Z","title":"Siamban: Target-aware tracking with siamese box adaptive network,","venue":null,"work_id":"042bbef2-722f-4a91-ac1f-43f160d8e61b","year":2022},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.511427Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:fac3b9b40c966507ae549ea8898663535c06a4dfd05a16a422633aaac0ed9306","observation_id":"d3736a04-9935-4c84-aafc-549119065670","resolution":{"observed_at":"2026-08-06T00:09:46.123633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.110513Z","title":"Fast online object tracking and segmentation: A unifying approach,","venue":null,"work_id":"fa055539-9c65-4d0c-9995-fd976e4244ae","year":2019},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.514377Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:9e9339e5801438a212600580a03375dfd106823abff3d5bcd235ca28ae06d822","observation_id":"4413f9c7-2fd5-440b-bcf5-c8668d532482","resolution":{"observed_at":"2026-08-06T00:09:46.113825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.101465Z","title":"Attribute-based progressive fusion network for rgbt tracking,","venue":null,"work_id":"13c54ac8-f3fa-4d8f-bbbc-516bad0ba206","year":2022},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.517411Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:997c26e012f3f108083fb6c3ef653099ae867eb4425e4a1c5f5f2b3fca39ff2f","observation_id":"3de9d966-018c-47c4-ba50-a09836a49b3e","resolution":{"observed_at":"2026-08-06T00:09:46.104527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.092768Z","title":"Cross-modal pattern-propagation for rgb-t tracking,","venue":null,"work_id":"16f4e364-e7b0-4410-92aa-cf04da21871d","year":2020},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.520289Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:3233750c9fcd0a23f79b3e89660f576eb62e52805e18e22343d004bf4aed5113","observation_id":"7810d613-66be-4904-8011-b5f7dd83115c","resolution":{"observed_at":"2026-08-06T00:09:46.095937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.083127Z","title":"Jointly modeling motion and appearance cues for robust RGB-T tracking,","venue":null,"work_id":"13e566bf-eeae-43c3-aca2-d91cfe922b13","year":2021},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.523945Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:350c0830e30dd53f6570d9ab3bf3f9d9c64144d755022f70bd793ffa28f9b497","observation_id":"effb7b87-3d4a-4f17-8c0d-3306b193efba","resolution":{"observed_at":"2026-08-06T00:09:46.087532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.073725Z","title":"Challenge-aware RGBT tracking,","venue":null,"work_id":"ab6b50d2-91a4-4a70-8117-0a4df044c88d","year":2020},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.526650Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:f243759fc702683b297e22345181e86b553b13cec9c6ebead6cf4cf8216babb1","observation_id":"1c9c684d-efd0-4ee3-9a82-53e10f4f82f5","resolution":{"observed_at":"2026-08-06T00:09:46.077541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.064176Z","title":"Quality-aware feature aggregation network for robust RGBT tracking,","venue":null,"work_id":"d4326d9d-199e-415a-98ea-8c44bc75ac9c","year":2020},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.529642Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:670d6537ab8ac55fbd71a5c757f2a5a719b22dcc6a07983870276a3860b28591","observation_id":"cdcc709a-05ed-44d4-87f2-65f8f76aca66","resolution":{"observed_at":"2026-08-06T00:09:46.068198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.055052Z","title":"Dense feature aggregation and pruning for RGBT tracking,","venue":null,"work_id":"6f191d06-8397-40bc-a0ad-6943f2876446","year":2019},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.532773Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:2092a7fb00f06dbb268af1654b1f83b042e400988530565f0116ff6581f96f2c","observation_id":"09459674-ab58-47ec-a941-97cf59504ec7","resolution":{"observed_at":"2026-08-06T00:09:46.058630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.045894Z","title":"Deep adaptive fusion network for high performance RGBT tracking,","venue":null,"work_id":"c143f6e5-56d9-4e6a-9857-b64d27bc79d5","year":2019},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.535769Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:be2eb6b0895bfb27ceb2970f460662b2df1bda1fdc73b6564eb6a6128c62bc6e","observation_id":"9dd0b79d-0b98-4be5-92f1-58af100f4b20","resolution":{"observed_at":"2026-08-06T00:09:46.049287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.036920Z","title":"Object tracking in RGB-T videos using modal-aware attention network and competitive learning,","venue":null,"work_id":"c41d8153-9304-4764-8583-18cc3c301d7d","year":2020},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.539077Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:6fc743495609e25cf05f63ce8ed936c5cceeac68d472c220ecea2787378fd7e1","observation_id":"571e0ec0-4c8e-4f5a-a52c-2880d0ec09dc","resolution":{"observed_at":"2026-08-06T00:09:46.040053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11023","last_updated":"2024-12-15T02:33:37Z","snapshot_observed_at":"2026-08-11T15:20:59.693624Z","submitted_at":"2024-12-15T02:33:37Z","title":"Exploring Enhanced Contextual Information for Video-Level Object Tracking","version":1},"cited_work":{"arxiv_id":"2412.11023","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.11023","snapshot_observed_at":"2026-08-06T00:09:45.800343Z","title":"Exploring Enhanced Contextual Information for Video-Level Object Tracking","venue":"cs.CV","work_id":"4dd0d550-b3b1-4a18-a5ed-5abf6afb1889","year":2024},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.541820Z"},"links":{"cited_paper":"/paper/2412.11023","citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:8830f68d909b0f5d49c096cb06d380b28979adea9dca53229229d11bf0efeb8d","observation_id":"b3efdcb1-b796-499c-8c63-465fc0f908bf","resolution":{"observed_at":"2026-08-06T00:09:45.804317Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.027951Z","title":"Fast-itpn: Integrally pre-trained transformer pyramid network with token migration,","venue":null,"work_id":"50a26c7f-cc5f-4061-a3ee-e3f0ae6b1bd2","year":2024},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.545175Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:4575c8325c43186b756b4f444d41b9a42fabb8c87f548d0a9378f9e8cf845a4c","observation_id":"254a2210-1dbb-44f1-b6e8-943f9fc73006","resolution":{"observed_at":"2026-08-06T00:09:46.031085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.018740Z","title":"Got-10k: A large high-diversity benchmark for generic object tracking in the wild,","venue":null,"work_id":"752dd4c5-0fa0-41a8-9070-9b510f087342","year":2019},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.548657Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:22eaedbf6ac2b44424b733484cbdfb897054bed2434b1158240a67f46703f9d5","observation_id":"a93cc7b4-9312-4abb-bae2-be1feafcf37c","resolution":{"observed_at":"2026-08-06T00:09:46.022165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:46.008780Z","title":"Trackingnet: A large-scale dataset and benchmark for object tracking in the wild,","venue":null,"work_id":"df3e70ac-1a9d-4178-980f-4cd2b3bf3815","year":2018},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.551551Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:c256293ea8326022058492638ce238e104acf9fe0488716fa2ce92a0367aad9d","observation_id":"20dde008-6850-4ec5-8e0e-78b883a3ec5d","resolution":{"observed_at":"2026-08-06T00:09:46.012423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.999003Z","title":"Microsoft coco: Common objects in context,","venue":null,"work_id":"a233cf07-83c3-4349-ac42-5cd2ceccef21","year":2014},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.554534Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:2541e27bf5778be59e4f8dab4f52930c69d30fad6edcdec64fed5b1e7797889c","observation_id":"fabd465d-7895-408a-a8f3-64c580da8891","resolution":{"observed_at":"2026-08-06T00:09:46.002594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.988617Z","title":"Lasot: A high-quality benchmark for large-scale single object tracking,","venue":null,"work_id":"f051161b-db9a-4e55-b8b1-8cb666f45062","year":2019},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.557637Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:769cafeb5991a8066fe8d86c9db09bb23d2eb75d8a05e337f4588383b0566720","observation_id":"9a8152e0-66cb-4870-9447-841c7846999a","resolution":{"observed_at":"2026-08-06T00:09:45.992729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.978811Z","title":"Lasher: A large-scale high-diversity benchmark for rgbt tracking,","venue":null,"work_id":"ecd0227f-db33-4783-a270-d557d6bb34ee","year":2021},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.560467Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:c2e11940fbf9136041524313238046ad098d878c86b4b37ffc13f4d29cf4faa2","observation_id":"0c998677-8d21-4256-8faf-2e10a0796100","resolution":{"observed_at":"2026-08-06T00:09:45.982352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.968842Z","title":"Visevent: Reliable object tracking via collaboration of frame and event flows,","venue":null,"work_id":"5b6edcce-4e30-4989-96f1-46209ca5865f","year":2023},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.563568Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:77597ffdeb0a03a12bf7f2c8c476ce0d546c6078f313937686089e0f03c7b2ea","observation_id":"4c9f9456-81ed-45d4-b9b0-cece5158950d","resolution":{"observed_at":"2026-08-06T00:09:45.972313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.959211Z","title":"Depthtrack: Unveiling the power of rgbd tracking,","venue":null,"work_id":"97fca642-290c-49f5-8b8e-ef41a0f43a54","year":2021},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.567327Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:145c5ecf72e8adc3b1e545b581f7f1ac411fc2c1e0c196e75e2f9d7c5e988326","observation_id":"8d1bc65a-67f4-4dd3-912a-2c271df176e9","resolution":{"observed_at":"2026-08-06T00:09:45.963228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.949660Z","title":"Rgbd1k: A large-scale dataset and benchmark for rgb-d object tracking,","venue":null,"work_id":"c1e73062-1627-4062-a2df-744743c3fa2a","year":2023},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.570535Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:b97ddcf628928c5bfb2e8ddc5ea274dc2429c548aa9a478f6fccb3bbcd89a470","observation_id":"d2180809-1177-4bad-910e-52387ef08fa4","resolution":{"observed_at":"2026-08-06T00:09:45.953438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.937632Z","title":"Correlation- aware deep tracking,","venue":null,"work_id":"a2474db5-87e2-439a-a672-8bddadec376f","year":2022},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.574169Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:bf0a0a471fa500c802a67c5ab8496eb99936d0aea99c3e60c51221e0bce7bc29","observation_id":"6bcbeb21-a9db-42c6-91a7-47b8a9534477","resolution":{"observed_at":"2026-08-06T00:09:45.942011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.926459Z","title":"The tenth visual object tracking vot2022 challenge results,","venue":null,"work_id":"9a920537-584a-4b46-a68d-c2c7654ca221","year":2023},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.577885Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:6c1b39e1610135d35a7190988c02773a691c6a3fed7d32ffe7d195f94a8272ea","observation_id":"9004d9bc-2a79-447a-a5ce-f3a46dab6e61","resolution":{"observed_at":"2026-08-06T00:09:45.930704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.916376Z","title":"The eighth visual object tracking VOT2020 challenge results,","venue":null,"work_id":"0e537175-47ee-4798-888e-721a611df0e8","year":2020},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.580770Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:55beacf00ddb27a74eff7a2e95c2013227158430bdc588cee7dfac43e3a4ecb8","observation_id":"41b0b6c6-da42-4c8f-a945-913abe2204e2","resolution":{"observed_at":"2026-08-06T00:09:45.919732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.906621Z","title":"Dal: A deep depth-aware long-term tracker,","venue":null,"work_id":"a90cf7c8-9ccc-4d2a-9c96-a653ef212964","year":2021},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.583500Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:a8ce5f982ab433a9f761c28876d06cfb39c3c1db3b0615288f42426697963116","observation_id":"30e40a7b-fdde-4c20-8f0d-7cf66a4d4e37","resolution":{"observed_at":"2026-08-06T00:09:45.909738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.897794Z","title":"The seventh visual object tracking VOT2019 challenge results,","venue":null,"work_id":"8fe4d25f-0dea-447e-bf66-0bc07f799301","year":2019},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.587062Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:e5e2b6eaacc31172d4d8232522e04e555fe62eecea638b49429687e14d672eda","observation_id":"f1998aeb-2155-4c80-8b22-dc647c00b748","resolution":{"observed_at":"2026-08-06T00:09:45.900796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.888829Z","title":"Context-aware three-dimensional mean-shift with occlusion handling for robust object tracking in RGB-D videos,","venue":null,"work_id":"94fd62e1-5f6c-4b3b-894e-18bcfb624dd3","year":2018},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.589843Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:bdc057dd064f934e3c230179e18147f3a21fd7b14a8c8b3026a2b0e6e1f1d3bd","observation_id":"59ac86b9-14a2-4235-aedd-db458844e1b2","resolution":{"observed_at":"2026-08-06T00:09:45.892407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.878678Z","title":"Learning discrimi- native model prediction for tracking,","venue":null,"work_id":"2c823686-aaf4-479b-99e3-90e9cbbf7afe","year":2019},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.592741Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:4e023300ed7a2207a14e686de6974f3e1fe3d01137f972d4f47dc2a5daf78ffb","observation_id":"294601b8-82a8-4689-bbba-a2b39591d0bb","resolution":{"observed_at":"2026-08-06T00:09:45.882609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.868890Z","title":"Channel-wise knowledge distillation for dense prediction,","venue":null,"work_id":"1c0968f4-2d60-4125-ad99-1dc2eac8ef1b","year":2021},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.595760Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:40cf266cd9c591c818a65077a5666f1594e50c086793ff2d4581c2778cfcce7f","observation_id":"aefcdcd9-707b-41d0-aa87-10fbe1e6713d","resolution":{"observed_at":"2026-08-06T00:09:45.872267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6550","last_updated":"2015-03-27T11:52:28Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-19T22:40:51Z","title":"FitNets: Hints for Thin Deep Nets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6550","snapshot_observed_at":"2026-08-06T00:09:45.598653Z","title":"Fitnets: Hints for thin deep nets,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.598653Z"},"links":{"cited_paper":"/paper/1412.6550","citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:c026fef2650ae229f1be099e47f63b9bec612168269806a36fd27f72e712b8b8","observation_id":"a8a382e4-2bf8-4cbb-a52b-f67722b8e486","resolution":{"observed_at":"2026-08-06T00:09:45.598653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.858701Z","title":"Similarity-preserving knowledge distillation,","venue":null,"work_id":"d271431b-42c2-4df6-acae-6866e26723eb","year":2019},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.602628Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:c77935cb059bcd41ad1a2a21234f83212d8da83a390cdeef6987e180154a8d0b","observation_id":"4e5fea43-c5b8-4fee-a932-c17191b56a7f","resolution":{"observed_at":"2026-08-06T00:09:45.862165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.848588Z","title":"Customkd: Customizing large vision foundation for edge model improvement via knowledge distillation,","venue":null,"work_id":"564f9f04-f79c-43bd-9c32-d2c087bc6210","year":2025},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.605504Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:51f8489ee192e83367b7ffa4e15b4a567ce1e0d86e995161c3558be440a10ceb","observation_id":"ae849a77-651f-4a6a-9a05-bdea66e2c9fc","resolution":{"observed_at":"2026-08-06T00:09:45.852508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05451","last_updated":"2025-03-24T06:34:34Z","snapshot_observed_at":"2026-08-11T00:46:41.306433Z","submitted_at":"2024-03-08T16:57:47Z","title":"Attention-guided Feature Distillation for Semantic Segmentation","version":3},"cited_work":{"arxiv_id":"2403.05451","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.05451","snapshot_observed_at":"2026-08-06T00:09:45.777773Z","title":"Attention-guided Feature Distillation for Semantic Segmentation","venue":"cs.CV","work_id":"7b879e62-f38c-4e5a-a48f-31783ffe8fe4","year":2024},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.608192Z"},"links":{"cited_paper":"/paper/2403.05451","citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:8871a9c11cf799f048e57fee6d12d1c654f74b36118dfa3e5e6b5db20d0b12f1","observation_id":"016d73eb-3986-4d8f-b800-2f0ec16e6331","resolution":{"observed_at":"2026-08-06T00:09:45.783428Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.838972Z","title":"Rethinking knowledge distillation with raw features for semantic segmentation,","venue":null,"work_id":"0ae173e7-9105-4e8f-a61b-ecc07d4522a4","year":2024},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.612443Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:11601b47a4e8bb3173ac97a7ecf8c408501f8b0d95393486714d95c5343f76a7","observation_id":"dc3f0682-4722-48bd-86ad-cdb508d155d0","resolution":{"observed_at":"2026-08-06T00:09:45.842222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.616325Z","title":"Simple semi-supervised knowledge distillation from vision-language models via dual-head optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.616325Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:8d0689aef1b210b2bd969e3d9f36831a300ae7df0747ba51cbef4c4e4f901bf9","observation_id":"ea853971-8cb0-4f46-9d26-0a143d057e24","resolution":{"observed_at":"2026-08-06T00:09:45.616325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:09:45.619182Z","title":"Generative adversarial networks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T00:09:45.619182Z"},"links":{"citing_paper":"/paper/2608.01488"},"observation_digest":"sha256:f8032ac9666530702dd6a03e4d8691bbbc95f9e1a425eca612971961a05e4d21","observation_id":"43f71132-027a-4c9a-8d3a-73bae4af8369","resolution":{"observed_at":"2026-08-06T00:09:45.619182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01488","last_updated":"2026-08-02T20:41:33Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T18:46:09.215169Z","submitted_at":"2026-08-02T20:41:33Z","title":"Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":2,"verified_fuzzy":66},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 0 inbound Pith citation observations for arXiv:2608.01488."}