{"as_of":"2026-08-13T15:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5cecb77886aea80e044945a321968befd46bc1a1c1a7baeca9044ba39e2b1bff","coverage":[{"denominator":293,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T16:31:31.626384Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.09991/citation-record","integrity":"/paper/2412.09991/integrity","json":"/paper/2412.09991/citation-record.json","paper":"/paper/2412.09991"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2203.05328","last_updated":"2022-07-15T23:55:42Z","snapshot_observed_at":"2026-08-08T20:33:27.764159Z","submitted_at":"2022-03-10T12:20:58Z","title":"Backbone is All Your Need: A Simplified Architecture for Visual Object Tracking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.05328","snapshot_observed_at":"2026-08-11T16:31:31.136209Z","title":"Backbone is all your need: A simplified architecture for visual object tracking,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.136209Z"},"links":{"cited_paper":"/paper/2203.05328","citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:0558200fa191123ff9d121efb21407cf985efdb00018670af47e7edfe7bacb4b","observation_id":"98b0c77b-7012-411c-9edb-dfea921c3e5b","resolution":{"observed_at":"2026-08-11T16:31:31.136209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.142480Z","title":"High-speed tracking with kernelized correlation filters,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.142480Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:949f7b83f3f1be6ba93d0b189da1b9911bd53cb8a35f1ea2105c950d55851ab3","observation_id":"520a16a8-31f2-4134-a348-411414d498ed","resolution":{"observed_at":"2026-08-11T16:31:31.142480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.148980Z","title":"High performance visual tracking with siamese region proposal network,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.148980Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:92396625a4d9c3517c5a0a68c2ac4e0eb5a57c910ff04032695af79af4ad5c69","observation_id":"2adb3c3d-f4f4-43ef-8048-03e094f6284c","resolution":{"observed_at":"2026-08-11T16:31:31.148980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.155391Z","title":"3d-siamrpn: An end-to-end learning method for real-time 3d single object tracking using raw point cloud,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.155391Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:94a2355cab5fa78388dffb28b0059de6956b77eedafc9b959009b065e40a5811","observation_id":"7443d2ae-ebd9-4b03-8b21-35e164dc033c","resolution":{"observed_at":"2026-08-11T16:31:31.155391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.161806Z","title":"3d siamese voxel- to-bev tracker for sparse point clouds,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.161806Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:f42c440521006b1c24050957dfe55e19bda4f71d83949495c6ca8df72e09780f","observation_id":"5cdc276c-1584-43c8-a3e7-3d02f9726fde","resolution":{"observed_at":"2026-08-11T16:31:31.161806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.167219Z","title":"Real-time 3d human tracking for mobile robots with multisensors,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.167219Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:e1c7c024d8666283784406e58d0d06a31232926839b8f87ced66bde385aff481","observation_id":"d9da3388-0914-4b1d-acdd-d8a9283d4ba4","resolution":{"observed_at":"2026-08-11T16:31:31.167219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.172988Z","title":"Accurate and real-time 3-d tracking for the following robots by fusing vision and ultrasonar information,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.172988Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:6ac20eb1b4ea71c151d6be4c6eed4b3dec6cbad67b2db396767f0bca4a648b09","observation_id":"26a30e3d-5a51-4108-a0bb-cccb7f9033ba","resolution":{"observed_at":"2026-08-11T16:31:31.172988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.179359Z","title":"Grounding-tracking- integration,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.179359Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:55ee133886c5b2fc8db8e6149736ca04a8126999f1d99de3620b51deaeb8cebd","observation_id":"cb783ed1-39eb-4c39-9a65-f009249f2c3c","resolution":{"observed_at":"2026-08-11T16:31:31.179359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.183931Z","title":"Siamese natural lan- guage tracker: Tracking by natural language descriptions with siamese trackers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.183931Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:fa15eb212a4ac2d5cf30ad07b7336c1ab52ea0795e6aec9d255148e5c1588d16","observation_id":"8d0ce307-b95d-4b38-8076-25973e525304","resolution":{"observed_at":"2026-08-11T16:31:31.183931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.187923Z","title":"Tracking-learning-detection,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.187923Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:36562740630940b376dc6b612651a47fddb70dc0e5f12612faa7dde26c02a812","observation_id":"e7b1254f-ce47-4641-b4f0-3cf045f0fc2e","resolution":{"observed_at":"2026-08-11T16:31:31.187923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.193791Z","title":"Struck: Structured output tracking with kernels,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.193791Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:ffefda048bc2292821940f91d90e0a6c1fd2438ade2b11761b5436f5dff865f4","observation_id":"1b4c8a4e-6b5c-4cf2-9a88-62ca284d5b79","resolution":{"observed_at":"2026-08-11T16:31:31.193791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.208194Z","title":"Discrimina- tive scale space tracking,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.208194Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:ed5ae2922f7162a365c86c53eea5025421726eb16eec83dcc518da81dee29228","observation_id":"c546ae95-9be7-4930-a078-8f5a7004d937","resolution":{"observed_at":"2026-08-11T16:31:31.208194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.215094Z","title":"Joint feature learning and relation modeling for tracking: A one-stream framework,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.215094Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:71e2e8dba7fa586f9b96fe1f0fe2fe5d09c2ff541b36c21bcf7eacb711e1d716","observation_id":"6a342583-18ba-4437-a914-bfd196ee70f1","resolution":{"observed_at":"2026-08-11T16:31:31.215094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.220102Z","title":"Siamese box adaptive network for visual tracking,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.220102Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:f1eb0345d8efac8a100f5300df8036db5d41ab5a93fa42d0d68694ceeabdec8f","observation_id":"9a4357a1-ab54-4c6c-82e7-7eb2403e6ba1","resolution":{"observed_at":"2026-08-11T16:31:31.220102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.225842Z","title":"Fear: Fast, efficient, accurate and robust visual tracker,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.225842Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:1e66cbd7b878b1684816100c47f75b560119403b7e92f7d13a8d35827ae2fd52","observation_id":"dd0e4da7-73e4-41a4-9bbd-3dd604dfc0ab","resolution":{"observed_at":"2026-08-11T16:31:31.225842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.232100Z","title":"Fully-convolutional siamese networks for object tracking,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.232100Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:dcb6436a3b819986d5568745fa651d59d26992ff57209203061046532444fd1c","observation_id":"0c2c39aa-8dd8-404e-84fc-7e4099719470","resolution":{"observed_at":"2026-08-11T16:31:31.232100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.237451Z","title":"Learning discrimi- native model prediction for tracking,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.237451Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:3a7c6256810c4c663d6bf51c36f5ed7bf6a61e41dfb146bd7d274e0ba4256d4c","observation_id":"6f0ab336-d5df-4fc6-a3a1-b58fc782d77e","resolution":{"observed_at":"2026-08-11T16:31:31.237451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.242157Z","title":"Lasot: A high-quality benchmark for large-scale single object tracking,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.242157Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:652157bb1c71b6bec37cc8a2f97211d31a53621b7ac561804d27f7b61e982b9f","observation_id":"f47f5023-518b-4fa1-9129-f5843e5ccb3f","resolution":{"observed_at":"2026-08-11T16:31:31.242157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.247648Z","title":"Got-10k: A large high-diversity benchmark for generic object tracking in the wild,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.247648Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:94bbed0f003f075a785b51792852bed33933a566881557098beeeb5bdb1a039d","observation_id":"92fcc6f2-6985-4bba-a979-f759666879c5","resolution":{"observed_at":"2026-08-11T16:31:31.247648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.252946Z","title":"Track- ingnet: A large-scale dataset and benchmark for object tracking in the wild,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.252946Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:1628b8c761c803b669231c96cfa026e44fe5b6f730705d99ba236f5a0fe0c0f4","observation_id":"2b0a9837-3d68-40eb-b651-1a59a6bbf480","resolution":{"observed_at":"2026-08-11T16:31:31.252946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.257800Z","title":"Transforming model prediction for tracking,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.257800Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:830e81a3ee5287ebf318819ddf2b4e47d265daaa01bcbbbd23fc1e97a6bf0597","observation_id":"d79facda-34a0-4828-8b60-639a25a379ab","resolution":{"observed_at":"2026-08-11T16:31:31.257800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.261846Z","title":"Siamrpn++: Evolution of siamese visual tracking with very deep networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.261846Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:9ada6446fd55bf28fe095b8b9d3d07dda69a3cf47bdfac76b36809b2d5d467e4","observation_id":"dfa42956-95ac-4034-b220-799d9bd41f44","resolution":{"observed_at":"2026-08-11T16:31:31.261846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.267457Z","title":"Siamcar: Siamese fully convolutional classification and regression for visual tracking,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.267457Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:aaca4cca418676d0e5d966af82a76885fb606e723ef97c3c12f8bd38e7a6f0e8","observation_id":"32b1269d-a045-467c-a30c-a2b4ae636813","resolution":{"observed_at":"2026-08-11T16:31:31.267457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.273011Z","title":"Siamban: Target-aware tracking with siamese box adaptive network,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.273011Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:4453323c4ad096be7244bb93da80debbbd1a471086aa88999e78226f6c3e8b82","observation_id":"60fa4306-d88d-4795-abd4-8c68f273a1a2","resolution":{"observed_at":"2026-08-11T16:31:31.273011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.282606Z","title":"Uct: Learning unified convolutional networks for real-time visual tracking,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.282606Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:7355f6f759db607534fb61b948a67cb2af7d6fcc48b0e1abad90a763c75d19b1","observation_id":"493e6854-74b4-4bae-9c59-7c3387ccc3dd","resolution":{"observed_at":"2026-08-11T16:31:31.282606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.286779Z","title":"Branchout: Regularization for online ensemble tracking with convolutional neural networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.286779Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:b5a2c9eadb68722183a4819468197dd31307785b8e05a6bd713978d6bc8691b2","observation_id":"10d0b337-e4c5-4942-8d17-1e77da08c32e","resolution":{"observed_at":"2026-08-11T16:31:31.286779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.291619Z","title":"Correlation- aware deep tracking,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.291619Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:acf1a2313d3bcad3aea2eb1ac060c310f120be791c82066a8298dc158aa75237","observation_id":"ec8b8664-9840-4c27-a138-4866c921ccac","resolution":{"observed_at":"2026-08-11T16:31:31.291619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.295617Z","title":"Mixformer: End-to-end track- ing with iterative mixed attention,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.295617Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:716d182f90cf3ef24bcc99f3a935714c5a9760941fa0dc926fef0aa171594b8e","observation_id":"0b60f963-8b48-40b6-90fa-2e84c5011aae","resolution":{"observed_at":"2026-08-11T16:31:31.295617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.300332Z","title":"Learning dual-level deep representation for thermal infrared tracking,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.300332Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:e74dbfc5548e62e7d78cadc36df40030383c62934f24f4a50bc6bbf88a685d70","observation_id":"a92f98dd-204e-49b7-ab1a-b13f66e18a94","resolution":{"observed_at":"2026-08-11T16:31:31.300332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.305059Z","title":"Gfsnet: Generalization-friendly siamese network for thermal infrared object tracking,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.305059Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:d792f4e4fa3e62bdb9ef0151444ef931e34166aeb7ca7bf781e6410f08ecd894","observation_id":"87be72a5-8be4-4972-8e5a-7c5998762bb3","resolution":{"observed_at":"2026-08-11T16:31:31.305059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.309378Z","title":"Thermal infrared object tracking using correlation filters improved by level set,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.309378Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:141afa9338361cc193eb40ebd69b9a67cc1d577df9df7842b7483a1a4c70e3f1","observation_id":"b0e44dee-ecd5-4545-864b-3b021abc63b7","resolution":{"observed_at":"2026-08-11T16:31:31.309378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.314117Z","title":"P2b: Point-to-box network for 3d object tracking in point clouds,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.314117Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:230df7ef9c803ae4ec84a9b2aeffc277f957a2bd649e87507cbf2e4a6cff021e","observation_id":"1a005fae-81d7-4c9d-ac58-3f6cb968cb16","resolution":{"observed_at":"2026-08-11T16:31:31.314117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.318411Z","title":"Box- aware feature enhancement for single object tracking on point clouds,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.318411Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:7427836ebb83a19eabb7fcf4e30bb30ffbec0288d87900ffd18d17cdfb0da36d","observation_id":"42b147c9-72a2-4c68-9c91-befc91ee8be3","resolution":{"observed_at":"2026-08-11T16:31:31.318411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.322472Z","title":"Beyond 3d siamese tracking: A motion-centric paradigm for 3d single object tracking in point clouds,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.322472Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:52c67b09d28e958c5fc0c77627cf0a760f49aadfcd66f41c8ada7d84d36ac5cc","observation_id":"fe24cde3-a982-4575-8b42-f9847dfd96b0","resolution":{"observed_at":"2026-08-11T16:31:31.322472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.326570Z","title":"Sowp: Spatially or- dered and weighted patch descriptor for visual tracking,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.326570Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:024a4bae99d01379e6af30a38845db498f0706504a79c071a9e5be1c6cce945d","observation_id":"521e8834-fcd1-4548-bdc4-12b9dd4c1a84","resolution":{"observed_at":"2026-08-11T16:31:31.326570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.331051Z","title":"Weighted sparse representa- tion regularized graph learning for rgb-t object tracking,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.331051Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:9e2540fca02bbaecbe0c928199b9103cb23dd3c04d5e6e32ea7394dadc7427bc","observation_id":"4f6b37dd-3ccc-41f1-8700-89686542a295","resolution":{"observed_at":"2026-08-11T16:31:31.331051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.334749Z","title":"Learning adaptive attribute- driven representation for real-time rgb-t tracking,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.334749Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:0af67ed94ee9c107de2e53694e4e2cf66a120615434fb083f3d03d205a881214","observation_id":"c867e922-ab34-4de2-8e68-6f874f65c476","resolution":{"observed_at":"2026-08-11T16:31:31.334749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.339000Z","title":"F-siamese tracker: A frustum-based double siamese network for 3d single object tracking,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.339000Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:85dfb1fea10b15f8588f6c3019ed0885554d345f7d4153b21e4203d630177139","observation_id":"a57455c7-6594-40bb-a6bf-4a196109c167","resolution":{"observed_at":"2026-08-11T16:31:31.339000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.344308Z","title":"3d object tracking using rgb and lidar data,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.344308Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:5724ab0ffa27634c9a08e9e7765c5b529290e9a0c1de525fc5436c27d9a040c7","observation_id":"ffb3c152-d071-45f4-b7c3-0280df1ca227","resolution":{"observed_at":"2026-08-11T16:31:31.344308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.01076","last_updated":"2022-07-03T16:38:24Z","snapshot_observed_at":"2026-08-13T15:12:00.347431Z","submitted_at":"2022-07-03T16:38:24Z","title":"Divert More Attention to Vision-Language Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.01076","snapshot_observed_at":"2026-08-11T16:31:31.349570Z","title":"Divert more attention to vision- language tracking,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.349570Z"},"links":{"cited_paper":"/paper/2207.01076","citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:0bb510ccb20bbf57e58266cf33584a02b0c8473fa4f1c2f5afbd0dcf094f634b","observation_id":"a4bf185e-bf79-46ff-ab7f-7866452c4e31","resolution":{"observed_at":"2026-08-11T16:31:31.349570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.354605Z","title":"Handcrafted and deep trackers: Recent visual object tracking approaches and trends,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.354605Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:15606c8f9f99f8e0ddb41d9f81df74dd9a821e7fb1f91e1cab155ee3167ed159","observation_id":"251beb28-866d-4b5f-863c-a6510f2f83be","resolution":{"observed_at":"2026-08-11T16:31:31.354605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.360406Z","title":"Visual object tracking with discriminative filters and siamese networks: a survey and outlook,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.360406Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:1b56428b39f24978a4d678c15508093090e6cee8433c9313f16aae1af1ae2ad2","observation_id":"8f01648f-838a-4471-93db-b1c33b7f13d4","resolution":{"observed_at":"2026-08-11T16:31:31.360406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.364460Z","title":"Siamese visual object tracking: A survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.364460Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:c6d0ca5b902b09c9eb7ed19b99d025b3edbad7316a2200be8f6b9c1bff211684","observation_id":"f2c5a047-cb42-4522-a81b-1644b0d33051","resolution":{"observed_at":"2026-08-11T16:31:31.364460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.369469Z","title":"Recent advances of single-object tracking methods: A brief survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.369469Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:3e1a3556eb79312b028141b52bfc80f236524e601559e19e06ce1fdaa01f2c4a","observation_id":"9ddfdc4b-f777-489d-be6b-0acea3888969","resolution":{"observed_at":"2026-08-11T16:31:31.369469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.376248Z","title":"Visual object tracking: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.376248Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:da4c82028f0b36c9926837d3b3c4417c0584d3b5990db9d0a031c31c273658ec","observation_id":"ec55cf5f-e4c6-4140-842a-9df768e333cb","resolution":{"observed_at":"2026-08-11T16:31:31.376248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.380733Z","title":"Deep learning for visual tracking: A comprehensive survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.380733Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:264cd9e15a2b6db5bf327a57cb28629159c2cf65d7cd5f9d42a83793d23ceebe","observation_id":"8f98e9a9-9ad6-414f-b3c6-8f96a422733a","resolution":{"observed_at":"2026-08-11T16:31:31.380733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.385637Z","title":"Deep visual tracking: Review and experimental comparison,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.385637Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:6c0452e30496e798c5df2ed89fcaf25bf9c6d94e1319f12c398534d628a874a0","observation_id":"c7e95caf-e4f4-4765-9f32-107bc7d6ea37","resolution":{"observed_at":"2026-08-11T16:31:31.385637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.13066","last_updated":"2022-01-31T08:45:50Z","snapshot_observed_at":"2026-08-09T09:26:51.065753Z","submitted_at":"2022-01-31T08:45:50Z","title":"Single Object Tracking: A Survey of Methods, Datasets, and Evaluation Metrics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.13066","snapshot_observed_at":"2026-08-11T16:31:31.390462Z","title":"Single object tracking: A survey of methods, datasets, and evaluation metrics,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.390462Z"},"links":{"cited_paper":"/paper/2201.13066","citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:195e3e6a6f15204246957b95bd70ca208d4184133cdf4b842e4d929f9c6a585f","observation_id":"b1dce806-dfe7-4350-9f92-91a4a801d32b","resolution":{"observed_at":"2026-08-11T16:31:31.390462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.11410","last_updated":"2022-04-25T02:59:15Z","snapshot_observed_at":"2026-08-12T06:53:00.926285Z","submitted_at":"2022-04-25T02:59:15Z","title":"Single Object Tracking Research: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.11410","snapshot_observed_at":"2026-08-11T16:31:31.395508Z","title":"Single object tracking research: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.395508Z"},"links":{"cited_paper":"/paper/2204.11410","citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:c79f188b79edc6b2694c393b7d7fe94dad867cf1c43a6a965c9070c51fc7f647","observation_id":"f568543a-c48c-44d9-8392-f1af8e382f3e","resolution":{"observed_at":"2026-08-11T16:31:31.395508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.04176","last_updated":"2020-12-08T02:39:38Z","snapshot_observed_at":"2026-07-06T10:21:39.872468Z","submitted_at":"2020-12-08T02:39:38Z","title":"Multi-modal Visual Tracking: Review and Experimental Comparison","version":1},"cited_work":{"arxiv_id":"2012.04176","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.04176","snapshot_observed_at":"2026-08-11T16:31:32.698100Z","title":"Multi-modal Visual Tracking: Review and Experimental Comparison","venue":"cs.CV","work_id":"5aec584f-b8a9-406c-be15-3c922b8d69b5","year":2020},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.400530Z"},"links":{"cited_paper":"/paper/2012.04176","citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:e777fb2750ebc38508f5fe7b1a7fe83514424009f6868b738e1af86064700b88","observation_id":"1959ecdf-3290-44e4-adf1-0bfd28e554f8","resolution":{"observed_at":"2026-08-11T16:31:32.702920Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.404958Z","title":"Recent advances on multicue object tracking: a survey,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.404958Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:ab123523b24ca40fa32270fe24ac2b0a0ce4b59f779211ff1605cda99ba64551","observation_id":"55cb3586-24d8-4b1b-8b3c-c6aebe7d9782","resolution":{"observed_at":"2026-08-11T16:31:31.404958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.410326Z","title":"Recent trends in multicue based visual tracking: A review,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.410326Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:51e95c0b02bd43fc0d803e06831abf7ae48079a3663920e0b5b8a95bb2bfec6d","observation_id":"d96991d9-30f5-4cfc-86f5-a916ab96823f","resolution":{"observed_at":"2026-08-11T16:31:31.410326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.414783Z","title":"Recent advances and trends in visual tracking: A review,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.414783Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:5670e2894034b89c00fe24caf5f27d318f7bbf81650a04e75a7ea70952bb6bfc","observation_id":"fa8f6af4-667a-4fd7-866c-2291a6eab520","resolution":{"observed_at":"2026-08-11T16:31:31.414783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.420591Z","title":"A survey of appearance models in visual object tracking,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.420591Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:6d981e4b3f134d14051a1ecc4e3f891b386e620faa3e60d334304c91b1a2c00b","observation_id":"99158dac-f490-44d2-9ba7-cf68d5a781c9","resolution":{"observed_at":"2026-08-11T16:31:31.420591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.425052Z","title":"Visual tracking: An experimental survey,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.425052Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:f7c4f413e043887e0a7d5cee2c44c4eeba66a035263882628bc444049f113805","observation_id":"66f2746d-ac35-4d6b-828e-7a3650c52d9f","resolution":{"observed_at":"2026-08-11T16:31:31.425052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.429492Z","title":"A comparison of correlation filter-based trackers and struck trackers,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.429492Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:b1cb88ccdbd551800688b902e161e8c885e571d2dfd35d198c29bfed408a0970","observation_id":"39710fb0-0445-4fd4-9192-7b20c4815bdc","resolution":{"observed_at":"2026-08-11T16:31:31.429492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.436268Z","title":"Sparse coding based visual tracking: Review and experimental comparison,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.436268Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:d450c847780c4e307edd9495d4f2a88ece9d119c6036002d62c4ef901339778a","observation_id":"d53016c6-938d-4627-a99e-bef2ec438a30","resolution":{"observed_at":"2026-08-11T16:31:31.436268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.00569","last_updated":"2018-08-02T07:15:14Z","snapshot_observed_at":"2026-07-06T05:49:30.300264Z","submitted_at":"2017-07-03T14:27:10Z","title":"An In-Depth Analysis of Visual Tracking with Siamese Neural Networks","version":2},"cited_work":{"arxiv_id":"1707.00569","doi":null,"metadata_source":"pith","pith_arxiv_id":"1707.00569","snapshot_observed_at":"2026-08-11T16:31:32.680841Z","title":"An In-Depth Analysis of Visual Tracking with Siamese Neural Networks","venue":"cs.CV","work_id":"6dc1f0f9-1aa1-4330-a59f-f3a15cadd8ab","year":2017},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.441636Z"},"links":{"cited_paper":"/paper/1707.00569","citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:802fd526aa30530a2762e73d63c59a8a9196660d2fcd124cb4d3c32b82afb6b3","observation_id":"99bc8c8c-4d48-4531-8372-a3a5b9d4cf45","resolution":{"observed_at":"2026-08-11T16:31:32.685464Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.447160Z","title":"Object tracking: A survey,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.447160Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:e67f75804964af44c95b153386f7c0f99a32f2eb0cf3d188e26d8538e2c77ae2","observation_id":"f368ad87-a9c3-46de-bdff-c91820320b8f","resolution":{"observed_at":"2026-08-11T16:31:31.447160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14134","last_updated":"2022-03-26T18:53:51Z","snapshot_observed_at":"2026-07-06T12:52:48.251710Z","submitted_at":"2022-03-26T18:53:51Z","title":"RGBD Object Tracking: An In-depth Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14134","snapshot_observed_at":"2026-08-11T16:31:31.451726Z","title":"Rgbd object tracking: An in-depth review,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.451726Z"},"links":{"cited_paper":"/paper/2203.14134","citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:616ce0e1c2bcb1ede90ef8eeb7e99e8f7d3b8b2e93c84ba72bec253d11e10255","observation_id":"ef23938d-7208-42b9-b2b2-20614397f426","resolution":{"observed_at":"2026-08-11T16:31:31.451726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.456582Z","title":"Object fusion track- ing based on visible and infrared images: A comprehensive review,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.456582Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:899203e4ee5276d6d391bd7241e10ba76c807fd74e0a4f1a166c6b651d9eae0a","observation_id":"e793f389-378e-4583-b36d-e9191cf8fcc3","resolution":{"observed_at":"2026-08-11T16:31:31.456582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.465345Z","title":"The sixth visual object tracking vot2018 challenge results,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.465345Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:7042afc76fb83d6f68164fc3dbc2c6399c8ad2e748a77d39c469b3fecdbe87d2","observation_id":"b808df41-fced-4914-a22e-14a4773528fb","resolution":{"observed_at":"2026-08-11T16:31:31.465345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.470609Z","title":"A benchmark and simulator for uav tracking,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.470609Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:ecd4b9475c44244f50224469d951910d435802dde56c2b731ec308d0416b1ac0","observation_id":"986b4468-da90-4e8f-a99d-8bfe900b1f75","resolution":{"observed_at":"2026-08-11T16:31:31.470609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.475285Z","title":"Need for speed: A benchmark for higher frame rate object tracking,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.475285Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:5b91f30619ad4eb0f642c13deabe17b871880639a50c691e986a6766840ae029","observation_id":"885ae1af-eb0f-4937-8bb0-606c4f3da842","resolution":{"observed_at":"2026-08-11T16:31:31.475285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.479240Z","title":"Object tracking benchmark,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.479240Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:111f053f8f6a72a975a05fb983965ac5bdcb216c518cdb7c39bbda6510990ce7","observation_id":"34cf144a-25dd-4bdc-bf09-3f85988faa96","resolution":{"observed_at":"2026-08-11T16:31:31.479240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.483134Z","title":"Robust visual object tracking via adaptive attribute-aware discriminative correlation filters,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.483134Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:700ce4a74ba722e4511d4e1679b602731b0f7f49c3e8bec514a47412d97dffc3","observation_id":"74628fc5-5eef-449e-9fdd-7c2b487ad32b","resolution":{"observed_at":"2026-08-11T16:31:31.483134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.487707Z","title":"Bilateral weighted regression ranking model with spatial-temporal correlation filter for visual tracking,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.487707Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:f354b5dc7d78623c094a7cf32027b3d5d8eee07601cc06f6b583b98e22b81333","observation_id":"95655b0e-0d54-4b8c-a81e-479abd1c59eb","resolution":{"observed_at":"2026-08-11T16:31:31.487707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.492427Z","title":"Siamcorners: Siamese corner networks for visual tracking,","venue":null,"work_id":null,"year":1956},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.492427Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:2ecfd9ebaa210e96e179ba9bbf657264c9220641fbac21e57046a247e1038ac0","observation_id":"d921b52c-1bb4-40ec-8a05-d02dfe3c9a19","resolution":{"observed_at":"2026-08-11T16:31:31.492427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.496430Z","title":"Stgl: Spatial- temporal graph representation and learning for visual tracking,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.496430Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:153a1af6912e3a56bef3a031711e9b8dc2ce65e0f4b8051e42c339e95a091958","observation_id":"b40d47db-8239-4e8c-9a12-a53188fe7e46","resolution":{"observed_at":"2026-08-11T16:31:31.496430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.500363Z","title":"Discriminative siamese complementary tracker with flexible update,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.500363Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:69fdf79fe393dda9de15ec26e5837dadb47ee476dd0c5344ee9d934fd530688e","observation_id":"232ac84e-a229-4e38-a5ba-c7e946b68cee","resolution":{"observed_at":"2026-08-11T16:31:31.500363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.504934Z","title":"Siamese implicit region proposal network with compound attention for visual tracking,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.504934Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:1439b6d24e0ec5fa98e6cc69675e779a5b090475a7f02f3951eca198cf94b1da","observation_id":"feae254c-87e9-41e4-8ebb-f31113830ea6","resolution":{"observed_at":"2026-08-11T16:31:31.504934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.510886Z","title":"Learning feature channel weighting for real-time visual tracking,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.510886Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:bb4b0ef624b83e9ca9b88c9e2f7f14ac077299571a26b107f6f37e6e98ff1aaa","observation_id":"f287ccfc-16fb-405e-8180-3e2fea9bd3ab","resolution":{"observed_at":"2026-08-11T16:31:31.510886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.515098Z","title":"Global tracking via ensemble of local trackers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.515098Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:e8862bc305272d8e5a8d6e3540145633e9c8f9154c13d1f3c149723ed645e579","observation_id":"c76c853b-1942-4623-a008-d9ef76f4104c","resolution":{"observed_at":"2026-08-11T16:31:31.515098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.519462Z","title":"Unified transformer tracker for object tracking,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.519462Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:f22fba76a92570fb5d917fc1b1141e9f32d9244148fb3f27f1c46098f6516f19","observation_id":"125666dc-b848-4ce1-9c03-da1eaa6ce1a9","resolution":{"observed_at":"2026-08-11T16:31:31.519462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.524348Z","title":"Ranking-based siamese visual tracking,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.524348Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:e998be00aa322c2fcf376853c5f925ffd1aa96599be10376fd4951076a9f478e","observation_id":"ab06daad-367e-4348-b147-e1c8371e72ce","resolution":{"observed_at":"2026-08-11T16:31:31.524348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.528508Z","title":"Transformer tracking with cyclic shifting window attention,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.528508Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:111084e3278a49b082fa3984d5274762a1f334387748eb7ef9b70c53d169cb5c","observation_id":"feda4106-0932-4f26-937f-f3584fdb1fa2","resolution":{"observed_at":"2026-08-11T16:31:31.528508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.02526","last_updated":"2022-01-07T16:22:27Z","snapshot_observed_at":"2026-07-06T12:25:30.741916Z","submitted_at":"2022-01-07T16:22:27Z","title":"Learning Target-aware Representation for Visual Tracking via Informative Interactions","version":1},"cited_work":{"arxiv_id":"2201.02526","doi":null,"metadata_source":"pith","pith_arxiv_id":"2201.02526","snapshot_observed_at":"2026-08-11T16:31:32.651670Z","title":"Learning Target-aware Representation for Visual Tracking via Informative Interactions","venue":"cs.CV","work_id":"1ee1e7cc-04a6-4387-a221-21b5412e84fb","year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.532890Z"},"links":{"cited_paper":"/paper/2201.02526","citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:9f3e87a4a2f378ee92176c35e939eef843a623a960e32b64dd2f04ea5709db27","observation_id":"1c7d677f-e2a0-429e-91e1-0b75cbe0e1ca","resolution":{"observed_at":"2026-08-11T16:31:32.656036Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03776","last_updated":"2022-05-08T04:00:28Z","snapshot_observed_at":"2026-07-06T13:07:44.802145Z","submitted_at":"2022-05-08T04:00:28Z","title":"SparseTT: Visual Tracking with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.03776","snapshot_observed_at":"2026-08-11T16:31:31.537168Z","title":"Sparsett: Visual tracking with sparse transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.537168Z"},"links":{"cited_paper":"/paper/2205.03776","citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:49e9ab1a05f4fbf37931db9a1cf42c3e655ee1fca99c2f967c26e0d21dfc0980","observation_id":"03e35e3f-fbda-44b9-94d4-eb310f025af5","resolution":{"observed_at":"2026-08-11T16:31:31.537168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11179","last_updated":"2022-05-23T10:31:14Z","snapshot_observed_at":"2026-07-06T13:12:46.883502Z","submitted_at":"2022-05-23T10:31:14Z","title":"Online Hybrid Lightweight Representations Learning: Its Application to Visual Tracking","version":1},"cited_work":{"arxiv_id":"2205.11179","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.11179","snapshot_observed_at":"2026-08-11T16:31:32.619177Z","title":"Online Hybrid Lightweight Representations Learning: Its Application to Visual Tracking","venue":"cs.CV","work_id":"55cb931f-c00c-4d08-947d-e107ac663e12","year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.541240Z"},"links":{"cited_paper":"/paper/2205.11179","citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:edb9db104306ae66a10b8241e5b3a994b91ddaef729e46a6ea32bfab2ab6c618","observation_id":"4fda7e22-c83a-4761-85bb-ba10bb6ce512","resolution":{"observed_at":"2026-08-11T16:31:32.624327Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.547245Z","title":"Towards sequence-level training for visual tracking,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.547245Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:f8710100864ea1806ed3949d1786f48302d022b292d7e9ca7bccbaa21cafb75b","observation_id":"2c488359-c965-4284-829a-27df9b4b9ff2","resolution":{"observed_at":"2026-08-11T16:31:31.547245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.551895Z","title":"Towards grand unification of object tracking,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.551895Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:fa2c617f421d6e0b7467b54b5013d1aaea7494bf50800133128a0545b78ef911","observation_id":"9b872758-58ff-4865-bfa9-0364208753cc","resolution":{"observed_at":"2026-08-11T16:31:31.551895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.555797Z","title":"Robust visual tracking by segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.555797Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:0d56e51f5807983e30138a829f062265222c8c70acb79746e1d71241734373db","observation_id":"08cb77ce-9209-4920-92f8-b0101ef069d0","resolution":{"observed_at":"2026-08-11T16:31:31.555797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.559947Z","title":"Aiatrack: Attention in attention for transformer visual tracking,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.559947Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:255845a16caa53d163a810c537ad7db2a6682787b26a1b1831996a6f9c7c690a","observation_id":"e71314db-2571-4f6e-b968-1754921dc844","resolution":{"observed_at":"2026-08-11T16:31:31.559947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.564192Z","title":"Foreground-background distribution modeling transformer for visual object tracking,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.564192Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:b3f5a98cfadbd718fa40ccfef2cf173cfca7872724068b02613c454b2f80049d","observation_id":"f4ce0304-5941-4194-bf00-f46d2a01e8e3","resolution":{"observed_at":"2026-08-11T16:31:31.564192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.567796Z","title":"Robust object modeling for visual tracking,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.567796Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:dc4d284664e3fe3bfef64ffd54726f1187cd55710a1218955b489461ea0ee0a7","observation_id":"089ee8b7-8fc5-46f8-b56d-6e2140b0d93f","resolution":{"observed_at":"2026-08-11T16:31:31.567796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.571400Z","title":"Mixformerv2: Efficient fully transformer tracking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.571400Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:eff01078cd8874719d957e35276a6bd315bc38e3e114e3efc5f5a0b712e66c9a","observation_id":"8775d2c0-89fd-4053-ac4a-4b898cdc9ce1","resolution":{"observed_at":"2026-08-11T16:31:31.571400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.575348Z","title":"Reading relevant feature from global representation memory for visual object tracking,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.575348Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:6df22c811c09e4e69ac93639d0faa37a3029e12cde83e02697090683b8b67ef2","observation_id":"2a542953-ac2f-4f4f-b6bf-57d7a810e1cf","resolution":{"observed_at":"2026-08-11T16:31:31.575348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.579445Z","title":"Dropmae: Masked autoencoders with spatial-attention dropout for tracking tasks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.579445Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:e2aa27c0e10d780700a680efa6e3f691138ea313b68b30d28a8a462526bdc705","observation_id":"6ffa1e39-14f9-465d-b093-a9206b0767ab","resolution":{"observed_at":"2026-08-11T16:31:31.579445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.583507Z","title":"Generalized relation modeling for transformer tracking,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.583507Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:e5adf29bf7daf85648d518f854c7f5f54105e2897793f1a39be47b7de559aa9e","observation_id":"5481bd9e-cbb9-41d6-93ef-32e62ce9e05a","resolution":{"observed_at":"2026-08-11T16:31:31.583507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.587860Z","title":"Autoregressive visual tracking,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.587860Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:89d528d7541b282f0bbfbcfc657ecedcdcd8daf563585bad9bc4a918ae020ae1","observation_id":"46899b9b-77df-4eb5-a857-ca9ea121e576","resolution":{"observed_at":"2026-08-11T16:31:31.587860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.592032Z","title":"Seqtrack: Sequence to sequence learning for visual object tracking,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.592032Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:d1772b0a421246924c84482e37cc65c08e366151394ef3634f45a0ed08457933","observation_id":"2935f603-1547-4d8f-babd-1b29e7d824e9","resolution":{"observed_at":"2026-08-11T16:31:31.592032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.595858Z","title":"Videotrack: Learning to track objects via video transformer,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.595858Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:9a4d0108272a49de593a9fafaec40f290a66c03e64d11eaa3978fb89cf3e330c","observation_id":"76fcff6c-2b29-484e-b315-919dd2e71d7f","resolution":{"observed_at":"2026-08-11T16:31:31.595858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.02072","last_updated":"2024-04-02T09:00:38Z","snapshot_observed_at":"2026-08-13T08:03:40.763336Z","submitted_at":"2023-11-03T17:54:59Z","title":"HIPTrack: Visual Tracking with Historical Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.02072","snapshot_observed_at":"2026-08-11T16:31:31.599365Z","title":"Learning historical status prompt for accurate and robust visual tracking,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.599365Z"},"links":{"cited_paper":"/paper/2311.02072","citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:17e9dea6b654677db7a633cc97a6d3a762a6d0306fe33dff62930d9597256b20","observation_id":"3f90ac8e-f9d4-43aa-a7f8-223860d3fa53","resolution":{"observed_at":"2026-08-11T16:31:31.599365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01686","last_updated":"2024-01-03T11:44:09Z","snapshot_observed_at":"2026-08-13T04:49:38.413148Z","submitted_at":"2024-01-03T11:44:09Z","title":"ODTrack: Online Dense Temporal Token Learning for Visual Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01686","snapshot_observed_at":"2026-08-11T16:31:31.603362Z","title":"Odtrack: Online dense temporal token learning for visual tracking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.603362Z"},"links":{"cited_paper":"/paper/2401.01686","citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:8b3fc9bfd31782b2bee1685ee406ba45fb09c13e926a369eb0507e3ea0889b70","observation_id":"fc031207-a284-4bb7-9624-0ebb29872086","resolution":{"observed_at":"2026-08-11T16:31:31.603362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03142","last_updated":"2024-01-06T07:12:07Z","snapshot_observed_at":"2026-08-13T04:48:08.919651Z","submitted_at":"2024-01-06T07:12:07Z","title":"Explicit Visual Prompts for Visual Object Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03142","snapshot_observed_at":"2026-08-11T16:31:31.607253Z","title":"Explicit visual prompts for visual object tracking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.607253Z"},"links":{"cited_paper":"/paper/2401.03142","citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:afbc69caf2647c86fcd7e52bdc80fc2eda0245ae6a6c95a43e5e1e5a44fadea8","observation_id":"929561d2-4100-46bb-a474-22897604e684","resolution":{"observed_at":"2026-08-11T16:31:31.607253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.611566Z","title":"Dynamic saliency- aware regularization for correlation filter-based object tracking,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.611566Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:385e9d19b5b3e6e84d850642196c6373ca2b2dcd635ac1c38c5ae717a1a402a9","observation_id":"4a6345e3-62bc-46f1-8057-1b45e1c6fe24","resolution":{"observed_at":"2026-08-11T16:31:31.611566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.615255Z","title":"Learning adaptive discrim- inative correlation filters via temporal consistency preserving spatial feature selection for robust visual object tracking,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.615255Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:7f6b479ec55dba04ff807837a74faff612e0529a97f1b715ab9b49103ea03146","observation_id":"8c97b500-2313-4a34-abea-01ce1bd811c4","resolution":{"observed_at":"2026-08-11T16:31:31.615255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.619043Z","title":"Quadruplet network with one-shot learning for fast visual object tracking,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.619043Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:3969673291de81f1f1dafb7b91a8e3cf070bf70bd82bacb6fb080490b8c24aad","observation_id":"69bcf168-959f-4fc8-910b-df97bd8175ed","resolution":{"observed_at":"2026-08-11T16:31:31.619043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.622712Z","title":"Visual tracking via dynamic graph learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.622712Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:fbfba6f97197ab3a953e70e233333852ec8d01d2228651199070684490494fdf","observation_id":"c04ecbef-febd-4c43-a168-2afac3f99156","resolution":{"observed_at":"2026-08-11T16:31:31.622712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:31:31.626384Z","title":"Robust estimation of similarity transformation for visual object tracking,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-11T16:31:31.626384Z"},"links":{"citing_paper":"/paper/2412.09991"},"observation_digest":"sha256:ecf83cfd63142c4f9e8f35132722e5f5e81fa04f776da6fe46939c69600ff187","observation_id":"e32ad8bb-4390-4025-8ddd-48306f4e10fb","resolution":{"observed_at":"2026-08-11T16:31:31.626384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.09991","last_updated":"2024-12-13T09:25:18Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T16:26:07.357113Z","submitted_at":"2024-12-13T09:25:18Z","title":"Visual Object Tracking across Diverse Data Modalities: A Review"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":96,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":293},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 100 of 293 outbound references and 0 inbound Pith citation observations for arXiv:2412.09991."}