{"as_of":"2026-08-10T01:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:412a52fb7c50920dd501ce0d0ed67796db7cfb524f889181eec1b7c630dc4d91","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:20:11.741140Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.16191/citation-record","integrity":"/paper/2507.16191/integrity","json":"/paper/2507.16191/citation-record.json","paper":"/paper/2507.16191"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.867216Z","title":null,"venue":null,"work_id":"5224c50f-395a-4ba6-bd80-5f974be83233","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.436117Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:02cede11cbe515f2c0c3677905033469f3bb1f2fdcc72693c51872c67a6566d8","observation_id":"73dd2ece-d6c3-4e29-9d40-981f14284984","resolution":{"observed_at":"2026-08-06T15:20:17.871540Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.851236Z","title":null,"venue":null,"work_id":"5ff2a5fe-93f1-4520-861a-c63f6276f8d5","year":2016},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.488508Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:5ef659e5488e8b07f04a3168983ced41c56cc718bff613d7ba9dc0d690ea1f61","observation_id":"47eaceea-12ff-473e-99a0-16943240b4de","resolution":{"observed_at":"2026-08-06T15:20:17.855835Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.835758Z","title":null,"venue":null,"work_id":"4d3ae0ed-cf3f-4895-8625-5bd3d13b4275","year":2016},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.555077Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:0cb3513db0839bfa1e6117ed05804b40dcf09c69189fe52bf48704b6d2ba95a4","observation_id":"ae77e0b9-963e-44cd-8659-5c3263dc5746","resolution":{"observed_at":"2026-08-06T15:20:17.840222Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.820613Z","title":null,"venue":null,"work_id":"6b231495-e2bf-498f-a13c-41590b6bb470","year":2023},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.631539Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:5872fcfadb0edafe9ad540c62a5237dc9bbad0b25cbeecd89cd38cb4829fbc71","observation_id":"2aa79352-80c6-4508-9d4b-710b9caf63dd","resolution":{"observed_at":"2026-08-06T15:20:17.825397Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.804514Z","title":null,"venue":null,"work_id":"685f0a72-1a3b-483c-a760-d5510e0fa9ba","year":2023},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.684799Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:fe91530b58ecb7daaf4e36d694ef663a661089cd049ab253ab55e59f20a7b78c","observation_id":"f1951da9-b135-44d9-9abe-2d4d55f1720b","resolution":{"observed_at":"2026-08-06T15:20:17.809137Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:06.794045Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.794045Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:176fcc3b51757be426b41e69dcf06eb1f46c4c2e9cf87891c80efff5568f1782","observation_id":"f719d3a6-8d39-4bc0-92aa-0bac478e07d1","resolution":{"observed_at":"2026-08-06T15:20:06.794045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.762819Z","title":null,"venue":null,"work_id":"c5439a9e-bd96-4634-b394-807764e81b70","year":2022},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.966483Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:5961a66240dc8194b866ed499044acc8a9277923a10eec9ab26460c97e8d0446","observation_id":"2107af4c-0d6f-4235-b5cd-cf8279eeb3e0","resolution":{"observed_at":"2026-08-06T15:20:17.767230Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.746756Z","title":null,"venue":null,"work_id":"66a868e2-864f-4a44-bc08-908a5a2809c5","year":2022},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.037025Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:aba67e087dfb265133799ce7019724d93edfa716a4ceca39f68df6bd6c4a90d6","observation_id":"f911f9f0-6e28-4ca9-8575-049aa7b9c0d4","resolution":{"observed_at":"2026-08-06T15:20:17.751244Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:07.141500Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.141500Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:bd69acfe32b9d3c38257ae8cdcf7a00d4ad883a34f87a7dfaf768d7dd692a225","observation_id":"9f65a3bf-0ea9-4da9-9c67-c57f0552873a","resolution":{"observed_at":"2026-08-06T15:20:07.141500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T15:20:07.330723Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.330723Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:aa026ce63f8ecfe1616fe925a783984edee2d0e1b444eaa24d43a4c7d8da237f","observation_id":"81d5d451-0c11-489d-b783-487ed94d7465","resolution":{"observed_at":"2026-08-06T15:20:07.330723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.692758Z","title":null,"venue":null,"work_id":"ea9c476d-d751-4b7c-b836-8d5c29b4e540","year":2021},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.410714Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:a11f50ed8d7cf890ea160a337ba89ca85b82f41f0d420033aa060c5637612a3f","observation_id":"94da75b9-5e96-48f9-9836-3295d026e025","resolution":{"observed_at":"2026-08-06T15:20:17.700598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.674446Z","title":null,"venue":null,"work_id":"e443773e-fa5d-4daf-93fe-c03145fe0714","year":2019},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.490486Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:d16a12b66646a3db61220ecb6d5a870381f0c734d05ca5f1f94bd62ded2bcc83","observation_id":"2dc6ba60-5252-4111-8e16-1585c8be0ffa","resolution":{"observed_at":"2026-08-06T15:20:17.679095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.657395Z","title":null,"venue":null,"work_id":"17ae8991-80d9-4602-a4f0-b1ba70059154","year":2021},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.600908Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:e110c0a5666d1fc9e7743a63b00ffb0195bc5f6d8f236600a3ba98079ab488ad","observation_id":"08dc74d6-35e0-4d28-a49d-36e152d96104","resolution":{"observed_at":"2026-08-06T15:20:17.662883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-06T15:20:07.645474Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.645474Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:c6172873b9abe12809499a4604263c4756dcc4b21433a562e994f128ffd34d1a","observation_id":"de66318f-3ce9-4d46-be45-a6c0b902060b","resolution":{"observed_at":"2026-08-06T15:20:07.645474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.11893","last_updated":"2022-08-05T17:02:29Z","snapshot_observed_at":"2026-07-06T13:24:06.368922Z","submitted_at":"2022-06-23T17:58:39Z","title":"On the Parameterization and Initialization of Diagonal State Space Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.11893","snapshot_observed_at":"2026-08-06T15:20:07.738897Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.738897Z"},"links":{"cited_paper":"/paper/2206.11893","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:99fc3f052c56b6aa7b310201051ba94ec8d5ca0e21d890491acde65a34ea85dc","observation_id":"64ebe64b-361f-43d7-81cc-190513cc7106","resolution":{"observed_at":"2026-08-06T15:20:07.738897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14343","last_updated":"2022-05-18T18:30:07Z","snapshot_observed_at":"2026-08-09T05:32:40.512416Z","submitted_at":"2022-03-27T16:30:33Z","title":"Diagonal State Spaces are as Effective as Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14343","snapshot_observed_at":"2026-08-06T15:20:07.799580Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.799580Z"},"links":{"cited_paper":"/paper/2203.14343","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:07f1f92c7fccf23d659ce6ba78fbe6d75342862397d6adc7d18b2196908b1680","observation_id":"d39db7d6-21ef-4e9a-b990-4db86fcd228f","resolution":{"observed_at":"2026-08-06T15:20:07.799580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15691","last_updated":"2024-12-20T09:10:17Z","snapshot_observed_at":"2026-07-06T20:10:46.746601Z","submitted_at":"2024-12-20T09:10:17Z","title":"Exploiting Multimodal Spatial-temporal Patterns for Video Object Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15691","snapshot_observed_at":"2026-08-06T15:20:07.878115Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.878115Z"},"links":{"cited_paper":"/paper/2412.15691","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:a1dba315d19f83b917deaa7209e112d85fd47fd3f8da56e83a4a66f55e4b6664","observation_id":"ac6c7c01-1c17-4d32-a60e-9ef0a9aaa8ce","resolution":{"observed_at":"2026-08-06T15:20:07.878115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06583","last_updated":"2025-02-10T15:50:26Z","snapshot_observed_at":"2026-08-08T14:55:18.557727Z","submitted_at":"2025-02-10T15:50:26Z","title":"Adaptive Perception for Unified Visual Multi-modal Object Tracking","version":1},"cited_work":{"arxiv_id":"2502.06583","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.06583","snapshot_observed_at":"2026-08-06T15:20:13.646436Z","title":"Adaptive Perception for Unified Visual Multi-modal Object Tracking","venue":"cs.CV","work_id":"e4425109-f42b-446b-a14e-231c5ecf1748","year":2025},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.965249Z"},"links":{"cited_paper":"/paper/2502.06583","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:0cdf316c07ac1e0ffd34be2700b9cb8b9c2189e19089f745729f2b40c6b140de","observation_id":"16c70ea3-faff-4ac1-8bd3-9e1cdca7e96a","resolution":{"observed_at":"2026-08-06T15:20:13.728895Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.33962","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:13.433980Z","title":null,"venue":null,"work_id":"aa54cff9-118a-482d-8050-e7058f6f680b","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.043985Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:338cb10e5a0cecd549459d7314b24f0109a10f16b44fdd5bac6f4945e23f6f66","observation_id":"78074902-1021-4349-8877-d4246884fda2","resolution":{"observed_at":"2026-08-06T15:20:13.512529Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.32896","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:13.191874Z","title":null,"venue":null,"work_id":"d467b015-02b1-48d9-ab18-4fae37b35b13","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.145994Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:7cc206ead1cfc04db14afb26e104cb34778a1ee7bd638d34dc067b6dc76826df","observation_id":"6468cfbd-3bb7-4631-9480-50ab094f3d06","resolution":{"observed_at":"2026-08-06T15:20:13.261635Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.594856Z","title":null,"venue":null,"work_id":"9e4ebbff-bf12-4f2b-860f-5587e5620b9a","year":2019},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.205829Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:dbc3a0faaee5ed54f3d0a780118b68bb3511ecc879f9db66ad9b83dfac8ea5cd","observation_id":"e11e4810-4f52-442a-9b28-69af28e7c6bc","resolution":{"observed_at":"2026-08-06T15:20:17.645965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.398738Z","title":null,"venue":null,"work_id":"db555946-778b-48e7-b2db-ad6ec5071227","year":2019},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.307505Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:e5e084ae1567f2d3f65d02120f01fa6a7fe21e013cbc3808facd1cb14ca01125","observation_id":"ec5ddedb-3e92-4d90-8007-ab91ceb16a00","resolution":{"observed_at":"2026-08-06T15:20:17.524056Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.142427Z","title":null,"venue":null,"work_id":"cb5a58a6-4793-4911-9db7-7320558415d8","year":2018},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.405190Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:fb5a6a31a52dfa6437f9bad98ebb2ac32365daa8980f282746a1079191502bd2","observation_id":"0ade4111-c17b-4724-bbec-881a7c8b2441","resolution":{"observed_at":"2026-08-06T15:20:17.279990Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13615","last_updated":"2024-12-18T08:53:52Z","snapshot_observed_at":"2026-08-06T13:35:49.932865Z","submitted_at":"2024-12-18T08:53:52Z","title":"MambaLCT: Boosting Tracking via Long-term Context State Space Model","version":1},"cited_work":{"arxiv_id":"2412.13615","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.13615","snapshot_observed_at":"2026-08-06T15:20:12.944661Z","title":"MambaLCT: Boosting Tracking via Long-term Context State Space Model","venue":"cs.CV","work_id":"c555224a-ac85-4355-82dd-f350f1f85ca5","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.484726Z"},"links":{"cited_paper":"/paper/2412.13615","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:dff8dca5e956c4b2eed731fc43efba383ed7e553125d74ccd4cf23eb88e81e29","observation_id":"ab453aef-ee02-4fb6-8c20-137504230734","resolution":{"observed_at":"2026-08-06T15:20:13.021855Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.02002","last_updated":"2018-02-07T18:44:44Z","snapshot_observed_at":"2026-07-06T05:54:18.908943Z","submitted_at":"2017-08-07T06:32:42Z","title":"Focal Loss for Dense Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.02002","snapshot_observed_at":"2026-08-06T15:20:08.578635Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.578635Z"},"links":{"cited_paper":"/paper/1708.02002","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:5beff49e3beef52d6eb245c451b72985647dfb2a82c2ddd2fc276b92fe6d76d7","observation_id":"ad2e4d76-3a2b-4432-85a7-47d4ac9405e5","resolution":{"observed_at":"2026-08-06T15:20:08.578635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:08.685807Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.685807Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:c8cda6b9ec25d64900678522f97d457430dd4e1f2e71ddb578b7191a71e823b8","observation_id":"e5e3666d-b374-4053-a524-4d689d72ecec","resolution":{"observed_at":"2026-08-06T15:20:08.685807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10166","last_updated":"2024-12-29T14:57:13Z","snapshot_observed_at":"2026-07-06T17:17:31.008185Z","submitted_at":"2024-01-18T17:55:39Z","title":"VMamba: Visual State Space Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10166","snapshot_observed_at":"2026-08-06T15:20:08.752195Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.752195Z"},"links":{"cited_paper":"/paper/2401.10166","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:e28b17078c5c65fc96eacad6e28b567ee86c585c7b93098f3a2464c5deea3348","observation_id":"829d0531-e278-4a23-9bcf-209ffed99b1b","resolution":{"observed_at":"2026-08-06T15:20:08.752195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T15:20:08.832478Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.832478Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:0a88a0ebdd387d9815690504a3be0f95c3a256c5527c7ef4ca88488fb057d82f","observation_id":"52781879-acbd-4951-86b2-3a5ceb70ada2","resolution":{"observed_at":"2026-08-06T15:20:08.832478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:16.852868Z","title":null,"venue":null,"work_id":"2974af9e-33c7-476d-aed6-1bc3f035235e","year":2018},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.906292Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:4334953bda813dab6ba0b5449473bec77384326042e749dbd9f27f19031df037","observation_id":"36b02ad8-d1f8-4877-9a63-61a88c50fc49","resolution":{"observed_at":"2026-08-06T15:20:16.996359Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:09.052292Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.052292Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:50658626e47223ecd9b362d9a94c4db45bc3ac499c3046980e24506bb8f44376","observation_id":"5f14433e-0986-4709-8465-e9baedebef07","resolution":{"observed_at":"2026-08-06T15:20:09.052292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:09.161075Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.161075Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:3780e022900549b42f7e29abc03388c7fd3a1b7ce45d0bcaeee059f87e2f7da7","observation_id":"eef7b4e2-4904-4f84-b89d-71d1b75a522f","resolution":{"observed_at":"2026-08-06T15:20:09.161075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:16.541804Z","title":null,"venue":null,"work_id":"ecd37755-65fb-469f-8c5b-3a1c3d5fac3a","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.266401Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:11075a332a4ea06245ada7fd3b1957e92efe379b510ef285a8d2000d4d61d1f6","observation_id":"381930cf-aff3-46c3-9379-f6848e667287","resolution":{"observed_at":"2026-08-06T15:20:16.708265Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19694","last_updated":"2023-10-30T16:11:06Z","snapshot_observed_at":"2026-08-05T16:49:20.850159Z","submitted_at":"2023-10-30T16:11:06Z","title":"Convolutional State Space Models for Long-Range Spatiotemporal Modeling","version":1},"cited_work":{"arxiv_id":"2310.19694","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.19694","snapshot_observed_at":"2026-08-06T15:20:12.594924Z","title":"Convolutional State Space Models for Long-Range Spatiotemporal Modeling","venue":"cs.LG","work_id":"ce1edf54-67fc-485c-b4ef-8c429761f1b0","year":2023},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.310282Z"},"links":{"cited_paper":"/paper/2310.19694","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:c05f9b86a340717dc6c25c35e5e0e08bb4cfc0f9c192a5342625914cb41ec42c","observation_id":"d7fa4688-1b7e-4212-a145-9a43fa8862ae","resolution":{"observed_at":"2026-08-06T15:20:12.662630Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:16.358871Z","title":null,"venue":null,"work_id":"d958151d-c344-496f-ab32-7316f29de86b","year":2023},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.395479Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:1c996f00c1c4a56307b6dc2f5d4d93d0c80cb178e9b46b93efd8d096f40bda8b","observation_id":"3593425f-ccc0-41c3-afb3-87379868f7d4","resolution":{"observed_at":"2026-08-06T15:20:16.439744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:16.183977Z","title":null,"venue":null,"work_id":"bf7c7d7b-13f9-4211-ac9f-6ef903ef2347","year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.476302Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:2474d512357a49187303315cda8932988b6f593264edc829f82da8e73f104382","observation_id":"6504bb16-e0e2-4176-b88e-72c8790a75b7","resolution":{"observed_at":"2026-08-06T15:20:16.268835Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:15.758828Z","title":null,"venue":null,"work_id":"b1a9afc5-a8f0-4cce-bab0-f41c3c851ce8","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.659536Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:1d97677c506199c9370215ebbcc2d7cba0084b7c1e2590a4a4563396d5e270ac","observation_id":"5e99ffb6-273a-4e3b-96ce-e2ea73586f84","resolution":{"observed_at":"2026-08-06T15:20:15.840732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:15.594803Z","title":null,"venue":null,"work_id":"6a3ec2cf-0c3b-4eca-bd3f-f59696457e64","year":2021},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.739628Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:f4404c41bc6ef01236aaef04f560d226139fc81b338c3f10a8b863980ea99f45","observation_id":"3d130926-55ce-4971-8412-66d39c05eeb1","resolution":{"observed_at":"2026-08-06T15:20:15.676551Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:15.435666Z","title":null,"venue":null,"work_id":"812914ca-1143-4059-a4b9-aec7bca29db8","year":2023},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.842035Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:b0f7c586baf7357ce400dcd60798ba10db4bd2e5d883a8957c8c2d8e2da7c060","observation_id":"8a43d840-7c27-4c68-a54e-23cac48140ef","resolution":{"observed_at":"2026-08-06T15:20:15.512256Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.06521","last_updated":"2018-07-18T11:20:08Z","snapshot_observed_at":"2026-08-03T21:23:12.210486Z","submitted_at":"2018-07-17T16:05:59Z","title":"CBAM: Convolutional Block Attention Module","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.06521","snapshot_observed_at":"2026-08-06T15:20:09.919343Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.919343Z"},"links":{"cited_paper":"/paper/1807.06521","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:4088bdaefc3d32249bc73dda7b3ee4cc37e1369886431fd33a389fc05b243a4b","observation_id":"d3258a87-35c8-413e-9aed-bbbc483f5263","resolution":{"observed_at":"2026-08-06T15:20:09.919343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.01666","last_updated":"2022-03-03T11:53:54Z","snapshot_observed_at":"2026-07-06T12:43:38.893285Z","submitted_at":"2022-03-03T11:53:54Z","title":"Correlation-Aware Deep Tracking","version":1},"cited_work":{"arxiv_id":"2203.01666","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.01666","snapshot_observed_at":"2026-08-06T15:20:12.388280Z","title":"Correlation-Aware Deep Tracking","venue":"cs.CV","work_id":"a9db8ae3-9ea4-4983-bc53-c371435969e8","year":2022},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.000092Z"},"links":{"cited_paper":"/paper/2203.01666","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:8637e997fb7b93b931d6764c8a7b0cbf047f01fe27929eb0d836ee542a5c820b","observation_id":"c63c5510-6ffc-4861-839b-6ef33f0c6daf","resolution":{"observed_at":"2026-08-06T15:20:12.470336Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:15.279152Z","title":null,"venue":null,"work_id":"6f1a40bf-6095-4b4a-b7f8-db26633ace23","year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.127241Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:0d07423b1812e0f597b94ecd49bfef3047a0e915b838198db09098387f8850f7","observation_id":"c4eb3aeb-fc06-4a3d-b0df-0f9c3dbb7a81","resolution":{"observed_at":"2026-08-06T15:20:15.359186Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:15.108304Z","title":null,"venue":null,"work_id":"4ffc0f82-35bc-40a4-b02d-60e649646677","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.313682Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:93e22a915b1b6a90180e8ee8f0e63e7c60c1abc1ccd6640ca3bb9a495c88ee0b","observation_id":"816775b9-456a-4976-ada7-d21f836ae072","resolution":{"observed_at":"2026-08-06T15:20:15.194844Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.06188","last_updated":"2020-04-02T14:01:38Z","snapshot_observed_at":"2026-07-06T08:37:02.581209Z","submitted_at":"2019-11-14T15:43:37Z","title":"SiamFC++: Towards Robust and Accurate Visual Tracking with Target Estimation Guidelines","version":4},"cited_work":{"arxiv_id":"1911.06188","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.06188","snapshot_observed_at":"2026-08-06T15:20:12.054681Z","title":"SiamFC++: Towards Robust and Accurate Visual Tracking with Target Estimation Guidelines","venue":"cs.CV","work_id":"67d82cf5-bd89-4902-a59a-e7fb43fa6084","year":2019},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.412493Z"},"links":{"cited_paper":"/paper/1911.06188","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:8df13272e37af133f963a42155e863244ad24eb88947ba331dd44cca276736c7","observation_id":"7d753933-8569-4e25-a741-4065c1f587ca","resolution":{"observed_at":"2026-08-06T15:20:12.127824Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:14.939555Z","title":null,"venue":null,"work_id":"a744cc4b-3585-4b54-9b59-1b66bb310527","year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.493878Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:16c0a7ecf3316114fd1a84e837b4bd2a4e60d25d5883c9b9783c2616a5f130e1","observation_id":"3bffae36-d469-4f8e-9908-b89e6f3d6f5f","resolution":{"observed_at":"2026-08-06T15:20:15.027520Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13611","last_updated":"2024-12-18T08:37:22Z","snapshot_observed_at":"2026-07-06T20:09:05.798010Z","submitted_at":"2024-12-18T08:37:22Z","title":"Robust Tracking via Mamba-based Context-aware Token Learning","version":1},"cited_work":{"arxiv_id":"2412.13611","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.13611","snapshot_observed_at":"2026-08-06T15:20:12.233803Z","title":"Robust Tracking via Mamba-based Context-aware Token Learning","venue":"cs.CV","work_id":"245c38a9-1692-4c25-a241-eeb309fa025c","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.230637Z"},"links":{"cited_paper":"/paper/2412.13611","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:25ca90988192307bda928923426d0ef3f6a7c7a6c867ec23e4c6141609c07907","observation_id":"26d94542-1626-4d12-8754-89106045ce9f","resolution":{"observed_at":"2026-08-06T15:20:12.306621Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:14.591740Z","title":null,"venue":null,"work_id":"884d2c50-25b6-45bb-92fd-bcfedba56f8f","year":2021},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.865794Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:ca85add4faf0c51909eef1e3a6a0bbdebcca47b050742431e21c0b3d0061ed2f","observation_id":"e66b553a-cb35-4c90-8996-d2ac07febdc4","resolution":{"observed_at":"2026-08-06T15:20:14.678072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:14.450424Z","title":null,"venue":null,"work_id":"23754bb7-df7a-4737-81f4-3727449d159d","year":2023},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.997980Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:8023d9d456398d752d2bf94ee3fe3e77ce9d6b845bc950381aebbabedb8eafc8","observation_id":"500d506f-f219-4f14-80df-82dd05ad55bb","resolution":{"observed_at":"2026-08-06T15:20:14.514139Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14168","last_updated":"2024-08-01T15:56:43Z","snapshot_observed_at":"2026-08-09T01:52:24.869810Z","submitted_at":"2024-01-25T13:27:03Z","title":"Vivim: a Video Vision Mamba for Medical Video Segmentation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14168","snapshot_observed_at":"2026-08-06T15:20:11.176482Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:11.176482Z"},"links":{"cited_paper":"/paper/2401.14168","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:19aeb7a8c8bdee69c6711f59bbe6a65a09560d326c5dac10f0077f04553734ee","observation_id":"79c2b040-56e9-4578-bd52-3eca28930e5f","resolution":{"observed_at":"2026-08-06T15:20:11.176482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:14.753480Z","title":null,"venue":null,"work_id":"d58c674b-ee07-4142-a2ef-e9e61269a514","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.589631Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:e5e4c0073de11c205a3dbb427b696e7f2a02475775e5e1277d01ffe1b8b3fcf7","observation_id":"14a0d89a-7d2f-4db3-a93f-fc86df08c73a","resolution":{"observed_at":"2026-08-06T15:20:14.839406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06625","last_updated":"2025-03-09T14:02:30Z","snapshot_observed_at":"2026-08-07T17:18:57.345263Z","submitted_at":"2025-03-09T14:02:30Z","title":"Similarity-Guided Layer-Adaptive Vision Transformer for UAV Tracking","version":1},"cited_work":{"arxiv_id":"2503.06625","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.06625","snapshot_observed_at":"2026-08-06T15:20:11.910089Z","title":"Similarity-Guided Layer-Adaptive Vision Transformer for UAV Tracking","venue":"cs.CV","work_id":"cb0ec93d-81e0-40d9-8bb1-a20c5c76a247","year":2025},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.708501Z"},"links":{"cited_paper":"/paper/2503.06625","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:e169e2f0753d550541d1a685955a19e9ff01e2107c95e60527050217c45c371b","observation_id":"814a9bb0-55d8-4581-ab8e-fe38aa802f0f","resolution":{"observed_at":"2026-08-06T15:20:11.970007Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:13.935462Z","title":null,"venue":null,"work_id":"e0b97215-7c92-4bb2-bf61-bd5c220b90b1","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:11.624042Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:d04bdf84c13780cd3ebc99e758b611451e58874266dc3efc7b74531db93a5dbc","observation_id":"bcf5fe5b-8252-4f26-8ca3-38e18ccd8ab3","resolution":{"observed_at":"2026-08-06T15:20:14.002038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09417","last_updated":"2024-11-14T02:00:33Z","snapshot_observed_at":"2026-07-06T17:16:59.193820Z","submitted_at":"2024-01-17T18:56:18Z","title":"Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09417","snapshot_observed_at":"2026-08-06T15:20:11.741140Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:11.741140Z"},"links":{"cited_paper":"/paper/2401.09417","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:e0abe4276d158e85c592709b1556b2534bda45c79b571c0d07d8a256e4b7a808","observation_id":"b796eb35-f9b2-4f07-bcf3-ffa49cb4a4ec","resolution":{"observed_at":"2026-08-06T15:20:11.741140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:14.292588Z","title":null,"venue":null,"work_id":"3dfc8f2e-3d45-400c-84d1-feccaff5429a","year":2022},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:11.308101Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:435360f4369f6a876ee640637c7aa1b6b0438788c96d07dfa36f88c02739f43f","observation_id":"83578a43-effd-4ca6-aa62-b958aff1937e","resolution":{"observed_at":"2026-08-06T15:20:14.368760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:14.131604Z","title":null,"venue":null,"work_id":"4ec87fda-7c76-4f01-85e3-f056aa0fb100","year":2020},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:11.457487Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:bf9017ff70256ff29d550ed99399f0e40ec349f208a5a0e7e944aaa98f706ae6","observation_id":"085fa55c-2c88-4327-bd26-5f9f0dbb56a9","resolution":{"observed_at":"2026-08-06T15:20:14.214621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.717655Z","title":"In Proceedings of the IEEE conference on computer vision and pattern recognition","venue":null,"work_id":"877fd729-abca-4079-9c2a-1d46a0495ebe","year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.220686Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:af31a28096b4333c2929dceb689591d662c56d5bef9836c335a552f7fa7083e6","observation_id":"712c4763-bc2e-477c-a567-b5cf11c308dd","resolution":{"observed_at":"2026-08-06T15:20:17.723520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.777934Z","title":"InProceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"98a2da6a-dffa-4734-a841-1c0bb5856b94","year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.866642Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:7fc4a50ea6f7a5d9d324a2500b294d491fe8e9e70bc4bdaa748a8f47005d4912","observation_id":"b7a0f9fa-ded2-4760-a00a-3648a654f51f","resolution":{"observed_at":"2026-08-06T15:20:17.782936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:15.864983Z","title":"In Proceed- ings of the AAAI Conference on Artificial Intelligence , Vol","venue":null,"work_id":"a20071e3-a26e-4d76-881a-d5aca47ddb0c","year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.547849Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:cb23fd9eafb7add5166bdc8f226498c2576e9187dd954c69225024ba0ee8b8e6","observation_id":"d362ebd0-b116-4c51-a047-5ffba4268729","resolution":{"observed_at":"2026-08-06T15:20:16.010266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T20:26:19.384761Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":45,"verified_exact":6,"verified_fuzzy":3},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2507.16191."}