{"as_of":"2026-08-20T14:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:760de1433ff9f1029eb634bc9f676d51384e4f3cfa4d0d8b5cb259f7a1a07ccb","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T10:47:49.969731Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:34:51.835945Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-23T19:43:23.351898Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"cited_work":{"arxiv_id":"2411.18933","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18933","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2411.18933 (2024)","venue":null,"work_id":"ad0e53dc-25a8-4e1d-afae-aa9c8db1270d","year":2024},"citing_paper":{"arxiv_id":"2410.04960","last_updated":"2026-06-04T11:59:03Z","snapshot_observed_at":"2026-08-16T13:11:56.955238Z","submitted_at":"2024-10-07T11:59:54Z","title":"On Efficient Variants of Segment Anything Model: A Survey","version":5},"reference_index":213,"source":"pdf_text","source_observed_at":"2026-05-23T19:42:24.122342Z"},"links":{"cited_paper":"/paper/2411.18933","citing_paper":"/paper/2410.04960"},"observation_digest":"sha256:5507ba2f3b3393e5edf11b1043b5d1e19c2d18a1ea5eb79f68bdbf8e88f201bd","observation_id":"d6c3127b-2d87-4d67-893f-e9aa09305c46","resolution":{"observed_at":"2026-05-23T19:43:23.355034Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18933","snapshot_observed_at":"2026-08-07T05:29:57.597591Z","title":"Efficient track anything,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.597591Z"},"links":{"cited_paper":"/paper/2411.18933","citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:397ee68fdbf23493dc384d5484b37718f242c4ecf29d95b53b1263cb3dc77cc8","observation_id":"8f3a1dd1-010a-47c2-9401-55bfe408522f","resolution":{"observed_at":"2026-08-07T05:29:57.597591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18933","snapshot_observed_at":"2026-08-05T21:43:19.755957Z","title":"Efficient track anything,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08117","last_updated":"2025-08-11T15:56:21Z","snapshot_observed_at":"2026-08-09T03:04:02.112708Z","submitted_at":"2025-08-11T15:56:21Z","title":"GRASPTrack: Geometry-Reasoned Association via Segmentation and Projection for Multi-Object Tracking","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T21:43:19.755957Z"},"links":{"cited_paper":"/paper/2411.18933","citing_paper":"/paper/2508.08117"},"observation_digest":"sha256:4a9b6b8404b4ce77752300a6086a0ed82c34b1f6a0f3e8576be26e4f44775146","observation_id":"6ccff48d-ab5b-4bba-9796-37b94cab6939","resolution":{"observed_at":"2026-08-05T21:43:19.755957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18933","snapshot_observed_at":"2026-08-15T17:34:51.835945Z","title":"Efficient track anything,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.11129","last_updated":"2025-08-15T00:35:27Z","snapshot_observed_at":"2026-08-16T02:54:08.344049Z","submitted_at":"2025-08-15T00:35:27Z","title":"Geometry-Aware Predictive Safety Filters on Humanoids: From Poisson Safety Functions to CBF Constrained MPC","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:34:51.835945Z"},"links":{"cited_paper":"/paper/2411.18933","citing_paper":"/paper/2508.11129"},"observation_digest":"sha256:cd8c8a6773feee36adcad8e091b50b6b156a279ba8c30dea0a0b74aaaf0c44ee","observation_id":"f983b7c7-7860-4d5c-a75c-1b28ee7fcbc0","resolution":{"observed_at":"2026-08-15T17:34:51.835945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.18933/citation-record","integrity":"/paper/2411.18933/integrity","json":"/paper/2411.18933/citation-record.json","paper":"/paper/2411.18933"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-12T10:47:49.842643Z","title":"Peters, and Arman Cohan","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.842643Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:bcd1b9fc1daf2ae2fcb8f8d2b3675ee13405c00cffa494918600f4d6cc4e60b0","observation_id":"a27d9526-0c10-470d-acfb-fc3ada1abe07","resolution":{"observed_at":"2026-08-12T10:47:49.842643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04155","last_updated":"2023-04-09T04:06:59Z","snapshot_observed_at":"2026-08-16T15:41:47.817321Z","submitted_at":"2023-04-09T04:06:59Z","title":"Segment Anything Model (SAM) for Digital Pathology: Assess Zero-shot Segmentation on Whole Slide Imaging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04155","snapshot_observed_at":"2026-08-12T10:47:49.861675Z","title":"Segment anything model (sam) for digital pathology: Assess zero-shot segmentation on whole slide imaging.arXiv preprint arXiv:2304.04155,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.861675Z"},"links":{"cited_paper":"/paper/2304.04155","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:7697ce10ec2a0c01a0ea2769bccdf3cac962b4b7e41c5117b1e9def0deb4a0c1","observation_id":"9e4fca33-7186-4e58-a5dd-e966754047c1","resolution":{"observed_at":"2026-08-12T10:47:49.861675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16268","last_updated":"2025-07-29T00:08:01Z","snapshot_observed_at":"2026-08-19T19:58:04.652419Z","submitted_at":"2024-10-21T17:59:19Z","title":"SAM2Long: Enhancing SAM 2 for Long Video Segmentation with a Training-Free Memory Tree","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16268","snapshot_observed_at":"2026-08-12T10:47:49.865332Z","title":"Sam2long: Enhancing sam 2 for long video segmentation with a training-free memory tree.arXiv preprint arXiv:2410.16268,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.865332Z"},"links":{"cited_paper":"/paper/2410.16268","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:2a470d089ede46510c1e062561f1b055d38e2f8c97b1c3f4409030126170539f","observation_id":"5a0e924b-cfea-4323-87fc-989029b17d28","resolution":{"observed_at":"2026-08-12T10:47:49.865332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:47:50.406018Z","title":"Efficient hierarchical graph-based video segmentation","venue":null,"work_id":"0acb95d4-a2e7-409c-85b4-bbac63cb4e99","year":2010},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.871886Z"},"links":{"citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:232d9209e9b19ee7137ec912b83fa5eebe17fe9ef31c9f901a1811d7196e4a59","observation_id":"a27fa9fc-e6f6-494f-8456-79841f1a54f3","resolution":{"observed_at":"2026-08-12T10:47:50.409820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.00278","last_updated":"2023-04-29T15:27:57Z","snapshot_observed_at":"2026-08-19T06:05:56.774540Z","submitted_at":"2023-04-29T15:27:57Z","title":"Segment Anything Model (SAM) Meets Glass: Mirror and Transparent Objects Cannot Be Easily Detected","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.00278","snapshot_observed_at":"2026-08-12T10:47:49.875720Z","title":"Segment anything model (sam) meets glass: Mirror and transparent objects cannot be easily detected.arXiv preprint arXiv:2305.00278,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.875720Z"},"links":{"cited_paper":"/paper/2305.00278","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:a3687abeedb44dd28a70aa30dfdc3c5f1926b24522699a8e17c837ae1d8f0f17","observation_id":"f8ed993c-1b0f-405d-8e80-0fc7613200f5","resolution":{"observed_at":"2026-08-12T10:47:49.875720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:47:50.395011Z","title":"Interactive video object segmentation using global and local transfer modules","venue":null,"work_id":"21b56bb4-e51a-4845-9482-e1c9c7436b55","year":2020},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.879142Z"},"links":{"citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:3aa9c5eb813e91fb34048f95c8439b96d8afebc4beb0062baa76baad95e3693f","observation_id":"df86c5d4-17f0-4172-bef3-2a3ce46ca05d","resolution":{"observed_at":"2026-08-12T10:47:50.398571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.06545","last_updated":"2021-01-16T23:07:48Z","snapshot_observed_at":"2026-08-17T18:58:38.333421Z","submitted_at":"2021-01-16T23:07:48Z","title":"VideoClick: Video Object Segmentation with a Single Click","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.06545","snapshot_observed_at":"2026-08-12T10:47:49.882157Z","title":"Videoclick: Video object segmentation with a single click.arXiv preprint arXiv:2101.06545,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.882157Z"},"links":{"cited_paper":"/paper/2101.06545","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:a1f99ab08b23db49e61f8d8805f69ee771347ce20fcda16d7b211f1c81f53b81","observation_id":"ad4eaea7-f47e-4df0-8077-b62a76716f5e","resolution":{"observed_at":"2026-08-12T10:47:49.882157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19326","last_updated":"2024-05-01T01:30:58Z","snapshot_observed_at":"2026-08-16T13:56:42.387404Z","submitted_at":"2024-04-30T07:50:29Z","title":"LVOS: A Benchmark for Large-scale Long-term Video Object Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19326","snapshot_observed_at":"2026-08-12T10:47:49.885539Z","title":"Lvos: A benchmark for large-scale long-term video object segmentation.arXiv preprint arXiv:2404.19326,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.885539Z"},"links":{"cited_paper":"/paper/2404.19326","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:5a993922820e3282bdbc5db49f3b08436153045ec30699c8963d4422121fbbe9","observation_id":"bdc1088b-0d3d-49d3-bda7-f675c856a976","resolution":{"observed_at":"2026-08-12T10:47:49.885539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13093","last_updated":"2023-07-02T13:42:46Z","snapshot_observed_at":"2026-08-19T16:10:51.820664Z","submitted_at":"2023-05-22T14:59:03Z","title":"Restore Anything Pipeline: Segment Anything Meets Image Restoration","version":2},"cited_work":{"arxiv_id":"2305.13093","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.13093","snapshot_observed_at":"2026-08-12T10:47:50.254348Z","title":"Restore Anything Pipeline: Segment Anything Meets Image Restoration","venue":"cs.CV","work_id":"9ec3c36a-3f56-44ee-8a90-2ae274c2657c","year":2023},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.889132Z"},"links":{"cited_paper":"/paper/2305.13093","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:03a06e1b2063184b5c3ebee9be63794b9bc894a10e91ab0c0d47c13041279c4c","observation_id":"6f059f0e-1243-4ccd-85ef-5a336e5cd1ec","resolution":{"observed_at":"2026-08-12T10:47:50.258344Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01197","last_updated":"2023-12-03T23:57:43Z","snapshot_observed_at":"2026-08-19T16:50:22.820967Z","submitted_at":"2023-07-03T17:58:01Z","title":"Segment Anything Meets Point Tracking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01197","snapshot_observed_at":"2026-08-12T10:47:49.909144Z","title":"Segment anything meets point tracking","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.909144Z"},"links":{"cited_paper":"/paper/2307.01197","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:5c752a4cc2d849c23fd8ee162a4fd3be46bff098a2e2d533b595035766da94db","observation_id":"d7749796-35fb-4408-a6da-1cae5a60bc0e","resolution":{"observed_at":"2026-08-12T10:47:49.909144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-12T10:47:49.912478Z","title":"Sam 2: Segment anything in images and videos.arXiv preprint arXiv:2408.00714,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.912478Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:46bedab5b650f9b118a5e0c49a8c0abe66622cc006cd81da198b4e1a2b31ad70","observation_id":"d2182e08-79fc-44c2-b8b7-a91892191ee8","resolution":{"observed_at":"2026-08-12T10:47:49.912478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04098","last_updated":"2024-08-16T12:51:05Z","snapshot_observed_at":"2026-08-16T13:27:50.683029Z","submitted_at":"2024-08-07T21:33:07Z","title":"Performance and Non-adversarial Robustness of the Segment Anything Model 2 in Surgical Video Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04098","snapshot_observed_at":"2026-08-12T10:47:49.915828Z","title":"Performance and non-adversarial robustness of the segment anything model 2 in surgical video segmentation.arXiv preprint arXiv:2408.04098,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.915828Z"},"links":{"cited_paper":"/paper/2408.04098","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:387f5f7784782a2f4a3ae21e19b6376bb1fb2868512d830d84521fa05e6aba57","observation_id":"27dc0dba-a6a5-4cc1-8ce3-3f5d50136430","resolution":{"observed_at":"2026-08-12T10:47:49.915828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01243","last_updated":"2024-01-19T05:44:28Z","snapshot_observed_at":"2026-08-14T17:49:01.075211Z","submitted_at":"2018-12-04T06:41:46Z","title":"Efficient Attention: Attention with Linear Complexities","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01243","snapshot_observed_at":"2026-08-12T10:47:49.919122Z","title":"Efficient attention: Attention with linear complexities","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.919122Z"},"links":{"cited_paper":"/paper/1812.01243","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:2c709159c4c69405439414a3214c5cffd36f51f203b25ef91960f173c345b6cd","observation_id":"0b02447e-afa5-4897-b7eb-6b2451ba3a83","resolution":{"observed_at":"2026-08-12T10:47:49.919122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13679","last_updated":"2025-03-09T21:11:26Z","snapshot_observed_at":"2026-08-16T13:24:05.248100Z","submitted_at":"2024-08-24T22:05:04Z","title":"Segment Any Mesh","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13679","snapshot_observed_at":"2026-08-12T10:47:49.925401Z","title":"Segment any mesh: Zero-shot mesh part segmentation via lifting segment anything 2 to 3d.arXiv preprint arXiv:2408.13679,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.925401Z"},"links":{"cited_paper":"/paper/2408.13679","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:0d3391ebb9f883b181400218b87ed3a441b78e15105a550b1521b0db82565dcf","observation_id":"65d28a1b-dd1f-456d-9379-c2f469406fb4","resolution":{"observed_at":"2026-08-12T10:47:49.925401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04709","last_updated":"2023-04-11T03:53:13Z","snapshot_observed_at":"2026-08-16T15:41:32.048576Z","submitted_at":"2023-04-10T17:05:58Z","title":"Can SAM Segment Anything? When SAM Meets Camouflaged Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04709","snapshot_observed_at":"2026-08-12T10:47:49.929237Z","title":"Can sam segment anything? when sam meets camouflaged object detection.arXiv preprint arXiv:2304.04709,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.929237Z"},"links":{"cited_paper":"/paper/2304.04709","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:09a8c3fb84fb82ed744117e22955143e31efbde3b05d1cdb970c60db20329949","observation_id":"1293d61a-7df5-4c3d-9122-b77fd1ae90df","resolution":{"observed_at":"2026-08-12T10:47:49.929237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02094","last_updated":"2023-06-03T11:54:56Z","snapshot_observed_at":"2026-08-16T15:26:54.599378Z","submitted_at":"2023-06-03T11:54:56Z","title":"Segment Anything Meets Semantic Communication","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02094","snapshot_observed_at":"2026-08-12T10:47:49.932428Z","title":"Segment anything meets semantic communication","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.932428Z"},"links":{"cited_paper":"/paper/2306.02094","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:a8b7eb1a8bf0090d8912e18d16bd8eaf32114c6235c53886a001edfcba379a75","observation_id":"bfab8ed8-0bfc-427d-b283-d5386fff85f1","resolution":{"observed_at":"2026-08-12T10:47:49.932428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-12T10:47:49.935726Z","title":"Linformer: Self-attention with linear complexity","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.935726Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:ffbf7e4c4a519e02e842b526555c2404cf8bfd343491679659f7ac0c23db894d","observation_id":"7e559135-cd98-4e75-a495-f0930a374b69","resolution":{"observed_at":"2026-08-12T10:47:49.935726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:47:49.939048Z","title":"Sam2-unet: Segment anything 2 makes strong encoder for natural and medical image segmentation.arXiv preprint arXiv:2408.08870, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.939048Z"},"links":{"citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:483750eea1c71f11b1a7f82ddcba28d2d190de9d584dc3e5d4b220c6e194fb18","observation_id":"cff2698f-9dad-4b60-bf3e-626209ab2f6a","resolution":{"observed_at":"2026-08-12T10:47:49.939048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11968","last_updated":"2023-04-28T03:21:27Z","snapshot_observed_at":"2026-08-17T08:48:49.593119Z","submitted_at":"2023-04-24T10:04:06Z","title":"Track Anything: Segment Anything Meets Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11968","snapshot_observed_at":"2026-08-12T10:47:49.942086Z","title":"Track anything: Segment anything meets videos","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.942086Z"},"links":{"cited_paper":"/paper/2304.11968","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:61e02a40ce17089c12ffd893b330f4e0ed92b61371dbb6f1da4cedbaaa412515","observation_id":"b3b2c3fb-9a64-4057-94c6-006bb6eecd67","resolution":{"observed_at":"2026-08-12T10:47:49.942086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06790","last_updated":"2023-04-13T19:23:52Z","snapshot_observed_at":"2026-08-20T08:41:30.877315Z","submitted_at":"2023-04-13T19:23:52Z","title":"Inpaint Anything: Segment Anything Meets Image Inpainting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06790","snapshot_observed_at":"2026-08-12T10:47:49.945242Z","title":"Inpaint anything: Segment anything meets image inpainting.arXiv preprint arXiv:2304.06790,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.945242Z"},"links":{"cited_paper":"/paper/2304.06790","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:f3fedfdf53cba0e78d3c904b991057083fbcc351d4217eff86e4564f9acc1cf9","observation_id":"fd7fa7fc-8a6c-48e7-8df9-cd4ca05af031","resolution":{"observed_at":"2026-08-12T10:47:49.945242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.14062","last_updated":"2021-01-08T07:41:50Z","snapshot_observed_at":"2026-08-10T19:17:03.595450Z","submitted_at":"2020-07-28T08:34:04Z","title":"Big Bird: Transformers for Longer Sequences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.14062","snapshot_observed_at":"2026-08-12T10:47:49.948570Z","title":"Big bird: Transformers for longer sequences","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.948570Z"},"links":{"cited_paper":"/paper/2007.14062","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:5fb61455b34a7502de8c0b46b2ee8e2b38a91520a626de4c02ff75e056b5e8f9","observation_id":"800e439e-5da5-42b4-9859-b1700086b25d","resolution":{"observed_at":"2026-08-12T10:47:49.948570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13505","last_updated":"2025-04-30T07:19:18Z","snapshot_observed_at":"2026-08-16T15:05:44.160708Z","submitted_at":"2023-08-25T17:30:08Z","title":"Joint Modeling of Feature, Correspondence, and a Compressed Memory for Video Object Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13505","snapshot_observed_at":"2026-08-12T10:47:49.956523Z","title":"Joint modeling of feature, correspondence, and a compressed memory for video object segmentation.arXiv preprint arXiv:2308.13505, 2023b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.956523Z"},"links":{"cited_paper":"/paper/2308.13505","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:3d6ba9ddfe14afcbfac0e05be9d6cffbe318e070c7f011997abd434323626c6b","observation_id":"95ae323d-e8de-4847-998f-9205742f3753","resolution":{"observed_at":"2026-08-12T10:47:49.956523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18653","last_updated":"2025-05-10T02:48:36Z","snapshot_observed_at":"2026-08-18T06:43:59.076761Z","submitted_at":"2024-09-27T11:35:50Z","title":"When SAM2 Meets Video Camouflaged Object Segmentation: A Comprehensive Evaluation and Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18653","snapshot_observed_at":"2026-08-12T10:47:49.959875Z","title":"When sam2 meets video camouflaged object segmentation: A comprehensive evaluation and adaptation.arXiv preprint arXiv:2409.18653,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.959875Z"},"links":{"cited_paper":"/paper/2409.18653","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:7097f28ba86ef1729175a608a42413618983041e7b79ad36861cf76835398b7e","observation_id":"a2327d38-1a8a-4795-a4a0-1d14f46aa236","resolution":{"observed_at":"2026-08-12T10:47:49.959875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:47:50.373554Z","title":null,"venue":null,"work_id":"bb33b55a-6285-4081-8b75-c4e4a014876f","year":2017},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.963548Z"},"links":{"citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:2f1947f726f4457cddcdbaae8f82da0fdd51151ccfdcfd600d2e4a0b455a4f05","observation_id":"d13a96eb-cc49-4751-bee0-875b519a4ed7","resolution":{"observed_at":"2026-08-12T10:47:50.377142Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:47:50.363574Z","title":"This demonstrates that object pointer tokens need to be cross-attended with spatial tokens","venue":null,"work_id":"9936a802-ef9f-469d-a8c9-583e4c3520be","year":2024},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.966534Z"},"links":{"citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:fd1b895c5d788c4e18caed234e799450d2fedae5ef272c5d02d266dc65c3a57d","observation_id":"a5cc4970-da28-4a59-898a-514d9091b964","resolution":{"observed_at":"2026-08-12T10:47:50.367198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:47:50.352321Z","title":"19 Cross-Attention MOSE dev DAVIS 2017 val SA-V test Local-windowed 75.4 88.6 72.4 Pooling 76.5 88.6 74.0 Table 8 Comparing with local windowed attention","venue":null,"work_id":"95fef1bf-35ee-42b6-8d32-e458751b0b03","year":2017},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.969731Z"},"links":{"citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:bc0af06264647ac482ce9757f7d05afc347d3187fa579f32a9c17a455e5ce303","observation_id":"f9ca029d-0117-48c8-883d-b1259c67c722","resolution":{"observed_at":"2026-08-12T10:47:50.356181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:47:50.384657Z","title":"Key-segments for video object segmentation","venue":null,"work_id":"a14005ee-401d-44b6-a35e-4cd2d667c27c","year":1995},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":1989,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.892500Z"},"links":{"citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:ee0fc816ef00ddd0f74868c15b3cfc251de7c3f13953fde1d0ac73112f46824e","observation_id":"033ef77a-aed5-44a1-b48f-d80d1339dedc","resolution":{"observed_at":"2026-08-12T10:47:50.388515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.00557","last_updated":"2018-03-27T10:02:26Z","snapshot_observed_at":"2026-08-14T19:40:32.800459Z","submitted_at":"2018-03-01T18:56:36Z","title":"The 2018 DAVIS Challenge on Video Object Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.00557","snapshot_observed_at":"2026-08-12T10:47:49.851054Z","title":"The 2018 davis challenge on video object segmentation.arXiv preprint arXiv:1803.00557,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.851054Z"},"links":{"cited_paper":"/paper/1803.00557","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:30e9c0041713090469bb73ab79b2f0ea0fcfb75158d2933aadfb7bd67ff532c4","observation_id":"aceaa496-92dc-45be-837f-ad593c616a37","resolution":{"observed_at":"2026-08-12T10:47:49.851054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05501","last_updated":"2022-08-16T10:16:20Z","snapshot_observed_at":"2026-08-16T16:46:37.353608Z","submitted_at":"2022-07-12T12:50:34Z","title":"Next-ViT: Next Generation Vision Transformer for Efficient Deployment in Realistic Industrial Scenarios","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05501","snapshot_observed_at":"2026-08-12T10:47:49.895727Z","title":"Next- vit: Next generation vision transformer for efficient deployment in realistic industrial scenarios.arXiv preprint arXiv:2207.05501, 2022a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.895727Z"},"links":{"cited_paper":"/paper/2207.05501","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:7fa48975f7bb8dbd2b346ab0ef85af119745cef5ee3b0391900e645b06631625","observation_id":"d144eac8-0937-4c64-a1a0-d79f4e9e6d08","resolution":{"observed_at":"2026-08-12T10:47:49.895727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.00675","last_updated":"2018-03-01T17:50:08Z","snapshot_observed_at":"2026-08-02T10:51:13.194643Z","submitted_at":"2017-04-03T16:44:46Z","title":"The 2017 DAVIS Challenge on Video Object Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.00675","snapshot_observed_at":"2026-08-12T10:47:49.902442Z","title":"The 2017 davis challenge on video object segmentation.arXiv preprint arXiv:1704.00675,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.902442Z"},"links":{"cited_paper":"/paper/1704.00675","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:3269ca3767ac6a6254654fc02c376ffc4a9435b38afa36d949c9f2462b6603e3","observation_id":"2deccbc6-71ee-4b9c-95b2-9a8281288d44","resolution":{"observed_at":"2026-08-12T10:47:49.902442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10518","last_updated":"2024-09-29T21:58:22Z","snapshot_observed_at":"2026-08-19T15:36:25.635971Z","submitted_at":"2024-04-16T12:41:25Z","title":"MobileNetV4 -- Universal Models for the Mobile Ecosystem","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10518","snapshot_observed_at":"2026-08-12T10:47:49.905803Z","title":"Mobilenetv4-universal models for the mobile ecosystem.arXiv preprint arXiv:2404.10518,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.905803Z"},"links":{"cited_paper":"/paper/2404.10518","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:945c0b6a1745b50fac9d95ae1b88cf2d05129666942fc880432f9c82f7872c5a","observation_id":"32c283f3-dfdd-453e-b314-bce36d3b0f98","resolution":{"observed_at":"2026-08-12T10:47:49.905803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10289","last_updated":"2023-05-17T15:26:51Z","snapshot_observed_at":"2026-08-19T04:49:21.997023Z","submitted_at":"2023-05-17T15:26:51Z","title":"Explain Any Concept: Segment Anything Meets Concept-Based Explanation","version":1},"cited_work":{"arxiv_id":"2305.10289","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.10289","snapshot_observed_at":"2026-08-12T10:47:50.157699Z","title":"Explain Any Concept: Segment Anything Meets Concept-Based Explanation","venue":"cs.CV","work_id":"2fbb4939-8106-40a9-85d0-c93601aa3cac","year":2023},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.922276Z"},"links":{"cited_paper":"/paper/2305.10289","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:a8962fce103d6ef8c41da646c08f5f57f5dd1864bdbff4637b6801a372e00321","observation_id":"10274c17-02de-4fc3-9c8a-d449b1d6a765","resolution":{"observed_at":"2026-08-12T10:47:50.163450Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12306","last_updated":"2024-04-01T16:18:16Z","snapshot_observed_at":"2026-08-17T23:17:37.298054Z","submitted_at":"2023-04-24T17:56:12Z","title":"Segment Anything in Medical Images","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12306","snapshot_observed_at":"2026-08-12T10:47:49.898931Z","title":"Segment anything in medical images.arXiv preprint arXiv:2304.12306,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.898931Z"},"links":{"cited_paper":"/paper/2304.12306","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:79ff1d89f6f964eba797be645077dbb910d13d6b96782c5b75649c726536f563","observation_id":"ae5ed1fa-0ded-4a58-a1a8-616cc70da6a7","resolution":{"observed_at":"2026-08-12T10:47:49.898931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:47:50.426721Z","title":"Learning what to learn for video object segmentation","venue":null,"work_id":"f294ce64-08a0-4260-9257-0699a9af19aa","year":2020},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.847702Z"},"links":{"citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:0f9df770ddb9ae882c5bb9dc3ed5aee39ac7d19632b67e3e041baffe2c68e70e","observation_id":"94378cbd-78e9-4a2b-ab3c-4f70b8477047","resolution":{"observed_at":"2026-08-12T10:47:50.430282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:47:50.417000Z","title":"Video segmentation by tracing discontinuities in a trajectory embedding","venue":null,"work_id":"02b17d7a-bc98-4f2b-8af3-e5037b1304bb","year":2012},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.868649Z"},"links":{"citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:eab1d0b7f47711949789a75294fdb6f917a0bbfd7fbcf3d7e1f0f390a7bcfc4c","observation_id":"db034f5f-7389-46f2-956f-0736953df3a0","resolution":{"observed_at":"2026-08-12T10:47:50.420405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14289","last_updated":"2023-07-01T07:26:22Z","snapshot_observed_at":"2026-08-20T05:25:54.653744Z","submitted_at":"2023-06-25T16:37:25Z","title":"Faster Segment Anything: Towards Lightweight SAM for Mobile Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14289","snapshot_observed_at":"2026-08-12T10:47:49.951985Z","title":"Faster segment anything: Towards lightweight sam for mobile applications.arXiv preprint arXiv:2306.14289, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.951985Z"},"links":{"cited_paper":"/paper/2306.14289","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:bba1c83f9f5ceedca73bc34733ed362f4b01e73384a4d1fdb668132209e4f90b","observation_id":"565657e4-ba5e-47f3-96c4-406ef5e88da6","resolution":{"observed_at":"2026-08-12T10:47:49.951985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14207","last_updated":"2023-05-23T16:26:56Z","snapshot_observed_at":"2026-08-17T15:34:56.969343Z","submitted_at":"2023-05-23T16:26:56Z","title":"SAD: Segment Any RGBD","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14207","snapshot_observed_at":"2026-08-12T10:47:49.854674Z","title":"Sad: Segment any rgbd.arXiv preprint arXiv:2305.14207,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.854674Z"},"links":{"cited_paper":"/paper/2305.14207","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:32d9f78dc63a69b798217c788c9d21134af6e5ed70f924a3e2b1a5f3da062a32","observation_id":"8d02a4ac-2e8c-4cf3-ae15-e766cedf5c85","resolution":{"observed_at":"2026-08-12T10:47:49.854674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06558","last_updated":"2023-05-11T04:33:08Z","snapshot_observed_at":"2026-08-16T15:33:58.868647Z","submitted_at":"2023-05-11T04:33:08Z","title":"Segment and Track Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06558","snapshot_observed_at":"2026-08-12T10:47:49.858130Z","title":"Segment and track anything","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-12T10:47:49.858130Z"},"links":{"cited_paper":"/paper/2305.06558","citing_paper":"/paper/2411.18933"},"observation_digest":"sha256:25bbafc8d1ffda5617a8cadacb81b8bd44c9b525e9cccbe3579c1033bd02543f","observation_id":"d097148f-7ddc-45f9-9f53-115a1f6afc55","resolution":{"observed_at":"2026-08-12T10:47:49.858130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T15:36:02.313601Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":2,"verified_fuzzy":7},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 4 inbound Pith citation observations for arXiv:2411.18933."}