{"as_of":"2026-08-16T00:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:604c827bffeea82e4fa0402b03675a21e57097d567445f35a49db1e316fc81dd","coverage":[{"denominator":121,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:29:57.716070Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T06:28:14.694168Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T15:28:34.337275Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"cited_work":{"arxiv_id":"2506.07850","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07850","snapshot_observed_at":"2026-07-03T15:28:34.337275Z","title":"Rocky and Q","venue":null,"work_id":"d14dcb55-8792-4390-89c2-9d1a5d4eb756","year":2025},"citing_paper":{"arxiv_id":"2606.13497","last_updated":"2026-06-11T15:46:28Z","snapshot_observed_at":"2026-08-14T06:17:42.515809Z","submitted_at":"2026-06-11T15:46:28Z","title":"SPARC: Reliable Spatial Annotations from Robot Demonstrations at Scale","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T06:28:14.694168Z"},"links":{"cited_paper":"/paper/2506.07850","citing_paper":"/paper/2606.13497"},"observation_digest":"sha256:4dba2e1519d466e844fd42fddb559042a38d732e88222ddbe472deb4c1407e4f","observation_id":"49f00d6d-32cd-4e9b-97a9-1697007ced46","resolution":{"observed_at":"2026-07-03T15:28:34.338844Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07850/citation-record","integrity":"/paper/2506.07850/integrity","json":"/paper/2506.07850/citation-record.json","paper":"/paper/2506.07850"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.262734Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.262734Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:d8d3e7e240d0d509d4de44d210dd5fc8e1e2dfec3f2c924f7564e8fa04fc2d5e","observation_id":"141eb0cc-e367-4eac-8545-d8bc078a515d","resolution":{"observed_at":"2026-08-07T05:29:57.262734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.268357Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.268357Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:f0fc382c054077730dbfec73f1da7ab6fe91e0fe66ceba5bf516cd3571393bec","observation_id":"ca464e71-aefd-46a6-b77a-c4c58ac0942f","resolution":{"observed_at":"2026-08-07T05:29:57.268357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.273527Z","title":"Learning transferable visual models from natural language super- vision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.273527Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:48d4ef4582953511b428dba558373ede26f45b9c48924bfadedee6ba0535e7eb","observation_id":"4493ab42-bbf1-461d-8b01-d4edd12ec425","resolution":{"observed_at":"2026-08-07T05:29:57.273527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.278118Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.278118Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:88093670aec54711d8a1c5a480ed90e30ccfd49eaccc1215ad55771de9b18dac","observation_id":"269a7ba3-1575-4f2e-be58-7cdc5c292fc0","resolution":{"observed_at":"2026-08-07T05:29:57.278118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.282946Z","title":"On the opportunities and risks of foundation models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.282946Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:b4b0e73598281a86b77510a43ce2469bc0e3cbd6dafde987eeff201724e60d4b","observation_id":"07d54d86-0fcb-4d21-973f-df87082f29c8","resolution":{"observed_at":"2026-08-07T05:29:57.282946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.287611Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.287611Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:f28875b14db33149dd59d6755ed0c1a31ffc89d7738636609e8e241e26483178","observation_id":"36205894-e44e-45fb-ba09-ae733d85476b","resolution":{"observed_at":"2026-08-07T05:29:57.287611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.293031Z","title":"Coca: Contrastive captioners are image-text foundation models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.293031Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:4a5c39744915547dfc20842805bf1262f7bf197eda6387cdde08ad9012e298f2","observation_id":"7a05e676-81b4-40f4-8f65-b523e842a170","resolution":{"observed_at":"2026-08-07T05:29:57.293031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.297251Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.297251Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:7fd2b3b894fe1cc0e9809d2865c58f9aaf7f87e972a097be1666b232008a2304","observation_id":"c4e4e5a6-adbe-4db5-ab6d-7c2189296ae8","resolution":{"observed_at":"2026-08-07T05:29:57.297251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.301671Z","title":"Laion-400m: Open dataset of clip-filtered 400 million image-text pairs,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.301671Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:fb2ff0ba84b4a14ed6aa703a058288c3ac567da1761f3ea8f2973c833463fc7d","observation_id":"cbf1327a-3005-4230-b259-3309f126ff39","resolution":{"observed_at":"2026-08-07T05:29:57.301671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.306126Z","title":"Emerging properties in self-supervised vision trans- formers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.306126Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:57f3268be65c0203ee7768b861528eed386e68b162f4690c6cd33462d7a57b1b","observation_id":"d3f8c4f1-8d2a-4382-81ee-be0c6736c1c6","resolution":{"observed_at":"2026-08-07T05:29:57.306126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.311005Z","title":"I was surprised by the great response to my recent post on small object detection—thank you for all the dms and shares","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.311005Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:14aeca33dc142ffe8613f624629535bd715ca5e42f1eda7bedeac4d7b64152f7","observation_id":"b1d3a19a-b7e5-4862-95d7-2d3a71f2afee","resolution":{"observed_at":"2026-08-07T05:29:57.311005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.315678Z","title":"Training data-efficient image transformers & distillation through attention,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.315678Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:0a951b7dee0b6eb162249e6c5883d75509b4231c1939964806c1050b0c744472","observation_id":"c3517a28-e329-48fd-9ae6-63169e72ea86","resolution":{"observed_at":"2026-08-07T05:29:57.315678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.319788Z","title":"Review of accident detection methods using dashcam videos for autonomous driving vehicles,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.319788Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:27639783a9eb1846fcf5e78b58cf831b2f5320e3643c9b24b0044227fb1bc565","observation_id":"5e33a63b-3166-47c1-840f-6a5f2c5172e8","resolution":{"observed_at":"2026-08-07T05:29:57.319788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.324938Z","title":"The pascal visual object classes (voc) challenge,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.324938Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:8166a09086594e654836d6194a03b10f2c4cd4b4f3ad665f1a347412f4199318","observation_id":"cb8b6d95-f05e-45a7-9732-065599a72f91","resolution":{"observed_at":"2026-08-07T05:29:57.324938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.329873Z","title":"Fast r-cnn,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.329873Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:09856bd4a9c42c902d8c62960b9d492d8efb3151c2ca9ee85fa7a623fb16669e","observation_id":"a9a116e5-7655-4e8f-a4df-64427648107f","resolution":{"observed_at":"2026-08-07T05:29:57.329873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.334174Z","title":"Mobilenets: Efficient convolutional neural networks for mobile vision applications,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.334174Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:5b373ed6a00acc5136519af367f3e1c7a304af3799f14cf3db94b64779c25b33","observation_id":"3eb8f8f1-09a9-4de4-8237-c9b540a3aab6","resolution":{"observed_at":"2026-08-07T05:29:57.334174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.339404Z","title":"Vision meets robotics: The kitti dataset,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.339404Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:3bbf65915384da9296813bf03a72043f81e329f9ddc07cf5be085fece7608e8e","observation_id":"e2e4675c-7a3e-4f3c-ad70-33b83dd4d98c","resolution":{"observed_at":"2026-08-07T05:29:57.339404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.343647Z","title":"Masked generative distillation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.343647Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:784ff6e36d32195ce93f9fe992a3d6f232974e93100b53123aa20073e3ac698a","observation_id":"4b663b4c-4a0e-4ff2-8e05-730f09cc1705","resolution":{"observed_at":"2026-08-07T05:29:57.343647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.348366Z","title":"How to train your vit? data, augmentation, and regular- ization in vision transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.348366Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:8959ae7563f89fa9d48d2c92efb1f83fe7250ce1d536cb10bd5cd41b341e0807","observation_id":"2d2772ad-d95d-4746-b2ad-e380bb296ab7","resolution":{"observed_at":"2026-08-07T05:29:57.348366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.352832Z","title":"Afreeca: Annotation-free counting for all,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.352832Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:ed026f0482c271bb9d669c68eb6f7508448613297084802abc23ad9f5166ca58","observation_id":"049b3453-746b-4aac-bb7e-30d867ecb36f","resolution":{"observed_at":"2026-08-07T05:29:57.352832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.357710Z","title":"Open-vocabulary point-cloud object detection without 3d annota- tion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.357710Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:78683dc0d128701a883f35331c4d50be28a2c2614af84fa6fe86f4047ec2f66b","observation_id":"edc39b9c-1ae5-44b7-914d-7939eed7d367","resolution":{"observed_at":"2026-08-07T05:29:57.357710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.362659Z","title":"Emernerf: Emergent spatial- temporal scene decomposition via self-supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.362659Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:bd4b805b519680d4d3d1eb3588fb7b6f037a479b9e13c9ec329eb7339128656c","observation_id":"33041f99-8c1f-42a0-b604-4abe7663b2c6","resolution":{"observed_at":"2026-08-07T05:29:57.362659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.367022Z","title":"Stereo4d: Learning how things move in 3d from internet stereo videos,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.367022Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:1f220f2797fd40a3bd2831eeab8091a78202b33aed9db825a6c52cfbd3f2f59f","observation_id":"233047e2-9342-4cbc-a3b6-f642a7179426","resolution":{"observed_at":"2026-08-07T05:29:57.367022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05745","last_updated":"2023-12-10T03:56:06Z","snapshot_observed_at":"2026-08-13T06:54:42.398965Z","submitted_at":"2023-12-10T03:56:06Z","title":"Open World Object Detection in the Era of Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05745","snapshot_observed_at":"2026-08-07T05:29:57.371437Z","title":"Open world object detection in the era of foundation models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.371437Z"},"links":{"cited_paper":"/paper/2312.05745","citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:8a2e724c8419f05391faf6dd1a0111a6384721a2b55d2893b5219527a41f188f","observation_id":"490b2d99-cafd-4c36-9281-bb337f0a8503","resolution":{"observed_at":"2026-08-07T05:29:57.371437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.376168Z","title":"Yolo-world: Real-time open-vocabulary object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.376168Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:3a58fc01c5d9cab99f3466c1c59b73eed08bc265df235adfd1407f1714c0ab7c","observation_id":"0cb95db0-1b79-4fc6-8402-8dd10f385721","resolution":{"observed_at":"2026-08-07T05:29:57.376168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.381437Z","title":"Sapiens: Foundation for human vision models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.381437Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:49e3f8791264423eeb69e9d504a033af40340acb1cd3d9f16fbcf15b87be6af1","observation_id":"331f31a7-8fa9-489e-b121-312e93e292af","resolution":{"observed_at":"2026-08-07T05:29:57.381437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.386502Z","title":"Detrs beat yolos on real-time object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.386502Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:36ffe199d64f600aaf526bf7867d40cd76e5a79e93d19b021d046aee3fb5b13e","observation_id":"fc34242f-3b7a-4128-82b8-2e2d46869cbc","resolution":{"observed_at":"2026-08-07T05:29:57.386502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.391059Z","title":"Dino-x: A unified vision model for open-world object detection and understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.391059Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:4eaf90331d2e0594b8152d3e7df30a7d158efdbe4a0c4468550de15fb1ac9bce","observation_id":"88ef4513-b520-4d05-a8aa-59e62f80199d","resolution":{"observed_at":"2026-08-07T05:29:57.391059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.395200Z","title":"Prompt-guided detr with roi-pruned masked attention for open-vocabulary object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.395200Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:7021027cd22b4b2998948c5c89867d5321a17e3c335e172fef674ca6b024bfdf","observation_id":"bc88f3d9-4476-49d7-985d-b15702220d42","resolution":{"observed_at":"2026-08-07T05:29:57.395200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.399664Z","title":"Detclip: Dictionary-enriched visual-concept paralleled pre- training for open-world detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.399664Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:c59139e3c8d74434c71fa1100bcfc395b489ecf25cdb26c21268ea46f7db5d7f","observation_id":"eb7f98fd-a0ce-47ec-b9e4-4834e90f355a","resolution":{"observed_at":"2026-08-07T05:29:57.399664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.403899Z","title":"Aligning bag of regions for open-vocabulary object detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.403899Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:9216a602438f3d069a28810ae5b34a1ffad49b4ac3370475f2ccf491e10f077a","observation_id":"78bbcda0-b63c-4cd2-b6d2-24c874619e65","resolution":{"observed_at":"2026-08-07T05:29:57.403899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.407976Z","title":"Detclipv2: Scalable open-vocabulary object detection pre-training via word- region alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.407976Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:d3796558f8970babe8ab920066392ae484a8f14f7e1deb36c5a56a02cab7003a","observation_id":"53d379cd-3e7a-4d36-bfb5-3fa3c0f89319","resolution":{"observed_at":"2026-08-07T05:29:57.407976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.412248Z","title":"Fmgs: Founda- tion model embedded 3d gaussian splatting for holistic 3d scene understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.412248Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:f82c0e4a7f60d844d8ae2113576c96ef54fa18f4edfcb18e10fb9393cde5ec34","observation_id":"53d136b4-1885-484d-88de-d2b98b1ec9d3","resolution":{"observed_at":"2026-08-07T05:29:57.412248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.416393Z","title":"General object foundation model for images and videos at scale,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.416393Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:d86ebc514b3ad625d1c3b984075697ef9cbf80040cb5fa0ba8f0c999b41d6141","observation_id":"c79b529f-c13e-4f40-b47a-23f04eb04430","resolution":{"observed_at":"2026-08-07T05:29:57.416393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.421003Z","title":"Region-aware pretraining for open-vocabulary object detection with vision transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.421003Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:f0230788ca0bf3923022603297ad0d42ea213a25a05d38e469eeddc75f5cd228","observation_id":"1b1457d4-00fc-4708-8b80-127a2b498948","resolution":{"observed_at":"2026-08-07T05:29:57.421003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.425477Z","title":"Open- emma: Open-source multimodal model for end-to-end autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.425477Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:25640dfea0784297c0d02854cea9ff65050beeb891ebdffbeaab1cf807a4770a","observation_id":"2f01d0d1-213d-4d36-82d0-50b1eeedf3c8","resolution":{"observed_at":"2026-08-07T05:29:57.425477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.430265Z","title":"Simple open-vocabulary object detection with vision transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.430265Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:4b74b18c5c4fa12c953d49a2566d7df121ef325dd0fd8de0aebeb8c7fa9a4ae2","observation_id":"25b93f84-86f5-4e31-bacb-1dfaed846daa","resolution":{"observed_at":"2026-08-07T05:29:57.430265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.434897Z","title":"Exploiting unlabeled data with vision and language models for object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.434897Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:341deb751a18aa00ad45faa21e1dcfaa8b668051c7a4d5e431318a3bb5652d5a","observation_id":"d9c7a5f6-194b-419b-bdff-9cab8bf4d3ef","resolution":{"observed_at":"2026-08-07T05:29:57.434897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.439321Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.439321Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:393c18aa05aec40ed0abcae09d5abcbc13b0a283583354e46753ab7569c8bdef","observation_id":"9b28feed-45e9-4b91-8cbc-ca09c78cfa52","resolution":{"observed_at":"2026-08-07T05:29:57.439321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-07T05:29:57.443879Z","title":"Sam 2: Segment anything in images and videos,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.443879Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:50b6f7aeadf65779a8dc2f67590ba6eb3e9a7cdb343f85cd0409044a306ecb30","observation_id":"c693f3e2-d783-4d90-961f-fea6cee403a5","resolution":{"observed_at":"2026-08-07T05:29:57.443879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.448363Z","title":"Slicing aided hyper inference and fine-tuning for small object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.448363Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:fe96ccef7941c2ba9e86684b4e93ce426088b2e45646d8b6e7a1dadd39a3c8ba","observation_id":"97c6e091-31f6-4e8f-a6d5-ab303e497ffb","resolution":{"observed_at":"2026-08-07T05:29:57.448363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.452930Z","title":"Bdd100k: A diverse driving dataset for heterogeneous multitask learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.452930Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:f611997a255f532b565a1f348ee95d12d7d3dfa0eef3631d6cadc872d9fb6ad4","observation_id":"3afdfa69-558e-4277-b600-d6a4b2d14988","resolution":{"observed_at":"2026-08-07T05:29:57.452930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:57.457715Z","title":"nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.457715Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:94a3bf2923a7bb9aa52c951fcb235830b88ef2fe482167c1569dd514a48ee6dc","observation_id":"1146a43c-65ad-4757-a020-b0e33dfc88d0","resolution":{"observed_at":"2026-08-07T05:29:57.457715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:59.021517Z","title":"Multiple adverse weather conditions adaptation for object detection via causal intervention,","venue":null,"work_id":"3d0f033b-47f3-4c15-a067-b1d23207d085","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.462249Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:c43e1454cf05878704cd0346be6852f0e40701a4bd2107506599e446a2431e99","observation_id":"1ef8f871-3560-4280-9e42-f9e57f6d9558","resolution":{"observed_at":"2026-08-07T05:29:59.026965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:59.007358Z","title":"Learning enriched features for real image restoration and enhancement,","venue":null,"work_id":"e28b44cb-0839-412c-afe6-5704358dbe43","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.466677Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:8a6d9a5d12481fb06d2874f3ece3e2f3ae0d055874d563e2fc2e3d664feb5cfb","observation_id":"81036673-94cc-47ad-be23-4e90fec3a656","resolution":{"observed_at":"2026-08-07T05:29:59.011977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.992133Z","title":"You only need 90k parameters to adapt light: A light weight transformer for image enhancement and exposure correction,","venue":null,"work_id":"ce2e751d-8635-4c6f-9cf6-f921d70d4dd5","year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.470918Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:1b7ad3ee70cdf785ba012deed46687cfa868a73eb2a05fd1391c666f6ce17a41","observation_id":"9916782c-d57d-44f9-adad-5ff847df7855","resolution":{"observed_at":"2026-08-07T05:29:58.997808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.977925Z","title":"Learning multi-scale photo exposure correction,","venue":null,"work_id":"a43f4a3a-a294-4388-b6ac-05b80d949345","year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.476080Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:568bd161fe88a9b768f09198eb0c70c57cac2851b2a5d7cd530152f6ac2bb730","observation_id":"45fd805f-bd6b-4f8d-9b54-b05872d043e2","resolution":{"observed_at":"2026-08-07T05:29:58.982732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.963765Z","title":"Unpaired image-to-image translation using cycle-consistent adversarial networks,","venue":null,"work_id":"58a72075-193d-4a53-9b14-d64aa9fa27fa","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.480636Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:bf6e4a548917abc6ab4e8ab3947dae53809575a4a0a7518211d148f0c7671307","observation_id":"fdd5693c-134c-467b-b7a3-ec5fd9e4025c","resolution":{"observed_at":"2026-08-07T05:29:58.968419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.949771Z","title":"Track- former: Multi-object tracking with transformers,","venue":null,"work_id":"d2ff7f25-24ee-4d2b-9203-ced72bb763b1","year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.485241Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:461764262f589bdddc79e513cf93dca2bba5ef3ab6c0404487eee9418425d2df","observation_id":"8bfb6082-1d7a-4106-a8af-8a277fe8ec47","resolution":{"observed_at":"2026-08-07T05:29:58.954162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.933925Z","title":"Boosttrack: boosting the similarity measure and detection confidence for improved multiple object tracking,","venue":null,"work_id":"f7234517-923b-4bc2-a88c-fcadc3b98563","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.490389Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:f3542f1d351c14c70e693990830b6851bc915e63a589a030e32a4c7004deb061","observation_id":"58c620b3-1d1f-4e50-afe7-66437e7f8221","resolution":{"observed_at":"2026-08-07T05:29:58.939675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.919425Z","title":"Bytetrack: Multi-object tracking by associating every de- tection box,","venue":null,"work_id":"26d0a678-27c9-42ac-8843-c60dd5e7ce7a","year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.495250Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:dd1212427377d82df6d62e652e0efc7f317e1346635a111e735ef3b06e26ce45","observation_id":"91e1de73-6aee-4ce5-a655-fda1cc12759d","resolution":{"observed_at":"2026-08-07T05:29:58.923966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.906089Z","title":"Diffmot: A real-time diffusion-based multiple object tracker with non-linear prediction,","venue":null,"work_id":"3229fe67-f562-4359-9fdc-d03e27a66f5c","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.499666Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:84a32ae0f126adbd044c5f62ee068a5a27dc6c7508f42520e067f4b39cdee260","observation_id":"0563de1b-60ef-4f71-9e84-9b81bc888e60","resolution":{"observed_at":"2026-08-07T05:29:58.910807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.892256Z","title":"Simple cues lead to a strong multi-object tracker,","venue":null,"work_id":"cec798b7-d039-49f6-b41f-b28036d0cd52","year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.503887Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:e63fb2ef46e3b1b69f0b9d944a9d303c732d5e6f9071210852a5f8f6775e9266","observation_id":"47c2dce8-73e9-482a-a01e-36c85d962dc9","resolution":{"observed_at":"2026-08-07T05:29:58.896639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.878175Z","title":"Romot: Referring-expression-comprehension open-set multi-object track- ing,","venue":null,"work_id":"0ab4fa14-22cf-4aaa-9cff-d95cf47a64d7","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.508550Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:68159bac826a77e3e2d2f2c9c557c1fac79b077daa492b562a842b6affe847d5","observation_id":"ca4413ff-5f36-4ade-b6a9-f9d02fe52f41","resolution":{"observed_at":"2026-08-07T05:29:58.882851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.863651Z","title":"Samba: Synchronized set-of-sequences modeling for multiple object tracking,","venue":null,"work_id":"446aa016-2095-46bb-8583-696a68c78145","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.513088Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:15ef5ba690f1458560098248928f7cd3c6697ef1e1e27b923a46c9ca91373348","observation_id":"264d7d5e-3788-4926-8fdc-08ec25309c6e","resolution":{"observed_at":"2026-08-07T05:29:58.868490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.849409Z","title":"Sparsetrack: Multi-object tracking by performing scene decomposition based on pseudo-depth,","venue":null,"work_id":"58455b33-93f2-4d27-9398-03b1011ffc24","year":2025},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.517371Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:1cc786131a4a4a765f0391dfbe2595720f09e571765d2fe8c76f175ead020263","observation_id":"66bdfd4a-406c-4fd4-a4de-3e72b105b8b5","resolution":{"observed_at":"2026-08-07T05:29:58.854008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.834679Z","title":"Unifying short and long- term tracking with graph hierarchies,","venue":null,"work_id":"a11e4101-5059-4cc3-887f-236fb1c63faf","year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.521641Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:d9d21353568046fab915f5c0476813c4cd51ea37a4b534c4935ce193bd07343e","observation_id":"b3f76947-01ba-465b-a0e7-da6b5a99dda0","resolution":{"observed_at":"2026-08-07T05:29:58.839244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.820137Z","title":"Matching anything by segmenting anything,","venue":null,"work_id":"1f72971a-d652-44df-9f05-abc66da781b6","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.526617Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:5f3936a80f16899e58afb7b525c6c7c3aa790af5764c15de61fba872869be693","observation_id":"8519e4d7-16f9-4e3b-8c82-fa7895b6775d","resolution":{"observed_at":"2026-08-07T05:29:58.825360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.806422Z","title":"Joint modeling of feature, correspondence, and a compressed memory for video object seg- mentation,","venue":null,"work_id":"14f6e234-2a47-4656-a75c-ba7b3a3632f1","year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.531185Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:27044604f3cecb1f96f150cc5e8a91a65132c89e56edc35306a971f5344e1c8c","observation_id":"64e0327a-f25e-46ef-8aa2-89728e1e1bcc","resolution":{"observed_at":"2026-08-07T05:29:58.811130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.791272Z","title":"Putting the object back into video object segmentation,","venue":null,"work_id":"5200c39d-7ee7-4169-81cd-ea4b730ef290","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.535504Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:af411e5dfb3a02a975eb6b77d52f44771f284c4e84e869d99293007f8453aff6","observation_id":"ef3b0cf6-6090-4e67-9a6e-eb290f128804","resolution":{"observed_at":"2026-08-07T05:29:58.796553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.774674Z","title":"Tam-vt: Transformation- aware multi-scale video transformer for segmentation and tracking,","venue":null,"work_id":"8a9e8feb-5ed7-416e-bdc8-97a77ed09191","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.540001Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:c811b420229b77ee1b13f00f3296e332f1e768e0fa1d8ccff3bf9d3914953490","observation_id":"84caad5f-208f-44c5-958f-9092c957c86e","resolution":{"observed_at":"2026-08-07T05:29:58.780135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.759539Z","title":"Videoclick: Video object segmentation with a single click,","venue":null,"work_id":"d7132e8f-b655-4cae-9276-c81b25d079d9","year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.544497Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:9d7ac0c63a8663da5b1ae83a4f40773443ea84e5c88849c530ce2844babcf4af","observation_id":"816f34d1-afeb-46a7-a8c0-fa4172a15fde","resolution":{"observed_at":"2026-08-07T05:29:58.764851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.743930Z","title":"Tracking anything with decoupled video segmentation,","venue":null,"work_id":"529cacd1-7651-4970-b274-61dccc95fead","year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.548958Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:8eb239b9006e4e4ee21cbe9f4c545782740c5e81dfd75e67b3f477729e1c7d94","observation_id":"6e3a3064-84ac-49fb-a252-499cb01b38bf","resolution":{"observed_at":"2026-08-07T05:29:58.749321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.729231Z","title":"Segment anything meets point tracking,","venue":null,"work_id":"9797231d-a588-4952-ba61-9f5deb7ca75f","year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.553195Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:11986f995008b63dffecfb307526399117d4d17abf20e9cb66d6f166c3ab79bd","observation_id":"c88fc593-8467-45cc-9ecf-6ab7c2b6f38e","resolution":{"observed_at":"2026-08-07T05:29:58.734308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.714537Z","title":"Occluded video instance segmentation: A benchmark,","venue":null,"work_id":"39dcec50-8092-47c3-bc28-d068f84a4fa6","year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.557338Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:b36cf5fbf25d108cf2ea210cbf8091b5567b3d5238472b5b8b8597dd96e5b861","observation_id":"bf9cb5f8-cc62-4cdd-a3c7-cb383613eda1","resolution":{"observed_at":"2026-08-07T05:29:58.719088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.699718Z","title":"Towards open-vocabulary video instance segmentation,","venue":null,"work_id":"9848f3af-7502-4b93-8131-91c63c4a75bc","year":2023},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.561868Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:66b6b5b35704f5989e59be60dc846379e66b9a7ccc089fdb3792087055d071e1","observation_id":"89cb77e5-ea89-4f34-88cd-f40f0399b2ec","resolution":{"observed_at":"2026-08-07T05:29:58.704843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.684784Z","title":"Dynomo: Online point tracking by dynamic online monoc- ular gaussian reconstruction,","venue":null,"work_id":"ddfb926a-af4d-4884-932d-055087f4dbc6","year":2025},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.566440Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:9e4862a6ac34969d8381b493cd60d8a2be24379a23695450d57ba929ba7be563","observation_id":"c50198bd-0d88-499d-89a3-e4185fbb5892","resolution":{"observed_at":"2026-08-07T05:29:58.690240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.670930Z","title":"Spatialtracker: Tracking any 2d pixels in 3d space,","venue":null,"work_id":"3a0c5798-6eb5-4d0b-92a1-077a76fd342a","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.570932Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:494a5c3b95aca65cff8d10b62cb205ba3172396ef1e92ba2844b8cf872ec11d2","observation_id":"c606cdf6-5506-483b-bea3-7e55aeb607f5","resolution":{"observed_at":"2026-08-07T05:29:58.675448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.657023Z","title":"Track4gen: Teaching video diffusion models to track points im- proves video generation,","venue":null,"work_id":"bb85f877-cd48-4684-830a-298013970457","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.575277Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:052062715d22316176a8a6ae88c3264b7bb1229262f0949e1e7f84c1a1911034","observation_id":"3f62c37d-8d34-48d2-80e6-c16433b9d558","resolution":{"observed_at":"2026-08-07T05:29:58.661481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11831","last_updated":"2024-10-15T17:56:32Z","snapshot_observed_at":"2026-08-12T22:22:29.480026Z","submitted_at":"2024-10-15T17:56:32Z","title":"CoTracker3: Simpler and Better Point Tracking by Pseudo-Labelling Real Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11831","snapshot_observed_at":"2026-08-07T05:29:57.579631Z","title":"Cotracker3: Simpler and better point tracking by pseudo- labelling real videos,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.579631Z"},"links":{"cited_paper":"/paper/2410.11831","citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:c70999566a00efdf1a490abd6028b18d41d72a5536cb2ff44302dd149366fedd","observation_id":"e4f83091-7b1f-419d-882a-8043b18292de","resolution":{"observed_at":"2026-08-07T05:29:57.579631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.641876Z","title":"Omnitracker: Unifying visual object tracking by tracking- with-detection,","venue":null,"work_id":"3d6da0db-7596-43f1-a132-b7f27812a3c2","year":2025},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.584355Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:6c8afc1e3e76157be380d4ac79a6552abcdbd146cf5ea711b035d7488e1ca1fc","observation_id":"8df8190a-0ce3-423d-aee6-54daa121903b","resolution":{"observed_at":"2026-08-07T05:29:58.647312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.627960Z","title":"Spam- ming labels: Efficient annotations for the trackers of tomorrow,","venue":null,"work_id":"f82d0d59-97a2-4e93-83ae-e8f9a7358537","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.588717Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:8521c661f0f5ada87bb4ccd0be76f54a3beb8baa405b6cfdbdc5020ee011663a","observation_id":"517e82b4-1b50-4f2f-86c8-b954cd74284a","resolution":{"observed_at":"2026-08-07T05:29:58.632365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.614514Z","title":"Better call sal: Towards learning to segment anything in lidar,","venue":null,"work_id":"070f7ee3-2ab7-444b-9cb0-c121affecae1","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.593013Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:3ee91a0695f79877c16593182b8a1c5e0cf565669c54b459e11aa304241e1544","observation_id":"2c475c12-6a97-40d8-ad89-b0752cc4567f","resolution":{"observed_at":"2026-08-07T05:29:58.618924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18933","last_updated":"2024-11-28T05:52:10Z","snapshot_observed_at":"2026-08-12T19:25:30.601552Z","submitted_at":"2024-11-28T05:52:10Z","title":"Efficient Track Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18933","snapshot_observed_at":"2026-08-07T05:29:57.597591Z","title":"Efficient track anything,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.597591Z"},"links":{"cited_paper":"/paper/2411.18933","citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:93816b686ca1deb12d6b24fdfc9c072a121a05a6871fd5172cb29ed2a0a65945","observation_id":"8f3a1dd1-010a-47c2-9401-55bfe408522f","resolution":{"observed_at":"2026-08-07T05:29:57.597591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.600815Z","title":"Ref- ereverything: Towards segmenting everything we can speak of in videos,","venue":null,"work_id":"06df9a07-8c53-4ded-8e25-89ba739d51fc","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.602394Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:446c16e4877b9223226adae76a79d91f07ff7a017ab46ca5ad28db32a21e94b0","observation_id":"bee51378-5c63-4c9b-aac5-3b0cfdd1a4fc","resolution":{"observed_at":"2026-08-07T05:29:58.605410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.585422Z","title":"Samurai: Adapting segment anything model for zero-shot visual tracking with motion-aware memory,","venue":null,"work_id":"ac619dc5-ac04-4f16-9a6d-a786ac00355c","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.606601Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:b59f4909a7fefc6d4bba116acd79d11f959c6e783af984e375790c301ad2cbe1","observation_id":"69110601-d667-4a93-811f-41e58ed8cffc","resolution":{"observed_at":"2026-08-07T05:29:58.590896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.570989Z","title":"Smite: Segment me in time,","venue":null,"work_id":"236e5998-95f4-4493-b109-97fb9db3c499","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.610669Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:1ae11ed1a30339e321cd41855ecb0495a1abc01a0cfe8bda2bc34bedd6bdb7fd","observation_id":"3f90fa2b-bfb3-4a23-9757-35defb0efd6e","resolution":{"observed_at":"2026-08-07T05:29:58.575993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.556324Z","title":"Deep multiple instance learning for image classification and auto-annotation,","venue":null,"work_id":"8235b59b-612e-48ec-8c52-f76948abcbde","year":2015},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.614838Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:f6264bb8355e39a38b463cb4f1188febb83816b629fe5f8ba688b01e9c249cb3","observation_id":"69dc21d7-24c2-497e-85ce-b4b2e874e0fb","resolution":{"observed_at":"2026-08-07T05:29:58.560826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.540688Z","title":"Not all labels are equal: Rationalizing the labeling costs for training object detection,","venue":null,"work_id":"2dcaf1d8-776b-42f1-a7d3-8081b5742891","year":2021},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.619120Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:762ccd53883afa5761bfc48eb6f38af7f547c12629b400eac42326fc627550a5","observation_id":"9a447e4e-c188-4eab-8fef-dacf1cb6f137","resolution":{"observed_at":"2026-08-07T05:29:58.546476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.525858Z","title":"Scaling open- vocabulary object detection,","venue":null,"work_id":"fdba341d-fa07-4b46-a20d-af33bca17b36","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.623371Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:2515e50b71774599f8595dca3e7c4781f2f04d7b82f7fe0b051ba6f0fba976dd","observation_id":"6d28c945-c974-453e-a1d6-7f0d3215232d","resolution":{"observed_at":"2026-08-07T05:29:58.531148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.512130Z","title":"Detclipv3: Towards versatile generative open-vocabulary object detection,","venue":null,"work_id":"ecc58853-a9ee-43bc-b8ee-697a5af21436","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.627664Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:a40c7d45ad1ffc96607ad0a7f3d15eab83c543c7c9570896ccaef3cedf152203","observation_id":"e3e9f6fd-d633-4cec-a05f-a10bd7794271","resolution":{"observed_at":"2026-08-07T05:29:58.516510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.497821Z","title":"Apovis: Automated pixel-level open-vocabulary instance segmenta- tion through integration of pre-trained vision-language models and foundational segmentation models,","venue":null,"work_id":"cd30ff79-787b-404a-93c2-1e39e5133558","year":2025},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.631912Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:24d49c3b313835be45836d0c80b6d37af08d38634c414238fa5aca78098e3fb9","observation_id":"89fb9a6d-966e-413f-9ccc-3646726d2494","resolution":{"observed_at":"2026-08-07T05:29:58.502773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.482970Z","title":"Towards real-time open-vocabulary video instance segmentation,","venue":null,"work_id":"c3971b32-ad96-49ba-b59e-40df1e6724ba","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.636201Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:e7664823d9b77e74480d7937c8ac6590df999bfbedeee5d15348c9b1b35195bf","observation_id":"c25acfe3-242d-4ef9-8b96-4372f40c7895","resolution":{"observed_at":"2026-08-07T05:29:58.488488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.467978Z","title":"Aide: An automatic data engine for object detection in autonomous driving,","venue":null,"work_id":"5186b515-8ba4-4bb4-95e0-e7617fd73a46","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.640450Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:a9f27c4f1f5e193cf4b093c0d495a05e0f45c671f4fdc9ab2a9c73106a74887c","observation_id":"7ae07312-23b3-4818-9881-1d6d7ea6018b","resolution":{"observed_at":"2026-08-07T05:29:58.473757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.454130Z","title":"Automatic labeling of objects from lidar point clouds via trajectory-level re- finement,","venue":null,"work_id":"26bf8e44-b76c-4104-8f0e-ef5ff9f8e9ad","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.645606Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:976802066264a94bdf4cb1d434f5734ad4e2cc5d2810eac403a289feb64a2214","observation_id":"79e9f0b0-c5f0-4d54-991f-6e9e8b3ac182","resolution":{"observed_at":"2026-08-07T05:29:58.458559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.439699Z","title":"Cosmos world foundation model platform for physical ai,","venue":null,"work_id":"65304521-3f63-4df4-a436-68e57679429a","year":2025},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.649770Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:f5bf2e044c09099ffb8e341de164a007103a5113f01a5fa33aa6a793c2f5164a","observation_id":"a94816a4-697a-4e44-8524-57782251bd82","resolution":{"observed_at":"2026-08-07T05:29:58.444531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.425692Z","title":"Launch: Auto label images with roboflow,","venue":null,"work_id":"187f6e5b-52ad-4687-ba62-458d73c092ec","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.654079Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:59523cc30f969a28486395111caf4c0baf3d3811974675ec9fbbe18ba95330ba","observation_id":"ef4443e8-3f9c-43f4-ab77-8e4e6d4a821b","resolution":{"observed_at":"2026-08-07T05:29:58.430444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.412081Z","title":"Semi-supervised open-world object detection,","venue":null,"work_id":"d8a5801e-e08a-424a-a029-5df33ede103c","year":2024},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.658690Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:153b0acbfb40a78c6c0e8ced0d82ebdb7af91802db42956998fd1a29b3a3e8ed","observation_id":"9f0378ed-e1e9-49b9-aebd-ff2086420736","resolution":{"observed_at":"2026-08-07T05:29:58.416237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.398239Z","title":"A density-based algorithm for discovering clusters in large spatial databases with noise,","venue":null,"work_id":"f68c75ec-b1cb-40d1-a280-64b6072c9e4b","year":1996},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.662988Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:4f0293bb215e7442fa72881a4cc3ce6f6d4706f86d3d5d1c844076fdcc65c2fa","observation_id":"88c6090c-43b8-40d2-9100-1b30af70dab5","resolution":{"observed_at":"2026-08-07T05:29:58.402802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.383917Z","title":"Mot16: A benchmark for multi-object tracking,","venue":null,"work_id":"b3035f97-2f28-4ce6-b046-e992eb72ea62","year":2016},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.667378Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:133ca5725e5eb10dce7f4997c53cc04b529752bcad964805952b2deb777b1263","observation_id":"0f5e39e2-95ae-4a2b-a62d-8b00f75fe8b7","resolution":{"observed_at":"2026-08-07T05:29:58.388362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.02609","last_updated":"2020-06-04T01:53:18Z","snapshot_observed_at":"2026-08-14T14:56:35.951699Z","submitted_at":"2020-06-04T01:53:18Z","title":"Simple Unsupervised Multi-Object Tracking","version":1},"cited_work":{"arxiv_id":"2006.02609","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.02609","snapshot_observed_at":"2026-08-07T05:29:57.895205Z","title":"Simple Unsupervised Multi-Object Tracking","venue":"cs.CV","work_id":"87a8e2f0-a0b2-4dac-8ac0-2f3f44cde86b","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.672311Z"},"links":{"cited_paper":"/paper/2006.02609","citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:1c3449542bf51d0abf6011584b55d79b52e22bd1b5a95af8021eb939a9d7d5bc","observation_id":"23ae04ab-125f-4eec-8f95-e237a5e09244","resolution":{"observed_at":"2026-08-07T05:29:57.900009Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.02337","last_updated":"2020-12-10T04:11:29Z","snapshot_observed_at":"2026-08-13T20:52:18.285940Z","submitted_at":"2020-12-03T23:59:27Z","title":"Probabilistic Tracklet Scoring and Inpainting for Multiple Object Tracking","version":2},"cited_work":{"arxiv_id":"2012.02337","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.02337","snapshot_observed_at":"2026-08-07T05:29:57.870208Z","title":"Probabilistic Tracklet Scoring and Inpainting for Multiple Object Tracking","venue":"cs.CV","work_id":"7c2a4221-539b-4d41-a1f1-957080b1b99b","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.677451Z"},"links":{"cited_paper":"/paper/2012.02337","citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:53a75cf1046bc95c7e106903a873d09597c7c481133f7816940d9d27b89e4e1f","observation_id":"d21bd25a-5978-40b3-993f-d519487cd308","resolution":{"observed_at":"2026-08-07T05:29:57.877145Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.369274Z","title":"Tracking objects as points,","venue":null,"work_id":"c27d43a2-97a2-400a-8f45-92befb45fe3b","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.682281Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:53b752d2b4038139a0d6228c6ebd4889b1e11ad45ab650a4558934c82c992c75","observation_id":"95a3436c-593d-4113-a857-a8fb5397f545","resolution":{"observed_at":"2026-08-07T05:29:58.374585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.354131Z","title":"Mot20: A benchmark for multi object tracking in crowded scenes,","venue":null,"work_id":"6cb63ae3-629c-48b4-99b5-34ea4dd1f592","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.686599Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:bae8f81acb3083c951093d77df950d80765b0b72315de07282eec9da05470d02","observation_id":"c5080f07-314c-4f2f-94e7-b41a25a63ee7","resolution":{"observed_at":"2026-08-07T05:29:58.359120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.340340Z","title":"Dance- track: Multi-object tracking in uniform appearance and diverse motion,","venue":null,"work_id":"09e81ea6-3a78-448f-b426-4692a2ab4627","year":2022},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.690983Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:e30c5a03e2be659572661d70942adc29e5e90059b8b82677a291bc58a2406842","observation_id":"b524e032-ae8c-4426-bb30-6ebeef504211","resolution":{"observed_at":"2026-08-07T05:29:58.344860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.325487Z","title":"Framework for performance evaluation of face, text, and vehicle detection and tracking in video: Data, metrics, and protocol,","venue":null,"work_id":"a63f4ee8-7c44-413d-8ce0-640f44ae14cb","year":2009},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.695512Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:11b6b07385bdfb5bf81aa7422da54269dc2bfd65204254cd3c8aff882d3e731e","observation_id":"b6509b91-f2a5-4c15-b883-ad66031681f0","resolution":{"observed_at":"2026-08-07T05:29:58.330228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.310892Z","title":"Per- formance measures and a data set for multi-target, multi-camera tracking,","venue":null,"work_id":"bf622a4a-8500-45b1-a7a8-315ea0b969d9","year":2016},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.700395Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:a94ed2513211ca47251368bb643d547fca07eb450390c4d4602031c2ffc6d468","observation_id":"9d47f9c7-04f0-40d8-ba6c-53a797016299","resolution":{"observed_at":"2026-08-07T05:29:58.315467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.295552Z","title":"Hota: A higher order metric for evaluating multi- object tracking,","venue":null,"work_id":"86bb5d7b-040b-4978-aa7a-1fcfe317a157","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.705433Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:cf19c0bceec97e8f63587ba10b9b8d320bfd588d516361c42a06f2e0b9035427","observation_id":"245d57dc-c72c-4f0a-88bc-49cf1deabe72","resolution":{"observed_at":"2026-08-07T05:29:58.300986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.280748Z","title":"Tracking without bells and whistles,","venue":null,"work_id":"6c8c3bc4-10a4-403a-ab14-a11340e079c1","year":2019},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.711032Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:887878e414f1979ec7eb651181f877065797cac509208cac815a9f7eb77957cd","observation_id":"80075588-6396-4742-9571-bf0f4c39c8e0","resolution":{"observed_at":"2026-08-07T05:29:58.285525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:29:58.265654Z","title":"Learning a neural solver for multiple object tracking,","venue":null,"work_id":"f4cb3800-9f97-42e6-bfb1-37a9e8adbd81","year":2020},"citing_paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T05:29:57.716070Z"},"links":{"citing_paper":"/paper/2506.07850"},"observation_digest":"sha256:a4fde3d91143e7d06f782f02bdc4e5a6a0741d85c029fbfe20a66a1df2047a29","observation_id":"586c19e9-1e65-48ba-a8c9-8c2a8c2ff125","resolution":{"observed_at":"2026-08-07T05:29:58.270336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.07850","last_updated":"2025-06-09T15:15:15Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T19:25:49.383330Z","submitted_at":"2025-06-09T15:15:15Z","title":"SAM2Auto: Auto Annotation Using FLASH"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":2,"verified_fuzzy":53},"total_outbound_references":121},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 100 of 121 outbound references and 1 inbound Pith citation observation for arXiv:2506.07850."}