{"as_of":"2026-08-09T13:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b4c7683f817b9bca06e90acf11cf88f5e9ecf753c5307ec8d127b6c8ab035dc2","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T21:34:48.709465Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2603.13994/citation-record","integrity":"/paper/2603.13994/integrity","json":"/paper/2603.13994/citation-record.json","paper":"/paper/2603.13994"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"Journal of Vision23(5), 16–16 (2023) 1","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:8d7ab7d2077cf1cf7525d80b26dfc7eefcb06126fd06715737f7213bfb61e563","observation_id":"f79034e7-6c6c-46ce-98b3-c3422c79ffcd","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:2505.17329 (2025) 3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:9004da328792e9aa14b71694f8befd2a84507cfff62a3a8a3821b1a720e78d42","observation_id":"0d6abd4a-8905-4a90-9e8c-760c79ebabf4","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"PLOS Computational Biology20(6), e1012159 (2024) 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:e2cf60da72e109591e48824694dcc828e6144605f66ae4e0c291793b8f0c5aef","observation_id":"f23ab515-f00f-4165-802e-6c90cd6d4dba","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.05814","last_updated":"2022-10-15T21:18:49Z","snapshot_observed_at":"2026-08-07T13:01:28.667448Z","submitted_at":"2021-12-10T20:15:03Z","title":"Deep ViT Features as Dense Visual Descriptors","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.05814","snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:2112.05814 (2021) 3","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"cited_paper":"/paper/2112.05814","citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:ed6363b962ca5375273323ae672bc9ce71f539e37ea876d6faa590c4ab5c1d26","observation_id":"55c0e98a-11cd-4bf4-a8cb-76e93dbdadad","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"bioRxiv pp","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:71d39abe552d5f2d6a6060ecdaf9ecfae231f25af036d5bed1e0893354d36642","observation_id":"688f2c4c-677d-4e0e-b2ad-c9a64ebacbb1","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"In: Proceedings of the IEEE/CVF international conference on computer vision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:7b5b9f5642626263ab78a8de94a6f23bd815b17101b03a22b615881b21ba5cc1","observation_id":"ec581ca2-a61c-4abb-96a9-fe1ca1843da2","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:2505.21501 (2025) 3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:9d70718df55ba0d7512bbd4d23398d045100096974d4b6334e1118c78f9da8a5","observation_id":"f738176e-b40a-4b35-afa7-e9d57a668e24","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:040471e531335fc5d4f5eaa3c1941b512f598fb2aebad9b37d4bec64b7011a0c","observation_id":"d0d5d0e3-86ce-4b59-b728-6b3efd819348","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16588","last_updated":"2024-04-12T09:38:33Z","snapshot_observed_at":"2026-08-07T09:40:32.614733Z","submitted_at":"2023-09-28T16:45:46Z","title":"Vision Transformers Need Registers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16588","snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:2309.16588 (2023) 5","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"cited_paper":"/paper/2309.16588","citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:577f946154b5217c8776d95fe2a727b1c3cd8c50c105cc2e8bd574a65175a071","observation_id":"92dfd072-2f23-4c29-9a3d-3c150e999d4f","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"bioRxiv pp","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:3a49f5abf601587af0627a38d148a7244b62ab1e280147bb4e2533e5253c919b","observation_id":"5779fe87-f358-4802-ae65-015447f1d301","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:2507.00493 (2025) 3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:bcbb4ee5c9b888f35e456048d534b635d33ee6be57d702b6b4926c56a0fb5bfe","observation_id":"08df5bf1-8c92-422f-8a5c-1aee76e36ccc","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:2010.11929 (2020) 3, 5","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:7b42a29959e5ea84c73af884353eb34086d307460a79145984b1ccfd81fd3c93","observation_id":"b0ce3bdd-3668-4ec7-9fc8-8c83473b2db6","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"Journal of Experimental Psychology: General123(2), 161 (1994) 5","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:b795877b5501aca2fc329d13bfbfdd45850d1d5b58947194bb12cf19bd2e2a99","observation_id":"503c5fa2-71da-4580-a0b8-b6c9697ef19d","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"associ- ation field","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:c20a8bf27e432055906f335ee16a8201734cb998b0ca3d0936ab3625229c2cb4","observation_id":"b729d74c-8d59-4213-b37d-786dbb0d3869","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"Science358(6368), eaag2612 (2017) 1 12","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:041e27545b8cd102b19cc43e7b522cb896d3dcb0ab4e85d923a40ad75a90d83f","observation_id":"d9ba9a18-e0a8-441a-ae00-abf0d95cb507","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"Nature reviews neuroscience14(5), 350–363 (2013) 1","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:bb935cbeb3acae57b843eeb49a5eceee4b6f55122767eb92aa72d9d6c93e5d5c","observation_id":"69c15ae2-b558-4297-b4de-beeaa7e51390","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.05208","last_updated":"2020-12-09T18:02:49Z","snapshot_observed_at":"2026-08-07T12:34:15.648511Z","submitted_at":"2020-12-09T18:02:49Z","title":"On the Binding Problem in Artificial Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.05208","snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:2012.05208 (2020) 1","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"cited_paper":"/paper/2012.05208","citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:8cd440bac37d824a5199da8f722c691dd32578fabbc90dc270a81024b5aed03d","observation_id":"75c87af2-1d6a-485c-b76b-36250db3c1fb","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"Advances in Neural Information Processing Systems37, 53732–53763 (2024) 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:472c36e81bf26e6fda398e4f92904a8478f52ce4fbd8da5142444ae800d0a95e","observation_id":"98a59e7b-7d4f-4a1e-9403-adf5627bd5f3","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:4c1d91d1706236924bb21027cbbcf9985de775836879dd8dc94cd2d90635fe6f","observation_id":"d454c4f1-4f81-4284-8da8-d3d5ffb29e71","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:2510.21142 (2025) 3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:0d4dc951e24588c36ac0960aebd075bfd315dcd268ce1737f067bcf7e1b6a05c","observation_id":"beaab390-7c30-45ed-9dcb-36a32bce0c4c","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"Elife5, e14320 (2016) 1","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:799979ecfaa0458a53afe5fa0d5fc0c25ab818316a4b53f285f21688dfe16f27","observation_id":"0f78a8c2-3e89-4882-a8b4-d3216d4b26e4","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.01558","last_updated":"2020-10-28T15:53:55Z","snapshot_observed_at":"2026-08-04T01:11:26.411564Z","submitted_at":"2019-06-04T16:21:46Z","title":"Disentangling neural mechanisms for perceptual grouping","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.01558","snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:1906.01558 (2019) 1, 3","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"cited_paper":"/paper/1906.01558","citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:849062b1e0124c92167719d98a62c0d37a143698f89e66bbe6f7d2b6e466fa84","observation_id":"c5dc5397-7284-4b51-b6ed-b42fb24637d7","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"Psychological Science23(12), 1482–1489 (2012) 3","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:0cfd382593438688efdee1206a7a676187d01145c44cc8007a7da6b330c4bab7","observation_id":"97a55d79-3d00-445c-803f-66ea3176875b","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15172","last_updated":"2022-09-30T01:47:47Z","snapshot_observed_at":"2026-07-06T13:58:02.046343Z","submitted_at":"2022-09-30T01:47:47Z","title":"Understanding Pure CLIP Guidance for Voxel Grid NeRF Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15172","snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:2209.15172 (2022) 3","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"cited_paper":"/paper/2209.15172","citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:cadf87d81c5b0b577fb2cb834e6a7c33a5a0c78dcfa3d8e4d9cf509875395116","observation_id":"05f4f595-563a-4c37-8ec7-5b144a534e1e","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00718","last_updated":"2025-05-31T21:35:54Z","snapshot_observed_at":"2026-08-07T17:04:28.567918Z","submitted_at":"2025-05-31T21:35:54Z","title":"From Local Cues to Global Percepts: Emergent Gestalt Organization in Self-Supervised Vision Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00718","snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:2506.00718 (2025) 3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"cited_paper":"/paper/2506.00718","citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:be2b9d7ce5ea3f6b2f98e42e85c39c4253b7c8c28262f4fff03625adca872327","observation_id":"136f44b0-0019-4248-a29c-237c99b2deb2","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:d7fcd9dcfb1b1b3d90c38b1f73693502c795ff6c2d223840304b1c0a182896dc","observation_id":"ad18b63d-ce3d-4428-9c58-5b4b237c8a16","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"In: Computer Vision–ECCV 2014: 13th European Conference, Zurich, Switzerland, September 6-12, 2014, Proceedings, Part V 13","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:bc4a600ac6ea83bf4f92cec847f2f0f08aaed3e2fbe987951c8a6198c6612369","observation_id":"7fe86bc5-3d82-4e2f-821b-22f16a8a8083","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:3f8a61cb53124abc0f0d82c3019b36b0716c3d3064b8f929472c06df57f56036","observation_id":"cdfbd0e3-9c8b-4f75-be10-ac1717e9e415","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05253","last_updated":"2025-06-19T08:43:44Z","snapshot_observed_at":"2026-08-07T16:07:52.278274Z","submitted_at":"2025-04-07T16:45:06Z","title":"Contour Integration Underlies Human-Like Vision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05253","snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:2504.05253 (2025) 2","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"cited_paper":"/paper/2504.05253","citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:a1323339f781891c57dfa9d5e2997da073a37c7ee77943b06d52cbcb8b9a49b7","observation_id":"9526140c-66a9-4bca-94a9-3dcca3aee3e1","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01542","last_updated":"2023-03-02T19:18:11Z","snapshot_observed_at":"2026-07-06T14:58:02.852672Z","submitted_at":"2023-03-02T19:18:11Z","title":"Self-attention in Vision Transformers Performs Perceptual Grouping, Not Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01542","snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:2303.01542 (2023) 3","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"cited_paper":"/paper/2303.01542","citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:fed4601a9a4dd61716cf091d2588182d08a4349b045f67439f475665049c7ffc","observation_id":"5748613a-fee7-4f4b-a5c3-acc7cb9eee55","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:c85af419cb6a35109a71fd16da7751fc51b53a3cf36e1d02b8bd6c0fcfb311bc","observation_id":"703318d1-8ad3-4b7c-9094-144c311e3bf6","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"PloS one20(12), e0337087 (2025) 1","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:339b9083fdbf1e5772dc2373945cdb2f705655af802be7454f8e6a6cb7942434","observation_id":"478e260b-078e-4d8f-a3e7-1cc52d3d267b","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"Nature Human Behaviour pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:d9a0cf02da7f907182822e700a80152e203f030296a35470c4d37c688df38a18","observation_id":"30941875-14c2-419c-8deb-aef80d0fae29","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"Neuron111(7), 1003–1019 (2023) 1, 5, 10","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:df0d9980e587c07b273c7cb7700ad4456c209b7032d99772f192deb8577ef576","observation_id":"0459ea22-d888-44ee-9fd6-07c4c815f3cd","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.14279","last_updated":"2021-09-29T09:01:07Z","snapshot_observed_at":"2026-08-07T17:37:50.854585Z","submitted_at":"2021-09-29T09:01:07Z","title":"Localizing Objects with Self-Supervised Transformers and no Labels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.14279","snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:2109.14279 (2021) 3","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"cited_paper":"/paper/2109.14279","citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:16e1dcfebf49f33d508cae256e80ada61e3eb48b88f07ecfd5ae6875f568bf29","observation_id":"6e5e7e3f-c3a2-45ab-8bd9-9bcf440d7c8a","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:2508.10104 (2025) 1, 2, 3, 5, 11","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:b39417c5c0cfd5140ea89469584175a84e241749f01c22ba27e1d76d89a962d5","observation_id":"81418dfa-c3bd-4d28-ba5e-96f7cefb838f","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.10270","last_updated":"2022-06-23T10:51:04Z","snapshot_observed_at":"2026-08-06T08:18:31.112514Z","submitted_at":"2021-06-18T17:58:20Z","title":"How to train your ViT? Data, Augmentation, and Regularization in Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.10270","snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"arXiv preprint arXiv:2106.10270 (2021) 6","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"cited_paper":"/paper/2106.10270","citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:a3deb89f1fc3e5eb7b75aef70c07c8d76ff6ee7555be561c1ff126afb23f0f5b","observation_id":"376ee791-ad4f-4850-a5d1-1d93161eae35","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"bioRxiv pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:5972de48735f8db4ce772e8ed25e290faa71fae55d3c7642410a53d9d32d2d5c","observation_id":"72913e3e-123d-4b8e-a723-a1897c30a4a8","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"In: European conference on computer vision","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:be9d859edd1966eb65207fe6e9e2d9358776623fc118f2ed6ff4ef848e67d15a","observation_id":"819fcfb4-2a38-475e-8c79-dd62f1ef00a1","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"Current opinion in neurobiology6(2), 171–178 (1996) 1 13","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:9ab66ed48c8025e4db8139b0b72bdc180551a4f7b2152156f16cc565ff34b59c","observation_id":"5e054b9e-267a-4833-931f-c4bcec218b6e","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"Brain and Mind 1(3), 353–384 (2000) 1, 3","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:55de93b10b1f03e04a49e880cf6c985183b2172e771914c27aa6836f760dd7b3","observation_id":"153c4d3b-5a3f-44f7-8e53-da6392360679","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"perceptual grouping and figure–ground organization","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:59a12e0fd6c01698c048e1df663c76b99e9241ab2712cc3f0b3723fa434b240e","observation_id":"d497540c-c7ce-4fcf-b6f1-b658b5d44447","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:084a37dd099e01586c7fa960c6aac2c0644653dea4980c428b8de4b609256253","observation_id":"c19b0ee3-8cdb-4424-93fd-dc00aa537aeb","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:425dca1a4d4133d1d332c49e29d8d2c9ae4d223fe670e92f89d2b15600492eaa","observation_id":"1ceb4f51-4f5e-4c2f-9b22-412fd78a4dd2","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T21:34:48.709465Z","title":"Advances in Neural Information Processing Systems36, 9388–9408 (2023) 1 14","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-14T21:34:48.709465Z"},"links":{"citing_paper":"/paper/2603.13994"},"observation_digest":"sha256:fbb5328b1bcc25a984c062e8a9afe0d8acd34cd868a2d440d1243aba166ac1bc","observation_id":"35c2aa8b-0a02-41ec-9841-1bba3bf4b66b","resolution":{"observed_at":"2026-07-14T21:34:48.709465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.13994","last_updated":"2026-07-09T15:26:35Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T21:42:03.113909Z","submitted_at":"2026-03-14T15:43:10Z","title":"Human-like Object Grouping in Self-supervised Vision Transformers"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2603.13994."}