{"as_of":"2026-08-15T23:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4fad7ada19dcdd7b97b6ac0eaea3e2738128bde7d3495d851a4cffbbe8678ad1","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:14:38.122080Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.10195/citation-record","integrity":"/paper/2608.10195/integrity","json":"/paper/2608.10195/citation-record.json","paper":"/paper/2608.10195"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.878852Z","title":"Bendeck and J","venue":null,"work_id":"b129c203-cd18-47d0-b840-3c519182d251","year":null},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.897219Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:233433c6f2b8992b8f4b7cbe7938e7d15310ece0825708760f014ba37c863cd9","observation_id":"8003a1bd-a7cc-4540-a410-1285504b921d","resolution":{"observed_at":"2026-08-14T04:14:38.885055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.861634Z","title":"Binz and E","venue":null,"work_id":"85a8d885-6e6c-4ea4-8907-9d5e8036f02a","year":2023},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.902729Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:5ced5b0641400b6a835413b7b1cb876e172dd11c9f7fc6603a157a66052ee6ec","observation_id":"bbc6b384-7ea6-4290-8085-cd8e54ad2ff7","resolution":{"observed_at":"2026-08-14T04:14:38.866855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.843984Z","title":null,"venue":null,"work_id":"8c09a459-4f6b-4c4f-8e37-9e93b51d09b3","year":1984},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.909397Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:5374b23ac762d8f18be0d3badaf20675098d56350ac58f7ada8d6fc1cfeef04b","observation_id":"a6d71381-1f3d-46b7-a457-77ee7de5e297","resolution":{"observed_at":"2026-08-14T04:14:38.848995Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.824518Z","title":null,"venue":null,"work_id":"272f85ac-6655-4dc7-93fa-e4caca771c13","year":1960},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.915600Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:099fddf3015a606fc066c02cc081acb6a0d070a99e1b7c2bda18aafcc5e43157","observation_id":"f383a65a-ded5-403c-8085-e062dff95d77","resolution":{"observed_at":"2026-08-14T04:14:38.829690Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.806194Z","title":"Demiralp, M","venue":null,"work_id":"553ada22-f1cb-4285-be24-a8247529b186","year":1933},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.921063Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:ad3467f5216ef2fb3beba68d114013bec12a9a5aca73cf97dc92165834c0a36c","observation_id":"df26e7ad-f3c8-4edd-b446-5c7b8325e347","resolution":{"observed_at":"2026-08-14T04:14:38.811372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.786248Z","title":"Geirhos, K","venue":null,"work_id":"24660aab-4fa7-4e6c-96e8-a79be9d3a6d5","year":2020},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.925985Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:bcd2ba59accca0007926f2fd2d2dc937703df1fda4f4fa69339379b03f54ee34","observation_id":"ba55ed49-17df-4a4a-9726-8587fb0bdf7c","resolution":{"observed_at":"2026-08-14T04:14:38.792345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.768611Z","title":"Geirhos, K","venue":null,"work_id":"4b999937-9abc-45dc-b72d-14e8a7e23c83","year":2021},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.931234Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:323928efdea8e5a0302730639534fbeee85f623c4d910d7bf2f3c6a55405b02e","observation_id":"6aff5982-771e-47f5-b525-ce1cd9568cfa","resolution":{"observed_at":"2026-08-14T04:14:38.773721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.750941Z","title":"Geirhos, P","venue":null,"work_id":"587ee79b-c290-45f6-a1e6-769afe840e18","year":null},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.937677Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:799baed9a03a45ec62d19a39e5c55023377743e69ad05721ac72a7e3ec4397e4","observation_id":"2643d56f-e007-49dd-85bb-ede25b75a62c","resolution":{"observed_at":"2026-08-14T04:14:38.756957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.717701Z","title":null,"venue":null,"work_id":"b503458f-ae36-4221-b1b9-9de58a127f40","year":1953},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.947482Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:3717cc8b61fa45c710849b32e597fd171e1500d5e636288a321aef3c2a3afbad","observation_id":"53a600c6-8635-4f45-85fc-b31d3d2b4550","resolution":{"observed_at":"2026-08-14T04:14:38.730429Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.696438Z","title":"Haehn, J","venue":null,"work_id":"973ef553-1299-4891-97ba-eacc2ec9c94b","year":2019},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.952396Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:412a7bc5dad921aecc1086423200d6d923e721807b08a8a10d0bf3fcdeab8720","observation_id":"1d5642a6-2a8d-42b4-b4b4-493829bbb334","resolution":{"observed_at":"2026-08-14T04:14:38.704440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.677940Z","title":null,"venue":null,"work_id":"22cf87c8-58d0-482e-91c9-7d18c4d3e80f","year":2022},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.957292Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:a13ca0619e6dd149a53dd2dfa5caf400809674e5446aa9f2000a37cf0a050cf6","observation_id":"86b1f758-cd3c-4cc9-a35a-78efd74f4ba7","resolution":{"observed_at":"2026-08-14T04:14:38.682992Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.661387Z","title":null,"venue":null,"work_id":"2042f050-11ac-4a85-b014-d3279d2c2bb7","year":1996},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.962228Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:abed54340389dcd467fdbd2609c5c203c11ab7970444d66411c1bcf20ef33f7d","observation_id":"915b78b7-475a-4540-b0c7-8738a60e3de8","resolution":{"observed_at":"2026-08-14T04:14:38.666290Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.643890Z","title":null,"venue":null,"work_id":"32b87c22-7c94-44c8-8fc0-1bd39fa2ee9a","year":2023},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.967043Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:16cc42a28be99be6f885d69f12dbd769b229f1ac9645c0dc6deb75764de4531c","observation_id":"d689d506-4cb6-4a78-a90c-1ec9c144b952","resolution":{"observed_at":"2026-08-14T04:14:38.648788Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.620124Z","title":null,"venue":null,"work_id":"6c7b33d6-6f72-4107-aa53-6f0ca2b68150","year":2020},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.975248Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:422f4691ef8ec2b0489385aa72e2b9225490354c7d6ef1cfcc6c3d13527ba977","observation_id":"62c86f26-e75f-4326-8da9-2e8ee8c4bb8c","resolution":{"observed_at":"2026-08-14T04:14:38.627008Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.603299Z","title":"Heer and M","venue":null,"work_id":"e3b70de1-0d35-4b75-bf53-ce69ccc76445","year":2010},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.980014Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:c205f72d3f73b4cef039518bc5d63e5a5c002e4979cee7f386f400242d9ec68e","observation_id":"d9262281-f6e0-41e4-8a61-c5024aa36cd6","resolution":{"observed_at":"2026-08-14T04:14:38.608425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00718","last_updated":"2025-05-31T21:35:54Z","snapshot_observed_at":"2026-08-14T05:12:40.702351Z","submitted_at":"2025-05-31T21:35:54Z","title":"From Local Cues to Global Percepts: Emergent Gestalt Organization in Self-Supervised Vision Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00718","snapshot_observed_at":"2026-08-14T04:14:37.988960Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.988960Z"},"links":{"cited_paper":"/paper/2506.00718","citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:ce2492d965e55d07c21afafe44273f354f6a36e8acb2d2330502c90d1240283b","observation_id":"21574dc7-b5be-4395-a037-89bd62271167","resolution":{"observed_at":"2026-08-14T04:14:37.988960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.583192Z","title":null,"venue":null,"work_id":"7e99264d-4463-4b04-aa8b-b0d29c4a2385","year":2024},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.994422Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:5246cf974cc51e086b48f80befe561b7cb06ee5b8f7d40a505e4824124d1946d","observation_id":"2013f4fc-ca9d-4fb5-befb-64c7bc66cfa4","resolution":{"observed_at":"2026-08-14T04:14:38.587991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05299","last_updated":"2025-04-07T17:58:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T17:58:57Z","title":"SmolVLM: Redefining small and efficient multimodal models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05299","snapshot_observed_at":"2026-08-14T04:14:37.998915Z","title":"Marafioti, O","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:37.998915Z"},"links":{"cited_paper":"/paper/2504.05299","citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:af44df72358e9dd792a5b794ae8fd3e4caabc8333f5d1fb427e88fb2adcdba04","observation_id":"5a21eed5-ac60-4de2-b91b-46625c3f6323","resolution":{"observed_at":"2026-08-14T04:14:37.998915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.566803Z","title":"Masry, D","venue":null,"work_id":"7fe0fc75-910d-4b96-b02e-8202ebf61cc7","year":2022},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.004300Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:6cf08aa8e56e82c28b55f5a7f6a3808b74b03e8443def0f1ebf6bba5e94464a9","observation_id":"244e7378-d31f-41d9-860d-2e01116163f3","resolution":{"observed_at":"2026-08-14T04:14:38.571791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.552522Z","title":null,"venue":null,"work_id":"8de073cd-bd16-4124-8b42-7c5c49dfaa77","year":2022},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.008784Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:0fc7d930766a477e116d2e6d0e065d12ed5641499f9ead1c08cb83d37606d678","observation_id":"bc9019f6-3999-4abb-bbb9-3fd8a5ba1f82","resolution":{"observed_at":"2026-08-14T04:14:38.556611Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.533452Z","title":"Muttenthaler, J","venue":null,"work_id":"4b3d4942-1ba9-4021-8fd0-81288ebf7c2c","year":2023},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.013596Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:9147230061e889a25718c6cc335e0fbd6ce84f5fb21f179742410b5c3dec17bc","observation_id":"65053c9f-4cbf-4851-9097-66b4b5444041","resolution":{"observed_at":"2026-08-14T04:14:38.537850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.514280Z","title":"Oquab, T","venue":null,"work_id":"88ea4f6d-ac22-4222-bf89-2bafdccdcfd3","year":2024},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.017979Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:b7297622d8ca6a2927dc456b72bd34c8fe01f666eb715fab8765ff318dca982b","observation_id":"314ce5e3-4529-4dbd-958b-2c0e1d2fd976","resolution":{"observed_at":"2026-08-14T04:14:38.519449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.493082Z","title":"Pandey and A","venue":null,"work_id":"7bcdbaf7-8723-4634-8254-190bf8fba81c","year":2025},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.027031Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:93298a1a769bf87e46b5d007834919dea93879ed5e6ed88e989ccbb5d8a9195f","observation_id":"9cbf151d-9884-4ab6-8dba-e2845f2c905b","resolution":{"observed_at":"2026-08-14T04:14:38.501733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.477605Z","title":"Radford, J","venue":null,"work_id":"38a80425-e871-4b55-bcf0-7f94b02c24b9","year":2021},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.037183Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:c7f337860d1883dea77f32e8329518c5d59a9576fe8c79091c25f087f8765e80","observation_id":"ac8c85d5-9f12-42bc-ab1c-5195f5d3c7fe","resolution":{"observed_at":"2026-08-14T04:14:38.482379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.461362Z","title":"Schrimpf, J","venue":null,"work_id":"c5b91911-c7fa-42bc-9ba4-30ae10e67c08","year":2020},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.042371Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:a7c984160cf9f38d98eecc52a26189faae69477309a234e03f40ce5105dd78c0","observation_id":"98b8af51-3410-4b50-9a57-35f19caae153","resolution":{"observed_at":"2026-08-14T04:14:38.466240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.444602Z","title":null,"venue":null,"work_id":"66bc26f1-3cb1-4f62-ab0f-93c0b5b20745","year":2025},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.047565Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:9f34b6fc4f9f5f9dd5cf9db350051b3feddba4c79e63cd43e236f5d5e80bf84d","observation_id":"c744dfbe-bfab-4fa7-a1f5-f39d9955ba79","resolution":{"observed_at":"2026-08-14T04:14:38.450294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.429944Z","title":"Skau and R","venue":null,"work_id":"0a3f6a70-cc21-47a2-bb66-bfcd775cb370","year":2016},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.052526Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:5f08f91971d11a02bd5d843bf48d0824edffdf4281883936f039c026f58295c8","observation_id":"f9fe5922-6d20-46a8-ac82-5142187febb2","resolution":{"observed_at":"2026-08-14T04:14:38.434329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13018","last_updated":"2024-11-26T10:31:41Z","snapshot_observed_at":"2026-08-13T20:59:28.725867Z","submitted_at":"2023-10-18T17:47:58Z","title":"Getting aligned on representational alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13018","snapshot_observed_at":"2026-08-14T04:14:38.058262Z","title":"Sucholutsky, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.058262Z"},"links":{"cited_paper":"/paper/2310.13018","citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:e680f3c29bef72a14bdb4254a068773a8f44df729099e43c092373bc9e256e52","observation_id":"8dde479d-b5c5-419d-b567-e096fb5b740e","resolution":{"observed_at":"2026-08-14T04:14:38.058262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.413262Z","title":null,"venue":null,"work_id":"f0d8a126-731e-42e4-a493-e474766e0fee","year":2018},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.063570Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:ae9cfb300c539c57423d27cbfdf7787ed650bf27e7d9648d7ad900c255944197","observation_id":"48014051-31ba-498c-9fc9-2060948ed58f","resolution":{"observed_at":"2026-08-14T04:14:38.417712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.398702Z","title":"Talbot, V","venue":null,"work_id":"05de1a01-9d00-49ff-96e9-aeef76586c00","year":2014},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.068278Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:4948eba61182189bc9d525595af78e7cd9a7323e49e4f6984335bd820eb3f198","observation_id":"97f3c624-9d0c-49e9-a7b3-87e6cb03ba6e","resolution":{"observed_at":"2026-08-14T04:14:38.402928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.383448Z","title":"Torfs, K","venue":null,"work_id":"c41abfab-9a64-4d3e-b2de-7d313b63d259","year":2014},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.072850Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:0ec49beb53632d99049122ff1a32726d618875d9c46a406fa27f407989589ff3","observation_id":"6ed0fbfa-7464-4e1f-af7d-ea07237e324a","resolution":{"observed_at":"2026-08-14T04:14:38.388312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.366979Z","title":"Tseng, A","venue":null,"work_id":"3a595cc5-8531-425c-ac9e-a666dc899e14","year":2024},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.077279Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:8c1abf5e1bae7aa4f8816148fec7c371a524d3b7dcfedbf55753c52db48ff852","observation_id":"5de745d3-bf06-48a2-abe2-bccb48983418","resolution":{"observed_at":"2026-08-14T04:14:38.372427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17202","last_updated":"2025-05-22T18:15:04Z","snapshot_observed_at":"2026-08-14T01:51:07.013368Z","submitted_at":"2025-05-22T18:15:04Z","title":"CHART-6: Human-Centered Evaluation of Data Visualization Understanding in Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17202","snapshot_observed_at":"2026-08-14T04:14:38.082018Z","title":"Verma, K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.082018Z"},"links":{"cited_paper":"/paper/2505.17202","citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:ac5ac870f484336eaf4d43c416bd8b171157e4745bfe1a870d4682b2fe317924","observation_id":"1fc2a428-9bde-45ce-a174-423774fcc281","resolution":{"observed_at":"2026-08-14T04:14:38.082018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-14T04:14:38.087144Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.087144Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:bf310e6bb38c47dd62cd7cc5e89761d1522ed5b270d844d0fc8291954c0b4bd6","observation_id":"9b42d781-938b-419b-9721-62f63197e5ce","resolution":{"observed_at":"2026-08-14T04:14:38.087144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.350135Z","title":"Ware.Information Visualization: Perception for Design","venue":null,"work_id":"2125c06a-3785-4ba5-9e8b-84ccf85f2488","year":2013},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.092237Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:c38f3d352e216634689db61e54cd47367380733c195066a5dcc4b8fc24ef583c","observation_id":"07fef077-96e3-4237-9552-ebad55dd76c1","resolution":{"observed_at":"2026-08-14T04:14:38.355465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.333242Z","title":"Wertheimer","venue":null,"work_id":"62659d9d-beec-46e9-9cbb-0387d8fee697","year":1923},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.097131Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:717b4887ed7dc7ddba070ccebf478a87da7c8a7c86352f2107ca260be20a0939","observation_id":"0cdd7994-cd88-4a19-9e95-c2849d0f19a4","resolution":{"observed_at":"2026-08-14T04:14:38.338035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.317101Z","title":"Whitney and A","venue":null,"work_id":"d77bacdc-6063-4881-9c8b-4808e7a31192","year":2018},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.102974Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:3be609c5e0283596cbbce05637c2faba3817192611375c38449ec162f629d06d","observation_id":"a32259af-0692-423b-ab71-6de428ddd02f","resolution":{"observed_at":"2026-08-14T04:14:38.322320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.299918Z","title":null,"venue":null,"work_id":"91de1767-fce8-4ecd-9941-34dac9ab33a9","year":null},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.107644Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:f2f16df49a48fc28e321d13fcf2b0075fb10eeeffdeaf18eca9a13c0927b754a","observation_id":"fec9a85d-df09-458d-ac13-cf87d3a2c9af","resolution":{"observed_at":"2026-08-14T04:14:38.304782Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.283078Z","title":null,"venue":null,"work_id":"f6e81c81-d907-4a8f-bd7b-4cabd03456ee","year":2023},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.112264Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:a471dde5f81a686860bcbff2467fa8fdc0530580f6422f083b40ebd66e7ad944","observation_id":"a51d41d3-0f6c-402b-a9fa-f98a2a7d4316","resolution":{"observed_at":"2026-08-14T04:14:38.287882Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10857","last_updated":"2025-03-13T20:13:39Z","snapshot_observed_at":"2026-08-14T07:36:52.444195Z","submitted_at":"2025-03-13T20:13:39Z","title":"Towards Understanding Graphical Perception in Large Multimodal Models","version":1},"cited_work":{"arxiv_id":"2503.10857","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.10857","snapshot_observed_at":"2026-08-14T04:14:38.160962Z","title":"Towards Understanding Graphical Perception in Large Multimodal Models","venue":"cs.GR","work_id":"23844d30-7db4-4f34-ae50-5cdafc452942","year":2025},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.116892Z"},"links":{"cited_paper":"/paper/2503.10857","citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:2c52647203da899763cea01bea75a57358a42370607a43ba6f5718e133365cd4","observation_id":"a55ac8e0-b553-499d-a937-3da38a54b075","resolution":{"observed_at":"2026-08-14T04:14:38.167801Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:14:38.267011Z","title":"trial_id","venue":null,"work_id":"dcb28b61-3e4c-49f4-99bc-2bf03a467713","year":2023},"citing_paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T04:14:38.122080Z"},"links":{"citing_paper":"/paper/2608.10195"},"observation_digest":"sha256:865953982a1239d5235e41c76250c1e4791f707ab9c998a9fd39b6a422e52497","observation_id":"a8004356-457c-45e3-920e-bb0cedb3c866","resolution":{"observed_at":"2026-08-14T04:14:38.271926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.10195","last_updated":"2026-08-10T20:14:14Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T21:54:18.134655Z","submitted_at":"2026-08-10T20:14:14Z","title":"More Accurate, Less Human: Gestalt Grouping in Vision Models"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2608.10195."}