{"as_of":"2026-08-15T21:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9c0e2e213fa277c4d7eebf37baf2051233da83c477e82b535f2362ba5a488340","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:31:31.198783Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.21635/citation-record","integrity":"/paper/2505.21635/integrity","json":"/paper/2505.21635/citation-record.json","paper":"/paper/2505.21635"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:24.959654Z","title":"Self-supervised learning from images with a joint-embedding predictive architecture","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:24.959654Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:cf9ee4b96eeaee0fbddcce5413bdb43bd0821c9b2d0f7e25152281e2387fcb55","observation_id":"5fd357de-3731-4840-bb5e-0aa24b0fd64b","resolution":{"observed_at":"2026-08-07T13:31:24.959654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:41.654320Z","title":"BEiT: BETR pre-training of image transformers","venue":null,"work_id":"d872b7fa-892e-4b01-bf39-3d250aa65db4","year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.037549Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:c12067706d4c2a1f9962b723d72607fcf45ab08c72bdd4da58738bd0521292a8","observation_id":"dc3d8099-e5cd-4c76-86d2-9818886a70de","resolution":{"observed_at":"2026-08-07T13:31:41.770579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:41.465911Z","title":"Revisiting feature prediction for learning visual representations from video","venue":null,"work_id":"9b4f1114-4075-4f21-9d92-2c4732644b46","year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.131048Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:82125d2ea10297e3dcde68a70ae5f0371fa3ec90ac17092b12f424bd17faf35f","observation_id":"9b478194-a2be-470c-9f9e-40be4368986e","resolution":{"observed_at":"2026-08-07T13:31:41.540832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:41.233526Z","title":"Unsupervised scale-consistent depth and ego-motion learning from monocular video","venue":null,"work_id":"220c1f1d-22a8-41c6-9bd9-0ab439694c64","year":2019},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.263015Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:c0ed8b7a129446467af5d41daf5a256bc617423d68bbc529dcf2e3ee445e3eb2","observation_id":"dc252626-206f-42fb-9343-e6b1a23c1fe0","resolution":{"observed_at":"2026-08-07T13:31:41.355144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11390","last_updated":"2019-01-22T18:55:34Z","snapshot_observed_at":"2026-08-14T17:27:29.664717Z","submitted_at":"2019-01-22T18:55:34Z","title":"MONet: Unsupervised Scene Decomposition and Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.11390","snapshot_observed_at":"2026-08-07T13:31:25.335860Z","title":"MONet: Unsupervised scene decomposition and representation.arXiv preprint arXiv:1901.11390, 2019","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.335860Z"},"links":{"cited_paper":"/paper/1901.11390","citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:48d02992d6e46008be6754feefd738373e4348728966873e66dda00fd5ffb19d","observation_id":"2f8ad3a3-8f2d-4afa-ac96-247c37371926","resolution":{"observed_at":"2026-08-07T13:31:25.335860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:41.057406Z","title":"nuscenes: A multimodal dataset for autonomous driving","venue":null,"work_id":"fe8c2ab3-9f88-4609-9558-690234b463f6","year":2020},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.453406Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:c8022e6ed0c88aaa79b1f1497e538bdb83815583c7fa9b5683dce46f8e4863b2","observation_id":"41674d50-5a4a-4e80-88f8-edada8952d27","resolution":{"observed_at":"2026-08-07T13:31:41.140108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:25.503315Z","title":"Emerging properties in self-supervised vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.503315Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:79831d148ab1c77cf5de0b05be5ee19ecee7586c1ff3581084b8982859b5cd4c","observation_id":"74d62430-3f13-4972-a054-7722a8dab393","resolution":{"observed_at":"2026-08-07T13:31:25.503315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:25.617462Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.617462Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:30959b2934aac28ed2042d69cf5b46f496d7f8313ccf13ed85f5cf52c9241ce0","observation_id":"367d2663-6682-4574-8e60-9572d806d3dd","resolution":{"observed_at":"2026-08-07T13:31:25.617462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04297","last_updated":"2020-03-09T17:56:49Z","snapshot_observed_at":"2026-07-06T09:03:25.467987Z","submitted_at":"2020-03-09T17:56:49Z","title":"Improved Baselines with Momentum Contrastive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04297","snapshot_observed_at":"2026-08-07T13:31:25.660743Z","title":"Improved baselines with momentum contrastive learning.arXiv preprint arXiv:2003.04297, 2020","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.660743Z"},"links":{"cited_paper":"/paper/2003.04297","citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:44420bad0a8d6eb734f59d8f1fca78e2bfe70b52669a6e058959fd2fcaef2130","observation_id":"ca831bed-ee46-4602-af1a-45dbc4998aa5","resolution":{"observed_at":"2026-08-07T13:31:25.660743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:40.845255Z","title":"An empirical study of training self-supervised vision transformers","venue":null,"work_id":"b510b272-1ce1-461e-b8d6-0ad107909572","year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.699470Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:ed0fb0dbcc000ae4db9d7332ff3a7b5c09291fe704ce29e1c95af9aa79bcdc80","observation_id":"987542f9-5d20-4580-a4df-e3f200263297","resolution":{"observed_at":"2026-08-07T13:31:40.915105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:40.633500Z","title":"OpenMMLab’s pre-training toolbox and benchmark","venue":null,"work_id":"67dab3bd-efa6-43c7-a97e-d0910d8d2d9a","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.768737Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:500d315876666733f1092ab20c645aacfd2c302bada663f971abb6ada46c593d","observation_id":"8c107250-60bc-4791-aa39-c279a28afb1b","resolution":{"observed_at":"2026-08-07T13:31:40.745501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:40.450741Z","title":"Vision transformers need registers","venue":null,"work_id":"8dabb439-40bb-48c4-a01f-43f263d85b58","year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.820081Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:f4ab22fd6ab1adca0f2f2b4ed19a8bd33fe5136e5df5f1918704159912af587e","observation_id":"1f827847-6e7f-4702-a208-5f1cce0cf65b","resolution":{"observed_at":"2026-08-07T13:31:40.545930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:25.848360Z","title":"ImageNet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.848360Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:72bbb11eb798aa4f5aa07dc9d1d0ed74cead591897f243c66677d3013089696f","observation_id":"fb463561-fcb5-4078-b6e9-2564cc528622","resolution":{"observed_at":"2026-08-07T13:31:25.848360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:40.235784Z","title":"With a little help from my friends: Nearest-neighbor contrastive learning of visual representations","venue":null,"work_id":"2244704f-166f-4e38-a1d1-bbfe2a9dfe24","year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.883256Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:7951960b89b941c2c20e208b23f8a42cfe1192a2812764b22e14258f08b5b2b2","observation_id":"182d59d3-822f-44dc-8dab-879747bc7c1a","resolution":{"observed_at":"2026-08-07T13:31:40.330063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:40.030942Z","title":"Depth map prediction from a single image using a multi-scale deep network","venue":null,"work_id":"dd9744f2-dac0-4e1d-9d34-fb4ffda84b73","year":2014},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:25.934891Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:b4d651a6b090a0c58eca9685573268ff41e45dbbafed825107cf35c90ff79d42","observation_id":"130a40f6-3018-45ce-9c0b-d42fcb09ea9b","resolution":{"observed_at":"2026-08-07T13:31:40.127745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:39.811322Z","title":"Are we ready for autonomous driving? the kitti vision benchmark suite","venue":null,"work_id":"c9ef36c2-133f-425a-8515-e54261631515","year":2012},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.004386Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:1dd42229750646a9813c39c17e60efe5a74539fc879732cb4ddf001832751fd9","observation_id":"cb2f33ba-6537-4fff-83d3-a2d553ddcdbd","resolution":{"observed_at":"2026-08-07T13:31:39.904187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:26.048537Z","title":"Ego4D: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.048537Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:cdcd0557560ac3a0e77338c7c9ae7ef041be6fb18a18a8e4883ddc946b4f0635","observation_id":"2ef800fa-9091-4d46-8aa0-cf14202f051d","resolution":{"observed_at":"2026-08-07T13:31:26.048537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:39.620885Z","title":"Multi-object representation learning with iterative variational inference","venue":null,"work_id":"611715e3-aecb-488e-8a65-8822375a7741","year":2019},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.100916Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:22371e835490b25e8ba90e0cd22321f8a61f41bb1e08eb336bf74fb4324e31ad","observation_id":"c348f0ff-0e14-4c36-a98e-0a3b59b18c23","resolution":{"observed_at":"2026-08-07T13:31:39.695669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:39.394596Z","title":"Bootstrap your own latent-a new approach to self-supervised learning","venue":null,"work_id":"6c1928f8-e0d8-4049-a2f2-2dbc95c300b9","year":2020},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.149515Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:d99687badce931aad612842888eed3ace5626fe0ef9585ed256ef2bc130fdf2b","observation_id":"1453dc1b-d073-4fb8-913b-54b43d54dfbb","resolution":{"observed_at":"2026-08-07T13:31:39.498278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:26.204237Z","title":"Tan et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.204237Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:88bd9e5c71c2536eb8d995592f5ab9ee7bd94a887ba5d5d5707dc5560f3e9310","observation_id":"b63f46ec-d330-4df1-b2f3-4dee58d6c1c1","resolution":{"observed_at":"2026-08-07T13:31:26.204237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:26.255690Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.255690Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:54fbf408c320eaca845070f14ff7e557f195081613d94993fd4613b19f13cbdf","observation_id":"9d61bc25-3162-4c50-818c-440470da75bb","resolution":{"observed_at":"2026-08-07T13:31:26.255690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:26.309810Z","title":"Momentum contrast for unsupervised visual representation learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.309810Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:da3fa3fbed557c871a17045d8b618943aee6cddedfea330f0569fcda994e29d4","observation_id":"6c3f7287-38ea-4c0e-b515-4b2e0f83860c","resolution":{"observed_at":"2026-08-07T13:31:26.309810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:26.387778Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.387778Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:7421532ed79e50eaead40b7677097cc901253c13a80941be21d2b99a392f45d3","observation_id":"f6b08049-a3e0-4e6f-8a0f-3146748cdcc3","resolution":{"observed_at":"2026-08-07T13:31:26.387778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:39.213021Z","title":"Development of perceptual completion originates in early infancy","venue":null,"work_id":"6c303591-3b7d-4de3-8509-b98609d7c462","year":2003},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.456219Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:ae7d2f89cc1607638e29bfa12474b5687885e9727318a6fdcb8e4d0670db121c","observation_id":"09e66b67-0716-46a8-8cd1-dc50a777bb47","resolution":{"observed_at":"2026-08-07T13:31:39.271530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:39.018706Z","title":"Discriminative clustering for image co-segmentation","venue":null,"work_id":"be03bbfe-def3-4908-9e7d-b917cbe2c681","year":2010},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.523767Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:a9cf8935c0e759cc7fb79532c17e491f3fd0dedb901ba86f58eafcce69432567","observation_id":"efb7751b-a93a-4629-9f94-4d9072972030","resolution":{"observed_at":"2026-08-07T13:31:39.099997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:38.823496Z","title":"Multi-class cosegmentation","venue":null,"work_id":"017e150d-9b4d-4c51-b642-4df490bd1f3e","year":2012},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.614586Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:5e0414747c55e612224b08d766d8991b749976a513e1a51454641de768d09050","observation_id":"9384502d-7bd8-4301-8a45-44e73897bda4","resolution":{"observed_at":"2026-08-07T13:31:38.910704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:38.646550Z","title":"Perception of object unity in young infants.Infant Behavior and Development, 11(2):161–180, 1983","venue":null,"work_id":"bcd70d9b-f083-41fb-bda6-553ec190f489","year":1983},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.681207Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:3fb48dc21a2294469e6346389080409dc77079fbcffeeb9b8bd4d4c64b25e216","observation_id":"f01fd727-cb17-403f-801d-073de1e6a5b1","resolution":{"observed_at":"2026-08-07T13:31:38.721723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:38.460318Z","title":"Panoptic feature pyramid networks","venue":null,"work_id":"4234edb4-7f9c-419f-a72a-682a3af5cb92","year":2019},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.779367Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:4c78f5d07ebdd6ad1718f73e4e599781af55e6b84874a122c86c0fbb33e09f71","observation_id":"39d4670e-bed4-440b-8cc3-65324ed15106","resolution":{"observed_at":"2026-08-07T13:31:38.561060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:38.247676Z","title":"A new neural framework for visuospatial processing.Nature Reviews Neuroscience, 12(4):217–230, 2011","venue":null,"work_id":"bff9b50c-25c2-4897-8f40-35c39ebe39a5","year":2011},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:26.877509Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:20dd31e2563034eb5da25639da8c1e1404a2def59ac3cb761cae94f66dd797b6","observation_id":"0b13f8de-d537-4522-a251-b8a0f0294a7a","resolution":{"observed_at":"2026-08-07T13:31:38.336543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:38.029737Z","title":"Segment and recognize anything at any granularity","venue":null,"work_id":"2ffde959-3cb8-4857-bb30-4e66e77d5d5d","year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.000781Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:e58f2a125e7d3bf816b97c83594731140680ece08fc191c82bcae78d79dbcd6a","observation_id":"c72457b6-7742-449a-825b-e699bc331260","resolution":{"observed_at":"2026-08-07T13:31:38.137101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:37.816091Z","title":"BEVFormer: learning bird’s-eye-view representation from LiDAR-camera via spatiotemporal transformers","venue":null,"work_id":"1522906c-ba6a-4559-99f9-3bdc7b0cd5cf","year":2020},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.085881Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:e0ba4875899fd4560038e8eb777f8062406001bf7296e13e1c6cc245a33ec004","observation_id":"a3395514-81c3-4f90-abbd-7c1c1c3eb224","resolution":{"observed_at":"2026-08-07T13:31:37.901881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:37.672440Z","title":"V A-DepthNet: A variational approach to single image depth prediction","venue":null,"work_id":"ef730347-efe5-4110-98de-9dd3f1259ae4","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.168533Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:c6012c441d06ff4700faa22731acfe3b14f9d1d4c6b525214b59e13bbbf85b99","observation_id":"1b330a99-952b-41e5-a417-4677851be292","resolution":{"observed_at":"2026-08-07T13:31:37.740810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:27.228242Z","title":"Fully sparse 3D occupancy prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.228242Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:e2e8bdb1e9d4becd038d6180e919446dcf0d81fc7c203ef93dcc7d8c6a2e290e","observation_id":"1c10159c-a77b-40b3-8246-b3c3ce8315a6","resolution":{"observed_at":"2026-08-07T13:31:27.228242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:27.320898Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.320898Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:aeeddb29f67a9207330840c645ce5e3ce667734740386232468b4bdab9a6d2cd","observation_id":"b361d8db-31cd-4ae9-9a13-2a22f523eb84","resolution":{"observed_at":"2026-08-07T13:31:27.320898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:27.402700Z","title":"Object-centric learning with slot attention","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.402700Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:0a4c25e573f061d2c77bdebd430dad554ac92a24ce021d8748933e46d0123074","observation_id":"c7162666-a6f9-4628-a487-d6296fb7958a","resolution":{"observed_at":"2026-08-07T13:31:27.402700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:27.510348Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.510348Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:f2df6d173cb88ced7c6f12171a70fe04a106fdbe68820236b53991ea3e1658e0","observation_id":"93be6318-245c-4d2f-a569-ed7dede62ad2","resolution":{"observed_at":"2026-08-07T13:31:27.510348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07376","last_updated":"2025-02-14T22:53:14Z","snapshot_observed_at":"2026-08-13T04:20:56.456336Z","submitted_at":"2024-02-12T02:16:59Z","title":"Unsupervised Discovery of Object-Centric Neural Fields","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07376","snapshot_observed_at":"2026-08-07T13:31:27.621968Z","title":"Unsupervised discovery of object-centric neural fields","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.621968Z"},"links":{"cited_paper":"/paper/2402.07376","citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:d3b74a8750e22c6d7d53395f50f613c666f87f9beb7b563d16acd518a2a388c2","observation_id":"4a069e75-9087-424b-a238-72006426dccf","resolution":{"observed_at":"2026-08-07T13:31:27.621968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:37.399679Z","title":null,"venue":null,"work_id":"a4f2f29b-418e-4973-ba12-54f7321750ed","year":1982},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.718498Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:b49f3ea964d6c4585bd54be31a05ec4d2aebf9d4fb3ba4d1c851054dc388c467","observation_id":"5dd5e13f-fbbf-4ac1-84c3-ebfcbe9f2daf","resolution":{"observed_at":"2026-08-07T13:31:37.534968Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:37.226265Z","title":"Object exploration and object knowledge in young infants: A view from developmental psychology.Cognition, Brain, and Consciousness, 2001","venue":null,"work_id":"bc78c1f6-6d7a-4225-866b-f3be1773ec9c","year":2001},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.846082Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:c8adefdf3536a3ef110a8d66e98962ae7e82856febff267472f6ff0924216a4e","observation_id":"b30abedf-6f88-4f9c-a379-b930d45a8ea0","resolution":{"observed_at":"2026-08-07T13:31:37.299495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:36.996903Z","title":"DINOv2: Learning robust visual features without supervision.TMLR, 2023","venue":null,"work_id":"854cef13-5653-4eea-b09d-2ef16790709c","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:27.961306Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:d86cb1402f91c17f3a08fd8cef02abef2e0df24cac84660df9284ac3d294cbd8","observation_id":"0223579e-6e19-4af2-b1c3-b4514d2cc701","resolution":{"observed_at":"2026-08-07T13:31:37.101874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:36.844558Z","title":"Open X-embodiment: Robotic learning datasets and RT-X models","venue":null,"work_id":"e388568a-7ca9-4caa-b308-6b6e07265d23","year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.093616Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:93d3fb50fa28deab7bd88dadc5346735cadbba8fd1e3e90d908175344cf289b1","observation_id":"d5731c95-059d-4853-8bcc-8c31c362b2da","resolution":{"observed_at":"2026-08-07T13:31:36.911664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:28.179885Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.179885Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:01eb1ea5a4180de5d3af6632e3be2bb890e38dc47cc88e3add401bcf59e128f1","observation_id":"15267dab-a6a4-4e56-b035-1b4ae27bb243","resolution":{"observed_at":"2026-08-07T13:31:28.179885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.06366","last_updated":"2022-10-03T11:47:10Z","snapshot_observed_at":"2026-08-13T14:45:57.387723Z","submitted_at":"2022-08-12T16:48:10Z","title":"BEiT v2: Masked Image Modeling with Vector-Quantized Visual Tokenizers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.06366","snapshot_observed_at":"2026-08-07T13:31:28.288089Z","title":"BEiT v2: Masked image modeling with vector-quantized visual tokenizers.arXiv preprint arXiv:2208.06366, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.288089Z"},"links":{"cited_paper":"/paper/2208.06366","citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:72aa0f81192752a086ee8f804679a9fbbba3f44b03c8203168206f693e6a4974","observation_id":"955c7340-0723-4556-a397-3d843f9d872e","resolution":{"observed_at":"2026-08-07T13:31:28.288089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:28.384396Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.384396Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:b583635aaeabb34fb7923dae8c4fa94631a81a29a0ae24487fb59da4da153d88","observation_id":"7256f0b5-9b90-43af-aae1-89a95a0585ec","resolution":{"observed_at":"2026-08-07T13:31:28.384396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:36.663855Z","title":"NDDepth: Normal-distance assisted monocular depth estimation","venue":null,"work_id":"38417d23-9d49-4b63-8c3c-b2f6ed325b05","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.478170Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:2b155989e15ca0561c707cab1708394aa42e52801b425119a3e9c5d8393a1412","observation_id":"5037b5c7-4e9a-43f3-a1b9-d3a46c9fbc6f","resolution":{"observed_at":"2026-08-07T13:31:36.729101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:36.509921Z","title":"IEBins: Iterative elastic bins for monocular depth estimation","venue":null,"work_id":"3a87a9c1-58ba-4936-a729-ef02c82273e4","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.579175Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:2039557ae167a9ca7ad3a70866b8d542913150e8f8db642e1f1de772fa617311","observation_id":"5fd24125-f097-4c22-8dcc-393a096c37d6","resolution":{"observed_at":"2026-08-07T13:31:36.577751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:36.379748Z","title":"VideoFlow: Exploiting temporal cues for multi-frame optical flow estimation","venue":null,"work_id":"4bd6bad8-5499-4321-abf5-6a9578b7ee2b","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.661345Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:4b9489303be64f640c7d072b5847837bb10babf700cdf45e27462643e26922d1","observation_id":"f270a981-92e5-4ecf-8658-7fcb3f16325a","resolution":{"observed_at":"2026-08-07T13:31:36.444296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:36.227869Z","title":"Localizing objects with self-supervised transformers and no labels","venue":null,"work_id":"9cb51ce2-8872-431e-ba92-60b8cddb572f","year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.758526Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:95b7b771ae6278c72133652a43a0b9b5b1575f1558348d1e6b1b49824085f416","observation_id":"6de36e87-8e12-4367-b9cc-f62b9f259266","resolution":{"observed_at":"2026-08-07T13:31:36.308055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:36.086534Z","title":"Locate: self-supervised object discovery via flow-guided graph-cut and bootstrapped self-training","venue":null,"work_id":"2a03b6aa-163c-4358-85c9-fdafc7df9a6c","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.826708Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:c22624630e8313f4f83f430bdc505c4adf06a9cc0c12bd31bb01a9ecac1b0cad","observation_id":"49f39d0c-8684-4f13-a70e-45180f216b3c","resolution":{"observed_at":"2026-08-07T13:31:36.151687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:35.915024Z","title":"Selective search for object recognition.IJCV, 104:154–171, 2013","venue":null,"work_id":"7e803925-f0f4-4a47-abec-4a749deea9f1","year":2013},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:28.987102Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:7ac71d531f65e2b39d35d8ef668fad9b3c64eb8e58c13b2c8254661d569082a0","observation_id":"423b56ea-86e3-420f-973e-3e02bb38d5b5","resolution":{"observed_at":"2026-08-07T13:31:36.002078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:35.802767Z","title":"Two cortical visual systems.Analysis of Visual Behavior, 1982","venue":null,"work_id":"b672f0a3-4ac9-4f34-8a8f-77ff03b6f9b9","year":1982},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.109536Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:073fb3d7e8469dab14a17eefde49fd5dfeedec2088578f3b4c241e3568ec49b8","observation_id":"415edad0-0c63-4217-86d2-652538c6a744","resolution":{"observed_at":"2026-08-07T13:31:35.855718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:35.576766Z","title":"Object cosegmentation","venue":null,"work_id":"96a671f9-face-482c-ba67-f0ab79188352","year":2011},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.212078Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:e3f606436ec1e3a91ac96dc8d3ed5fbaeb778e31d082cb6d1026f0c120b6c0a7","observation_id":"2c989a00-2d3c-4693-a7a4-91c1859f5425","resolution":{"observed_at":"2026-08-07T13:31:35.687583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:35.384249Z","title":"Unsupervised image matching and object discovery as optimization","venue":null,"work_id":"884e98a3-bdc6-4eab-848d-56f6b54a7767","year":2019},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.351351Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:61895dec92839d2e95e8e2e31a5fe6ee7b707e97e47dedc264040839e09580cc","observation_id":"b967e307-cdea-4207-82d2-8c51ec60c8c9","resolution":{"observed_at":"2026-08-07T13:31:35.469892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:35.148239Z","title":"Large-scale unsupervised object discovery","venue":null,"work_id":"5afb0482-c031-423c-a9a0-7b8da430c56a","year":2021},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.471213Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:a58cfe24bf203bb6009170a2f8d57c2a8199fa53b9ca0aeb69b65f902cb52931","observation_id":"32692875-99c1-402e-8568-ee4243526bc6","resolution":{"observed_at":"2026-08-07T13:31:35.276939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:34.915020Z","title":"DCDepth: Progressive monocular depth estimation in discrete cosine domain","venue":null,"work_id":"7290ffec-c7fe-449f-9ef1-4e573f3e9ecf","year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.601614Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:ac58af091614b0b8bbc13d67d8666d972e83c8388badf8ebdfab6a2946a10371","observation_id":"afac61fc-ddc4-4291-9f78-3d238a9f54a3","resolution":{"observed_at":"2026-08-07T13:31:35.032382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:34.717076Z","title":"Image as a foreign language: BEiT pretraining for vision and vision-language tasks","venue":null,"work_id":"42d94920-35d1-4e81-8ffe-6e876bf070c7","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.683893Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:96f1a4a8c5f6c3a015758e4cae099094e453c71996b74443cc09daf8b21abb07","observation_id":"31f7f0cf-56ce-4c84-a849-b2b93a012987","resolution":{"observed_at":"2026-08-07T13:31:34.808549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:34.387848Z","title":"Self- supervised transformers for unsupervised object discovery using normalized cut","venue":null,"work_id":"e6854624-19b8-4f26-8a1f-576fd734949e","year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.787260Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:9807b058fb880c99de7d550e6dc74a017cce13934b00fea556c8404793c99b57","observation_id":"5eaa2410-9f72-413f-8eff-8f9dad482392","resolution":{"observed_at":"2026-08-07T13:31:34.540007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:34.068286Z","title":"TokenCut: Segmenting objects in images and videos with self-supervised transformer and normalized cut.TPAMI, 45(12):15790–15801, 2023","venue":null,"work_id":"36156608-9ae7-4d7d-b73e-0d60d16d05bc","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:29.913540Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:53f6eb9d798bac433e63081eac6fefd12b38f8e2d7d6d57c71dd846f158a0dda","observation_id":"4b457c8d-fac7-4b1e-9c77-e103d6702bee","resolution":{"observed_at":"2026-08-07T13:31:34.244426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:33.810056Z","title":"4D unsupervised object discovery","venue":null,"work_id":"eb05e683-9362-4375-9b48-4966f791cde4","year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.012538Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:b5fedd609805cbe259696421305fa2b050928f2d99fc37694ed79304b5782a98","observation_id":"88705376-2756-4163-ab9a-541f581f74ad","resolution":{"observed_at":"2026-08-07T13:31:33.933268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:33.545874Z","title":"Unsupervised object discovery and co-localization by deep descriptor transformation.PR, 88:113–126, 2019","venue":null,"work_id":"80aea961-e776-4525-b181-cc497325f69e","year":2019},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.043731Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:48f37dd25e24c265a7100ed681df4cf73541bdb4f99d55b83e4b9624396390e0","observation_id":"7bb5eaf4-9626-479b-995f-d229f2559e09","resolution":{"observed_at":"2026-08-07T13:31:33.684195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:33.205242Z","title":"CroCo: Self-supervised pre-training for 3D vision tasks by cross-view completion","venue":null,"work_id":"9f6d9f5e-9bdb-4001-a274-a7f6942c434d","year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.149844Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:82d4419de70bc000cd3ab063927996406817212fdf103ee8e6a5e06f5383364b","observation_id":"3dd73b52-c58f-4a10-a197-8a853dadcf1f","resolution":{"observed_at":"2026-08-07T13:31:33.374955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:33.040313Z","title":"SimMIM: A simple framework for masked image modeling","venue":null,"work_id":"c0d335a1-896b-43b0-b265-ab8496074b74","year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.256971Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:8c7a92e033acd4166dc9301d60a137cc1967a3f13927f980bed1ff8ecd103769","observation_id":"df8c767b-2e57-486b-86f0-e3296d6309bf","resolution":{"observed_at":"2026-08-07T13:31:33.108156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:32.777740Z","title":"Revealing the dark secrets of masked image modeling","venue":null,"work_id":"7583fd96-3858-4ed0-bd2f-410b3bb52b74","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.370850Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:03ae40ef4fc6784519e593bcb7a04207237d424fb77187d6ceefa422f5139b2c","observation_id":"fe1cc001-7aca-418f-9289-aba28b6da36f","resolution":{"observed_at":"2026-08-07T13:31:32.925583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:32.511144Z","title":"BEVFormer v2: Adapting modern image backbones to bird’s-eye- view recognition via perspective supervision","venue":null,"work_id":"c074428f-301d-4b5f-b402-3f807e5dc194","year":2023},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.458860Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:a9c78dd833a235a12c638be8a5f6e8337d03efb1a326d6ed33b5d113e77337ab","observation_id":"d7f8c352-7a2d-4d8b-836e-82cb678bf4b0","resolution":{"observed_at":"2026-08-07T13:31:32.646465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:32.312651Z","title":"Generalized predictive model for autonomous driving","venue":null,"work_id":"aaaaef0e-cd2d-414d-b3a8-221d6df740c2","year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.554913Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:c6366151997d7ea0e3ddb226f15265de27e266158c6462c89fae0b739ff6b993","observation_id":"75038a03-2c63-4b52-bc6e-9734f133308e","resolution":{"observed_at":"2026-08-07T13:31:32.390655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:30.641934Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.641934Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:d9261580e707502dbde0995aca0b602b9e32b42ad6083d8611159dbbbcfd00d4","observation_id":"faf216ae-0164-46dd-840a-baa21141f8be","resolution":{"observed_at":"2026-08-07T13:31:30.641934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:30.722512Z","title":"Depth anything v2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.722512Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:9345d6363d129185ea80032ddc3a34a502271580af42de96e2b460d80dfe47f3","observation_id":"bb1029cd-2a10-483f-a3fb-b382fcaca729","resolution":{"observed_at":"2026-08-07T13:31:30.722512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:32.072368Z","title":"Decoupled contrastive learning","venue":null,"work_id":"e8229cec-7f95-461a-be1c-5e975d499a20","year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.799628Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:f0bf908b06c302cba9609b030d7fef2b3e79dc15b23491661724cf357644f90b","observation_id":"95c2c685-17f5-447d-b345-269e93f1073c","resolution":{"observed_at":"2026-08-07T13:31:32.166851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:31.909196Z","title":"Neural window fully-connected CRFs for monocular depth estimation","venue":null,"work_id":"458929e1-1b98-48e2-8421-8ef2f1ffc897","year":2022},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.883842Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:9d8571e9e7e87d30949804e72e170801c364e4d5e2cf92a82fbab7481c5d5fc0","observation_id":"41f6c796-563e-4b7c-9f7a-e7588c7f03e3","resolution":{"observed_at":"2026-08-07T13:31:31.985073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:31.761945Z","title":"HEAP: unsupervised object discovery and localization with contrastive grouping","venue":null,"work_id":"9b542068-9a8e-4d1b-8ba0-a93d09c6103a","year":2024},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:30.983454Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:dff6729a2320ddfdad9248795a08d0a3aad6fa4eb392fdd987e4163c950a86ab","observation_id":"6f179519-cdaa-46ef-8ad0-accf16c48139","resolution":{"observed_at":"2026-08-07T13:31:31.817057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:31.572117Z","title":"Unsupervised learning of depth and ego-motion from video","venue":null,"work_id":"dac02906-92aa-4761-a7c9-d29baba338e7","year":2017},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:31.094408Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:d80abb55ba6357fe29db44da4755b4644fbf6af825e0987aec58428ddb9b2c12","observation_id":"2c0d6bcf-db85-4edd-b1d0-dd3da009ce5c","resolution":{"observed_at":"2026-08-07T13:31:31.672593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:31:31.395434Z","title":"Edge boxes: Locating object proposals from edges","venue":null,"work_id":"343c00de-3a0a-4019-b397-8b73fbcbd63d","year":2014},"citing_paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:31.198783Z"},"links":{"citing_paper":"/paper/2505.21635"},"observation_digest":"sha256:e4006b4da17ef1b4dac3456a5e7cf77355f827335764b875fdfdad5678bad885","observation_id":"e1862ab6-e4e9-46f3-88c7-a4a386017214","resolution":{"observed_at":"2026-08-07T13:31:31.478858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21635","last_updated":"2025-05-27T18:09:02Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T08:46:11.171671Z","submitted_at":"2025-05-27T18:09:02Z","title":"Object Concepts Emerge from Motion"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":50},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2505.21635."}