Pith. sign in

Paper Citation Record · LEDGER

Cluster and Predict Latent Patches for Improved Masked Image Modeling

As of 8 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 4 inbound Pith citation observations for arXiv:2502.08769.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.08769 v3

Coverage vector

measured 74 of 74 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T23:50:07.591495Z

measured 78 of 78 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 4 of 4 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-06T19:13:57.887170Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T10:29:44.836738Z

Reference resolution

74 of 74 outbound references displayed

  • verified exact0
  • verified fuzzy45
  • unresolved29
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation e64fd209-0933-4b59-ada4-cfaecb37f555 · outbound

This paper cites Mim-refiner: A contrastive learning boost from intermediate pre-trained representations, 2024.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Mim-refiner: A contrastive learning boost from intermediate pre-trained representations, 2024

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:08.171213Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.372866Z digest=sha256:49b8974fbda3c2c87a335808275ac3bc40341204cd528bad0f98b6e4cf0f3815

Observation affb467d-cb62-4c25-9828-79d172f73d03 · outbound

This paper cites Self-labelling via simultaneous clustering and representation learning.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Self-labelling via simultaneous clustering and representation learning

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.377023Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.377023Z digest=sha256:0927bb466bb28eef77dff3e968ccc1e59b83343f71085266757cf5d51380b39f

Observation 0727c0ae-930c-4d4b-8c3b-c049fbf98300 · outbound

This paper cites Masked siamese networks for label-efficient learning.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Masked siamese networks for label-efficient learning

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:08.157219Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.380319Z digest=sha256:bd75dba6c8d9fa6d2cb6501391857456c31b9da5b5dabc1123d79ea0b6081809

Observation e6156ec4-db27-40f2-a81a-717c9211a1fe · outbound

This paper cites Self-supervised learning from images with a joint-embedding predictive architecture.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Self-supervised learning from images with a joint-embedding predictive architecture

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.383526Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.383526Z digest=sha256:98706ec674ac00b8548facdf84e22d27fbec2d8802345fa7351090116efbd34a

Observation 5275a5ba-00c8-487a-ad6b-f04b4fc69dda · outbound

This paper cites data2vec: A general framework for self-supervised learning in speech, vision and language.

Cluster and Predict Latent Patches for Improved Masked Image Modeling data2vec: A general framework for self-supervised learning in speech, vision and language

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:08.143374Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.386636Z digest=sha256:2e460700cfe7fa4c730e3b9dea690b0ba28b487bd6761e8564927ad1273cdab3

Observation 4be6fc8f-9ab6-4d6c-af2d-65de12a83abd · outbound

This paper cites Efficient self-supervised learning with contextualized target representations for vision, speech and language.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Efficient self-supervised learning with contextualized target representations for vision, speech and language

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.389844Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.389844Z digest=sha256:928bf58085d3a1bb7206fd9d5e4e3f06f06c12eefbbe90003ee4c2d22687da49

Observation c9be6d1e-fd5d-4b7c-86f6-150fce1ae03e · outbound

This paper cites Beit: Bert pre-training of image transformers.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Beit: Bert pre-training of image transformers

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:08.129092Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.393315Z digest=sha256:be20c986cae486375914b630e569578262a3978e9a8284163216ce4ee338938b

Observation 49a4743c-bf3b-44cf-bc36-1afee2967373 · outbound

This paper cites Stochastic positional embeddings improve masked image modeling.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Stochastic positional embeddings improve masked image modeling

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:08.119531Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.396361Z digest=sha256:8c9722908c82112925a3e093e6ff65b80a2c6c4e9d3837fd77e6ec6fb6028db0

Observation 63f55369-b7a8-4b83-af5a-1cf91ecba547 · outbound

This paper cites Objectnet: A large-scale bias-controlled dataset for pushing the limits of object recognition models.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Objectnet: A large-scale bias-controlled dataset for pushing the limits of object recognition models

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:08.110608Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.399244Z digest=sha256:321ca70f4f326d40b64adbc97f89b66d55e66d51d603650c97dc152136ae26c0

Observation c137fadc-b63d-471f-8164-ca9e43bb34b4 · outbound

This paper cites V-jepa: Latent video prediction for visual representation learning, 2023.

Cluster and Predict Latent Patches for Improved Masked Image Modeling V-jepa: Latent video prediction for visual representation learning, 2023

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:08.101588Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.402414Z digest=sha256:4f098ae7eea24bb04d6d6be6f7484b5033b396945eddfd2ef5cb4d9c337ec248

Observation ee0fbd76-015e-464d-b862-02753ebe7013 · outbound

This paper cites Are we done with ImageNet?.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Are we done with ImageNet?

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.405408Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.405408Z digest=sha256:877eb813cb44980b7f02db8decd396103c651cdf37c265876b1d9e41a35e82d4

Observation 866f21aa-8678-4038-befe-023044aedc24 · outbound

This paper cites Depth pro: Sharp monocular metric depth in less than a second, 2024.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Depth pro: Sharp monocular metric depth in less than a second, 2024

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:08.092606Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.408898Z digest=sha256:70e5ed29f0aff1af862e9b77ddd45aa313e6087836e8fe3effb2e2630285d43a

Observation c5041c8f-00d8-43bf-a525-84b137b495c4 · outbound

This paper cites A limited memory algorithm for bound constrained optimization.

Cluster and Predict Latent Patches for Improved Masked Image Modeling A limited memory algorithm for bound constrained optimization

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:08.083751Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.411762Z digest=sha256:430f98fd0b9561ea28cce6f7bd626a704c4442c985fd662f61db69a7b19887c4

Observation 1a74868c-f175-4173-abce-6b9bea721d3d · outbound

This paper cites Deep clustering for unsupervised learning of visual features.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Deep clustering for unsupervised learning of visual features

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.414838Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.414838Z digest=sha256:1d433bc2717f0b23e987bb756754a475ed61fcecd300bf170f5cf37295b3d177

Observation 46d778fb-81a4-446e-a4bd-2b18a3848f5c · outbound

This paper cites Unsupervised learning of visual features by contrasting cluster assignments.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Unsupervised learning of visual features by contrasting cluster assignments

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.417820Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.417820Z digest=sha256:85780a8bcdadab3c037751003424e6db54aa9d2cf6b3619c2422e8233521fe20

Observation 73658325-b10e-415d-9d82-e988c8c80488 · outbound

This paper cites Emerging properties in self-supervised vision transformers.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Emerging properties in self-supervised vision transformers

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.420841Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.420841Z digest=sha256:d05fbd3f80a087491b5d0771badc1d27306cd25972fadf09aefabb75f85e342e

Observation 4a756af9-0202-4c6d-b631-66b09d57b9a8 · outbound

This paper cites Generative pretraining from pixels.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Generative pretraining from pixels

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:08.059440Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.423778Z digest=sha256:fc6e9277428ce90c20ff8b41f74b110c9cc1020f6794ef92e02e9064312700ac

Observation 3bd9c4c6-87ed-4f13-8763-89941078d6ea · outbound

This paper cites Towards a general-purpose foundation model for computational pathology.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Towards a general-purpose foundation model for computational pathology

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:08.050623Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.426720Z digest=sha256:4fe95d9519ef74db70cb609b32a01ccb59990ac40ec1c0484482d99b747647dc

Observation 76f551b3-9afa-4f4f-b7a4-ad727a2b2540 · outbound

This paper cites A simple framework for contrastive learning of visual representations.

Cluster and Predict Latent Patches for Improved Masked Image Modeling A simple framework for contrastive learning of visual representations

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:08.041590Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.429627Z digest=sha256:adad8c25356f1cd61da78709664a9b498efe8dbad9385ad69a1640c8c61db576

Observation 2bfcb3c6-7260-4cd8-b2b0-c4158ede7a81 · outbound

This paper cites An empirical study of training self-supervised vision transformers.

Cluster and Predict Latent Patches for Improved Masked Image Modeling An empirical study of training self-supervised vision transformers

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.432479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.432479Z digest=sha256:fcf0d0abe92a933379f3b11becd4b06774a4180a849afeb8d00a4544562fe57c

Observation 4f29bb6c-aba0-41c1-a566-cbafbc9e0af1 · outbound

This paper cites The cityscapes dataset for semantic urban scene understanding.

Cluster and Predict Latent Patches for Improved Masked Image Modeling The cityscapes dataset for semantic urban scene understanding

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.435256Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.435256Z digest=sha256:13b37c501d762472c0106e6cbd8cfc6a948011c013a8552ce3f527fda8ca4bdd

Observation a33e0d39-8445-4c3e-b5c1-8f1ed761c940 · outbound

This paper cites Vision transformers need registers.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Vision transformers need registers

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.438148Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.438148Z digest=sha256:a53f6eab0354a8e0a727fa587f6dccebc680dfb4ace9f4ac1657b995ee57e0f3

Observation 9a3a6299-d39c-4128-ad6d-130455ba5cd2 · outbound

This paper cites Endodino: A foundation model for gi endoscopy, 2025.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Endodino: A foundation model for gi endoscopy, 2025

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:08.017934Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.441063Z digest=sha256:8f4960103313afeb0cfa188575f7cdf8eb52e62e15aefb071b2dd22c43bd7d89

Observation 18199c8e-0d36-4f98-bfdc-fde4761828dc · outbound

This paper cites BERT: pre-training of deep bidirectional transformers for language understanding.

Cluster and Predict Latent Patches for Improved Masked Image Modeling BERT: pre-training of deep bidirectional transformers for language understanding

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:08.009069Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.443978Z digest=sha256:df0b2dc6268bbc0760b72fd0d1d8c88046a9ff7451829878aff91a7b155848c4

Observation b5fc92c9-e613-4773-aa08-fd077901dcce · outbound

This paper cites Unsupervised visual representation learning by context prediction.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Unsupervised visual representation learning by context prediction

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.446829Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.446829Z digest=sha256:dbfac476b424a70543b2c0701cf2e92a8a8ef83acc0058bb69184698d8385d3a

Observation a946cdd3-d29f-4fa9-95f8-f33aa27388e4 · outbound

This paper cites An image is worth 16x16 words: Transformers for image recognition at scale.

Cluster and Predict Latent Patches for Improved Masked Image Modeling An image is worth 16x16 words: Transformers for image recognition at scale

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.449847Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.449847Z digest=sha256:58e65ca823a8473ea12a5da8fbd985192073e1670b88d3ae8ea9186cec8106c7

Observation a0e84832-fc92-4d67-a9f2-433c00e8196c · outbound

This paper cites o kman, M rten Wadenb \.

Cluster and Predict Latent Patches for Improved Masked Image Modeling o kman, M rten Wadenb \

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.990271Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.453047Z digest=sha256:1b78194d53d786babf92eb4548274b96ec1460c5841f4a09ee6ea2a790d11892

Observation 3f7e670a-dd50-473e-a8e2-0bc3aed625a8 · outbound

This paper cites Scalable pre-training of large autoregressive image models.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Scalable pre-training of large autoregressive image models

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.981466Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.455970Z digest=sha256:c2cc2f0585088ce53256e215baafdf324f5d83c721a36256259bae2e07c90bba

Observation 4884892d-8102-4533-a151-c52a2fd7b95c · outbound

This paper cites The pascal visual object classes (voc) challenge.

Cluster and Predict Latent Patches for Improved Masked Image Modeling The pascal visual object classes (voc) challenge

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.458831Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.458831Z digest=sha256:28010e8bac258e5954abd1dfc34c3de40b797fd71449cf8404dbec70453b4962

Observation 8fe93c9b-26ff-41f7-a011-c47b2cad24ee · outbound

This paper cites Eva: Exploring the limits of masked visual representation learning at scale.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Eva: Exploring the limits of masked visual representation learning at scale

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.967740Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.461571Z digest=sha256:3865af3368b4020e18e93f0d38512aac4af1f58fbc46baa7f48a56b522923174

Observation 619dd6f0-2191-4681-8cb5-d2435f8a3490 · outbound

This paper cites Eva-02: A visual representation for neon genesis.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Eva-02: A visual representation for neon genesis

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.958856Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.464737Z digest=sha256:47913c625817b1fede06335db0c62fb659a2888a5f38177cdb29cbd168ee46d8

Observation 82671770-9e2b-4584-91b4-695e87ad79a4 · outbound

This paper cites Rethinking patch dependence for masked autoencoders, 2024.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Rethinking patch dependence for masked autoencoders, 2024

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.950151Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.467748Z digest=sha256:9bda76b3262ad3cbbe48f5dac058ca5a4e6c7241344c381a264315b59be9d575

Observation 24bf672d-d6b5-479e-993a-7cc1ed888107 · outbound

This paper cites Unsupervised representation learning by predicting image rotations.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Unsupervised representation learning by predicting image rotations

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.470609Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.470609Z digest=sha256:d0436fa02ed675cadec7fb5ef00824569acc965b402e4f709b0f12d739a266fb

Observation 63f1df5b-79a5-439a-8e4c-339027aea395 · outbound

This paper cites Moca: Self-supervised representation learning by predicting masked online codebook assignments.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Moca: Self-supervised representation learning by predicting masked online codebook assignments

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.936227Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.473551Z digest=sha256:54923540d157c51d3b53694f97636801e009225006e9b00c2bc7623deb9a1393

Observation e585265f-921d-4e03-899a-e23bd48441fc · outbound

This paper cites Momentum contrast for unsupervised visual representation learning.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Momentum contrast for unsupervised visual representation learning

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.476453Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.476453Z digest=sha256:143dcaf1630f9645a2412891be82aa17f6bd0d312f92256285820e694176790a

Observation ada7ba09-5da0-486a-98f9-f143e3e9769d · outbound

This paper cites Masked autoencoders are scalable vision learners.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Masked autoencoders are scalable vision learners

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.479313Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.479313Z digest=sha256:eaab2de33a596e244c91c9efc7e5631c1125c49768c9009d9c9d0d7275cca0d8

Observation aec7e784-0981-4ba5-99b6-5e469482ad57 · outbound

This paper cites Natural adversarial examples.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Natural adversarial examples

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.482133Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.482133Z digest=sha256:f9ccd137c866c9a51a4ddcdba4a8333997792780257f76a3d05aed740b880a4c

Observation 5f2a1434-4d4d-409b-b1d8-63b45eb5bfc6 · outbound

This paper cites Contrastive masked autoencoders are stronger vision learners.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Contrastive masked autoencoders are stronger vision learners

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.912506Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.485221Z digest=sha256:36afe9f6ecf30b58c98fca40ed6ec5539a022c4e72a6c881a80dbf4fedc6eec0

Observation c83b423e-8ea2-4c5e-93d6-c8a99c5b517f · outbound

This paper cites an unresolved cited work.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Unresolved cited work

Reference 39

Resolution
unresolved
raw_fallback, observed 2026-08-07T23:50:07.903599Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.488112Z digest=sha256:32cd7f9040f4aba6fce05cbdbab11d39e3f8041cc788d12a4110fa705388f539

Observation 7b2bbcfa-7c35-4dd5-8778-8157ab2d53aa · outbound

This paper cites Adam: A method for stochastic optimization.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Adam: A method for stochastic optimization

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.894446Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.491163Z digest=sha256:fa6dbf47e2316805b632136c5693a29aa5bd24eb565063318d5dc09af5979de9

Observation b308b999-fd16-4155-8079-33084944fae3 · outbound

This paper cites A path towards autonomous machine intelligence, 2022.

Cluster and Predict Latent Patches for Improved Masked Image Modeling A path towards autonomous machine intelligence, 2022

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.885626Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.494396Z digest=sha256:9f72aef22d71206c2d97eed1aa1f1957f65744584fa78fc423b9db5dcf2ed2c2

Observation 377e077e-86b1-48d6-98eb-503876300c96 · outbound

This paper cites Deepseek-v3 technical report, 2024.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Deepseek-v3 technical report, 2024

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.876872Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.497828Z digest=sha256:a3b3acdce1187318a1e30002529623631d481b328f830f8667584e9721712900

Observation fde0bc63-6951-40ee-9065-1b447ee562c1 · outbound

This paper cites Decoupled weight decay regularization, 2017.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Decoupled weight decay regularization, 2017

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.868172Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.500801Z digest=sha256:fcce440aad6320c18f50a3f21dfda329ce24e51f6043e1f52ad12de7daddbbfa

Observation 9b3fb27b-99ac-491b-886e-0b103d3d9d59 · outbound

This paper cites Torchvision: Pytorch's computer vision library.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Torchvision: Pytorch's computer vision library

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.859169Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.503791Z digest=sha256:44d6fe71e3fb5ed509e72ed75983951c280d62e14aae9488a88fe50d65d8c0d8

Observation a91de2bf-3772-4fdb-a957-1117bff0993d · outbound

This paper cites Self-supervised learning of pretext-invariant representations.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Self-supervised learning of pretext-invariant representations

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.506667Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.506667Z digest=sha256:b05a0c6cc338ddf52906b5ccfbccbd1d8eba964e415d0b062d234a371ebedd79

Observation ecf4ca09-9cc3-40f4-82f2-faada597e0fd · outbound

This paper cites Advancing human-centric ai for robust x-ray analysis through holistic self-supervised learning, 2024.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Advancing human-centric ai for robust x-ray analysis through holistic self-supervised learning, 2024

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.845454Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.509438Z digest=sha256:9e56f7b1e028b859326555f11b30fd0283bed95f5daa10c5ec78f611d12d1d90

Observation 93e6c209-c278-4f8e-a933-cd7e52e60e06 · outbound

This paper cites Representation Learning with Contrastive Predictive Coding.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Representation Learning with Contrastive Predictive Coding

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.512374Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.512374Z digest=sha256:193a3ee6c623a66ffbe696ff1a4502734d43482c4c11ccfd4e642f99d3d8ebfa

Observation 0f7775d7-3e2b-4b84-903a-41a85534d560 · outbound

This paper cites Dinov2: Learning robust visual features without supervision.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Dinov2: Learning robust visual features without supervision

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.836104Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.515457Z digest=sha256:7d902aaea841e4697fb8aaaff28b81fd024b7fa50fd54a719fb22d240153f640

Observation f930ddcd-6022-4075-9fe7-c501b3253bf4 · outbound

This paper cites Context encoders: Feature learning by inpainting.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Context encoders: Feature learning by inpainting

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.827446Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.518444Z digest=sha256:7c83ad5fdadc992629d3575bcabd6312e427ef8bd285eebff7d043a3e7365967

Observation 1c1f4f13-6cf2-42d9-b5c9-39285b6a63b9 · outbound

This paper cites Improving language understanding by generative pre-training, 2018.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Improving language understanding by generative pre-training, 2018

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.521541Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.521541Z digest=sha256:6dec7a6f5b7b22e20a57e43cf2bf9b8bef60a77c139396efe4535b072c6a5ede

Observation ab79520b-c91b-4eb2-97d3-aaa6370c192f · outbound

This paper cites Zero-shot text-to-image generation.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Zero-shot text-to-image generation

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.524359Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.524359Z digest=sha256:3eebdb5f8b95b46cacbe1bf1dbb24c818a5b5c8ec3eabb650cc7263d810fa3aa

Observation d787353b-fd33-4741-8cde-e961e4d6597c · outbound

This paper cites Machine learning in python: Main developments and technology trends in data science, machine learning, and artificial intelligence, 2020.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Machine learning in python: Main developments and technology trends in data science, machine learning, and artificial intelligence, 2020

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.808793Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.527309Z digest=sha256:4f737bcd5ee3761105d176dd72e8b9e5ec52da4f1ecbb50aaee521a9d2a8f748

Observation 73c077ff-2cc1-4778-8624-a62da0966b56 · outbound

This paper cites Do imagenet classifiers generalize to imagenet? In ICML, 2019.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Do imagenet classifiers generalize to imagenet? In ICML, 2019

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.530143Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.530143Z digest=sha256:bedce21e12d3857594e4e6db985a1a588756b31be0dd05cf76b34486c5e28319

Observation f538355e-5b4a-41fc-9748-0f59f7a2cf3f · outbound

This paper cites Imagenet large scale visual recognition challenge.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Imagenet large scale visual recognition challenge

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.794958Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.533008Z digest=sha256:5b8174fad8352e095450ba5b717aeeb320dc7cea8c5c89148ced7458462ad9c5

Observation 01a3fa6a-3f2d-4fdd-a4ab-218ace82b162 · outbound

This paper cites Sigma: Sinkhorn-guided masked video modeling.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Sigma: Sinkhorn-guided masked video modeling

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.786140Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.535814Z digest=sha256:5cc95b674aa29c35d7372e7dbbaa2e3e69f6c533b52e0cac04c8970ed5367535

Observation 03793c26-e018-4988-bf34-f66bc7bed3a7 · outbound

This paper cites Web-scale k-means clustering.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Web-scale k-means clustering

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.777248Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.538768Z digest=sha256:191934abdc3628c487df76ba39549f8062e4fff08f95724918c836b3fb91b759

Observation cc0bbcb5-b204-4ab4-b0dc-be01084b5aff · outbound

This paper cites Concerning nonnegative matrices and doubly stochastic matrices.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Concerning nonnegative matrices and doubly stochastic matrices

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.768485Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.541651Z digest=sha256:c6990736b3f4885fed5bfe331834fc69498ac323a652e43a60da4241b8deede4

Observation 71497537-1fb9-4982-bf87-53b1e49aa061 · outbound

This paper cites Roformer: Enhanced transformer with rotary position embedding.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Roformer: Enhanced transformer with rotary position embedding

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.544619Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.544619Z digest=sha256:f9197449e5ce32981fa02c0510749fdd75e5d5dcd0396727646130cab6c3dbb6

Observation e2afff0e-51a7-42b1-b489-665f78593d31 · outbound

This paper cites T-JEPA: Augmentation-Free Self-Supervised Learning for Tabular Data.

Cluster and Predict Latent Patches for Improved Masked Image Modeling T-JEPA: Augmentation-Free Self-Supervised Learning for Tabular Data

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.547661Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.547661Z digest=sha256:33685f866cd11132042610a500fe0f7c233f3427eb43a57cf241acdd48fe9000

Observation 9332855d-31d5-4d2f-9a77-9ce603cd036a · outbound

This paper cites Very high resolution canopy height maps from rgb imagery using self-supervised vision transformer and convolutional decoder trained on aerial lidar.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Very high resolution canopy height maps from rgb imagery using self-supervised vision transformer and convolutional decoder trained on aerial lidar

Reference 60

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.754537Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.550852Z digest=sha256:ced859de6ef92b1f26bd4f712397b1e15999ca7445e4a84fc69636d9d47baa35

Observation 24166dd7-4065-4acc-9070-5850df9f9304 · outbound

This paper cites Dino-tracker: Taming dino for self-supervised point tracking in a single video.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Dino-tracker: Taming dino for self-supervised point tracking in a single video

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.745387Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.553783Z digest=sha256:32585fe87c1a286d4180ddc8e94fbc2e81b05b3c073ba9e65030df5ae63d6a3d

Observation 1012bfcb-709a-490e-b18c-2b191e835b12 · outbound

This paper cites Benchmarking representation learning for natural world image collections.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Benchmarking representation learning for natural world image collections

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.736440Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.556618Z digest=sha256:b49116c378e5a5780e6a095bd985fe8c397d45eadcf31ae1688725bd6b90a529

Observation 09bf2426-bffb-4417-8b0a-9992e740c291 · outbound

This paper cites Attention is all you need.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Attention is all you need

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.559390Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.559390Z digest=sha256:7d4b5f719462fb71ba4bc8c5b0998a0ebffca7b6dac6e627d2530afaf4b00390

Observation 9d190232-a474-4e33-985c-9f74b17f81a3 · outbound

This paper cites Vincent, H.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Vincent, H

Reference 64

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.721865Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.562290Z digest=sha256:ff9bf3f84517bca980311b8054ae76b9f1eab7ac15b12ccf2e50f529c6ad9adf

Observation 03a388a6-3cf3-4d29-9a55-502e65642cdd · outbound

This paper cites A foundation model for clinical-grade computational pathology and rare cancers detection.

Cluster and Predict Latent Patches for Improved Masked Image Modeling A foundation model for clinical-grade computational pathology and rare cancers detection

Reference 65

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.712776Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.565149Z digest=sha256:7f43c3e08c7fb9dea96a406e7a8e9492e379809dcc0618e088530f39882a11c6

Observation 2a4280e0-4b36-4d95-8c11-69ac599d0947 · outbound

This paper cites Sun database: Large-scale scene recognition from abbey to zoo.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Sun database: Large-scale scene recognition from abbey to zoo

Reference 66

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.703872Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.568303Z digest=sha256:933920be861d0c999e87e537e675ba7a9e6a8e9e5355547e8738389d4e592c1f

Observation 89dfc7d7-8d07-4983-95b7-ed952a786bd0 · outbound

This paper cites Simmim: A simple framework for masked image modeling.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Simmim: A simple framework for masked image modeling

Reference 67

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.694583Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.571101Z digest=sha256:6afd3977ed78045e74aaac114293e7816d456af0e30b24e32371112e8f1172f6

Observation bd409697-b5c0-4df1-96f7-38e7d60df78d · outbound

This paper cites A whole-slide foundation model for digital pathology from real-world data.

Cluster and Predict Latent Patches for Improved Masked Image Modeling A whole-slide foundation model for digital pathology from real-world data

Reference 68

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.685696Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.573921Z digest=sha256:cebb35753598e724d1b3358e07f10259ee7ae0015c2404b404e85cce1fc2c3f8

Observation 52981f07-77ca-421e-959a-06d2635c58a3 · outbound

This paper cites Depth anything: Unleashing the power of large-scale unlabeled data.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Depth anything: Unleashing the power of large-scale unlabeled data

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.576803Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.576803Z digest=sha256:eb1eba75446ad90cc842eb69b60a948799fa3b4dcbac3a22f23bbdeeb68cc3db

Observation 46bc9068-cfc6-4076-80ae-32ce6c0ac2b6 · outbound

This paper cites Depth anything v2, 2024 b.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Depth anything v2, 2024 b

Reference 70

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.671669Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.579735Z digest=sha256:69cc53b5fdbf12962c6b45762d7ba3e412fd5f4dd5ddd53dc174841d4c10e792

Observation d3f037b7-e65d-4465-a4f3-fafd8849fa92 · outbound

This paper cites Colorful image colorization.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Colorful image colorization

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.582651Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.582651Z digest=sha256:19fbbcaff5f819bd0fa35fefc39520f0ba71f05a588937649a10b7c5f6657e3b

Observation 323e94d1-8d9b-417f-ab22-6bc31226f118 · outbound

This paper cites Cae v2: Context autoencoder with clip target, 2022.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Cae v2: Context autoencoder with clip target, 2022

Reference 72

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.657730Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.585444Z digest=sha256:8258e417755f2b33d46e63238dfc1937af8e7c834452c6081ff4cb0666750018

Observation 94ef0851-dcbc-4bd1-8101-143584786c9a · outbound

This paper cites Scene parsing through ade20k dataset.

Cluster and Predict Latent Patches for Improved Masked Image Modeling Scene parsing through ade20k dataset

Reference 73

Resolution
unresolved
no resolver link, observed 2026-08-07T23:50:07.588355Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T23:50:07.588355Z digest=sha256:dba0ccb12983f72c461e0c762cdbecc3c94b2e485014f9ce8619ced90bbff4a5

Observation c4c25e21-09f6-4514-808f-03cd2fcdca3b · outbound

This paper cites ibot: Image bert pre-training with online tokenizer.

Cluster and Predict Latent Patches for Improved Masked Image Modeling ibot: Image bert pre-training with online tokenizer

Reference 74

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T23:50:07.643482Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T23:50:07.591495Z digest=sha256:2cb81b69d2f4e82c179c13f49b62ffee2313e7edc7d58dad1b3b59efd7088a76

Pith citing papers

Observation c4e2b4b3-0965-4f08-9eee-0052b9bee9ca · inbound

Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion cites this paper.

Feed-Forward SceneDINO for Unsupervised Semantic Scene Completion Cluster and Predict Latent Patches for Improved Masked Image Modeling

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T19:13:57.887170Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T19:13:57.887170Z digest=sha256:27d87c4138c03a1f6b595a1556d8e79e3575ec15c403dded4c1b4c8dde698cce

Observation 5ca6159f-0d2c-44c2-a94a-b60543384547 · inbound

Text-Conditional JEPA for Learning Semantically Rich Visual Representations cites this paper.

Text-Conditional JEPA for Learning Semantically Rich Visual Representations Cluster and Predict Latent Patches for Improved Masked Image Modeling

Reference 6

Resolution
verified exact
arxiv_id, observed 2026-05-12T10:51:30.652080Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-07T17:58:43.650308Z digest=sha256:7debfbe16c92e75fb56f10d7c5ca351d4d42fa6870dac8ac1900e8665ee5fa23

Observation 63d6c140-fce3-4bb0-a322-f08060f9b25b · inbound

UniverSat: Resolution- and Modality-Agnostic Transformers for Earth Observation cites this paper.

UniverSat: Resolution- and Modality-Agnostic Transformers for Earth Observation Cluster and Predict Latent Patches for Improved Masked Image Modeling

Reference 64

Resolution
verified exact
arxiv_id, observed 2026-07-04T10:29:44.839565Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-06-26T08:50:49.531565Z digest=sha256:b199ed5a3ea64f3a491af0ae9c83e3c3cf9d62d3351ea59102df727467418527

Observation 544ba040-2d98-410e-945d-49933a15a2e2 · inbound

Separating Representation from Reconstruction Enables Scalable Text Encoders cites this paper.

Separating Representation from Reconstruction Enables Scalable Text Encoders Cluster and Predict Latent Patches for Improved Masked Image Modeling

Reference 8

Resolution
unresolved
no resolver link, observed 2026-07-11T22:20:52.422988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-11T22:20:52.422988Z digest=sha256:1dfdb2da980c4b1416b18782a78ebe1701f76c8d0a851cffffc868fe2b859a5b