Pith. sign in

Paper Citation Record · LEDGER

Autoencoders as Cross-Modal Teachers: Can Pretrained 2D Image Transformers Help 3D Representation Learning?

As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2212.08320.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2212.08320 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 6 of 6 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 6 of 6 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T14:31:04.494724Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-13T20:28:13.968090Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 75a276ea-305f-434d-bb40-67d08cba74c7 · inbound

Self-Supervised and Generalizable Tokenization for CLIP-Based 3D Understanding cites this paper.

Self-Supervised and Generalizable Tokenization for CLIP-Based 3D Understanding Autoencoders as Cross-Modal Teachers: Can Pretrained 2D Image Transformers Help 3D Representation Learning?

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-07T14:31:04.494724Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:31:04.494724Z digest=sha256:ca303e0d35a5b91607cceb45fb399f5acbbd4ba6be3646ff4e38f2e7cdd53a48

Observation 813ae369-a2a8-4b6b-b832-706d0cad5a72 · inbound

UniPre3D: Unified Pre-training of 3D Point Cloud Models with Cross-Modal Gaussian Splatting cites this paper.

UniPre3D: Unified Pre-training of 3D Point Cloud Models with Cross-Modal Gaussian Splatting Autoencoders as Cross-Modal Teachers: Can Pretrained 2D Image Transformers Help 3D Representation Learning?

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T04:40:58.997365Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:40:58.997365Z digest=sha256:dc5f6b7fa11553b96d7d5fd457aed5182d5e51c56bfcbb4ada5db36c623691cd

Observation 1ff89e71-7df1-44ca-92f7-f9e061cac7d9 · inbound

Asymmetric Dual Self-Distillation for 3D Self-Supervised Representation Learning cites this paper.

Asymmetric Dual Self-Distillation for 3D Self-Supervised Representation Learning Autoencoders as Cross-Modal Teachers: Can Pretrained 2D Image Transformers Help 3D Representation Learning?

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-06T22:26:20.192816Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:26:20.192816Z digest=sha256:41516f875abf608be1c8aa37ba8306f57d3c53916f5dc75dfff11c2ce1fcdfe8

Observation 0e5602c2-f5ed-4eb0-a700-b6332f490aeb · inbound

Towards More Diverse and Challenging Pre-training for Point Cloud Learning: Self-Supervised Cross Reconstruction with Decoupled Views cites this paper.

Towards More Diverse and Challenging Pre-training for Point Cloud Learning: Self-Supervised Cross Reconstruction with Decoupled Views Autoencoders as Cross-Modal Teachers: Can Pretrained 2D Image Transformers Help 3D Representation Learning?

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-05T12:47:49.134477Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T12:47:49.134477Z digest=sha256:2da35a1d671171d61e8521afc938391e7d635a0f30addb1142b6a87db90b607b

Observation b1a932d2-aa13-4538-84ae-8f70788c3b8b · inbound

Deformation-based In-Context Learning for Point Cloud Understanding cites this paper.

Deformation-based In-Context Learning for Point Cloud Understanding Autoencoders as Cross-Modal Teachers: Can Pretrained 2D Image Transformers Help 3D Representation Learning?

Reference 8

Resolution
metadata mismatch
arxiv_id, observed 2026-05-13T19:58:12.017795Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-13T19:57:08.451707Z digest=sha256:e78c2706fe2a132ba8ad8d436f27b6487c343ca6e66c8c433d16fc4eff768baa

Observation 26cf73f1-401b-4332-9900-3a195192e437 · inbound

Bridging the Dimensionality Gap: A Taxonomy and Survey of 2D Vision Model Adaptation for 3D Analysis cites this paper.

Bridging the Dimensionality Gap: A Taxonomy and Survey of 2D Vision Model Adaptation for 3D Analysis Autoencoders as Cross-Modal Teachers: Can Pretrained 2D Image Transformers Help 3D Representation Learning?

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-05-13T20:28:13.969779Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-13T20:26:27.298974Z digest=sha256:ffa3083967ba3995c30e76b5481aa69ff02d00619451696ed4e15ac6435b34bd