Pith. sign in

Paper Citation Record · LEDGER

A Touch, Vision, and Language Dataset for Multimodal Alignment

As of 14 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2402.13232.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2402.13232 v1

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 13 of 13 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00

measured 13 of 13 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T11:16:31.917970Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-03T09:47:59.675659Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation c1b96a28-7bf3-4d85-a3e4-5649284a747a · inbound

Advances and Challenges in Foundation Agents: From Brain-Inspired Intelligence to Evolutionary, Collaborative, and Safe Systems cites this paper.

Advances and Challenges in Foundation Agents: From Brain-Inspired Intelligence to Evolutionary, Collaborative, and Safe Systems A Touch, Vision, and Language Dataset for Multimodal Alignment

Reference 149

Resolution
verified exact
arxiv_id, observed 2026-05-22T21:42:10.801472Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-22T21:39:49.832151Z digest=sha256:3d2a27c956deecf4446b1808270d617ccc3a4c0de83f69afca41c3e592859c5d

Observation 4f22ebe4-ecc7-4fe6-9693-bf0d04947b89 · inbound

Tactile MNIST: Benchmarking Active Tactile Perception cites this paper.

Tactile MNIST: Benchmarking Active Tactile Perception A Touch, Vision, and Language Dataset for Multimodal Alignment

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T11:16:31.917970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:16:31.917970Z digest=sha256:d1e5bf27120bd5a1b5976c86f3c3315fb933deb6bce349bef98e0a38104da044

Observation 3d24c59b-55bf-49c6-92f1-b193af15e7a5 · inbound

ViTacFormer: Learning Cross-Modal Representation for Visuo-Tactile Dexterous Manipulation cites this paper.

ViTacFormer: Learning Cross-Modal Representation for Visuo-Tactile Dexterous Manipulation A Touch, Vision, and Language Dataset for Multimodal Alignment

Reference 8

Resolution
verified exact
arxiv_id, observed 2026-05-19T09:47:13.839140Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-19T09:46:38.742771Z digest=sha256:5ba3e67d3acce6641d92e2af0fd533914cfaae340e5339311bcf44c679ae3f7e

Observation 94ba5a7c-16fa-4316-869c-708a7ee5699a · inbound

HapticCap: A Multimodal Dataset and Task for Understanding User Experience of Vibration Haptic Signals cites this paper.

HapticCap: A Multimodal Dataset and Task for Understanding User Experience of Vibration Haptic Signals A Touch, Vision, and Language Dataset for Multimodal Alignment

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-06T16:32:42.011998Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T16:32:42.011998Z digest=sha256:6dc79a9c82b9854cb5a95f87ff8fc42d5f1d8af43557b8293c945aafe1d822c2

Observation f587822a-9574-4891-9e4e-960948d43229 · inbound

Learning to Feel the Future: DreamTacVLA for Contact-Rich Manipulation cites this paper.

Learning to Feel the Future: DreamTacVLA for Contact-Rich Manipulation A Touch, Vision, and Language Dataset for Multimodal Alignment

Reference 8

Resolution
metadata mismatch
arxiv_id, observed 2026-05-16T18:41:10.946732Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-16T18:39:59.449746Z digest=sha256:77e1cc3c2664fc6c1c684759643cb9c0a73c5fc5d5d0ececb832ad19bc6af058

Observation 81be2bbc-0141-48b0-a819-8f88128d6c48 · inbound

Learning to Feel the Future: DreamTacVLA for Contact-Rich Manipulation cites this paper.

Learning to Feel the Future: DreamTacVLA for Contact-Rich Manipulation A Touch, Vision, and Language Dataset for Multimodal Alignment

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-03T13:35:54.064014Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:35:54.064014Z digest=sha256:7168795203a3c216309f5d8e66dd9f665d2727e7b5dcd0920c9024f762383854

Observation 2b9098bd-d404-46b5-8fe2-18a1a02738fa · inbound

Tactile-based Multimodal Fusion in Embodied Intelligence: A Survey of Vision, Language, and Contact-Driven Paradigms cites this paper.

Tactile-based Multimodal Fusion in Embodied Intelligence: A Survey of Vision, Language, and Contact-Driven Paradigms A Touch, Vision, and Language Dataset for Multimodal Alignment

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-05-20T12:53:17.469458Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-20T12:52:15.138790Z digest=sha256:ca976a17c4669432d116bb53fcbd02017bf6d9768b6d4ca625c963b99569ea43

Observation 7fbbbd87-9372-48a7-a3e1-9d7a732f5000 · inbound

Multimodal LLMs under Pairwise Modalities cites this paper.

Multimodal LLMs under Pairwise Modalities A Touch, Vision, and Language Dataset for Multimodal Alignment

Reference 16

Resolution
metadata mismatch
arxiv_id, observed 2026-05-21T05:39:40.695707Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-21T05:37:56.792564Z digest=sha256:92795527f0834ede44296af3ec4ed3e7e94b80b42095c002a824ffc604ca1954

Observation 10fe604c-a373-43e3-bf80-6d88bd628d8b · inbound

Touch-R1: Reinforcing Touch Reasoning in MLLMs cites this paper.

Touch-R1: Reinforcing Touch Reasoning in MLLMs A Touch, Vision, and Language Dataset for Multimodal Alignment

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-06-29T19:03:51.624707Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-06-29T18:55:05.919049Z digest=sha256:1435af241c452f9ebe59c46a42d78c1596b50e5a8bcf6d7494d16b29db3e3739

Observation 1c5482b2-3f15-4c4a-a0e7-5b57f9df204a · inbound

HapTile: A Haptic-Informed Vision-Tactile-Language-Action Dataset for Contact-Rich Imitation Learning cites this paper.

HapTile: A Haptic-Informed Vision-Tactile-Language-Action Dataset for Contact-Rich Imitation Learning A Touch, Vision, and Language Dataset for Multimodal Alignment

Reference 19

Resolution
verified exact
arxiv_id, observed 2026-07-02T08:16:48.121665Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-06-28T06:12:33.204696Z digest=sha256:c79a8c41875edaa0e2d97f5ec3e1c176a215aa464ae5b30e7b7d7955285469e2

Observation 2a81bce8-605c-4560-ba30-cff845e3fe3f · inbound

Tac-DINO: Learning Vision-Tactile Features with Patch Alignment cites this paper.

Tac-DINO: Learning Vision-Tactile Features with Patch Alignment A Touch, Vision, and Language Dataset for Multimodal Alignment

Reference 85

Resolution
metadata mismatch
arxiv_id, observed 2026-07-03T09:47:59.676971Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=arxiv_source observed=2026-06-27T10:19:44.434418Z digest=sha256:abab75511c67206bf242450496e009c826899dced0aecfbd44f16fc384d97e42

Observation 92209a6c-5d78-4a4b-b942-90ccc9863c3d · inbound

UniTac: A Unified Multimodal Model for Cross-Sensor Tactile Understanding and Generation cites this paper.

UniTac: A Unified Multimodal Model for Cross-Sensor Tactile Understanding and Generation A Touch, Vision, and Language Dataset for Multimodal Alignment

Reference 13

Resolution
metadata mismatch
arxiv_id, observed 2026-07-01T10:05:40.666283Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-07-01T05:56:03.597839Z digest=sha256:4ebebd3c6f77ddbf94bf6c6d4bb7faf2e125b708617e2587773f9d7a898426c8

Observation 6c4959b0-f1d3-41a8-bfd0-7f06d9b10587 · inbound

VQ-Touch: A Data-Efficient Tactile Generation Framework Across Sensors and Scenarios cites this paper.

VQ-Touch: A Data-Efficient Tactile Generation Framework Across Sensors and Scenarios A Touch, Vision, and Language Dataset for Multimodal Alignment

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-02T01:16:33.289469Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T01:16:33.289469Z digest=sha256:5e87cbb8a8142e9b8579d84eded9fa6d4b8f13f21bde67d64ecc12f117befb09