{"as_of":"2026-08-14T20:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e342b38a8b23991d57a6aae2808765d06755ecaaff14a90db296f6994de9a4be","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:16:31.917970Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T09:47:59.675659Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.13232","last_updated":"2024-02-20T18:47:56Z","snapshot_observed_at":"2026-08-13T04:14:18.230568Z","submitted_at":"2024-02-20T18:47:56Z","title":"A Touch, Vision, and Language Dataset for Multimodal Alignment","version":1},"cited_work":{"arxiv_id":"2402.13232","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13232","snapshot_observed_at":"2026-07-03T09:47:59.675659Z","title":"A touch, vision, and language dataset for multimodal alignment","venue":null,"work_id":"d31525ce-36e3-4896-a8b7-06ca37ff822c","year":2024},"citing_paper":{"arxiv_id":"2504.01990","last_updated":"2025-08-02T12:44:02Z","snapshot_observed_at":"2026-08-12T16:45:40.094278Z","submitted_at":"2025-03-31T18:00:29Z","title":"Advances and Challenges in Foundation Agents: From Brain-Inspired Intelligence to Evolutionary, Collaborative, and Safe Systems","version":2},"reference_index":149,"source":"pdf_text","source_observed_at":"2026-05-22T21:39:49.832151Z"},"links":{"cited_paper":"/paper/2402.13232","citing_paper":"/paper/2504.01990"},"observation_digest":"sha256:3d2a27c956deecf4446b1808270d617ccc3a4c0de83f69afca41c3e592859c5d","observation_id":"c1b96a28-7bf3-4d85-a3e4-5649284a747a","resolution":{"observed_at":"2026-05-22T21:42:10.801472Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13232","last_updated":"2024-02-20T18:47:56Z","snapshot_observed_at":"2026-08-13T04:14:18.230568Z","submitted_at":"2024-02-20T18:47:56Z","title":"A Touch, Vision, and Language Dataset for Multimodal Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13232","snapshot_observed_at":"2026-08-07T11:16:31.917970Z","title":"A touch, vision, and language dataset for multimodal alignment.arXiv preprint arXiv:2402.13232, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06361","last_updated":"2025-06-14T14:33:43Z","snapshot_observed_at":"2026-08-14T03:53:24.586859Z","submitted_at":"2025-06-03T14:42:16Z","title":"Tactile MNIST: Benchmarking Active Tactile Perception","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:16:31.917970Z"},"links":{"cited_paper":"/paper/2402.13232","citing_paper":"/paper/2506.06361"},"observation_digest":"sha256:d1e5bf27120bd5a1b5976c86f3c3315fb933deb6bce349bef98e0a38104da044","observation_id":"4f22ebe4-ecc7-4fe6-9693-bf0d04947b89","resolution":{"observed_at":"2026-08-07T11:16:31.917970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13232","last_updated":"2024-02-20T18:47:56Z","snapshot_observed_at":"2026-08-13T04:14:18.230568Z","submitted_at":"2024-02-20T18:47:56Z","title":"A Touch, Vision, and Language Dataset for Multimodal Alignment","version":1},"cited_work":{"arxiv_id":"2402.13232","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13232","snapshot_observed_at":"2026-07-03T09:47:59.675659Z","title":"A touch, vision, and language dataset for multimodal alignment","venue":null,"work_id":"d31525ce-36e3-4896-a8b7-06ca37ff822c","year":2024},"citing_paper":{"arxiv_id":"2506.15953","last_updated":"2026-05-13T00:42:26Z","snapshot_observed_at":"2026-08-11T23:07:39.134745Z","submitted_at":"2025-06-19T01:38:13Z","title":"ViTacFormer: Learning Cross-Modal Representation for Visuo-Tactile Dexterous Manipulation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T09:46:38.742771Z"},"links":{"cited_paper":"/paper/2402.13232","citing_paper":"/paper/2506.15953"},"observation_digest":"sha256:5ba3e67d3acce6641d92e2af0fd533914cfaae340e5339311bcf44c679ae3f7e","observation_id":"3d24c59b-55bf-49c6-92f1-b193af15e7a5","resolution":{"observed_at":"2026-05-19T09:47:13.839140Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13232","last_updated":"2024-02-20T18:47:56Z","snapshot_observed_at":"2026-08-13T04:14:18.230568Z","submitted_at":"2024-02-20T18:47:56Z","title":"A Touch, Vision, and Language Dataset for Multimodal Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13232","snapshot_observed_at":"2026-08-06T16:32:42.011998Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13318","last_updated":"2025-07-17T17:37:24Z","snapshot_observed_at":"2026-08-14T14:18:16.664757Z","submitted_at":"2025-07-17T17:37:24Z","title":"HapticCap: A Multimodal Dataset and Task for Understanding User Experience of Vibration Haptic Signals","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T16:32:42.011998Z"},"links":{"cited_paper":"/paper/2402.13232","citing_paper":"/paper/2507.13318"},"observation_digest":"sha256:6dc79a9c82b9854cb5a95f87ff8fc42d5f1d8af43557b8293c945aafe1d822c2","observation_id":"94ba5a7c-16fa-4316-869c-708a7ee5699a","resolution":{"observed_at":"2026-08-06T16:32:42.011998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13232","last_updated":"2024-02-20T18:47:56Z","snapshot_observed_at":"2026-08-13T04:14:18.230568Z","submitted_at":"2024-02-20T18:47:56Z","title":"A Touch, Vision, and Language Dataset for Multimodal Alignment","version":1},"cited_work":{"arxiv_id":"2402.13232","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13232","snapshot_observed_at":"2026-07-03T09:47:59.675659Z","title":"A touch, vision, and language dataset for multimodal alignment","venue":null,"work_id":"d31525ce-36e3-4896-a8b7-06ca37ff822c","year":2024},"citing_paper":{"arxiv_id":"2512.23864","last_updated":"2026-06-28T00:20:33Z","snapshot_observed_at":"2026-08-11T14:58:03.634029Z","submitted_at":"2025-12-29T21:06:33Z","title":"Learning to Feel the Future: DreamTacVLA for Contact-Rich Manipulation","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T18:39:59.449746Z"},"links":{"cited_paper":"/paper/2402.13232","citing_paper":"/paper/2512.23864"},"observation_digest":"sha256:77e1cc3c2664fc6c1c684759643cb9c0a73c5fc5d5d0ececb832ad19bc6af058","observation_id":"f587822a-9574-4891-9e4e-960948d43229","resolution":{"observed_at":"2026-05-16T18:41:10.946732Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13232","last_updated":"2024-02-20T18:47:56Z","snapshot_observed_at":"2026-08-13T04:14:18.230568Z","submitted_at":"2024-02-20T18:47:56Z","title":"A Touch, Vision, and Language Dataset for Multimodal Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13232","snapshot_observed_at":"2026-08-03T13:35:54.064014Z","title":"C.-H., Drake, J., Ortiz, J., Mukadam, M., Lambeta, M., Calandra, R., and Goldberg, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.23864","last_updated":"2026-06-28T00:20:33Z","snapshot_observed_at":"2026-08-11T14:58:03.634029Z","submitted_at":"2025-12-29T21:06:33Z","title":"Learning to Feel the Future: DreamTacVLA for Contact-Rich Manipulation","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T13:35:54.064014Z"},"links":{"cited_paper":"/paper/2402.13232","citing_paper":"/paper/2512.23864"},"observation_digest":"sha256:7168795203a3c216309f5d8e66dd9f665d2727e7b5dcd0920c9024f762383854","observation_id":"81be2bbc-0141-48b0-a819-8f88128d6c48","resolution":{"observed_at":"2026-08-03T13:35:54.064014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13232","last_updated":"2024-02-20T18:47:56Z","snapshot_observed_at":"2026-08-13T04:14:18.230568Z","submitted_at":"2024-02-20T18:47:56Z","title":"A Touch, Vision, and Language Dataset for Multimodal Alignment","version":1},"cited_work":{"arxiv_id":"2402.13232","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13232","snapshot_observed_at":"2026-07-03T09:47:59.675659Z","title":"A touch, vision, and language dataset for multimodal alignment","venue":null,"work_id":"d31525ce-36e3-4896-a8b7-06ca37ff822c","year":2024},"citing_paper":{"arxiv_id":"2605.17336","last_updated":"2026-05-17T09:09:30Z","snapshot_observed_at":"2026-08-14T14:28:44.165585Z","submitted_at":"2026-05-17T09:09:30Z","title":"Tactile-based Multimodal Fusion in Embodied Intelligence: A Survey of Vision, Language, and Contact-Driven Paradigms","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T12:52:15.138790Z"},"links":{"cited_paper":"/paper/2402.13232","citing_paper":"/paper/2605.17336"},"observation_digest":"sha256:ca976a17c4669432d116bb53fcbd02017bf6d9768b6d4ca625c963b99569ea43","observation_id":"2b9098bd-d404-46b5-8fe2-18a1a02738fa","resolution":{"observed_at":"2026-05-20T12:53:17.469458Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13232","last_updated":"2024-02-20T18:47:56Z","snapshot_observed_at":"2026-08-13T04:14:18.230568Z","submitted_at":"2024-02-20T18:47:56Z","title":"A Touch, Vision, and Language Dataset for Multimodal Alignment","version":1},"cited_work":{"arxiv_id":"2402.13232","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13232","snapshot_observed_at":"2026-07-03T09:47:59.675659Z","title":"A touch, vision, and language dataset for multimodal alignment","venue":null,"work_id":"d31525ce-36e3-4896-a8b7-06ca37ff822c","year":2024},"citing_paper":{"arxiv_id":"2605.21059","last_updated":"2026-05-20T11:44:01Z","snapshot_observed_at":"2026-07-06T23:31:32.577242Z","submitted_at":"2026-05-20T11:44:01Z","title":"Multimodal LLMs under Pairwise Modalities","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-21T05:37:56.792564Z"},"links":{"cited_paper":"/paper/2402.13232","citing_paper":"/paper/2605.21059"},"observation_digest":"sha256:92795527f0834ede44296af3ec4ed3e7e94b80b42095c002a824ffc604ca1954","observation_id":"7fbbbd87-9372-48a7-a3e1-9d7a732f5000","resolution":{"observed_at":"2026-05-21T05:39:40.695707Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13232","last_updated":"2024-02-20T18:47:56Z","snapshot_observed_at":"2026-08-13T04:14:18.230568Z","submitted_at":"2024-02-20T18:47:56Z","title":"A Touch, Vision, and Language Dataset for Multimodal Alignment","version":1},"cited_work":{"arxiv_id":"2402.13232","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13232","snapshot_observed_at":"2026-07-03T09:47:59.675659Z","title":"A touch, vision, and language dataset for multimodal alignment","venue":null,"work_id":"d31525ce-36e3-4896-a8b7-06ca37ff822c","year":2024},"citing_paper":{"arxiv_id":"2605.27154","last_updated":"2026-05-26T15:14:56Z","snapshot_observed_at":"2026-08-10T18:37:50.736930Z","submitted_at":"2026-05-26T15:14:56Z","title":"Touch-R1: Reinforcing Touch Reasoning in MLLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T18:55:05.919049Z"},"links":{"cited_paper":"/paper/2402.13232","citing_paper":"/paper/2605.27154"},"observation_digest":"sha256:1435af241c452f9ebe59c46a42d78c1596b50e5a8bcf6d7494d16b29db3e3739","observation_id":"10fe604c-a373-43e3-bf80-6d88bd628d8b","resolution":{"observed_at":"2026-06-29T19:03:51.624707Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13232","last_updated":"2024-02-20T18:47:56Z","snapshot_observed_at":"2026-08-13T04:14:18.230568Z","submitted_at":"2024-02-20T18:47:56Z","title":"A Touch, Vision, and Language Dataset for Multimodal Alignment","version":1},"cited_work":{"arxiv_id":"2402.13232","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13232","snapshot_observed_at":"2026-07-03T09:47:59.675659Z","title":"A touch, vision, and language dataset for multimodal alignment","venue":null,"work_id":"d31525ce-36e3-4896-a8b7-06ca37ff822c","year":2024},"citing_paper":{"arxiv_id":"2606.04825","last_updated":"2026-06-19T15:18:21Z","snapshot_observed_at":"2026-08-05T16:45:28.031865Z","submitted_at":"2026-06-03T12:48:17Z","title":"HapTile: A Haptic-Informed Vision-Tactile-Language-Action Dataset for Contact-Rich Imitation Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T06:12:33.204696Z"},"links":{"cited_paper":"/paper/2402.13232","citing_paper":"/paper/2606.04825"},"observation_digest":"sha256:c79a8c41875edaa0e2d97f5ec3e1c176a215aa464ae5b30e7b7d7955285469e2","observation_id":"1c5482b2-3f15-4c4a-a0e7-5b57f9df204a","resolution":{"observed_at":"2026-07-02T08:16:48.121665Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13232","last_updated":"2024-02-20T18:47:56Z","snapshot_observed_at":"2026-08-13T04:14:18.230568Z","submitted_at":"2024-02-20T18:47:56Z","title":"A Touch, Vision, and Language Dataset for Multimodal Alignment","version":1},"cited_work":{"arxiv_id":"2402.13232","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13232","snapshot_observed_at":"2026-07-03T09:47:59.675659Z","title":"A touch, vision, and language dataset for multimodal alignment","venue":null,"work_id":"d31525ce-36e3-4896-a8b7-06ca37ff822c","year":2024},"citing_paper":{"arxiv_id":"2606.12069","last_updated":"2026-06-10T13:33:42Z","snapshot_observed_at":"2026-07-06T23:51:02.805629Z","submitted_at":"2026-06-10T13:33:42Z","title":"Tac-DINO: Learning Vision-Tactile Features with Patch Alignment","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-06-27T10:19:44.434418Z"},"links":{"cited_paper":"/paper/2402.13232","citing_paper":"/paper/2606.12069"},"observation_digest":"sha256:abab75511c67206bf242450496e009c826899dced0aecfbd44f16fc384d97e42","observation_id":"2a81bce8-605c-4560-ba30-cff845e3fe3f","resolution":{"observed_at":"2026-07-03T09:47:59.676971Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13232","last_updated":"2024-02-20T18:47:56Z","snapshot_observed_at":"2026-08-13T04:14:18.230568Z","submitted_at":"2024-02-20T18:47:56Z","title":"A Touch, Vision, and Language Dataset for Multimodal Alignment","version":1},"cited_work":{"arxiv_id":"2402.13232","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13232","snapshot_observed_at":"2026-07-03T09:47:59.675659Z","title":"A touch, vision, and language dataset for multimodal alignment","venue":null,"work_id":"d31525ce-36e3-4896-a8b7-06ca37ff822c","year":2024},"citing_paper":{"arxiv_id":"2606.31451","last_updated":"2026-06-30T10:25:46Z","snapshot_observed_at":"2026-08-02T09:59:19.263812Z","submitted_at":"2026-06-30T10:25:46Z","title":"UniTac: A Unified Multimodal Model for Cross-Sensor Tactile Understanding and Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-01T05:56:03.597839Z"},"links":{"cited_paper":"/paper/2402.13232","citing_paper":"/paper/2606.31451"},"observation_digest":"sha256:4ebebd3c6f77ddbf94bf6c6d4bb7faf2e125b708617e2587773f9d7a898426c8","observation_id":"92209a6c-5d78-4a4b-b942-90ccc9863c3d","resolution":{"observed_at":"2026-07-01T10:05:40.666283Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13232","last_updated":"2024-02-20T18:47:56Z","snapshot_observed_at":"2026-08-13T04:14:18.230568Z","submitted_at":"2024-02-20T18:47:56Z","title":"A Touch, Vision, and Language Dataset for Multimodal Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13232","snapshot_observed_at":"2026-08-02T01:16:33.289469Z","title":"A touch, vision, and language dataset for multimodal alignment.arXiv preprint arXiv:2402.13232, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14728","last_updated":"2026-07-16T08:53:41Z","snapshot_observed_at":"2026-08-05T03:05:45.343058Z","submitted_at":"2026-07-16T08:53:41Z","title":"VQ-Touch: A Data-Efficient Tactile Generation Framework Across Sensors and Scenarios","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T01:16:33.289469Z"},"links":{"cited_paper":"/paper/2402.13232","citing_paper":"/paper/2607.14728"},"observation_digest":"sha256:5e87cbb8a8142e9b8579d84eded9fa6d4b8f13f21bde67d64ecc12f117befb09","observation_id":"6c4959b0-f1d3-41a8-bfd0-7f06d9b10587","resolution":{"observed_at":"2026-08-02T01:16:33.289469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.13232/citation-record","integrity":"/paper/2402.13232/integrity","json":"/paper/2402.13232/citation-record.json","paper":"/paper/2402.13232"},"outbound":[],"paper":{"arxiv_id":"2402.13232","last_updated":"2024-02-20T18:47:56Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T04:14:18.230568Z","submitted_at":"2024-02-20T18:47:56Z","title":"A Touch, Vision, and Language Dataset for Multimodal Alignment"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2402.13232."}