{"as_of":"2026-08-08T20:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bf5c0c305c45bd4e56f297d51c93f84222fc184ff50e289d12aeab62c98a181b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":34,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T05:51:28.929585Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T17:48:45.818442Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2502.13451","last_updated":"2026-05-09T11:40:06Z","snapshot_observed_at":"2026-08-02T06:35:33.765328Z","submitted_at":"2025-02-19T05:52:34Z","title":"MapNav: A Novel Memory Representation via Annotated Semantic Maps for Vision-and-Language Navigation","version":5},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-23T02:58:50.014240Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2502.13451"},"observation_digest":"sha256:d6beac54a0beb4a8a3ffa57fe8e6ab6a8e127a596621481f976379758411cc9f","observation_id":"85047882-7362-46eb-84ff-ed2d40f024f9","resolution":{"observed_at":"2026-05-23T03:02:27.106028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2508.13073","last_updated":"2025-09-01T08:10:01Z","snapshot_observed_at":"2026-08-07T15:40:31.068428Z","submitted_at":"2025-08-18T16:45:48Z","title":"Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey","version":2},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-05-17T20:28:15.818016Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2508.13073"},"observation_digest":"sha256:12221f320fe4b840867fd99f458ecf17bf1a1ae3831b99ff1500b21c4e92a759","observation_id":"f03eee57-e0a7-44aa-a3f0-5f25f92a8554","resolution":{"observed_at":"2026-05-17T20:28:16.076931Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2601.20239","last_updated":"2026-05-13T12:53:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T04:22:47Z","title":"TouchGuide: Inference-Time Steering of Visuomotor Policies via Touch Guidance","version":6},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-16T11:06:23.555610Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2601.20239"},"observation_digest":"sha256:7775c26d3760b1df68180c2b0581974889091c5abea078883500ca0cb9ad4cae","observation_id":"bc867176-91dc-456c-ba8c-bf5fa9a08035","resolution":{"observed_at":"2026-05-16T11:07:47.761991Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-08-03T04:18:56.611547Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation.Preprint at arXiv:2505.09577, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05513","last_updated":"2026-07-14T09:20:36Z","snapshot_observed_at":"2026-08-03T04:18:53.645115Z","submitted_at":"2026-02-05T10:13:34Z","title":"DECO: Decoupled Multimodal Diffusion Transformer for Bimanual Dexterous Manipulation with a Plugin Tactile Adapter","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T04:18:56.611547Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2602.05513"},"observation_digest":"sha256:95ac4070d3ae09aa263ba78e64f11493c5defc4d2f0830ab819e48ae1a16f0c4","observation_id":"6f6edddc-ed13-4a38-b6c0-3a389dc659fb","resolution":{"observed_at":"2026-08-03T04:18:56.611547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2603.04038","last_updated":"2026-07-23T08:29:51Z","snapshot_observed_at":"2026-08-02T23:58:56.855247Z","submitted_at":"2026-03-04T13:18:05Z","title":"Force-Aware Residual DAgger via Trajectory Editing for Precision Insertion with Impedance Control","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T17:13:35.380611Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2603.04038"},"observation_digest":"sha256:9130fadaae1efe6da6d9ca546d86d44969b8f3d16fd893aa82543d243e741953","observation_id":"67a794c7-e44f-438e-9a1b-7b54d296ebff","resolution":{"observed_at":"2026-05-15T17:16:21.377351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-08-02T19:00:02.184000Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04038","last_updated":"2026-07-23T08:29:51Z","snapshot_observed_at":"2026-08-02T23:58:56.855247Z","submitted_at":"2026-03-04T13:18:05Z","title":"Force-Aware Residual DAgger via Trajectory Editing for Precision Insertion with Impedance Control","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T19:00:02.184000Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2603.04038"},"observation_digest":"sha256:60af2c88656cce95a41aa2fe2a94b34f95c70483e415ba3b35a030965fbc8e3a","observation_id":"ec069182-79b7-44c5-95e1-cdd717e5839b","resolution":{"observed_at":"2026-08-02T19:00:02.184000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-08-02T18:34:48.702793Z","title":"Vtla: Vision-tactile-language-action model with preference learning for insertion manipulation.arXiv preprint arXiv:2505.09577, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.08541","last_updated":"2026-07-21T01:28:23Z","snapshot_observed_at":"2026-08-02T18:34:47.412259Z","submitted_at":"2026-03-09T16:09:18Z","title":"EquiBim: Learning Symmetry-Equivariant Policy for Bimanual Manipulation","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T18:34:48.702793Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2603.08541"},"observation_digest":"sha256:1a8a76f0e2de7ccb477a30d08930eb43007c56fdd18b300af1341cf315633354","observation_id":"87599493-c667-41ca-a8d9-1eb946e8a5af","resolution":{"observed_at":"2026-08-02T18:34:48.702793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-08-02T18:13:11.413729Z","title":"arXiv preprint arXiv:2505.09577 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.14604","last_updated":"2026-07-15T00:55:50Z","snapshot_observed_at":"2026-08-07T00:53:09.787457Z","submitted_at":"2026-03-15T20:57:51Z","title":"Tactile Modality Fusion for Vision-Language-Action Models","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-02T18:13:11.413729Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2603.14604"},"observation_digest":"sha256:9b226f63925ea6a2328067e28438962d819cc5f3aac4accbe532cd9b67f0f02c","observation_id":"54ebce5b-3ef5-44da-bbed-05a604582b7d","resolution":{"observed_at":"2026-08-02T18:13:11.413729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-08-04T05:51:28.929585Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.15257","last_updated":"2026-08-02T20:22:57Z","snapshot_observed_at":"2026-08-07T11:00:16.440130Z","submitted_at":"2026-03-16T13:24:58Z","title":"HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T05:51:28.929585Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2603.15257"},"observation_digest":"sha256:d7b50f4accaea3b82c494bc3b3983033c02635061c3fc0680455185856c46062","observation_id":"6a1df052-d7e4-4675-8834-7f7842876603","resolution":{"observed_at":"2026-08-04T05:51:28.929585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2603.25044","last_updated":"2026-03-30T07:44:33Z","snapshot_observed_at":"2026-08-02T12:22:24.189474Z","submitted_at":"2026-03-26T05:26:56Z","title":"ThermoAct:Thermal-Aware Vision-Language-Action Models for Robotic Perception and Decision-Making","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T00:46:03.360770Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2603.25044"},"observation_digest":"sha256:5dda1d159ad6f7e7e4be7333872437eaa83f70cd3e9a336aa8c618004b707e4d","observation_id":"003e1b12-b783-42fa-97c2-38b084887864","resolution":{"observed_at":"2026-05-15T00:48:24.801503Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2604.13015","last_updated":"2026-04-27T15:02:49Z","snapshot_observed_at":"2026-07-06T23:01:05.634599Z","submitted_at":"2026-04-14T17:54:17Z","title":"Learning Versatile Humanoid Manipulation with Touch Dreaming","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T14:48:33.942119Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2604.13015"},"observation_digest":"sha256:47b98b345352e5133964537097d5593459721bf96664bd5875d1eabfc4c1ad2e","observation_id":"41a142b3-56bb-4fdb-8ffc-ee4b9fbbf403","resolution":{"observed_at":"2026-05-11T11:31:03.197264Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2604.23272","last_updated":"2026-04-25T12:28:47Z","snapshot_observed_at":"2026-08-01T01:40:08.735966Z","submitted_at":"2026-04-25T12:28:47Z","title":"Modular Sensory Stream for Integrating Physical Feedback in Vision-Language-Action Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T08:12:14.321695Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2604.23272"},"observation_digest":"sha256:0b396df197b5d0da60a98f6e6723c7b4a2ac660ddcc07b09c951006899a178bc","observation_id":"e128bd5a-7e36-431b-a22d-ab8b7627f2d1","resolution":{"observed_at":"2026-05-11T20:46:09.813784Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":1},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-05-07T16:06:10.595164Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:c9069d892912d79335c8d85f29fd760b007ee2d07c33fba27fbc09a767115d4d","observation_id":"2c998959-2884-4334-8a54-46774c488c89","resolution":{"observed_at":"2026-05-12T10:51:30.989676Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:af0d0d5baf5b34fadafb3cdbd27d13a565ea9e9ad5f389958dc6c30f3d7dd647","observation_id":"a3ff81c1-1dda-4a1c-98f2-4f71451eb0df","resolution":{"observed_at":"2026-05-09T06:05:35.093062Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2605.07308","last_updated":"2026-05-18T04:08:11Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:17:08Z","title":"AT-VLA: Adaptive Tactile Injection for Enhanced Feedback Reaction in Vision-Language-Action Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-11T01:24:34.761241Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2605.07308"},"observation_digest":"sha256:ff6098977c383c2118de312f61463de27ea635d866a8e68fd10c757ae824b89d","observation_id":"e878782d-1bf3-4a67-a9a6-ad4993fb9adc","resolution":{"observed_at":"2026-05-11T04:25:57.913998Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2605.07308","last_updated":"2026-05-18T04:08:11Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:17:08Z","title":"AT-VLA: Adaptive Tactile Injection for Enhanced Feedback Reaction in Vision-Language-Action Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-20T23:21:10.571364Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2605.07308"},"observation_digest":"sha256:1c75e647df9616683993cedb754812582fb093a6f985a9fe9d2a7846274fd2f7","observation_id":"8022e4eb-e605-429b-a2ef-8ab7835c3799","resolution":{"observed_at":"2026-05-20T23:23:51.399978Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2605.17336","last_updated":"2026-05-17T09:09:30Z","snapshot_observed_at":"2026-08-02T12:21:23.782064Z","submitted_at":"2026-05-17T09:09:30Z","title":"Tactile-based Multimodal Fusion in Embodied Intelligence: A Survey of Vision, Language, and Contact-Driven Paradigms","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T12:52:15.138790Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2605.17336"},"observation_digest":"sha256:1cdde7a0a27af73f22fbf8aa3c3ff14f9a4f3edb7880f5da45cbf2c956e388e3","observation_id":"5cc4fca7-2ba3-4457-8197-de2dad359cf1","resolution":{"observed_at":"2026-05-20T12:53:17.455775Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2605.20082","last_updated":"2026-05-19T16:36:34Z","snapshot_observed_at":"2026-08-03T04:22:47.012823Z","submitted_at":"2026-05-19T16:36:34Z","title":"VL-DPO: Vision-Language-Guided Finetuning for Preference-Aligned Autonomous Driving","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T05:39:04.567741Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2605.20082"},"observation_digest":"sha256:42224de239d1ec208df95297b603839b6c5f51f68dbacc53908c3b4683cc6dd6","observation_id":"a39e7b79-e3be-479f-9448-e9e473ed3550","resolution":{"observed_at":"2026-05-20T05:43:06.044789Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2605.22812","last_updated":"2026-05-21T17:57:44Z","snapshot_observed_at":"2026-08-01T15:37:49.036384Z","submitted_at":"2026-05-21T17:57:44Z","title":"GesVLA: Gesture-Aware Vision-Language-Action Model Embedded Representations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T04:51:21.649138Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2605.22812"},"observation_digest":"sha256:554671f595d029a20bde259a4c6760f379c74a5f33baaddff9418fa88124d804","observation_id":"deb86fcf-2648-4ac3-a21b-60b33e5e0024","resolution":{"observed_at":"2026-05-22T04:54:36.789826Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2606.01241","last_updated":"2026-06-02T03:11:27Z","snapshot_observed_at":"2026-08-07T02:28:05.002889Z","submitted_at":"2026-05-31T13:43:23Z","title":"OneVLA: A Unified Framework for Embodied Tasks","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T17:05:08.124096Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2606.01241"},"observation_digest":"sha256:0faa848db92f25aef426ed43aa70093ed1c2340d52a1e37e1a59a0da75e4dad6","observation_id":"39320593-d38a-4be3-a221-2606b236d181","resolution":{"observed_at":"2026-07-01T21:26:14.119462Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2606.06281","last_updated":"2026-06-04T15:23:03Z","snapshot_observed_at":"2026-08-06T02:59:10.321110Z","submitted_at":"2026-06-04T15:23:03Z","title":"Multi-Resolution Tactile Imitation Learning for Contact-Rich Robotic Manipulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T00:58:25.323475Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2606.06281"},"observation_digest":"sha256:f5bf3ef47ae20dba6e34fa71763db3cc5cd7bac7c4330a5d653034abb5eb3c07","observation_id":"aba90667-92f1-495b-8f7c-488d0521de8c","resolution":{"observed_at":"2026-07-02T13:46:59.709221Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2606.08737","last_updated":"2026-06-07T17:18:23Z","snapshot_observed_at":"2026-08-05T06:09:09.261687Z","submitted_at":"2026-06-07T17:18:23Z","title":"Dream-Tac: A Unified Tactile World Action Model for Contact-Rich Robot Manipulation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-27T18:17:06.288698Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2606.08737"},"observation_digest":"sha256:05503dbbe51aa96a765b6af36501cbad1fd9e8f1118c59560ae160f0c2301374","observation_id":"600bdd2c-bef5-4a56-a973-15f07c022c21","resolution":{"observed_at":"2026-07-02T23:27:26.846188Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2606.09337","last_updated":"2026-06-16T02:41:26Z","snapshot_observed_at":"2026-08-01T15:23:43.890468Z","submitted_at":"2026-06-08T11:05:05Z","title":"TORL-VLA: Tactile Guided Online Reinforcement Learning for Contact-Rich Manipulation","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T16:30:35.385161Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2606.09337"},"observation_digest":"sha256:8155f6cb36de79417954b859d5bb02d62424341f5d603376a13c7bbc07dfd4bb","observation_id":"dfdb8e34-46fa-491c-8435-1402e3399fcb","resolution":{"observed_at":"2026-07-03T01:27:31.318702Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2606.09777","last_updated":"2026-06-08T17:38:57Z","snapshot_observed_at":"2026-08-02T02:10:16.108128Z","submitted_at":"2026-06-08T17:38:57Z","title":"AetheRock: An Arm-Worn Robot Teaching System for Force-Guided Vision-Tactile Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-27T16:25:09.975308Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2606.09777"},"observation_digest":"sha256:5df65613552cdd5d4142a709948257484b6067ea558f4c69b190e136427b3b93","observation_id":"5ad00eeb-cbaf-40ce-8dcd-0a4521a1f9c4","resolution":{"observed_at":"2026-07-03T01:37:30.970592Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2606.17055","last_updated":"2026-06-18T20:58:46Z","snapshot_observed_at":"2026-07-06T23:52:42.390632Z","submitted_at":"2026-06-15T17:59:55Z","title":"T-Rex: Tactile-Reactive Dexterous Manipulation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T03:48:22.394092Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2606.17055"},"observation_digest":"sha256:babec24de0b0ffd713973a0f61d5e83d1a11455127ec15c49e0cd0cb49855112","observation_id":"3d83f345-cd47-4999-b134-8612b7a929ba","resolution":{"observed_at":"2026-07-03T17:48:45.819744Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2606.29089","last_updated":"2026-06-27T21:06:06Z","snapshot_observed_at":"2026-08-04T23:51:33.201822Z","submitted_at":"2026-06-27T21:06:06Z","title":"TAP-VLA: Tactile Annotation Prompting for Vision Language Action Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T09:10:55.016700Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2606.29089"},"observation_digest":"sha256:8ea7afa6ac933e92ed430b039120d010bfe4e571b10beddaffd2dfc306fac861","observation_id":"fa9295e3-16b9-4bc9-b4e1-a29da44ffac2","resolution":{"observed_at":"2026-06-30T13:24:40.657005Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2606.29941","last_updated":"2026-06-29T08:20:18Z","snapshot_observed_at":"2026-08-06T16:16:32.268412Z","submitted_at":"2026-06-29T08:20:18Z","title":"Seeing Touch from Motion: A Unified Modality-Aware Visuo-Tactile Policy with Tactile Motion Correlation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-30T05:55:54.345160Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2606.29941"},"observation_digest":"sha256:89355cc4d3715b033333dc142986c6c1a243f7978ca0e414164d1c1ccc3ed9b1","observation_id":"016b8ec0-921f-447f-a891-ccb3dc999813","resolution":{"observed_at":"2026-06-30T13:24:41.083919Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2606.31451","last_updated":"2026-06-30T10:25:46Z","snapshot_observed_at":"2026-08-02T09:59:19.263812Z","submitted_at":"2026-06-30T10:25:46Z","title":"UniTac: A Unified Multimodal Model for Cross-Sensor Tactile Understanding and Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-01T05:56:03.597839Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2606.31451"},"observation_digest":"sha256:956c9974d16c2ce6986377a7dd6320a7a5e98763d02527922f704c3d05f0d5c7","observation_id":"8e932c72-171b-4768-960b-dc21080c4b12","resolution":{"observed_at":"2026-07-01T10:05:40.667113Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":"2505.09577","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-03T17:48:45.818442Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation","venue":null,"work_id":"041b7d2c-2bd2-404b-9fd1-bba9dc42b727","year":2025},"citing_paper":{"arxiv_id":"2607.02503","last_updated":"2026-07-02T17:58:36Z","snapshot_observed_at":"2026-08-02T23:26:02.522488Z","submitted_at":"2026-07-02T17:58:36Z","title":"VT-WAM: Visual-Tactile World Action Model for Contact-Rich Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-03T10:33:28.236522Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2607.02503"},"observation_digest":"sha256:37d58d1ec18a992634948c24ef6090e114f04be8d74e295c93e7824ddd54dc9a","observation_id":"04aa15f3-f957-4ac0-bbbd-82c62f85dd21","resolution":{"observed_at":"2026-07-03T10:37:56.171158Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-12T02:52:21.616045Z","title":"Vtla: Vision- tactile-language-action model with preference learning for insertion manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03387","last_updated":"2026-07-07T03:40:42Z","snapshot_observed_at":"2026-08-07T07:13:07.703314Z","submitted_at":"2026-07-03T14:42:30Z","title":"Feeling the Unexpected: ResTacVLA for Contact-Rich Manipulation via Residual Tactile Representation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T02:52:21.616045Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2607.03387"},"observation_digest":"sha256:662a444b1c19bcb02593963b81657c1ec9e2bef7613617b9e6ff2596d9785eca","observation_id":"288bb0f1-15a9-4c4f-b40d-f2a3d6025a3d","resolution":{"observed_at":"2026-07-12T02:52:21.616045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-11T20:46:04.923901Z","title":"Borong Zhang, Yuhao Zhang, Jiaming Ji, Yingshan Lei, Juntao Dai, Yuanpei Chen, and Yaodong Yang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04234","last_updated":"2026-07-05T11:12:29Z","snapshot_observed_at":"2026-07-11T20:46:04.581079Z","submitted_at":"2026-07-05T11:12:29Z","title":"SoftVTBench: A Safety-Aware Visuo-Tactile Benchmark for Physically Constrained Robotic Manipulation of Deformable Objects","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-11T20:46:04.923901Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2607.04234"},"observation_digest":"sha256:800baa88918fa37212c1cdce16b5d8320ee0ae4bdfd93354d26c062f1140a20e","observation_id":"86468231-dc2d-4628-ac08-96c85388bd7b","resolution":{"observed_at":"2026-07-11T20:46:04.923901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-08-02T01:39:24.316369Z","title":"Zhang et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14609","last_updated":"2026-07-16T06:12:05Z","snapshot_observed_at":"2026-08-08T01:49:12.243800Z","submitted_at":"2026-07-16T06:12:05Z","title":"Representation-Aligned Tactile Grounding for Contact-Rich Robotic Manipulation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T01:39:24.316369Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2607.14609"},"observation_digest":"sha256:f94a961f5950d01c9c9cf9098f75bb5839556c4e86ded368cfbdefbbbaabc889","observation_id":"2bb9e23c-9859-4fea-bcf7-1f0074e5f471","resolution":{"observed_at":"2026-08-02T01:39:24.316369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-08-01T15:44:14.315740Z","title":"Zhang, P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-01T15:44:09.860402Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:14.315740Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:855e1936fbf9f390a02085dd4d41fe5db944b1fa5999fa67d7472685353d00e2","observation_id":"0be13bcd-9d77-4c44-befc-92e4441947ba","resolution":{"observed_at":"2026-08-01T15:44:14.315740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09577","snapshot_observed_at":"2026-07-31T08:56:17.620543Z","title":"arXiv:2505.09577","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28391","last_updated":"2026-07-30T15:47:01Z","snapshot_observed_at":"2026-08-03T13:41:02.237895Z","submitted_at":"2026-07-30T15:47:01Z","title":"TacWAM: Anchor-Guided World Action Model with Mechanics-Aware Tactile Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T08:56:17.620543Z"},"links":{"cited_paper":"/paper/2505.09577","citing_paper":"/paper/2607.28391"},"observation_digest":"sha256:56cdcabf59482294acee820ccb273a1fe8cccf604b6d6daa4321600e9c977ad5","observation_id":"347ed5ec-02fc-4dc2-af20-803662fa2efe","resolution":{"observed_at":"2026-07-31T08:56:17.620543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.09577/citation-record","integrity":"/paper/2505.09577/integrity","json":"/paper/2505.09577/citation-record.json","paper":"/paper/2505.09577"},"outbound":[],"paper":{"arxiv_id":"2505.09577","last_updated":"2025-05-14T17:29:35Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-07T15:45:21.303112Z","submitted_at":"2025-05-14T17:29:35Z","title":"VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 34 inbound Pith citation observations for arXiv:2505.09577."}