{"as_of":"2026-08-10T13:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:12cf3f717c64cce81a6f771d477b07aac7f01b6c180668d9f80c17b6e2c2c51d","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T06:00:14.837743Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T12:52:15.138790Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T12:53:17.402749Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"cited_work":{"arxiv_id":"2509.04658","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04658","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sur- former v2: A multimodal classifier for surface understand- ing from touch and vision","venue":null,"work_id":"f6110c34-c0b8-45cb-bfc5-5da7b6ee7c16","year":2025},"citing_paper":{"arxiv_id":"2605.17336","last_updated":"2026-05-17T09:09:30Z","snapshot_observed_at":"2026-08-02T12:21:23.782064Z","submitted_at":"2026-05-17T09:09:30Z","title":"Tactile-based Multimodal Fusion in Embodied Intelligence: A Survey of Vision, Language, and Contact-Driven Paradigms","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-20T12:52:15.138790Z"},"links":{"cited_paper":"/paper/2509.04658","citing_paper":"/paper/2605.17336"},"observation_digest":"sha256:d73f2f336a96512e0161bfcfa903d86996573ddc70e194f89bd9ce99c4105c9b","observation_id":"0ace1f1b-26c1-499b-baa1-0b0bfe490ffc","resolution":{"observed_at":"2026-05-20T12:53:17.404600Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.04658/citation-record","integrity":"/paper/2509.04658/integrity","json":"/paper/2509.04658/citation-record.json","paper":"/paper/2509.04658"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.06566","last_updated":"2025-08-07T00:59:33Z","snapshot_observed_at":"2026-08-09T00:15:37.737116Z","submitted_at":"2025-08-07T00:59:33Z","title":"Surformer v1: Transformer-Based Surface Classification Using Tactile and Vision Features","version":1},"cited_work":{"arxiv_id":"2508.06566","doi":"10.48550/arxiv.2508.06566","metadata_source":"pith","pith_arxiv_id":"2508.06566","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Surformer v1: Transformer-Based Surface Classification Using Tactile and Vision Features","venue":"cs.CV","work_id":"9b680bf7-b208-4f52-8fa8-840da59b989e","year":2025},"citing_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:14.786778Z"},"links":{"cited_paper":"/paper/2508.06566","citing_paper":"/paper/2509.04658"},"observation_digest":"sha256:2a85817183c6434a79fa4ddbcd39aaa3f61e01758121105260deb4842d70988b","observation_id":"90a39ecc-a9ff-4eca-bf9d-8a13bca83ec9","resolution":{"observed_at":"2026-08-05T06:00:14.885388Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12498","last_updated":"2022-11-29T16:39:06Z","snapshot_observed_at":"2026-08-09T07:17:13.271866Z","submitted_at":"2022-11-22T18:59:32Z","title":"Touch and Go: Learning from Human-Collected Vision and Touch","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12498","snapshot_observed_at":"2026-08-05T06:00:14.790891Z","title":"Touch and go: Learning from human-collected vision and touch,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:14.790891Z"},"links":{"cited_paper":"/paper/2211.12498","citing_paper":"/paper/2509.04658"},"observation_digest":"sha256:9ac75fda8869abe47fdc6d17da1daf81df8f440c15f7ad7df99fd88112ff4af7","observation_id":"62731c6a-0b80-4370-9c7d-8ee10f2325e5","resolution":{"observed_at":"2026-08-05T06:00:14.790891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T06:00:14.795366Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:14.795366Z"},"links":{"citing_paper":"/paper/2509.04658"},"observation_digest":"sha256:8aab4542bab609c8f15bce5ca2b40ae95801ed5f815dcb5499cec4dc9cab6ff1","observation_id":"23471172-3861-4079-93b2-15449c796d56","resolution":{"observed_at":"2026-08-05T06:00:14.795366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.02394","last_updated":"2020-01-08T06:54:53Z","snapshot_observed_at":"2026-08-09T00:15:37.244663Z","submitted_at":"2020-01-08T06:54:53Z","title":"Convolutional Networks with Dense Connectivity","version":1},"cited_work":{"arxiv_id":"2001.02394","doi":null,"metadata_source":"pith","pith_arxiv_id":"2001.02394","snapshot_observed_at":"2026-08-05T06:00:15.083497Z","title":"Convolutional Networks with Dense Connectivity","venue":"cs.LG","work_id":"bc2e9764-e207-49bd-8510-fd5f76d6d4bf","year":2020},"citing_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:14.798802Z"},"links":{"cited_paper":"/paper/2001.02394","citing_paper":"/paper/2509.04658"},"observation_digest":"sha256:bb64e3688cf3ff51fdcb6ea34cb461346cdf225a34a3d12c3a456b0f61f6cbe5","observation_id":"259e1bb6-c6fd-43c6-85e1-774488e7b737","resolution":{"observed_at":"2026-08-05T06:00:15.088284Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T06:00:15.201579Z","title":"Gradient-based learning applied to document recognition,","venue":null,"work_id":"c72299e1-6888-47e0-a2f1-acceb9e73769","year":2002},"citing_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:14.802571Z"},"links":{"citing_paper":"/paper/2509.04658"},"observation_digest":"sha256:fe456c4d54be9dacdd0b93feaccf77939359766c315e63a613062ddcf68b72dc","observation_id":"9ffcbcc7-4b59-448c-ab6f-e626d9426984","resolution":{"observed_at":"2026-08-05T06:00:15.204959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.11946","last_updated":"2020-09-11T05:08:01Z","snapshot_observed_at":"2026-08-06T22:36:56.473526Z","submitted_at":"2019-05-28T17:05:32Z","title":"EfficientNet: Rethinking Model Scaling for Convolutional Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.11946","snapshot_observed_at":"2026-08-05T06:00:14.806676Z","title":"EfficientNet: Rethinking model scaling for convo- lutional neural networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:14.806676Z"},"links":{"cited_paper":"/paper/1905.11946","citing_paper":"/paper/2509.04658"},"observation_digest":"sha256:1171f907c14d7112d9c452baad92fec21795a7aa7d709bb816e18163615fd7f9","observation_id":"17824df3-b995-4898-8f4b-f6ca687f56a5","resolution":{"observed_at":"2026-08-05T06:00:14.806676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T06:00:15.191274Z","title":"Majority voting: Material classification by tactile sensing using surface textures,","venue":null,"work_id":"0c6b9faa-d7da-4f6b-9ffd-86e530d6bf3d","year":2010},"citing_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:14.811600Z"},"links":{"citing_paper":"/paper/2509.04658"},"observation_digest":"sha256:bb5fd8a2c44195cfcd14938289588f897a524617a3b15dddea138c87acf8d3da","observation_id":"2545e364-6b30-471d-b503-c2caa70e3cb5","resolution":{"observed_at":"2026-08-05T06:00:15.194631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/5756488","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T06:00:15.055558Z","title":"Tactile-data classification of contact materials using computational intelligence,","venue":null,"work_id":"0dcf47ca-05da-4d95-8640-19c8bc41b29e","year":2011},"citing_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:14.814929Z"},"links":{"citing_paper":"/paper/2509.04658"},"observation_digest":"sha256:2818ff9b26d097777eb81474f52aecd3f05859922eaba29b3e89b2fea41cbbae","observation_id":"7da64e3e-0ffc-46e6-9de8-c7dd8b174f35","resolution":{"observed_at":"2026-08-05T06:00:15.060851Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T06:00:15.181651Z","title":"Tactile-data classification of contact materials using principal component analysis and self-organizing maps,","venue":null,"work_id":"7d3901c4-a84b-4e88-b2df-e1e67ddd2414","year":2005},"citing_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:14.818036Z"},"links":{"citing_paper":"/paper/2509.04658"},"observation_digest":"sha256:451df9690db6494003cf290f4429b91a04793994d60af06fd0c800b4c78bda2c","observation_id":"d8bb8402-25db-4517-83e8-1e93994c2a9a","resolution":{"observed_at":"2026-08-05T06:00:15.184948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/1104537","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T06:00:14.981128Z","title":"Estimating perceptual attributes of haptic textures using visuo-tactile data,","venue":null,"work_id":"4551854c-91af-40d1-be12-5ccae59471d2","year":2025},"citing_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:14.821187Z"},"links":{"citing_paper":"/paper/2509.04658"},"observation_digest":"sha256:cf8c1b479e4b31afed1fa642fcacd41302115aaa60c3e3f9f50f760b9f5b958b","observation_id":"be0a046b-c960-4a9e-84e7-4257e6b6fd36","resolution":{"observed_at":"2026-08-05T06:00:14.986302Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00121","last_updated":"2022-09-30T22:38:29Z","snapshot_observed_at":"2026-08-10T11:06:12.354675Z","submitted_at":"2022-09-30T22:38:29Z","title":"Visuo-Tactile Transformers for Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00121","snapshot_observed_at":"2026-08-05T06:00:14.824282Z","title":"Visuo-tactile trans- formers for manipulation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:14.824282Z"},"links":{"cited_paper":"/paper/2210.00121","citing_paper":"/paper/2509.04658"},"observation_digest":"sha256:12f70207cbd1f8ba7354447a73d35d9d46c4ce39539f1fed78fda79689168364","observation_id":"a0efb47b-42af-4855-a341-452efbb2a5d9","resolution":{"observed_at":"2026-08-05T06:00:14.824282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15953","last_updated":"2026-05-13T00:42:26Z","snapshot_observed_at":"2026-07-06T21:44:32.853406Z","submitted_at":"2025-06-19T01:38:13Z","title":"ViTacFormer: Learning Cross-Modal Representation for Visuo-Tactile Dexterous Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15953","snapshot_observed_at":"2026-08-05T06:00:14.827748Z","title":"Vi- TacFormer: Learning cross-modal representation for visuo-tactile dexterous manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:14.827748Z"},"links":{"cited_paper":"/paper/2506.15953","citing_paper":"/paper/2509.04658"},"observation_digest":"sha256:2ea5fe43e4ebeac0b38ffec7cfa927fc332716312fd33a29c384d709a3185018","observation_id":"f9023a75-e8ef-4511-8c93-311b30a82b1f","resolution":{"observed_at":"2026-08-05T06:00:14.827748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07455","last_updated":"2025-05-12T11:37:35Z","snapshot_observed_at":"2026-08-09T09:36:53.505968Z","submitted_at":"2025-05-12T11:37:35Z","title":"GelFusion: Enhancing Robotic Manipulation under Visual Constraints via Visuotactile Fusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07455","snapshot_observed_at":"2026-08-05T06:00:14.831282Z","title":"GelFusion: Enhancing robotic manipulation under visual constraints via visuotactile fusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:14.831282Z"},"links":{"cited_paper":"/paper/2505.07455","citing_paper":"/paper/2509.04658"},"observation_digest":"sha256:cc31b9cc7b8e1f2dcb5de91d06a8ebfd66f41d110f5b365ca766bbb2005aab42","observation_id":"41855a90-f11d-4be1-b5e8-e3d9058d4178","resolution":{"observed_at":"2026-08-05T06:00:14.831282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s40430-025-05587-w","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T06:12:12.796739Z","title":"Efficient visual-tactile transformer with token reorganization for robotic slip detection,","venue":"Journal of the Brazilian Society of Mechanical Sciences and Engineering","work_id":"9306e4f9-49ed-4829-acf0-bb274184ca48","year":2025},"citing_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:14.834507Z"},"links":{"citing_paper":"/paper/2509.04658"},"observation_digest":"sha256:52de348ddbf831b7c668ef4ebdcbe480b64a5a3f6da6dfa2ab15b69f583bd77a","observation_id":"acb187f6-3e3f-4111-afd3-bc22ace99e04","resolution":{"observed_at":"2026-08-05T06:00:14.869635Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T06:00:15.171963Z","title":"EfficientNetV2: Smaller models and faster training,","venue":null,"work_id":"3634f428-67b7-4866-b8c9-3c1acaf9afc6","year":2021},"citing_paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:14.837743Z"},"links":{"citing_paper":"/paper/2509.04658"},"observation_digest":"sha256:050875bbcdfc4174c530f4fcab10cb4d987d5be0d8f0c838b4770a506639b4f9","observation_id":"e021d8c5-3097-402e-852c-5d1986145b58","resolution":{"observed_at":"2026-08-05T06:00:15.175128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.04658","last_updated":"2025-09-04T21:05:33Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-09T00:15:33.009879Z","submitted_at":"2025-09-04T21:05:33Z","title":"Surformer v2: A Multimodal Classifier for Surface Understanding from Touch and Vision"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":5,"verified_fuzzy":4},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 1 inbound Pith citation observation for arXiv:2509.04658."}