{"as_of":"2026-08-16T11:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c756d9919d6ad1a947bc260685083f586e02a93d95c092180b3ed5dfa18fd1ae","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:35:34.228782Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07596/citation-record","integrity":"/paper/2608.07596/integrity","json":"/paper/2608.07596/citation-record.json","paper":"/paper/2608.07596"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.668202Z","title":"Robotics: Science and Systems, (RSS) , year=","venue":null,"work_id":"51f89435-1013-4b79-a6f0-112566a4ec26","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.909109Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:94229036cf1789a608eb0fe0655b9725701cc1e13174c671fd2e862f3e7c0337","observation_id":"4b466f73-5780-47a7-9d9d-de629dc6eb3a","resolution":{"observed_at":"2026-08-11T00:35:35.677833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.638455Z","title":"Conference on Robot Learning, (CoRL) , pages=","venue":null,"work_id":"0c99e121-005c-4357-9bc8-72cba25f7e09","year":2023},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.916077Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:48b91078cf9921c85fcb4d1e23bec493b2b55607d445eee7aca4af90d8aa9ae1","observation_id":"747b62ac-016d-4f60-ae68-4eb035017161","resolution":{"observed_at":"2026-08-11T00:35:35.645715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.618478Z","title":"2024 IEEE International Conference on Robotics and Automation, (ICRA) , pages=","venue":null,"work_id":"f419bd80-d631-4ef7-9ab7-38d6822bc1bf","year":2024},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.921588Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:4966d72639f1583a28c77b692a5f5c09fadb36890fb7a9e33cf165050651ad2d","observation_id":"03d951a4-3e63-4b4c-b79b-42eac8ec0214","resolution":{"observed_at":"2026-08-11T00:35:35.624650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.600711Z","title":"Robotics: Science and Systems, (RSS) , year=","venue":null,"work_id":"e4610df3-e405-48ca-8af3-5368730e0bff","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.926453Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:f9f37a3fbbf485e37c34e481c97e48b22f3f19d8ee4949350ce8efc0bfe251c4","observation_id":"f8875d01-5c97-4dbd-beda-4c59d68e95f9","resolution":{"observed_at":"2026-08-11T00:35:35.606242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.579690Z","title":"Robotics: Science and Systems, (RSS) , year=","venue":null,"work_id":"fb138b15-d0b8-48ad-a458-57d566d105b4","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.931814Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:777395356c6f10f5788ec2ee1e845766b94d6b173aea1a8baa74040cd42ebdd8","observation_id":"33fb4354-f436-48ff-b975-8337d778a52a","resolution":{"observed_at":"2026-08-11T00:35:35.586224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-08-15T09:35:08.116329Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-08-11T00:35:33.936905Z","title":"arXiv preprint arXiv:2502.19645 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.936905Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:5222385d3909d376ffb0b6eaca98f1a3c53912105bc69653d58f9acf7541927c","observation_id":"682cfa4d-a884-4f77-a5cf-0565363944cf","resolution":{"observed_at":"2026-08-11T00:35:33.936905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.562230Z","title":"Proceedings of The 8th Conference on Robot Learning, (CoRL) , series=","venue":null,"work_id":"5ddecda5-bd4f-4c05-aecf-0e03ab7c7fc8","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.942229Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:555e686455f41062be526aeab64771ee11daba73af02632233fd03a46b7e90a9","observation_id":"c8f02491-5e5e-4f75-9447-3836f938b411","resolution":{"observed_at":"2026-08-11T00:35:35.567523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-11T00:35:33.947054Z","title":"arXiv preprint arXiv:2410.24164 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.947054Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:686c5b01f642c0d59eda097217c3adbf45e6acd7fef0b31c4ba4684f02829161","observation_id":"9a09f445-0443-4831-9461-87aab53256bf","resolution":{"observed_at":"2026-08-11T00:35:33.947054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-11T00:35:33.952595Z","title":"arXiv preprint arXiv:2501.09747 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.952595Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:980189006808997f98406a56d4295fb38c83e6b1c3e8bf1196ca28d48a449a1f","observation_id":"6532a9a7-af94-47b0-96b7-95d7aafe248a","resolution":{"observed_at":"2026-08-11T00:35:33.952595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-08-16T09:32:38.319890Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-11T00:35:33.957812Z","title":"arXiv preprint arXiv:2501.15830 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.957812Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:8e3cb453159039eb0e575089af1f715313398357ecd738251266723cc0fc41e7","observation_id":"64f554c9-f6f4-460d-88d6-75c7b1a195c3","resolution":{"observed_at":"2026-08-11T00:35:33.957812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-08-11T00:35:33.962861Z","title":"arXiv preprint arXiv:2503.14734 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.962861Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:d896a598ad71e8813fa3dda8ab949a84eeae539cbac414b65d2ec7766e873eec","observation_id":"c9a4b720-77e8-4eef-9b56-4721c48a727c","resolution":{"observed_at":"2026-08-11T00:35:33.962861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19854","last_updated":"2025-04-28T14:47:34Z","snapshot_observed_at":"2026-08-14T03:25:49.528763Z","submitted_at":"2025-04-28T14:47:34Z","title":"NORA: A Small Open-Sourced Generalist Vision Language Action Model for Embodied Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19854","snapshot_observed_at":"2026-08-11T00:35:33.967894Z","title":"arXiv preprint arXiv:2504.19854 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.967894Z"},"links":{"cited_paper":"/paper/2504.19854","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:0cb58df7a8cf832537222cf522762c06654a8d81cdbc8fa6cceba4a7bfdb87c5","observation_id":"494832c3-524e-4d9e-897e-2a9695183653","resolution":{"observed_at":"2026-08-11T00:35:33.967894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03912","last_updated":"2025-05-06T18:35:07Z","snapshot_observed_at":"2026-08-15T23:40:23.773295Z","submitted_at":"2025-05-06T18:35:07Z","title":"OpenHelix: A Short Survey, Empirical Analysis, and Open-Source Dual-System VLA Model for Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.03912","snapshot_observed_at":"2026-08-11T00:35:33.972992Z","title":"arXiv preprint arXiv:2505.03912 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.972992Z"},"links":{"cited_paper":"/paper/2505.03912","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:0980c0956e1e781280c18fc89bfc14775b13fa2bf5adb99ac238c11ab01b905c","observation_id":"9b930aff-6958-4fd1-a881-6e94f5721b07","resolution":{"observed_at":"2026-08-11T00:35:33.972992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.545676Z","title":null,"venue":null,"work_id":"f3f3c421-57c1-481b-b3bd-a532dfc1b2b8","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.977846Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:568420904827d0717d81a3a367984339d1e87f63a88d768cb8d5f66dbb51833c","observation_id":"812d97d4-c376-4aca-905e-7c7355cd097e","resolution":{"observed_at":"2026-08-11T00:35:35.550944Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06111","last_updated":"2025-11-03T11:52:57Z","snapshot_observed_at":"2026-08-09T00:51:47.897197Z","submitted_at":"2025-05-09T15:11:13Z","title":"UniVLA: Learning to Act Anywhere with Task-centric Latent Actions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06111","snapshot_observed_at":"2026-08-11T00:35:33.982248Z","title":"arXiv preprint arXiv:2505.06111 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.982248Z"},"links":{"cited_paper":"/paper/2505.06111","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:1f80c4e4026dbd8122babfbad87e873d75c322e7f6a5a58a9cf6da62206e7a85","observation_id":"452b9d52-ddb7-4c42-adb0-721ef0b315f2","resolution":{"observed_at":"2026-08-11T00:35:33.982248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.19850","last_updated":"2025-06-24T17:59:57Z","snapshot_observed_at":"2026-08-15T18:55:35.634820Z","submitted_at":"2025-06-24T17:59:57Z","title":"Unified Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.19850","snapshot_observed_at":"2026-08-11T00:35:33.987020Z","title":"arXiv preprint arXiv:2506.19850 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.987020Z"},"links":{"cited_paper":"/paper/2506.19850","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:c2a5795facfc0d8cfdc960b2f4015c30d16cc421752b937c826a25c119abd3f8","observation_id":"ae01dba0-592c-4607-8fed-b77e1323147c","resolution":{"observed_at":"2026-08-11T00:35:33.987020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01844","last_updated":"2025-06-02T16:30:19Z","snapshot_observed_at":"2026-08-13T11:17:54.365190Z","submitted_at":"2025-06-02T16:30:19Z","title":"SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01844","snapshot_observed_at":"2026-08-11T00:35:33.991732Z","title":"arXiv preprint arXiv:2506.01844 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.991732Z"},"links":{"cited_paper":"/paper/2506.01844","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:b1bc62bdcfdd640b05f4db22183ff8d0f709f89bd4794f8804d3ba63c9113c03","observation_id":"d898cd00-4121-4ffc-80fb-de129440c20f","resolution":{"observed_at":"2026-08-11T00:35:33.991732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.527116Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , volume=","venue":null,"work_id":"9de5c059-a557-4115-a460-a89d573aa6a3","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:33.998600Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:1c6799ab2114b87ea9d67d531e8471dada791956425ac7acaceb47dcac177f60","observation_id":"654f8063-a1f0-45f8-867a-e2fa531093e4","resolution":{"observed_at":"2026-08-11T00:35:35.533311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21539","last_updated":"2025-06-26T17:55:40Z","snapshot_observed_at":"2026-08-13T10:05:34.967093Z","submitted_at":"2025-06-26T17:55:40Z","title":"WorldVLA: Towards Autoregressive Action World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21539","snapshot_observed_at":"2026-08-11T00:35:34.003076Z","title":"arXiv preprint arXiv:2506.21539 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.003076Z"},"links":{"cited_paper":"/paper/2506.21539","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:dcc7f5c295e9e0944ddc07fa330ef6d919973a34b57afdda62e4a7bdfb16a768","observation_id":"58dde0c7-43be-4497-8470-8740a13758ee","resolution":{"observed_at":"2026-08-11T00:35:34.003076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.506017Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , volume=","venue":null,"work_id":"08fdf374-4443-4fe4-a6d8-a566ac3154f4","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.007922Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:6e8bc2777578b7b4561c9e4726fc8eebe4faa19d2bd59c774fe4e88b57f4df0a","observation_id":"6d2a7c34-7c01-4238-8105-634bc36b7a22","resolution":{"observed_at":"2026-08-11T00:35:35.511925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.485676Z","title":"2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) , pages=","venue":null,"work_id":"8b629f65-ed5c-406b-85f9-56a89a855364","year":2025},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.012722Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:1501dec5c978d7bdea0a3e33e4906e7447ce9e48b431d3aeeea44bbd17de0e26","observation_id":"384e4837-7ed7-4e83-8571-a31b10a9ed7e","resolution":{"observed_at":"2026-08-11T00:35:35.492443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.464261Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , volume=","venue":null,"work_id":"de7442f2-deda-4b1d-8825-b69836ddb320","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.017906Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:b66e36b49a72c595f1f5aff49b72cf08e2751421f8f49148a5f365de4c1f754f","observation_id":"b285ceb2-a2e7-4cb1-b587-c1529e08402c","resolution":{"observed_at":"2026-08-11T00:35:35.470050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.07917","last_updated":"2025-09-18T12:21:57Z","snapshot_observed_at":"2026-08-14T09:44:01.476519Z","submitted_at":"2025-08-11T12:32:45Z","title":"MolmoAct: Action Reasoning Models that can Reason in Space","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.07917","snapshot_observed_at":"2026-08-11T00:35:34.022811Z","title":"arXiv preprint arXiv:2508.07917 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.022811Z"},"links":{"cited_paper":"/paper/2508.07917","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:b2d8f0ad9354ecfa84c5278bb52c592eb797351d3c88112094199574a8e1c004","observation_id":"0099ce7b-955b-4f4f-ac34-4daec65881ef","resolution":{"observed_at":"2026-08-11T00:35:34.022811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:34.027764Z","title":"arXiv preprint arXiv:2508.18269 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.027764Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:9ee6094af0483cd4fed1b8a3095a774baf46284d26f3b92ea789be5c52821fac","observation_id":"2cffc22e-1892-4ef4-8517-1b3d61f21ce7","resolution":{"observed_at":"2026-08-11T00:35:34.027764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.441432Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference, (CVPR) , pages=","venue":null,"work_id":"ddfb3632-d484-4017-9564-97afde12ef77","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.033050Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:17bb46f6b636f249e1a7c0c89844d008ccd663792d632894f9adbb2de478c7c9","observation_id":"48fb7e2f-7c58-4469-bf01-4029ad0a5c05","resolution":{"observed_at":"2026-08-11T00:35:35.451036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.423880Z","title":"International Conference on Learning Representations, (ICLR) , volume=","venue":null,"work_id":"acb8d8f2-3a3a-4794-8d6d-965b0197621a","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.039391Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:7698fb9ed0c19b6f2038ab32d6cd52609764dd2311a29023f5d2e3f4411c64fd","observation_id":"0eb855cc-071d-4774-9775-40274226c0c7","resolution":{"observed_at":"2026-08-11T00:35:35.429296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.404513Z","title":null,"venue":null,"work_id":"fd505cb8-0522-4afa-aa5e-7dc9744ba494","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.044424Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:1922d773f391f6a355662a6200b05b7e72fc9a2a16e552a7401c60202a2e039f","observation_id":"7613ae2a-4f67-4760-9786-e2821a3b9870","resolution":{"observed_at":"2026-08-11T00:35:35.411988Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:34.049414Z","title":"IEEE Robotics and Automation Letters , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.049414Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:ba5b33919d22de5fce176974be609f2e36aacacc16ee4be6ea3b1724a29607f2","observation_id":"8a395ff8-e313-4b32-947d-2c0fb055ba0a","resolution":{"observed_at":"2026-08-11T00:35:34.049414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.376115Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , volume=","venue":null,"work_id":"2b6300d1-7e51-4cb6-982f-50f20dc7e642","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.054221Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:56caa5ec087ab20b683f712f7da3568f27896cfb576d0969b1b148ee47b0a727","observation_id":"b7d25c2e-4a66-453c-adb7-4f04e14f708f","resolution":{"observed_at":"2026-08-11T00:35:35.381114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-11T00:35:34.059112Z","title":"arXiv preprint arXiv:2412.15115 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.059112Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:4f84bee067789b9dcf8c89ff34068fa3f5ce04bfa251b013ecc78ab0fb62733d","observation_id":"7cdc859b-2167-4d83-8b10-50d53a5c46b6","resolution":{"observed_at":"2026-08-11T00:35:34.059112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.358467Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":"2e4bbed5-5405-4a1e-be96-bce8fe9f730e","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.064174Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:c765919aa4f2686ac79d940585ed35e7dd5c7f00550a532a96b518992ca7f111","observation_id":"89a540b9-7a3b-4112-a607-e3c8ff3fa0a6","resolution":{"observed_at":"2026-08-11T00:35:35.365102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.14795","last_updated":"2022-03-15T22:37:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-30T17:53:34Z","title":"Perceiver IO: A General Architecture for Structured Inputs & Outputs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.14795","snapshot_observed_at":"2026-08-11T00:35:34.068707Z","title":"arXiv preprint arXiv:2107.14795 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.068707Z"},"links":{"cited_paper":"/paper/2107.14795","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:a3c63fe2baa34d7baa3c4ec2e8d7c1f8be8afb289eaa3ec60761372e0a0dd8da","observation_id":"1a82e1ca-8c67-46aa-97d6-51cdc5de47c8","resolution":{"observed_at":"2026-08-11T00:35:34.068707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.341548Z","title":"International Conference on Learning Representations, (ICLR) , year=","venue":null,"work_id":"b76337cf-0dfd-44b0-bbb0-13828b0f2013","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.073459Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:e5d714b8fc77a17055384b7556e5837730a2cb700b0ed956af3911af9b3d046b","observation_id":"ff8aabc9-3ec9-4aec-8245-d514c0ae8118","resolution":{"observed_at":"2026-08-11T00:35:35.347349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.323145Z","title":"The International Journal of Robotics Research , volume=","venue":null,"work_id":"2e9cdfe0-2446-4147-a287-086e415c9855","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.078271Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:d161d4cb8ebc07ac94cc2f626f0c5d570ef550a426ce9016a071d5186a923895","observation_id":"6a200344-e35f-4058-a551-56d924274c46","resolution":{"observed_at":"2026-08-11T00:35:35.328884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.304719Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , year=","venue":null,"work_id":"48a3f2ff-8e3a-4167-a894-b0df173e133b","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.082895Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:de4db76a101b5527f215eefd8571d0ad8d80409307af105684e27ebaa1bac925","observation_id":"f9cec340-7ed8-4bef-bc5f-6eff2ae5d98f","resolution":{"observed_at":"2026-08-11T00:35:35.311077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.286084Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , year=","venue":null,"work_id":"ccd859ba-60ba-4719-9129-72bf10bdc1c0","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.087989Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:4cf1bd4008dcc95180b7bf221f9e2b1e94197b0ec918a141aede7ae28a2117b2","observation_id":"7cfbe172-b2dc-4605-87ac-09ce8aa0f657","resolution":{"observed_at":"2026-08-11T00:35:35.291097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.268397Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , year=","venue":null,"work_id":"9deb3f44-5f28-49bd-8636-412c80084b91","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.092469Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:1a98ff0f52e6a332b38955600eaca1298eb8a48ba0e1435a5804c500c4170ca4","observation_id":"09ce0788-796c-4457-a34c-1e5e412b333b","resolution":{"observed_at":"2026-08-11T00:35:35.274202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.248595Z","title":"Advances in Neural Information Processing Systems, (NeurIPS) , year=","venue":null,"work_id":"df4cb526-c9a5-4d43-bf67-76a978da88f0","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.097210Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:eb5e4560ab1b9e5ec79a0ba2405192fbb878253d893474ff3c585543e5732935","observation_id":"accb4a2c-31ac-4275-b69f-ceb837a0537d","resolution":{"observed_at":"2026-08-11T00:35:35.255054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.231164Z","title":"Transactions on Machine Learning Research, (TMLR) , year=","venue":null,"work_id":"b8604c7d-7000-4b89-9ade-03c22338b717","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.101372Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:4fe2358fa8009b56507edd7719d990310f386f52480d4a988fee23b8eaa86857","observation_id":"ae35bda9-6f7c-4c0a-8b31-db7a4ddb2aab","resolution":{"observed_at":"2026-08-11T00:35:35.236505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.213308Z","title":"Proceedings of the 40th International Conference on Machine Learning, (ICML) , year=","venue":null,"work_id":"a860a4af-8a32-4914-88c4-cbe1944ac0a0","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.105791Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:23528e13a394e444145b10fee522dea4a39b7676025a5d406e17cc12fd4001ab","observation_id":"1f2bfa0d-cc45-40c2-8f8a-08c900ce3224","resolution":{"observed_at":"2026-08-11T00:35:35.219144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.194197Z","title":"Proceedings of the 40th International Conference on Machine Learning, (ICML) , year=","venue":null,"work_id":"8d1b9c7e-1621-49eb-85ac-f69069087391","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.110372Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:0f31e7ef1d5490249cf52658297c378b22a4db41e1a7043751e2c506df5ba92d","observation_id":"77a90368-18f8-4b58-bbaf-d3662cd51880","resolution":{"observed_at":"2026-08-11T00:35:35.201589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.177955Z","title":"International Conference on Learning Representations, (ICLR) , year=","venue":null,"work_id":"5277d42b-dd3f-4f9e-b23c-45f1c109cf77","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.115440Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:ae064a87b9096f50cfdffabc908a7d7200356817e881c3b00d7f7b2b262f751f","observation_id":"429b474f-dc5b-4e92-8bff-bedf8647c035","resolution":{"observed_at":"2026-08-11T00:35:35.182799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-11T00:35:34.120708Z","title":"arXiv preprint arXiv:2307.09288 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.120708Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:44a0a7296c722a9fc98d95b2e0543173e64f2c1a0068d13651891873e09cbd48","observation_id":"cad5fe36-c811-4c2c-867a-395178ee963b","resolution":{"observed_at":"2026-08-11T00:35:34.120708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.161606Z","title":null,"venue":null,"work_id":"617dd3b7-2cdb-40f7-825a-89d7aaa02234","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.125755Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:01be5fbd6a0723a89b3e95647b90ce6fda223955413f6f794e9843d58732a0b2","observation_id":"c28e4040-05d6-4f7c-9f64-4fc67c88bbaf","resolution":{"observed_at":"2026-08-11T00:35:35.167202Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2408.15538","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:34.543351Z","title":"arXiv preprint arXiv:2408.15538 , year=","venue":null,"work_id":"dd5baca6-3fb3-4869-be50-7430f74b9bf6","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.130307Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:c11e0ec6960a8d9d9f66e857ac0d7eaeac88ad305d0f141a810b00541417fe6f","observation_id":"daf04920-6a90-4785-b118-9723326c2209","resolution":{"observed_at":"2026-08-11T00:35:34.553749Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.144436Z","title":"Proceedings of the Forty-third International Conference on Machine Learning, (ICML) , year =","venue":null,"work_id":"6238396e-d1cb-4565-aa86-f32109d9ad9e","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.134994Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:169047cbb8d8bdd52bcadcb223a5625bdd79d0aa6a4f18d3229bd08fa7345cf4","observation_id":"3f68d9cb-5f10-437e-985d-86b12305f62a","resolution":{"observed_at":"2026-08-11T00:35:35.149558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.13403","last_updated":"2026-05-13T11:58:02Z","snapshot_observed_at":"2026-08-13T07:25:04.882256Z","submitted_at":"2026-05-13T11:58:02Z","title":"RotVLA: Rotational Latent Action for Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":"2605.13403","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.13403","snapshot_observed_at":"2026-08-11T00:35:34.408236Z","title":"RotVLA: Rotational Latent Action for Vision-Language-Action Model","venue":"cs.RO","work_id":"0335866b-98ca-4fb9-ad9e-aa07fc7798e6","year":2026},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.140119Z"},"links":{"cited_paper":"/paper/2605.13403","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:96742e1c3afb7db3019115414d6d45adc358a87c195711404ceb2add4f5dfe4a","observation_id":"98cb8c74-4c67-491b-8e15-81d524aee35f","resolution":{"observed_at":"2026-08-11T00:35:34.413642Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.13382","last_updated":"2026-05-13T11:37:51Z","snapshot_observed_at":"2026-08-12T17:12:31.150915Z","submitted_at":"2026-05-13T11:37:51Z","title":"BlockVLA: Accelerating Autoregressive VLA via Block Diffusion Finetuning","version":1},"cited_work":{"arxiv_id":"2605.13382","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.13382","snapshot_observed_at":"2026-08-11T00:35:34.385895Z","title":"BlockVLA: Accelerating Autoregressive VLA via Block Diffusion Finetuning","venue":"cs.RO","work_id":"eabc7685-2c63-4b51-b7b4-922a95399856","year":2026},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.145103Z"},"links":{"cited_paper":"/paper/2605.13382","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:a74f8bef04ae390c836619c32676cc7eca03ff7d1310fd40cb4f7a6ced49bde1","observation_id":"0b052921-fc1e-4c06-b8b6-70d3bb9ddfe9","resolution":{"observed_at":"2026-08-11T00:35:34.391260Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.124741Z","title":"2026 , eprint=","venue":null,"work_id":"6967c4e8-42a8-41ec-95a8-d6127db64953","year":2026},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.149782Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:2898f6b5c5193df3cf5cf4a063081936b684efb48c5dba413103868957e7e8fb","observation_id":"2370e3a8-2ad4-4b98-ac6a-1dfe439519f2","resolution":{"observed_at":"2026-08-11T00:35:35.131789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.17517","last_updated":"2026-05-17T16:02:05Z","snapshot_observed_at":"2026-08-15T15:19:35.225979Z","submitted_at":"2026-05-17T16:02:05Z","title":"AffordVLA: Injecting Affordance Representations into Vision-Language-Action Models via Implicit Feature Alignment","version":1},"cited_work":{"arxiv_id":"2605.17517","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.17517","snapshot_observed_at":"2026-08-11T00:35:34.361224Z","title":"AffordVLA: Injecting Affordance Representations into Vision-Language-Action Models via Implicit Feature Alignment","venue":"cs.RO","work_id":"a1be23e3-54ef-449e-8f33-88a9e7677985","year":2026},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.154516Z"},"links":{"cited_paper":"/paper/2605.17517","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:26c1bb07af60dd1e27d0bd9335b88cf86ef4075d7ee3e11adf45f02cdfb648d1","observation_id":"26ed6c4c-190f-40b2-acc4-f190ccbacca1","resolution":{"observed_at":"2026-08-11T00:35:34.368582Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18719","last_updated":"2025-05-24T14:42:51Z","snapshot_observed_at":"2026-08-14T01:02:35.686274Z","submitted_at":"2025-05-24T14:42:51Z","title":"VLA-RL: Towards Masterful and General Robotic Manipulation with Scalable Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18719","snapshot_observed_at":"2026-08-11T00:35:34.159303Z","title":"arXiv preprint arXiv:2505.18719 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.159303Z"},"links":{"cited_paper":"/paper/2505.18719","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:ad0618b54b1974f77a40c26e979d391daf323c156b931ad66e1fa32f38fe1185","observation_id":"e1a778d8-91c5-41fb-b680-01ea895e6215","resolution":{"observed_at":"2026-08-11T00:35:34.159303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09674","last_updated":"2025-09-11T17:59:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-11T17:59:17Z","title":"SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09674","snapshot_observed_at":"2026-08-11T00:35:34.164448Z","title":"arXiv preprint arXiv:2509.09674 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.164448Z"},"links":{"cited_paper":"/paper/2509.09674","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:12b3b78bcdb1e546fe890d842f2a731463053b8ad0cc74dcb7e629844d48d959","observation_id":"fc142794-6e93-4634-8808-0e580b22ddf3","resolution":{"observed_at":"2026-08-11T00:35:34.164448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17016","last_updated":"2025-05-22T17:59:45Z","snapshot_observed_at":"2026-08-15T14:40:29.317550Z","submitted_at":"2025-05-22T17:59:45Z","title":"Interactive Post-Training for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17016","snapshot_observed_at":"2026-08-11T00:35:34.169769Z","title":"arXiv preprint arXiv:2505.17016 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.169769Z"},"links":{"cited_paper":"/paper/2505.17016","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:b1d918b8253b72c43a1fc3989e57df90a7fe48c9e54840ba647ce169e4c84782","observation_id":"60bdbcd6-3d96-46a7-8f96-07508a834730","resolution":{"observed_at":"2026-08-11T00:35:34.169769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.02881","last_updated":"2026-05-08T04:21:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-04T17:51:21Z","title":"MolmoAct2: Action Reasoning Models for Real-world Deployment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.02881","snapshot_observed_at":"2026-08-11T00:35:34.174630Z","title":"arXiv preprint arXiv:2605.02881 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.174630Z"},"links":{"cited_paper":"/paper/2605.02881","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:c0243895e7aeca96b8781ed9e71ea53619696e440531b10a7d8e68e1aea0d8de","observation_id":"387c7aba-4810-43e6-9d69-c54dc25d2456","resolution":{"observed_at":"2026-08-11T00:35:34.174630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.104243Z","title":"and others , journal=","venue":null,"work_id":"df9aa3b8-a907-4055-9bcc-994d7584c0cc","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.179643Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:32fa92d7b2cbb37980914920115e7a8a313e3f70c84016e7fac53b2a0902a36b","observation_id":"3733861e-2b9e-4789-b9c0-7e502471ae80","resolution":{"observed_at":"2026-08-11T00:35:35.111802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04996","last_updated":"2025-09-05T10:43:12Z","snapshot_observed_at":"2026-08-05T05:48:44.865688Z","submitted_at":"2025-09-05T10:43:12Z","title":"FLOWER: Democratizing Generalist Robot Policies with Efficient Vision-Language-Action Flow Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.04996","snapshot_observed_at":"2026-08-11T00:35:34.184325Z","title":"arXiv preprint arXiv:2509.04996 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.184325Z"},"links":{"cited_paper":"/paper/2509.04996","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:a44eb1befdfd4f3cd7bf674596fb21da8150a5d276d18cc51f2a3cf144574084","observation_id":"fc4847fe-5c01-4735-a15d-1d37ef460d09","resolution":{"observed_at":"2026-08-11T00:35:34.184325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.085504Z","title":"2026 , eprint=","venue":null,"work_id":"86aa6078-a952-4b2f-999e-95cc3ffb1916","year":2026},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.189249Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:c0b4fb5e7374f4ceb7bf8d323f4202a5b22fb4b7cf19ec90d8e09eab8be6c0f1","observation_id":"f067a94a-9ab2-4706-ad45-d746a1e180ba","resolution":{"observed_at":"2026-08-11T00:35:35.090873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.26432","last_updated":"2026-06-24T22:44:29Z","snapshot_observed_at":"2026-08-15T12:34:46.161466Z","submitted_at":"2026-06-24T22:44:29Z","title":"Embedding Foundation Model Predictions in Discrete-Choice Models with Structural Guarantees","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.26432","snapshot_observed_at":"2026-08-11T00:35:34.194998Z","title":"arXiv preprint arXiv:2606.26432 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.194998Z"},"links":{"cited_paper":"/paper/2606.26432","citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:044ca2ab80438039476d2eedf1610a5c3666e24fbed9df6a5b000fcac861f824","observation_id":"311f268c-441b-4818-a525-169c84b1f508","resolution":{"observed_at":"2026-08-11T00:35:34.194998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.063877Z","title":"ArXiv , year=","venue":null,"work_id":"9a7f4979-af5e-4159-ae4f-1588ebaa8e2e","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.199800Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:91cc1d0c94d840fdbbfc0579d25d2295bf79a728057382e9de63dbb7f7e70fa4","observation_id":"f47b5549-1a4c-422f-b287-f8be58816944","resolution":{"observed_at":"2026-08-11T00:35:35.071444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.043829Z","title":"European Conference on Computer Vision, (ECCV) , pages =","venue":null,"work_id":"d2a798e2-f06f-448e-b7de-ce152c6bcf3c","year":2022},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.204521Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:27e119c649ca246b57794cb18601619f474d1234117a1c6a2d8de289d06849e2","observation_id":"a3d555db-bf36-4c4d-911b-35f6e5555317","resolution":{"observed_at":"2026-08-11T00:35:35.049969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.022310Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"fb32ca84-5766-4135-b6c1-b34a2a3cd977","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.209515Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:9a3b9814556607260b9ed26d70bd17c7468a38586c96363820cc2a3998538550","observation_id":"8a6f43bd-0148-4b67-86e0-ad93073c771e","resolution":{"observed_at":"2026-08-11T00:35:35.029580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:35.002154Z","title":"ArXiv , year=","venue":null,"work_id":"9a26ee28-a16a-4919-962a-787b75e545c1","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.215143Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:46ce66e0fef8b0cc73967ec40ac902169129b1e1b80fed6229ba61aeb399ab21","observation_id":"c8070d3d-f600-4770-8ad6-794e0c8b8b50","resolution":{"observed_at":"2026-08-11T00:35:35.008183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:34.981644Z","title":"Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":"bafbfd7e-3823-4c8c-934c-1b6072ac40ef","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.219806Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:6f87e498fc9c90e8a06211e91a1529a3ae50b02d8f94badc363bf6663b8fa0e6","observation_id":"759e1ce8-a181-4f4a-b0a8-ea1a950920a5","resolution":{"observed_at":"2026-08-11T00:35:34.987118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:34.965051Z","title":"Proceedings of the European Conference on Computer Vision , pages =","venue":null,"work_id":"ab971ad2-d1fa-40cc-bd0b-f16dc27300c8","year":null},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.224308Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:df7941aa194429464850b124961bc7d70d97d134a2d9144a3c790dc140d35909","observation_id":"76fbabbe-c2f9-43af-b4fe-2fbb9aebfa29","resolution":{"observed_at":"2026-08-11T00:35:34.970101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:35:34.946140Z","title":"2026 , eprint =","venue":null,"work_id":"4044c99d-4fa0-47af-96de-7b3b6af7236f","year":2026},"citing_paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T00:35:34.228782Z"},"links":{"citing_paper":"/paper/2608.07596"},"observation_digest":"sha256:fe088dff81861ca2205326a24d65da1b12557907bc66939f829ef940b8528b5b","observation_id":"6fe099af-dc77-4460-835d-f46587f6cb41","resolution":{"observed_at":"2026-08-11T00:35:34.952900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.07596","last_updated":"2026-08-06T08:12:32Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-16T01:38:11.129918Z","submitted_at":"2026-08-06T08:12:32Z","title":"LIRA: Local Cross-Layer Information Routing for Vision-Language-Action Decoding"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":26,"verified_exact":1,"verified_fuzzy":35},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2608.07596."}