{"as_of":"2026-08-11T11:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ba39921bf92210ba90d35adfe0e571ef9827396391008984c6ded7b45054b905","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T02:57:44.784072Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.03372/citation-record","integrity":"/paper/2607.03372/integrity","json":"/paper/2607.03372/citation-record.json","paper":"/paper/2607.03372"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-08-09T22:50:03.459615Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Understanding intermediate layers using linear classifier probes.International Conference on Learning Representations (Workshop); arXiv:1610.01644, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:a1e05e61abe5e09e12747ea343e0b64ebda6a9ee901a3c4eebd07d5c47254a67","observation_id":"5b085c42-1192-4ef2-9523-de62e9ba0bcd","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Probing classifiers: Promises, shortcomings, and advances.Computational Linguistics, 48(1), 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:a866ceae1985425f08685bc9f4c07369f46d1105e48764e65cee25c30aedd3f6","observation_id":"925c39b5-f16a-4b41-bda9-49e68ad7b3b1","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08112","last_updated":"2025-11-11T01:13:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-14T17:47:09Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08112","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Eliciting latent predictions from transformers with the tuned lens.arXiv preprint arXiv:2303.08112, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2303.08112","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:b9e592da2a9f6f12192aa488b15b5af0c1c187d5b2bfca886170e14580f83dcd","observation_id":"f39cb90d-4d90-4c23-b130-1a42d719b2f0","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"GR00T N1: An open foundation model for generalist humanoid robots.arXiv preprint arXiv:2503.14734, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:34acb06e81fede77449f0a3e44439f488d06d13c05b75c672bd3174061d67044","observation_id":"33eee37f-7fce-454a-aa7c-4dcf9d4b848d","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:f218e02289676e83f20dbcf0aee48519c1794a5d1611f695f19b21154e7794a7","observation_id":"b3884091-d2ca-433e-a88f-230d663b51ff","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Towards monosemanticity: Decomposing language models with dictionary learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:e9cf4fcd0e63b0aec0930f6b200a1d1d05c4a4b893720772413148d522d3a945","observation_id":"721e2fa2-596c-4c9d-b7a2-69fcdbc4c271","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"RT-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:2e9597edc7449f738e192dfb34aa698aedcfd0f591c93ff316c6dac3ba59cf9d","observation_id":"f5a7db87-47dc-4304-94b6-bd4b3d69ca5e","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Observing and controlling features in vision-language-action models.arXiv preprint arXiv:2603.05487, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:3725cf5f363d58b1907442d150c77dc5a5776c68c104f47156f3eccdfdbb70e3","observation_id":"8e264f36-1a5e-4b0e-a772-19c64141acc3","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:0921d541f10b681e7730625f5a85492d9c5dba81ef0086ab9ef666c650baf304","observation_id":"a14312bb-0d32-4b5e-a200-72d26adfc228","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-11T07:21:14.568175Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Sparse au- toencoders find highly interpretable features in language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:22fb8832651a6950040c7ccc166f3392a3fe66d0953c406f6b42f14c6039430f","observation_id":"0d51e7fb-c297-4ea4-9b5d-2f2c62f3c235","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Causal abstractions of neural networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:9e760f210cb1f319a928e322cb510b7abb754ea3d8f54a8dde8314622818fd1b","observation_id":"dd401954-5494-4e20-a5b8-6d2f00bb012e","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Not all features are created equal: A mechanistic study of vision-language-action models.arXiv preprint arXiv:2603.19233, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:92dd185eebd40a9de93461ee5a25acad1d422d40e52401dde4f484dcf99f92f7","observation_id":"56d34cfa-2bac-483e-9317-259e8e5bee50","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00328","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Mechanistic interpretability for steering vision-language-action models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2509.00328","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:bf0797ce01d8f4d2eba696790f5d3fdeacf6d8c58e020c763ce899f94713892a","observation_id":"41a477b1-52f3-4b1e-b019-7872a0c4b39a","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Camps, John Bruno, Guillaume A","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:2bcf1d4e249213a874bf95b9ffdf8e309159c48c61151c6c3b8103ed8e4a947a","observation_id":"efacd7ab-3022-4da0-a3a1-7f5d89e3be70","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Con- textVLA: Vision-language-action model with amortized multi-frame context.arXiv preprint arXiv:2510.04246, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:84330ea26d3df923f3c8bb78315b3fa730bee919f8fdf2ece20407602b343843","observation_id":"816ebd41-e908-4f8a-8b79-990b83d64580","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"DROID: A large-scale in-the-wild robot manipulation dataset.arXiv preprint arXiv:2403.12945, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:cb756151079f359ce28457ddae6a186d0b481e05c2744ef13294cf4726859f97","observation_id":"3ed39525-d284-4453-8ab8-857a7c20e784","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"OpenVLA: An open-source vision-language-action model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:fbe6bbd5e64d481179e2ef6e860f1793c2fbdcad4b168d79a949d34aa781be09","observation_id":"26182259-7df4-44e6-9c3c-d924bcfd693a","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19645","last_updated":"2025-04-28T07:49:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-27T00:30:29Z","title":"Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19645","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Fine-tuning vision-language-action models: Optimizing speed and success.arXiv preprint arXiv:2502.19645, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2502.19645","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:ab1ba4a31640e2bd68be9199b57867b17afbc298ac79106cd65d86f9bb481e38","observation_id":"4674b25c-737d-40ff-ae69-02682bff59b0","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"CronusVLA: Towards efficient and robust manip- ulation via multi-frame vision-language-action modeling","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:ffa5c06da036d7e8c3e48a5c8ed45dd7557a0b1418380d4806869fba4eb98c4f","observation_id":"b647f780-d28d-469e-ab19-84ec48b465c8","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19650","last_updated":"2024-11-29T12:06:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-29T12:06:03Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19650","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"CogACT: A foundational vision-language-action model for synergizing cognition and action in robotic manipulation.arXiv preprint arXiv:2411.19650, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2411.19650","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:d01d6d900b4ba693f489e3f8fcb5e5e3d7478e8377c79e51fe4e6d3148dbd18a","observation_id":"3a5ceafd-417c-4b2d-b193-a5e0ae969005","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05941","last_updated":"2024-05-09T17:30:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-09T17:30:16Z","title":"Evaluating Real-World Robot Manipulation Policies in Simulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05941","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Evaluating real-world robot manipulation policies in simulation.arXiv preprint arXiv:2405.05941, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2405.05941","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:b5e2cbef53d5662eda2434c1639451a97e73dab392840a3b8c972f79107a3f03","observation_id":"e70c3f2a-ed7f-4a06-a8dd-597881a17740","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"LIBERO: Benchmarking knowledge transfer for lifelong robot learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:bac69e43fa9fdd9bf4c730f47bf4916dcd49b48b1a62cee8c1e90d7fbb8aba55","observation_id":"b38cb613-f45a-4c08-8c5c-fb2eff82aa50","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Locating and editing factual associations in GPT","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:f68b0bb12babfd23cd16441b1ae78df53da95bb928d4447241248559c608f0d2","observation_id":"7ff6cd45-5daa-44fe-bef4-f13d6f799625","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:3bf917b07e436ee1cb0a0be65808299afc47eb8d01c5d44eb061abc1f228a36f","observation_id":"a95bd8ca-1644-47ae-b4e9-7251613909c4","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Octo: An open-source generalist robot policy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:1fe2aed1565e4b5698327527b9a8d17fc25ae2c4e91afe3359766fd9ed3267aa","observation_id":"1161eb19-9758-45ca-bb9c-e2fdf05989d6","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08864","last_updated":"2025-05-14T15:22:36Z","snapshot_observed_at":"2026-08-11T05:34:32.208314Z","submitted_at":"2023-10-13T05:20:40Z","title":"Open X-Embodiment: Robotic Learning Datasets and RT-X Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08864","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Open x-embodiment: Robotic learning datasets and RT-X models.arXiv preprint arXiv:2310.08864, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2310.08864","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:02925134d3c00036a2d9d5b55f48f705c65959e78a357dda719d14644c393a01","observation_id":"82981cad-1248-498e-98bf-9f6dda4397b9","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"The linear representation hypothesis and the ge- ometry of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:67a44dd49af27ac083212d41a910c9a3de5d620b419ebac9ac95b0aad9620b6a","observation_id":"39b3d45a-953f-4912-a8dc-50cc00c2a637","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"FAST: Efficient action tokenization for vision- language-action models.arXiv preprint arXiv:2501.09747, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:417e36846bec0473c27a26848118d91ed55211e645eca877b182c5f83c7eb201","observation_id":"cfc4979f-bb4b-4987-8baa-9511a6dbf8fb","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"InConference on Robot Learning (CoRL), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:a1ea44b66f5f1d2f94e6b8b9b269a9a157961eeed15b59a1f7e929cb11162013","observation_id":"763ab3d3-e1ef-4b96-8e98-b6bc6c5a51a3","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19236","last_updated":"2026-01-30T13:36:22Z","snapshot_observed_at":"2026-07-06T22:19:00.152099Z","submitted_at":"2025-08-26T17:57:16Z","title":"MemoryVLA: Perceptual-Cognitive Memory in Vision-Language-Action Models for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.19236","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"MemoryVLA: Perceptual-cognitive memory in vision- language-action models for robotic manipulation.arXiv preprint arXiv:2508.19236, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2508.19236","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:8ce9db5ead245df23f224f365725adcf43f2d03db0f8420acf00a2fd6e3ab2f5","observation_id":"7780d197-e086-4bfe-9614-5701aa24e704","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01844","last_updated":"2025-06-02T16:30:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-02T16:30:19Z","title":"SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01844","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"SmolVLA: A vision-language-action model for affordable and efficient robotics.arXiv preprint arXiv:2506.01844, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2506.01844","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:65c4f27c1d2c11be123fecc540030580148f2d671f5925b5295531a2d80536cb","observation_id":"d8d6acd6-6c94-4391-aaf5-603059a2f93d","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"MemER: Scaling up memory for robot control via experience retrieval.arXiv preprint, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:dbf28d9773ca5e629963a6e3688c1356a71cf5b5fca8362b93fa1e986a9bc2b2","observation_id":"72b42d14-8d78-4ab9-89ac-0145b601db82","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Scaling monosemanticity: Extracting interpretable features from Claude 3 Sonnet.Trans- former Circuits Thread, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:305fde47d08645ea8a43858b09af93eb9a413a319d67fc23b26503754f6914ef","observation_id":"fcd522c4-28f8-480c-bc4c-b0aa9ed49f8d","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09561","last_updated":"2025-05-19T20:37:41Z","snapshot_observed_at":"2026-08-07T15:45:22.154426Z","submitted_at":"2025-05-14T17:00:47Z","title":"Learning Long-Context Diffusion Policies via Past-Token Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09561","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Learning long-context diffusion policies via past-token prediction.arXiv preprint arXiv:2505.09561, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2505.09561","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:31e605dca5079109a13b48eaf5a746b883f391589a0b000b67b49cb8d7353342","observation_id":"223e1e18-e6d6-45b8-b874-0beaf0336abf","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Vazquez, Ulisse Mini, and Monte MacDiarmid","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:4cec0e0a698352d748a0fbdd77823c6a9c2f1d0a2cc7f970dabc920bbab5db90","observation_id":"48c75b25-93ea-4ca5-8b36-e39e3abda9ec","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Investigating gender bias in language models using causal mediation anal- ysis","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:f7f73c3b72dd5c836629fd1f694fd76d287741747b0da2c6471d6aacba3a149c","observation_id":"6cc46662-2741-4550-9f70-74c03e8f6539","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"BridgeData V2: A dataset for robot learning at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:9b08d12d27f8deca2a5da48df15f115140c96954a14bb91056ed7f84781bc86d","observation_id":"a9b434ca-6656-4625-95d3-ac953335c43e","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Interpretability in the wild: A circuit for indirect object identification in GPT-2 small","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:c5d4e7e2131f1af8631ffcc5a189c8db91b035fa667cecbff8eaeca9af75be4d","observation_id":"246f1a23-60ad-4d5a-994f-c8c3537eb232","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"4D-VLA: Spatiotemporal vision-language- action pretraining with cross-scene calibration","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:074948ee3f6c75ed3f130d5bb45815a0ae4aed492b93b9809208cc61c2ed3ca4","observation_id":"503a9362-c686-49e4-8f45-84e9684d7d4e","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"Zhao, Vikash Kumar, Sergey Levine, and Chelsea Finn","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:31132f81568f33365ab847a1cdee0ffca5963d40e4c60d42fe48feb815a8b206","observation_id":"0f0c0cb9-439f-4e47-b57c-4a617d4b8be9","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09631","last_updated":"2024-03-14T17:58:41Z","snapshot_observed_at":"2026-08-05T20:54:58.855446Z","submitted_at":"2024-03-14T17:58:41Z","title":"3D-VLA: A 3D Vision-Language-Action Generative World Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09631","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"3D-VLA: A 3d vision-language-action generative world model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2403.09631","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:ccf46ae537ce687dcd174d738d4212b0f32118fccdd789c0c6851340eb690ca0","observation_id":"a1e84ef1-3817-41c1-aad4-4caa6576cb09","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.10274","last_updated":"2025-10-11T16:20:17Z","snapshot_observed_at":"2026-07-06T22:32:22.953630Z","submitted_at":"2025-10-11T16:20:17Z","title":"X-VLA: Soft-Prompted Transformer as Scalable Cross-Embodiment Vision-Language-Action Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.10274","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"X-VLA: Soft-prompted transformer as scalable cross-embodiment vision- language-action model.arXiv preprint arXiv:2510.10274, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2510.10274","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:d3be75768760fe2800efc7fabe3f79ebd0da022fd8ceff35b5717380cc2b9ab2","observation_id":"787c24e2-9682-4bc2-9e39-cb8bfad4b28d","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10345","last_updated":"2025-06-05T21:26:08Z","snapshot_observed_at":"2026-08-02T17:44:41.340688Z","submitted_at":"2024-12-13T18:40:51Z","title":"TraceVLA: Visual Trace Prompting Enhances Spatial-Temporal Awareness for Generalist Robotic Policies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10345","snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":"TraceVLA: Visual trace prompting enhances spatial-temporal awareness for generalist robotic policies.arXiv preprint arXiv:2412.10345, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"cited_paper":"/paper/2412.10345","citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:6fb3b10c050179929a794e0c887079ebca6a7d7d53da78f6a6a815df9dab3d3b","observation_id":"b93f35fe-a723-45c4-9a45-e5fc3e9d4d89","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:e140d4e9c715ce4f9bd0928fb7bbf96a18ffe91b4e31b8dbd4dae9a737ef727f","observation_id":"8a176505-ba6d-4477-83d5-873aaa651702","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T02:57:44.784072Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-12T02:57:44.784072Z"},"links":{"citing_paper":"/paper/2607.03372"},"observation_digest":"sha256:93dba8c18c4f344331d1752cf5706279c6b03069cfb4e33190489ad122e4e9a5","observation_id":"3d792434-ad2e-4b0f-860b-510f9ba2f165","resolution":{"observed_at":"2026-07-12T02:57:44.784072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.03372","last_updated":"2026-07-03T14:27:00Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T22:41:50.373499Z","submitted_at":"2026-07-03T14:27:00Z","title":"Present but Not Remembered: Auditing How Frozen VLAs Encode, Deploy, and Steer Visual History"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2607.03372."}