{"as_of":"2026-08-09T14:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9d4f6430812913520e45ee765d832b20fdad52f5603188d0c5d6c43c7440d1d4","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T18:49:51.241885Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:14:56.837802Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T03:29:29.909900Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"cited_work":{"arxiv_id":"2603.04910","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.04910","snapshot_observed_at":"2026-07-24T02:23:00.172127Z","title":"Vpwem: Non-markovian visuomotor policy with working and episodic memory.arXiv preprint arXiv:2603.04910, 2026","venue":null,"work_id":"c443bba2-0e56-4abb-8930-f454b481cd3e","year":2026},"citing_paper":{"arxiv_id":"2606.12497","last_updated":"2026-06-10T13:26:40Z","snapshot_observed_at":"2026-08-05T05:15:21.338433Z","submitted_at":"2026-06-10T13:26:40Z","title":"$\\mu$VLA: On Recurrent Memory for Partially Observable Manipulation in VLA Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T10:50:55.866910Z"},"links":{"cited_paper":"/paper/2603.04910","citing_paper":"/paper/2606.12497"},"observation_digest":"sha256:922b2fff685fc7effb5c83b4381f6ea5a81ec5fbc057d9c144a77f0f34a4e087","observation_id":"ea8ce27f-0152-4b01-82ce-b78e960f831b","resolution":{"observed_at":"2026-07-24T02:23:00.172127Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"cited_work":{"arxiv_id":"2603.04910","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.04910","snapshot_observed_at":"2026-07-24T02:23:00.172127Z","title":"Vpwem: Non-markovian visuomotor policy with working and episodic memory.arXiv preprint arXiv:2603.04910, 2026","venue":null,"work_id":"c443bba2-0e56-4abb-8930-f454b481cd3e","year":2026},"citing_paper":{"arxiv_id":"2606.20092","last_updated":"2026-06-29T12:49:53Z","snapshot_observed_at":"2026-08-03T01:42:23.549465Z","submitted_at":"2026-06-18T11:11:37Z","title":"EventVLA: Event-Driven Visual Evidence Memory for Long-Horizon Vision-Language-Action Policies","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T18:02:47.479255Z"},"links":{"cited_paper":"/paper/2603.04910","citing_paper":"/paper/2606.20092"},"observation_digest":"sha256:e62a34dc5777f24a523f86fa3c41ae8cdb226234f395d18a32e29167ef8fb5e8","observation_id":"451c8041-cb5a-403b-9d53-0d72f4863f2c","resolution":{"observed_at":"2026-07-24T02:23:00.172127Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"cited_work":{"arxiv_id":"2603.04910","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.04910","snapshot_observed_at":"2026-07-24T02:23:00.172127Z","title":"Vpwem: Non-markovian visuomotor policy with working and episodic memory.arXiv preprint arXiv:2603.04910, 2026","venue":null,"work_id":"c443bba2-0e56-4abb-8930-f454b481cd3e","year":2026},"citing_paper":{"arxiv_id":"2606.20092","last_updated":"2026-06-29T12:49:53Z","snapshot_observed_at":"2026-08-03T01:42:23.549465Z","submitted_at":"2026-06-18T11:11:37Z","title":"EventVLA: Event-Driven Visual Evidence Memory for Long-Horizon Vision-Language-Action Policies","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T10:48:57.031494Z"},"links":{"cited_paper":"/paper/2603.04910","citing_paper":"/paper/2606.20092"},"observation_digest":"sha256:15baf08de278295e53b42cd5f07b866e214aa0e442a2474b2a5fe365d4fcca04","observation_id":"c227aa2d-21fe-4ebf-b6c4-4a7cde5b4513","resolution":{"observed_at":"2026-07-24T02:23:00.172127Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.04910","snapshot_observed_at":"2026-08-01T15:44:12.793735Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.18231","last_updated":"2026-07-20T17:58:31Z","snapshot_observed_at":"2026-08-09T01:32:12.598177Z","submitted_at":"2026-07-20T17:58:31Z","title":"FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T15:44:12.793735Z"},"links":{"cited_paper":"/paper/2603.04910","citing_paper":"/paper/2607.18231"},"observation_digest":"sha256:81b8deb6fe6ca692d05fe72720b051c8724dde80db4cf3b066e74db8974efd60","observation_id":"23dc111f-4928-4937-8559-dfddb2a5807e","resolution":{"observed_at":"2026-08-01T15:44:12.793735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.04910","snapshot_observed_at":"2026-08-04T09:19:22.079197Z","title":"2603.04910 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02326","last_updated":"2026-08-04T14:52:13Z","snapshot_observed_at":"2026-08-07T23:11:50.540353Z","submitted_at":"2026-08-03T14:48:20Z","title":"ChainVLA: Chaining Vision-Language-Action Queries through a Unified Execution State for Long-Horizon Manipulation","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-04T09:19:22.079197Z"},"links":{"cited_paper":"/paper/2603.04910","citing_paper":"/paper/2608.02326"},"observation_digest":"sha256:58099cfabe2383af8c9392fc48804e6d46a64d859428e2e32dd6c8f3c55e63d4","observation_id":"7d6a5c19-3495-4612-9617-e7c1cb2d1796","resolution":{"observed_at":"2026-08-04T09:19:22.079197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.04910","snapshot_observed_at":"2026-08-07T00:14:56.837802Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02326","last_updated":"2026-08-04T14:52:13Z","snapshot_observed_at":"2026-08-07T23:11:50.540353Z","submitted_at":"2026-08-03T14:48:20Z","title":"ChainVLA: Chaining Vision-Language-Action Queries through a Unified Execution State for Long-Horizon Manipulation","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T00:14:56.837802Z"},"links":{"cited_paper":"/paper/2603.04910","citing_paper":"/paper/2608.02326"},"observation_digest":"sha256:29c6a84ae82f8c1aacf56c78537b05dadd914cc093602dd79b21c744bdef0c4f","observation_id":"41f8740e-7a7d-49f8-b8cb-72af49ecbd74","resolution":{"observed_at":"2026-08-07T00:14:56.837802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2603.04910/citation-record","integrity":"/paper/2603.04910/integrity","json":"/paper/2603.04910/citation-record.json","paper":"/paper/2603.04910"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.088113Z","title":"Recent advances in robot learning from demonstration,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.088113Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:0a904d3ebbcb7386c0102977ad96bc646a63d9ddfbf4c41a1ae3c3990fffc51f","observation_id":"b2f15702-b65e-4690-aff8-cde086d56303","resolution":{"observed_at":"2026-08-02T18:49:51.088113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.091778Z","title":"A review of robot learning for manipulation: Challenges, representations, and algorithms,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.091778Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:958786fe525b8d0f9d20c062548a0e512111fb7aa403a22a42b61f847bd29e7a","observation_id":"74b09a07-6bca-485a-9e77-c8882f45ea92","resolution":{"observed_at":"2026-08-02T18:49:51.091778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.094744Z","title":"R3M: A universal visual representation for robot manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.094744Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:a642e3a000a9b7463aeb7126d696dd9d26db529dc1c19d715adfe8f2c16e65dc","observation_id":"efcfdf60-2f9e-4b11-8347-91d20e9b7214","resolution":{"observed_at":"2026-08-02T18:49:51.094744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.097683Z","title":"Real-world robot learning with masked visual pre-training,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.097683Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:5d95ef0c3727c9c60189b1efe17922eb687111c6bdeb74a649bdc2af2beca56f","observation_id":"c84f7bd2-7b46-4e90-8071-667adf24e33d","resolution":{"observed_at":"2026-08-02T18:49:51.097683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.100385Z","title":"RT-2: Vision-language-action models transfer web knowledge to robotic control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.100385Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:70ca1f0e4351d33c7d0010e8e8cd148c8093b4413b6ce728c718b5706ac38ddc","observation_id":"d463ecad-a57c-419a-99cd-39fe5fa44e55","resolution":{"observed_at":"2026-08-02T18:49:51.100385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05996","last_updated":"2024-07-08T14:46:44Z","snapshot_observed_at":"2026-07-06T18:43:05.700263Z","submitted_at":"2024-07-08T14:46:44Z","title":"Multimodal Diffusion Transformer: Learning Versatile Behavior from Multimodal Goals","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05996","snapshot_observed_at":"2026-08-02T18:49:51.103217Z","title":"Multimodal diffusion transformer: Learning versatile behavior from multimodal goals,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.103217Z"},"links":{"cited_paper":"/paper/2407.05996","citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:d6a0b9166f7e373c0869bcc1675f9421bad711098cbcb262082cccb28f411a9c","observation_id":"3bbb0ec4-6d9c-496f-9a46-98a8775494e1","resolution":{"observed_at":"2026-08-02T18:49:51.103217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.106619Z","title":"Openvla: An open-source vision-language-action model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.106619Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:2cf01055f848084666f7df2108361caf36f466c6f3055c67623e4652eb3db749","observation_id":"8767baf7-fab9-40d3-abdd-040a0ed05c3d","resolution":{"observed_at":"2026-08-02T18:49:51.106619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.109263Z","title":"π 0: A vision-language- action flow model for general robot control,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.109263Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:9a3ebdc16997c8e6464e6d1aa1224c62d66b5dca83ae986b02e0dc5b5dc462f8","observation_id":"0933fd6e-5373-42a7-bc3e-dd97224fed98","resolution":{"observed_at":"2026-08-02T18:49:51.109263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.111735Z","title":"Octo: An open-source generalist robot policy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.111735Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:9f5b594e0c91b55649035417e19a172339a3d5e28762bdc6d8eed41c91eb8c3e","observation_id":"bebd692e-5dd1-4255-8af8-f218d537de14","resolution":{"observed_at":"2026-08-02T18:49:51.111735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.114298Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.114298Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:b80cbfba700f944c9a730e167596bb5526deecb66b1df428d5483c6b6472da2c","observation_id":"a34300db-a0d1-43df-8963-0e7bee085ad0","resolution":{"observed_at":"2026-08-02T18:49:51.114298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.117114Z","title":"3d diffusion policy: Generalizable visuomotor policy learning via simple 3d representations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.117114Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:a3eb298ecdeaa7059e06c2b37e93dfb0e02908fc2aef5f424e64a148d8d02082","observation_id":"e32c469f-3057-4e98-8fb1-749405d5a192","resolution":{"observed_at":"2026-08-02T18:49:51.117114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.119646Z","title":"RDT-1B: a diffusion foundation model for bimanual manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.119646Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:ad3d714fdaf626d96f107a38f1512cd2f67ac578e893d5596d246544409cf1c1","observation_id":"f0cbd876-512b-4878-88ea-d7379b6b2a26","resolution":{"observed_at":"2026-08-02T18:49:51.119646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.122155Z","title":"RT- 1: Robotics transformer for real-world control at scale,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.122155Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:7de103ca87b7b713091cabe9f0ce910c6999e5a35873a71c9c4fe132213bbd31","observation_id":"b09c1f5a-85c2-45a9-8be0-23417fa10f60","resolution":{"observed_at":"2026-08-02T18:49:51.122155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.124909Z","title":"Otter: A vision-language-action model with text-aware visual feature extraction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.124909Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:8d4e9ac33daa00ae89f59af092dfb4f9c68eec7abb2b608e65e04d61d44f5ae6","observation_id":"b89e0b39-0545-46eb-8ca5-5034a1299193","resolution":{"observed_at":"2026-08-02T18:49:51.124909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.127639Z","title":"Bidirectional decoding: Improving action chunking via guided test- time sampling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.127639Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:995d16bb6f0c4bf0f724a05fa211a2fdaf3ba47f557d65ab4f96f2c915fa12e5","observation_id":"7721f815-ccd3-4f56-a5a3-049320d2ba35","resolution":{"observed_at":"2026-08-02T18:49:51.127639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.130117Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.130117Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:c56dc09ae07c8309989b56f40e90b7f1c173e767c810290f0f1218c15db74ab3","observation_id":"5783d68c-43cd-4055-9a00-ecc20c858753","resolution":{"observed_at":"2026-08-02T18:49:51.130117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12330","last_updated":"2025-02-19T08:57:34Z","snapshot_observed_at":"2026-08-09T02:43:37.914721Z","submitted_at":"2025-02-17T21:33:56Z","title":"X-IL: Exploring the Design Space of Imitation Learning Policies","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12330","snapshot_observed_at":"2026-08-02T18:49:51.132556Z","title":"X-il: Exploring the design space of imitation learning policies,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.132556Z"},"links":{"cited_paper":"/paper/2502.12330","citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:2cf9b70bb9a7a690edc29ec7e2434c8c0e00558458a58573542d3303618d44aa","observation_id":"4079481f-e827-433f-8b19-220fc1931661","resolution":{"observed_at":"2026-08-02T18:49:51.132556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.135400Z","title":"Transformers are rnns: Fast autoregressive transformers with linear attention,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.135400Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:20192c88b350418a8c897a748d74d0ba6095256ae434bc7f4664a0ec69bd72ca","observation_id":"1ceb2655-16fc-4f52-a688-276d071fad9f","resolution":{"observed_at":"2026-08-02T18:49:51.135400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.138108Z","title":"Mamba: Linear-time sequence modeling with selective state spaces,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.138108Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:acc989f030efebfa7fa678cfe746d222ee4892f7fc70df9fc8b9459103482073","observation_id":"58d61b3b-1949-4011-8ab5-aae73397000c","resolution":{"observed_at":"2026-08-02T18:49:51.138108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.140487Z","title":"Transformers are ssms: Generalized models and efficient algorithms through structured state space duality,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.140487Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:7dc8efc7b9abd36b63c9dbe65ef8d604d4047e28a7bffb2218a8f3aa4813bef5","observation_id":"3c42a8ba-c1a8-4fe3-b1fa-4be8d9468538","resolution":{"observed_at":"2026-08-02T18:49:51.140487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.143136Z","title":"Mail: Improving imitation learning with selective state space models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.143136Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:30b47c690f34533f5c8184d61be8fc7efe67a14b75f809d7108de1a99550403a","observation_id":"06e89e01-84e4-4bcd-bf0f-12818c196c22","resolution":{"observed_at":"2026-08-02T18:49:51.143136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.145769Z","title":"Causal confusion in imitation learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.145769Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:5a4774adb96f7ea4f0ce85e15ce00521c2fdce56b63712b7d1f1b897332e00a1","observation_id":"b4076952-cf39-49f6-8f0c-08c1cc933b68","resolution":{"observed_at":"2026-08-02T18:49:51.145769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.148185Z","title":"Fighting copycat agents in behavioral cloning from observation histories,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.148185Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:1bf86b161e07ee319b843b0ca4089ee008a8f35b86895cc5650c5f120d5c5306","observation_id":"d54c96a0-a231-4d94-ab80-bd2b08887409","resolution":{"observed_at":"2026-08-02T18:49:51.148185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.151118Z","title":"Fighting fire with fire: Avoiding dnn shortcuts through priming,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.151118Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:85cc068dafc0c8bf849a9f8fc0c825952c854d995642be9b34fb0b91adf6f716","observation_id":"8033003e-0941-4284-896e-e9c190d876af","resolution":{"observed_at":"2026-08-02T18:49:51.151118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.153897Z","title":"Regularized behavior cloning for blocking the leakage of past action information,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.153897Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:1c3a195af02664a6b7aaeaa1aa67afa3ee2a138af8bdb8322f7b30042ab0a37c","observation_id":"843684fa-fc16-4020-8a4c-db5963f1edb7","resolution":{"observed_at":"2026-08-02T18:49:51.153897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.156591Z","title":"Why there are complementary learning systems in the hippocampus and neocortex: insights from the successes and failures of connectionist models of learning and memory.,","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.156591Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:9ae942648fa947ef2c4f5c1a09bcb38afe1f2d3fcd5950d40fd2cd6db15d7bf9","observation_id":"ca209a92-4a6d-420c-add2-fdde7e62d4de","resolution":{"observed_at":"2026-08-02T18:49:51.156591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.159443Z","title":"Adapting language models to compress contexts,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.159443Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:3681dcde924ab0d65c6cf5224bc25e95ba41936ff9dd31e05c9c697040f70850","observation_id":"3d184e0b-da28-4228-a012-e3502b241ebe","resolution":{"observed_at":"2026-08-02T18:49:51.159443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.162123Z","title":"Artificial hippocampus networks for efficient long-context modeling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.162123Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:07127a344bbee4eb6e54a7f8d0aa3ad7abc6d98e32e65a416c0aa3022b4b7638","observation_id":"d910d33c-93bc-48c9-8ed1-c4415a6b39e4","resolution":{"observed_at":"2026-08-02T18:49:51.162123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02259","last_updated":"2026-07-29T12:55:39Z","snapshot_observed_at":"2026-08-06T20:31:23.587108Z","submitted_at":"2025-07-03T03:11:50Z","title":"MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02259","snapshot_observed_at":"2026-08-02T18:49:51.164996Z","title":"Memagent: Reshaping long- context llm with multi-conv rl-based memory agent,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.164996Z"},"links":{"cited_paper":"/paper/2507.02259","citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:4c272d49390ae4632645be2ea4a77c429b2a981c32726054c6de30c93c0f347f","observation_id":"f2b639fd-c456-4213-b15f-78d73e971541","resolution":{"observed_at":"2026-08-02T18:49:51.164996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.168125Z","title":"Ma-lmm: Memory-augmented large multimodal model for long-term video understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.168125Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:2670e1e5e0ce8cd463b1894768308dc43dc159698156a1ceb6cc254624fac9e1","observation_id":"565899d3-a0d2-43e9-b3c5-1917e7a4c136","resolution":{"observed_at":"2026-08-02T18:49:51.168125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.170805Z","title":"Memory consolidation enables long-context video understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.170805Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:5ae8c75eb0e4f9ec8ff5429b3e66a4953987c3dfd9e259402ac92cecb4116737","observation_id":"2a0bd7ec-2c2d-4a11-9f51-556b253f9c44","resolution":{"observed_at":"2026-08-02T18:49:51.170805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.173460Z","title":"Memory, benchmark & robots: A benchmark for solving complex tasks with reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.173460Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:834002ab44889e976449f8dcb29abc3c390a2426bae6abf48722e034978ba965","observation_id":"54c66b95-cb20-458a-bd86-ede72d3d4e01","resolution":{"observed_at":"2026-08-02T18:49:51.173460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.176321Z","title":"Error-aware imitation learning from teleoperation data for mobile manipulation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.176321Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:cd518c4774907f7511de70eb09334569a1cbeb89d90b11b2f43498fef16202fb","observation_id":"23ba3f84-0d25-4658-b753-0f648260dc06","resolution":{"observed_at":"2026-08-02T18:49:51.176321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.179009Z","title":"What matters in learning from offline human demonstrations for robot manipulation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.179009Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:373d9dab20a70a7e29ad1f6011e5a1ef58f897af215fbac8b5f198229bdfa1f9","observation_id":"062c96f7-ec07-45e6-9a1f-62c4710f3eee","resolution":{"observed_at":"2026-08-02T18:49:51.179009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12351","last_updated":"2024-02-23T19:22:58Z","snapshot_observed_at":"2026-07-06T16:50:22.657866Z","submitted_at":"2023-11-21T04:59:17Z","title":"Advancing Transformer Architecture in Long-Context Large Language Models: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12351","snapshot_observed_at":"2026-08-02T18:49:51.181734Z","title":"Advancing transformer architecture in long-context large language models: A comprehensive survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.181734Z"},"links":{"cited_paper":"/paper/2311.12351","citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:a769c3ed92ba346b1ed896acfed546ad49f9ee36d4838828ac03d95f8105ca59","observation_id":"54e750bc-68d9-4b7e-95a7-851a083deb45","resolution":{"observed_at":"2026-08-02T18:49:51.181734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.184303Z","title":"A comprehensive survey on long context language modeling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.184303Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:5b0cdf8346292a9c5d3edbcf13971fcce1376592b5e91741df7a337deee07d4e","observation_id":"93016d47-6262-40a6-b08b-b3530b3baf76","resolution":{"observed_at":"2026-08-02T18:49:51.184303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.186747Z","title":"Roformer: Enhanced transformer with rotary position embedding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.186747Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:b5a08816bec7c78c01912787c94bb4007822c4e343ed586f87856154a1b59728","observation_id":"0284f247-947a-4c19-aa90-cd9166692999","resolution":{"observed_at":"2026-08-02T18:49:51.186747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-02T18:49:51.189122Z","title":"Longformer: The long- document transformer,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.189122Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:cd6e2e3a001b3cb82ea9b8a522ecda73f1af5a8228b61e4e0dc221668e986565","observation_id":"686ced47-7f1b-4425-805e-7c2442052e4d","resolution":{"observed_at":"2026-08-02T18:49:51.189122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.02860","last_updated":"2019-06-02T21:21:48Z","snapshot_observed_at":"2026-07-06T07:25:48.468658Z","submitted_at":"2019-01-09T18:28:19Z","title":"Transformer-XL: Attentive Language Models Beyond a Fixed-Length Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.02860","snapshot_observed_at":"2026-08-02T18:49:51.192164Z","title":"Transformer-XL: Attentive language models beyond a fixed-length context,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.192164Z"},"links":{"cited_paper":"/paper/1901.02860","citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:39aa8158e1d20834511e57aa65f236b7300a520fb26cd589045dcf331d766409","observation_id":"198a60d0-7cd5-4c34-88b8-3e6ded163654","resolution":{"observed_at":"2026-08-02T18:49:51.192164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.195121Z","title":"Memorizing transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.195121Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:124f8e7164b65b307a577a9193480b79b80620833536511a35708345d1f11c81","observation_id":"207f2988-a71e-4bab-99b6-c9e09d513463","resolution":{"observed_at":"2026-08-02T18:49:51.195121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.197575Z","title":"Recurrent memory transformer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.197575Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:022c0e22e01af15274b9a86c00a006c76c043de50cdb1a18e53c29fbd974d175","observation_id":"8bd8d4f8-eb30-4588-ad5e-8ac8fc150882","resolution":{"observed_at":"2026-08-02T18:49:51.197575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.199924Z","title":"xlstm: Extended long short-term memory,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.199924Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:8c6b54c46822ee233ac7984f371bfe84cf878b93dc2453cfc5798d1ac0c9673a","observation_id":"1681ad95-65f1-4bf8-9db1-3b0210e9ad4c","resolution":{"observed_at":"2026-08-02T18:49:51.199924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.202886Z","title":"Packing input frame context in next-frame prediction models for video generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.202886Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:277900ba871d797a80a6804a91cae78b5d538fdb8a4c36aa1d123a7723890b8b","observation_id":"f4672969-2e02-44ab-949f-84ece835cb5e","resolution":{"observed_at":"2026-08-02T18:49:51.202886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.205392Z","title":"Mtil: Encoding full history with mamba for temporal imitation learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.205392Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:ae3fc17ac32ba55e6d15a9dacd201fa79cc4923f3157531753084ee5878cc859","observation_id":"0f0be8ca-12f4-4c10-988f-606f938966e6","resolution":{"observed_at":"2026-08-02T18:49:51.205392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15980","last_updated":"2024-09-27T20:10:08Z","snapshot_observed_at":"2026-07-06T19:07:16.252072Z","submitted_at":"2024-08-28T17:50:19Z","title":"In-Context Imitation Learning via Next-Token Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15980","snapshot_observed_at":"2026-08-02T18:49:51.207714Z","title":"In-context imitation learning via next-token prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.207714Z"},"links":{"cited_paper":"/paper/2408.15980","citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:b585a36619c2252e854a7e1168faaf108b92d6faa4f7e68fbec948caa6edfe46","observation_id":"dcbef881-3091-4760-91bf-9895badec32d","resolution":{"observed_at":"2026-08-02T18:49:51.207714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.210765Z","title":"Action tokenizer matters in in-context imitation learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.210765Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:2fc518e686589c5a159e9318a8edb2415e18f3d2098635905287c48ffd5f9a1b","observation_id":"9b080e72-00f1-463f-afb3-5f9d4126ea3b","resolution":{"observed_at":"2026-08-02T18:49:51.210765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.213397Z","title":"Learning long-context diffusion policies via past-token prediction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.213397Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:ea0f77653ec38b09e880f65cf8d7a8b7e2b63b2393c5528c1b58dd08b7a4e301","observation_id":"7c12f020-e8f7-4173-84bf-92fb0f1b5033","resolution":{"observed_at":"2026-08-02T18:49:51.213397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.215922Z","title":"Cronusvla: Transferring latent motion across time for multi-frame prediction in manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.215922Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:8431a024f0fd04c5980642b6cd9e7ef923c7c90864d7c0abd74bbb692276d709","observation_id":"86ba64ad-10c5-49d4-b9ef-4b721937bd26","resolution":{"observed_at":"2026-08-02T18:49:51.215922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.218388Z","title":"Contextvla: Vision-language-action model with amortized multi-frame context,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.218388Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:a2258627081018d9149270cab208e03460628234a309922fcea776bb1fc2e1f9","observation_id":"4eabee09-614e-484b-a4a7-1e6896f5f5bb","resolution":{"observed_at":"2026-08-02T18:49:51.218388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19236","last_updated":"2026-01-30T13:36:22Z","snapshot_observed_at":"2026-07-06T22:19:00.152099Z","submitted_at":"2025-08-26T17:57:16Z","title":"MemoryVLA: Perceptual-Cognitive Memory in Vision-Language-Action Models for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.19236","snapshot_observed_at":"2026-08-02T18:49:51.220850Z","title":"Memoryvla: Perceptual-cognitive memory in vision-language-action models for robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.220850Z"},"links":{"cited_paper":"/paper/2508.19236","citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:17f927b512e53db6ef1a0a9c26f073eb4853c1a89e12e6b25d2aa7c5f804c1a9","observation_id":"369d9604-7843-4033-926d-d74417a18d88","resolution":{"observed_at":"2026-08-02T18:49:51.220850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.223639Z","title":"Implicit behavioral cloning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.223639Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:e76f916f5babcd800c36177f6f1c666311ee4c243f33721fe069d204e6185cae","observation_id":"02457ef8-bae0-4a55-a960-b29ea9f463fd","resolution":{"observed_at":"2026-08-02T18:49:51.223639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.226365Z","title":"Cleandiffuser: An easy-to-use modularized library for diffusion models in decision making,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.226365Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:5d0c40e5c55229f3b8c1038b505b91fd04b4eafe638cca3bce64b979c814b2f9","observation_id":"5b5cbbae-678f-4d76-9cf8-bfcfb03c974d","resolution":{"observed_at":"2026-08-02T18:49:51.226365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.228891Z","title":"Language control diffusion: Efficiently scaling through space, time, and tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.228891Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:ef4b6041b35de549e7bc3d562a26687e6fd67049f246a1074acf14eee2828b21","observation_id":"c1c8bf91-16ca-4cb6-9521-5a887d7792c7","resolution":{"observed_at":"2026-08-02T18:49:51.228891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.231444Z","title":"Imitating human behaviour with diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.231444Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:79cc3003b0b56f42ea2c5904be2a7fdd90d083a087f0808d469d2b59d2756334","observation_id":"c10550e3-7ed9-4608-8700-e2c217dfda1d","resolution":{"observed_at":"2026-08-02T18:49:51.231444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.233917Z","title":"Flowpolicy: Enabling fast and robust 3d flow-based policy via consistency flow matching for robot manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.233917Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:fc940fd8e411c7022323ec843fefbed9150bc4e5db7fa1e030c10a85f312245c","observation_id":"24dec6c8-85ee-487a-803f-d79f9a98e2b9","resolution":{"observed_at":"2026-08-02T18:49:51.233917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20072","last_updated":"2026-05-31T15:50:43Z","snapshot_observed_at":"2026-08-05T15:11:00.360328Z","submitted_at":"2025-08-27T17:39:11Z","title":"Discrete Diffusion VLA: Bringing Discrete Diffusion to Action Decoding in Vision-Language-Action Policies","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.20072","snapshot_observed_at":"2026-08-02T18:49:51.236618Z","title":"Discrete diffusion vla: Bringing discrete diffusion to action decoding in vision-language- action policies,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.236618Z"},"links":{"cited_paper":"/paper/2508.20072","citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:6552b98af0075d3b9bbf9b41fe9d438197175941c644951ed5925f32a7a2cef0","observation_id":"c3c9fbe9-4f41-448f-9aca-588c7b772959","resolution":{"observed_at":"2026-08-02T18:49:51.236618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T18:49:51.239458Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.239458Z"},"links":{"citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:0ba910f8b6fe23ede2eae0c7006a8a78515de152ebd75ea43faa15b6e8dc47ef","observation_id":"998784f2-1f8b-4366-86c3-ab9c90d5b2df","resolution":{"observed_at":"2026-08-02T18:49:51.239458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-02T18:49:51.241885Z","title":"Spatialvla: Exploring spatial representations for visual-language-action model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-02T18:49:51.241885Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2603.04910"},"observation_digest":"sha256:0b510421046cfa93f8429ce3de7d21044bb17af0d518ccd78245d7af9c6ee9fe","observation_id":"d7c43434-b104-461b-8804-cc116dacf40d","resolution":{"observed_at":"2026-08-02T18:49:51.241885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.04910","last_updated":"2026-07-23T05:22:39Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-08T21:05:20.374758Z","submitted_at":"2026-03-05T07:52:50Z","title":"VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":58,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 6 inbound Pith citation observations for arXiv:2603.04910."}