{"as_of":"2026-08-10T02:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2b69a76613aa0422f893d5e8cdbb0f81069ee7ac46e099c66ba3047a428cb244","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:13:25.243758Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01456/citation-record","integrity":"/paper/2608.01456/integrity","json":"/paper/2608.01456/citation-record.json","paper":"/paper/2608.01456"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:31.253305Z","title":null,"venue":null,"work_id":"25ab4ad1-0491-4e7e-ad1c-6a81b3e4fb65","year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:18.452242Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:c504e5b18a59f29d4d872cd86c02bcb547e5750afd96e6063b57ad549e03b3b0","observation_id":"bc73b0fb-7c32-4c3f-b38c-187759f7c1a7","resolution":{"observed_at":"2026-08-06T00:13:31.341780Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:18.538136Z","title":"2021 , url =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:18.538136Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:1fb8b5bd67db006829ad9146a03b9b658a0775930fc9421394ed3428ecf2b7e9","observation_id":"6e805e04-e0be-425a-87e8-b46e44c166cd","resolution":{"observed_at":"2026-08-06T00:13:18.538136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:18.645867Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:18.645867Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:eed7cad4154c606a02299e35911ab462e1969e97f6a9736995315b85d62e865c","observation_id":"80d0d5fa-8573-4b6d-bb9d-76f1ab09fe37","resolution":{"observed_at":"2026-08-06T00:13:18.645867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:18.846578Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:18.846578Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:c45c7c2caf9b31deaa987fc9f4b566c1dbab6349c3da04aaf34fe450c4918152","observation_id":"41c34807-81d5-4b3c-9731-924c408cbc8b","resolution":{"observed_at":"2026-08-06T00:13:18.846578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:19.573745Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:19.573745Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:1167eb570d7d7a16577b7114b963650ca3893558008b76df5f7edac2c43ff16b","observation_id":"150b38fb-0e37-4d13-bf32-9d8529cf5564","resolution":{"observed_at":"2026-08-06T00:13:19.573745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:19.666122Z","title":"Conference on Robot Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:19.666122Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:4cc859061c0936469566cd769b88caddef2ff0a1325c53e5eb41553e726f3dfe","observation_id":"3a7f86fb-3824-429a-8299-3c2f8021c384","resolution":{"observed_at":"2026-08-06T00:13:19.666122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:31.036024Z","title":"Journal of health psychology , volume=","venue":null,"work_id":"3bca88df-90cc-4363-97f9-1a0796611599","year":2020},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:19.889981Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:5b2ed74bc3a9e4642777867348f38adf878d1ea2e4c76ea25abf3c23cdda696c","observation_id":"a442e3e7-284e-4bb7-bf63-a2778bea0ec9","resolution":{"observed_at":"2026-08-06T00:13:31.131296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:30.842482Z","title":"2024 , institution=","venue":null,"work_id":"81dd74e6-7198-4c09-8075-d098c2afd636","year":2024},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:20.062614Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:b96cd85a5f5f1b09738b2545eabe473b9edb7417a40dd3e31a095d4458defe46","observation_id":"33040ada-63ec-48ee-bda6-1aab5071a5ce","resolution":{"observed_at":"2026-08-06T00:13:30.945016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:30.705495Z","title":"2026 , institution=","venue":null,"work_id":"7ea91a25-2f2e-4a92-bc83-1db7b8e05a40","year":2026},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:20.163208Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:6677a62d5eded6936d4b46b20ef6ad5252c217cf40fd6beb4cca125f00d41eed","observation_id":"cf760974-b963-4cba-b66d-937c7008f725","resolution":{"observed_at":"2026-08-06T00:13:30.762832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-06T00:13:20.273436Z","title":"arXiv preprint arXiv:2507.06261 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:20.273436Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:0ef9385c0a6727dc622cbdff0dc68f88d60b1ebf5baea63c6355c4ce0628ca0d","observation_id":"643ba184-16c9-4252-80c5-efb6291998cb","resolution":{"observed_at":"2026-08-06T00:13:20.273436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-06T00:13:20.378471Z","title":"arXiv preprint arXiv:2511.21631 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:20.378471Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:26f22da13fb7b1135c7842e80d8702294d3ff0ed30df33809551735f2b4588c4","observation_id":"8e94e94b-9463-4a79-8ebb-8e2383890e98","resolution":{"observed_at":"2026-08-06T00:13:20.378471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:30.502956Z","title":"2025 , eprint=","venue":null,"work_id":"cef170fa-c78f-4c70-9bb7-7012a0f5018f","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:20.445967Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:6a3be956d245d69f6f978068482181f84276d0ae9d7bbd08b82338eb1baab3d6","observation_id":"9efc8d9c-4bdb-4ad1-8e80-35a90c51edaa","resolution":{"observed_at":"2026-08-06T00:13:30.603227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:30.300812Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"9490d61f-310d-496b-8378-7c3f8d352bce","year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:20.679191Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:9543863f27380246309c0c73a869ada54c463a7bedbf0d641c79e7db8412905c","observation_id":"7eccf257-c0aa-45d7-882b-ed3e496ead22","resolution":{"observed_at":"2026-08-06T00:13:30.377996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:30.011054Z","title":"2026 , eprint=","venue":null,"work_id":"35e27c92-8413-4cd7-a3a7-9d9effb465fe","year":2026},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:20.775680Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:e4716a89277ff0b9283690d98411222b4a991dcc68ea5f5692e1d06fe3e31a42","observation_id":"32b624aa-7b48-48b7-875f-2e252a36fe5a","resolution":{"observed_at":"2026-08-06T00:13:30.135091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:29.797150Z","title":null,"venue":null,"work_id":"bb2ff9b5-f5ba-4ebd-bd9c-c7c327561f25","year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.080516Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:4b60541db758966cec2cafa13d25b8a0995da251da3a38b3d1306ab93b20ffdd","observation_id":"07c3b2c1-0906-4356-bb6f-1f56af4b92f0","resolution":{"observed_at":"2026-08-06T00:13:29.916776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00081","last_updated":"2024-10-31T17:53:12Z","snapshot_observed_at":"2026-08-08T05:17:14.837884Z","submitted_at":"2024-10-31T17:53:12Z","title":"PARTNR: A Benchmark for Planning and Reasoning in Embodied Multi-agent Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00081","snapshot_observed_at":"2026-08-06T00:13:21.218440Z","title":"arXiv preprint arXiv:2411.00081 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.218440Z"},"links":{"cited_paper":"/paper/2411.00081","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:781d8428ddae6242dfddedce467c342a7712b2caf0e293165ce6b1819a97f7a5","observation_id":"d959edc4-cab0-491d-80f4-c34d7d274ea8","resolution":{"observed_at":"2026-08-06T00:13:21.218440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-industry.149","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:25.628662Z","title":"V esta B ench: An Embodied Benchmark for Safe Long-Horizon Planning Under Multi-Constraint and Adversarial Settings","venue":null,"work_id":"0bdd74e7-0365-45c3-9580-e0eb8054a461","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.333574Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:23ccb1687dedd130ffca204b01eb7c9a8c6cb035daf62aa9e3ff04bbbef36e75","observation_id":"5c4ca0b2-481f-4040-afaf-6bc1b87d196a","resolution":{"observed_at":"2026-08-06T00:13:25.698733Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:29.573972Z","title":"OpenEQA: Embodied Question Answering in the Era of Foundation Models , booktitle =","venue":null,"work_id":"14e40cfb-35d1-4a77-a0b3-3b7496f4471e","year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.488250Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:1b3bc98effb0a219a1e2764bc63797556331d1b36d724bc9c2910c23acb9268b","observation_id":"1b75831c-ff33-4a0a-b726-0cd781c3ed42","resolution":{"observed_at":"2026-08-06T00:13:29.679902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:29.409838Z","title":"2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) , pages=","venue":null,"work_id":"3f16ad80-ca0e-44e4-8da9-5c26eb302f7f","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.561128Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:4ab5084ffde4cbf736abdf15da7f81eed41c7fa33467d0ef035bc4657f505dfb","observation_id":"402f120a-9b27-4297-ac21-42f8c5ff6cb4","resolution":{"observed_at":"2026-08-06T00:13:29.478835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15941","last_updated":"2024-07-07T19:40:31Z","snapshot_observed_at":"2026-08-07T02:26:46.173562Z","submitted_at":"2024-03-23T22:04:03Z","title":"Explore until Confident: Efficient Exploration for Embodied Question Answering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15941","snapshot_observed_at":"2026-08-06T00:13:21.746846Z","title":"arXiv preprint arXiv:2403.15941 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.746846Z"},"links":{"cited_paper":"/paper/2403.15941","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:3153a60f697bb2625e79139940b8b06f2d3a7bd3a07b2d99c79b1c994614d0d4","observation_id":"3b4a2d98-186e-4600-815d-8c92d68759b1","resolution":{"observed_at":"2026-08-06T00:13:21.746846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:29.207013Z","title":"2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) , pages=","venue":null,"work_id":"bf3a9a5a-3a42-4ad2-a727-14b75a824c84","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.841686Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:863b3d2416de7437274e7de23d7ae3e5fb23d2bcb9583d3646ee63d8b7fb2b67","observation_id":"99fb8774-752b-4013-8c8a-fdd548f1e0d0","resolution":{"observed_at":"2026-08-06T00:13:29.330690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:29.020568Z","title":"2025 , doi =","venue":null,"work_id":"902a60c8-aeb4-46b4-9ba0-9c953913b805","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:21.946733Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:bc459f92d1f7e0942405d2e730b159d29989a4ef437b2e6124585ea74fa0e64d","observation_id":"61829477-2777-48a2-b568-f05490f4eb56","resolution":{"observed_at":"2026-08-06T00:13:29.067164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:28.851347Z","title":"2025 IEEE International Conference on Robotics and Automation (ICRA) , pages=","venue":null,"work_id":"357d31b3-d139-4a17-bbc3-05e7cd39113b","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.032708Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:776e35331f22e4c5fef61af5f156b4e06b1e49a30ed38826bbe0b1e63bedac5c","observation_id":"49066960-a1fe-4089-95f0-48b47b2f7f27","resolution":{"observed_at":"2026-08-06T00:13:28.934290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:28.687289Z","title":"2025 , publisher =","venue":null,"work_id":"d700078a-9094-4653-b2e0-735a709ad9b0","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.130618Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:ca29f36459f26a5630ecc65b18eaaa97665ea7671b5e46dbdab170383d41d7c7","observation_id":"bf2bc5be-1f40-454b-a7f7-694318c5d56e","resolution":{"observed_at":"2026-08-06T00:13:28.758937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:28.511047Z","title":"Proceedings of The 9th Conference on Robot Learning , series =","venue":null,"work_id":"8f47c76b-6468-49e3-ba68-d1b31ea205f4","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.231874Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:57e1a19764ac04a768c9cbf96d15e4636fb7243e7ff7ba964bedd60bdb063972","observation_id":"05965000-a873-499b-b701-42a74195460f","resolution":{"observed_at":"2026-08-06T00:13:28.593654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15513","last_updated":"2026-03-02T14:17:33Z","snapshot_observed_at":"2026-08-07T20:44:49.748480Z","submitted_at":"2026-02-17T11:41:28Z","title":"HIMM: Human-Inspired Long-Term Memory Modeling for Embodied Exploration and Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15513","snapshot_observed_at":"2026-08-06T00:13:22.296384Z","title":"arXiv preprint arXiv:2602.15513 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.296384Z"},"links":{"cited_paper":"/paper/2602.15513","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:d779a6eb2c5fe106102f1add16f8ff5ee30d899eff966d9d64b182c5fc2884a5","observation_id":"1c9ce600-e7f7-4756-9b70-ec0228b71927","resolution":{"observed_at":"2026-08-06T00:13:22.296384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:28.232746Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"b2432354-bf95-45ec-b5a4-34b2692b4aa7","year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.377457Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:95e3a05641d9c0546800104360267aa5f110312e0107201ee3db871b2abe0fd8","observation_id":"62856a61-dd79-4eb9-845e-5405bf44e3e1","resolution":{"observed_at":"2026-08-06T00:13:28.389224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:27.965177Z","title":"Findings of the Association for Computational Linguistics: NAACL 2025 , pages=","venue":null,"work_id":"a511507d-6f53-4712-ada7-fd191d84ea40","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.460711Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:451a4dd92097811923c95f1dd7dc62de3db3dc1738a3670642fa2764a809f877","observation_id":"d12d9d77-dbe8-4ed8-95b3-05877306eb15","resolution":{"observed_at":"2026-08-06T00:13:28.098668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:27.712275Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"5438b2d2-4235-4ac8-ab86-1e9eeea622a8","year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.544559Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:5ae9c2723d7ac25130199cd68374f4dd254369224dcca591e3c7fe449241b35c","observation_id":"ee6a31fc-2a43-45cd-be31-3889ae58e3dc","resolution":{"observed_at":"2026-08-06T00:13:27.840852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00574","last_updated":"2025-07-13T16:21:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-31T18:01:23Z","title":"VideoChat-Flash: Hierarchical Compression for Long-Context Video Modeling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00574","snapshot_observed_at":"2026-08-06T00:13:22.601162Z","title":"arXiv preprint arXiv:2501.00574 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.601162Z"},"links":{"cited_paper":"/paper/2501.00574","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:a5a3039267346ba3613401d5226b10fba50c5fc8c94246798b9cdab5d0093971","observation_id":"d3b7f910-a70e-4475-b4e6-7f994cd1d712","resolution":{"observed_at":"2026-08-06T00:13:22.601162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:27.490463Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"bedb3e37-2fde-4276-a351-a33ff46ae6b2","year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.696464Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:6f0d62adcbf071c5398b291cf648016ef1a0d9f5cf4ebf862d440f3dfb9a3cde","observation_id":"0447e351-738a-4d8c-9c5d-7491b668f57d","resolution":{"observed_at":"2026-08-06T00:13:27.589532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:22.851924Z","title":"arXiv preprint arXiv:2603.15167 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.851924Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:d565ac3516b4d02d62b1f6c6b7b030898a45865f6f6d1e3cbdd15f86b2eea91a","observation_id":"ec85da70-42d2-491d-b538-e7844e9f1230","resolution":{"observed_at":"2026-08-06T00:13:22.851924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:22.946013Z","title":"arXiv preprint arXiv:2603.02096 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:22.946013Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:0d6d72fda8783dc2df0d1cdd5833c54838122e945a8cc35f42ce476e4c2199d6","observation_id":"c99dfeaa-cb13-418e-a6e4-a6928342e45d","resolution":{"observed_at":"2026-08-06T00:13:22.946013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.09000","last_updated":"2026-04-23T08:05:34Z","snapshot_observed_at":"2026-07-06T22:57:59.555972Z","submitted_at":"2026-04-10T06:11:34Z","title":"StreamMeCo: Long-Term Agent Memory Compression for Efficient Streaming Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.09000","snapshot_observed_at":"2026-08-06T00:13:23.002550Z","title":"arXiv preprint arXiv:2604.09000 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.002550Z"},"links":{"cited_paper":"/paper/2604.09000","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:99567ce74b2438b4e98a8fde5c1fb63f3c11fe0a830dd676ee9617cc6ae3a64e","observation_id":"e1816bda-7b24-4391-b538-14c7102fc73d","resolution":{"observed_at":"2026-08-06T00:13:23.002550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.08272","last_updated":"2019-12-19T15:44:33Z","snapshot_observed_at":"2026-08-08T23:50:48.318949Z","submitted_at":"2018-10-18T20:48:08Z","title":"BabyAI: A Platform to Study the Sample Efficiency of Grounded Language Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.08272","snapshot_observed_at":"2026-08-06T00:13:23.118998Z","title":"Babyai: A platform to study the sample efficiency of grounded language learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.118998Z"},"links":{"cited_paper":"/paper/1810.08272","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:cae5ec1a35f46900a08462f2a1675c7425c6ae93e4c0e50823809ea6add1150f","observation_id":"b631ade4-3698-4af9-bf15-705a5dac37a6","resolution":{"observed_at":"2026-08-06T00:13:23.118998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:27.267236Z","title":"ProcTHOR : Large-scale embodied ai using procedural generation","venue":null,"work_id":"b3312772-24fb-4a62-b788-499bd65c66a9","year":2022},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.197524Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:8820b14f7df68f47c02ccdcb84ac49780b48165bdc887ba9d3f9115618254071","observation_id":"74b43f40-ed34-4a61-9d7e-4d8cc95ffcf2","resolution":{"observed_at":"2026-08-06T00:13:27.362569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15677","last_updated":"2025-07-29T22:40:49Z","snapshot_observed_at":"2026-08-06T23:49:24.463717Z","submitted_at":"2025-06-18T17:58:17Z","title":"Embodied Web Agents: Bridging Physical-Digital Realms for Integrated Agent Intelligence","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15677","snapshot_observed_at":"2026-08-06T00:13:23.324201Z","title":"Embodied web agents: Bridging physical-digital realms for integrated agent intelligence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.324201Z"},"links":{"cited_paper":"/paper/2506.15677","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:090dc1e68ecbf8174bfd9b281979fcdc306fe32697b0856b0448f6a01a80949d","observation_id":"5b6f1b39-6f58-496d-aa72-f697fe8a2caf","resolution":{"observed_at":"2026-08-06T00:13:23.324201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:23.441619Z","title":"3dllm-mem: Long-term spatial-temporal memory for embodied 3d large language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.441619Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:8bd3f2e95d4fc837855bd8efbffe608ccef2bbafc3097c09faee93b71477cf03","observation_id":"8aab4ed6-37b2-48cd-92a8-d705f6df5495","resolution":{"observed_at":"2026-08-06T00:13:23.441619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.24731","last_updated":"2026-06-23T06:21:28Z","snapshot_observed_at":"2026-08-08T01:51:47.048928Z","submitted_at":"2025-12-31T08:58:30Z","title":"EchoFoley: Event-Centric Hierarchical Control for Video Grounded Creative Sound Generation","version":2},"cited_work":{"arxiv_id":"2512.24731","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.24731","snapshot_observed_at":"2026-08-06T00:13:26.072965Z","title":"EchoFoley: Event-Centric Hierarchical Control for Video Grounded Creative Sound Generation","venue":"cs.CV","work_id":"d36e054f-e577-4cae-b5bc-593efb8b9aae","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.533166Z"},"links":{"cited_paper":"/paper/2512.24731","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:54236ed0945e2f15ddc7c5a8049f02d2f4d0646789440c76d41741db5ea19a84","observation_id":"f6e12665-6840-4bd2-8ba0-721e322fb5fc","resolution":{"observed_at":"2026-08-06T00:13:26.146920Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:27.054743Z","title":"Metal: A multi-agent framework for chart generation with test-time scaling","venue":null,"work_id":"dc793448-14d9-4d86-b5f9-1bbd9043cf16","year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.711213Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:e5f847db6477750eaab4826953d14126ca272ab3448236f21dbf70f811d16d48","observation_id":"ee392cd4-c2dd-4ab9-93e0-80b48178e350","resolution":{"observed_at":"2026-08-06T00:13:27.157260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11957","last_updated":"2026-06-23T06:39:00Z","snapshot_observed_at":"2026-08-03T10:02:14.175452Z","submitted_at":"2026-01-17T08:19:18Z","title":"PEARL: Self-Evolving Assistant for Time Management with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.11957","snapshot_observed_at":"2026-08-06T00:13:23.867852Z","title":"Pearl: Self-evolving assistant for time management with reinforcement learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.867852Z"},"links":{"cited_paper":"/paper/2601.11957","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:059cddb2aed936535a91a0716d7b6882ec8f6767b3200dcf89e75eb0066ee32e","observation_id":"d54e4d95-a460-4eb1-ab9d-6ec24b042be2","resolution":{"observed_at":"2026-08-06T00:13:23.867852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:26.887000Z","title":"Embodied agent interface: Benchmarking llms for embodied decision making","venue":null,"work_id":"91c5de69-1d73-4391-81a9-df2f57ff783b","year":2024},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:23.970631Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:9cd98fb5830d54d0520858882daeaee02ad5e86b0b689775fad534b8930cffa5","observation_id":"0f72dbda-f872-4b22-abb6-10fc59762c25","resolution":{"observed_at":"2026-08-06T00:13:26.967422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:24.070707Z","title":"Osexpert: Computer-use agents learning professional skills via exploration, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:24.070707Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:68440328b363733d536c3a3d5091947869710927511cddbfd16c37fcbe7fe196","observation_id":"ea32b4bb-07f7-4716-b7fd-e69bd7445df6","resolution":{"observed_at":"2026-08-06T00:13:24.070707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:26.699519Z","title":"Decision fatigue: A conceptual analysis","venue":null,"work_id":"957185d4-d2c1-4468-9ef3-bfc492e9898b","year":2020},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:24.148213Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:2663462bbc91a1181faef33ea3b4a2b4ab5f1de528943c752211a339d6c34268","observation_id":"e1280388-4d51-4f67-8983-127ff83a669a","resolution":{"observed_at":"2026-08-06T00:13:26.756272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22034","last_updated":"2025-07-29T17:34:12Z","snapshot_observed_at":"2026-08-07T20:29:47.386254Z","submitted_at":"2025-07-29T17:34:12Z","title":"UserBench: An Interactive Gym Environment for User-Centric Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.22034","snapshot_observed_at":"2026-08-06T00:13:24.345125Z","title":"Userbench: An interactive gym environment for user-centric agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:24.345125Z"},"links":{"cited_paper":"/paper/2507.22034","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:401ee9c94f97249608a1a83c09192fa32dc8d7b3d5f35a3c3d655e645c8acc33","observation_id":"c969f1aa-d0aa-4e6a-be7a-1d872897054f","resolution":{"observed_at":"2026-08-06T00:13:24.345125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:13:26.398599Z","title":"Alfred: A benchmark for interpreting grounded instructions for everyday tasks","venue":null,"work_id":"2d166589-fafd-4d14-8468-94e7e72fea2c","year":2020},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:24.449820Z"},"links":{"citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:b808a03a1fa6908d5c80b1716a42f8ed9e38c5814b8dd88296c32fa095fae8ae","observation_id":"272180e6-a89b-44d4-8ca5-514bd879bda5","resolution":{"observed_at":"2026-08-06T00:13:26.523498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03768","last_updated":"2021-03-14T22:44:38Z","snapshot_observed_at":"2026-08-08T17:40:47.037804Z","submitted_at":"2020-10-08T05:13:36Z","title":"ALFWorld: Aligning Text and Embodied Environments for Interactive Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03768","snapshot_observed_at":"2026-08-06T00:13:24.530451Z","title":"ALFWorld: Aligning Text and Embodied Environments for Interactive Learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:24.530451Z"},"links":{"cited_paper":"/paper/2010.03768","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:b33bd532af315231d0f031645b1aa3b8429f59788b9579588fa9fe642e574abf","observation_id":"5065bf6e-b338-4b3f-ab46-be5640614074","resolution":{"observed_at":"2026-08-06T00:13:24.530451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09560","last_updated":"2025-06-05T07:22:50Z","snapshot_observed_at":"2026-07-06T20:36:12.548343Z","submitted_at":"2025-02-13T18:11:34Z","title":"EmbodiedBench: Comprehensive Benchmarking Multi-modal Large Language Models for Vision-Driven Embodied Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09560","snapshot_observed_at":"2026-08-06T00:13:24.699600Z","title":"Embodiedbench: Comprehensive benchmarking multi-modal large language models for vision-driven embodied agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:24.699600Z"},"links":{"cited_paper":"/paper/2502.09560","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:a9f6dc7c806205b0d58c9a64a17af0b8097dcbccd40ff942cc739143cf4bfea6","observation_id":"ac8bf5ec-4b22-432b-bf15-3e24b956d6e0","resolution":{"observed_at":"2026-08-06T00:13:24.699600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-06T00:13:25.243758Z","title":"Webarena: A realistic web environment for building autonomous agents","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T00:13:25.243758Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2608.01456"},"observation_digest":"sha256:4b057c66c82305ea1adef991fd0eaa0ce32d1fd2d0428635c354c64d0f99a271","observation_id":"6edebceb-77b1-47bd-8594-5306967cee3e","resolution":{"observed_at":"2026-08-06T00:13:25.243758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01456","last_updated":"2026-08-02T19:29:48Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T00:43:46.129981Z","submitted_at":"2026-08-02T19:29:48Z","title":"Long-Horizon Embodied Decision-Making via Multimodal Memory Compression"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":2,"verified_fuzzy":22},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2608.01456."}