{"as_of":"2026-08-19T01:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9bbce2192668fc77e9c624db2333c6d101385a1d994dd73483b0668318c272a3","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T21:02:58.640918Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T07:06:05.820603Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-06-30T19:15:00.634246Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"cited_work":{"arxiv_id":"2605.15128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.15128","snapshot_observed_at":"2026-06-30T19:15:00.634246Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","venue":"cs.CV","work_id":"c0b1035f-b8ae-41c3-8aaf-5411dc69e853","year":2026},"citing_paper":{"arxiv_id":"2605.16953","last_updated":"2026-05-25T11:08:16Z","snapshot_observed_at":"2026-07-06T23:28:02.429673Z","submitted_at":"2026-05-16T12:08:22Z","title":"How do Humans Process AI-generated Hallucination Contents: a Neuroimaging Study","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T19:10:49.286658Z"},"links":{"cited_paper":"/paper/2605.15128","citing_paper":"/paper/2605.16953"},"observation_digest":"sha256:a75303913b9e839ed343a95e6bb82eb14595745a7bd841fd4e18c33f3069f784","observation_id":"b001212f-6f84-4c54-8b58-33fc28c5dadc","resolution":{"observed_at":"2026-06-30T19:15:00.635562Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15128","snapshot_observed_at":"2026-07-11T20:00:19.123214Z","title":"He, H.; Yao, W.; Ma, K.; Yu, W.; Dai, Y.; Zhang, H.; Lan, Z.; and Yu, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04334","last_updated":"2026-07-18T16:56:38Z","snapshot_observed_at":"2026-08-13T02:45:23.171486Z","submitted_at":"2026-07-05T14:33:29Z","title":"Do GUI Agents Believe Their Eyes? Diagnosing State-Belief Reliance on Pixels versus Structure","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T20:00:19.123214Z"},"links":{"cited_paper":"/paper/2605.15128","citing_paper":"/paper/2607.04334"},"observation_digest":"sha256:8c2bf78d00e1bb631a8924b67fd58094f8a2af92a4ae447b593d13c0ea597488","observation_id":"aae9400b-4079-404a-9690-831cb82e94c1","resolution":{"observed_at":"2026-07-11T20:00:19.123214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15128","snapshot_observed_at":"2026-08-02T08:46:59.069624Z","title":"He, H.; Yao, W.; Ma, K.; Yu, W.; Dai, Y.; Zhang, H.; Lan, Z.; and Yu, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04334","last_updated":"2026-07-18T16:56:38Z","snapshot_observed_at":"2026-08-13T02:45:23.171486Z","submitted_at":"2026-07-05T14:33:29Z","title":"Do GUI Agents Believe Their Eyes? Diagnosing State-Belief Reliance on Pixels versus Structure","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-02T08:46:59.069624Z"},"links":{"cited_paper":"/paper/2605.15128","citing_paper":"/paper/2607.04334"},"observation_digest":"sha256:030b2a89ff64b98e43c9b0da5dfb8ea4ce4bca223713445df59ab02e85f14d2a","observation_id":"4eec5a4e-4779-45c9-b3cf-367bed3ba159","resolution":{"observed_at":"2026-08-02T08:46:59.069624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15128","snapshot_observed_at":"2026-08-01T02:23:37.265350Z","title":"arXiv preprint arXiv:2605.15128 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25467","last_updated":"2026-07-28T08:59:57Z","snapshot_observed_at":"2026-08-18T18:02:58.651469Z","submitted_at":"2026-07-28T08:59:57Z","title":"Seen, Said, or Forgotten? A Causal Audit of Visual KV Memory Across Dialog Turns","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T02:23:37.265350Z"},"links":{"cited_paper":"/paper/2605.15128","citing_paper":"/paper/2607.25467"},"observation_digest":"sha256:817bb1ca221a10e0df3f376db39eed7b2e27d582068519b90e96809cdaf6b872","observation_id":"dea09742-4308-4a70-92bf-5c279140614f","resolution":{"observed_at":"2026-08-01T02:23:37.265350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.15128","snapshot_observed_at":"2026-08-03T07:06:05.820603Z","title":"arXiv preprint arXiv:2605.15128 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29440","last_updated":"2026-07-31T14:07:12Z","snapshot_observed_at":"2026-08-16T16:14:31.315759Z","submitted_at":"2026-07-31T14:07:12Z","title":"Beyond Retrieval: Analytic Memory for Multimodal Agents","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-03T07:06:05.820603Z"},"links":{"cited_paper":"/paper/2605.15128","citing_paper":"/paper/2607.29440"},"observation_digest":"sha256:75729f1a66104f19eacdafbb465102706793737d31c3382b30111531aa6c49e8","observation_id":"b1634793-f54c-4083-a700-7279caf86ac8","resolution":{"observed_at":"2026-08-03T07:06:05.820603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.15128/citation-record","integrity":"/paper/2605.15128/integrity","json":"/paper/2605.15128/citation-record.json","paper":"/paper/2605.15128"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:1300dbfab452001dc804936c4d2a90e2c701fdddb1ad8369f9a85ccb11e03a96","observation_id":"ab0c11a4-eb4b-461c-895b-bf0ad7c8c920","resolution":{"observed_at":"2026-06-30T21:05:04.036246Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.03515","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T01:17:31.111040Z","title":"Mem-gallery: Benchmarking multimodal long-term conversational memory for mllm agents","venue":null,"work_id":"67ddfb4e-bb84-463b-818d-0e5258817e4c","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:ed1867c8a7cfb0cc8941ee7b509ecd74e6d6f421e33e929a000da41cd85b0d33","observation_id":"dfd22008-c294-4806-ab16-af6265c48e6f","resolution":{"observed_at":"2026-06-30T21:05:04.033324Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.125747Z","title":"Visual long-term memory has a massive storage capacity for object details.Proceedings of the National Academy of Sciences, 105(38): 14325–14329, 2008","venue":null,"work_id":"e1e9c105-1bc0-4e1e-8115-6a92a08a41ab","year":2008},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:668d589fde348bdfd67899d52af69b45b54dc0de9dc3d28430ec10b5a681a0df","observation_id":"a525e587-26b3-4261-ac5a-67a4277a9c2b","resolution":{"observed_at":"2026-07-07T18:14:04.127305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04010","last_updated":"2025-08-06T01:49:32Z","snapshot_observed_at":"2026-08-09T10:49:53.210181Z","submitted_at":"2025-08-06T01:49:32Z","title":"HarmonyGuard: Toward Safety and Utility in Web Agents via Adaptive Policy Enhancement and Dual-Objective Optimization","version":1},"cited_work":{"arxiv_id":"2508.04010","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04010","snapshot_observed_at":"2026-06-30T21:05:04.028542Z","title":"Harmonyguard: Toward safety and utility in web agents via adaptive policy enhancement and dual- objective optimization, 2025","venue":null,"work_id":"934211ef-adf0-469e-a760-a61ea265b536","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"cited_paper":"/paper/2508.04010","citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:3690482d865ce24250a5342d44908b3c51ec84bc3eabd6358b706c734fc77216","observation_id":"aa26b9f2-5eca-4763-9517-d97697483b13","resolution":{"observed_at":"2026-06-30T21:05:04.030169Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6027.375564","doi":"10.1145/3746027.3755646","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating the robustness of multimodal agents against active environmental injection attacks","venue":null,"work_id":"6613c6d1-956d-46f2-b02f-95f984323f81","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:11dd98db1dda6c435194e65efd5afbdd36643210d0f62aed31dc58b148d2d490","observation_id":"0041c38c-c515-4a64-a6bc-e428665f002f","resolution":{"observed_at":"2026-06-30T21:05:03.217519Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.123742Z","title":"Safepred: A predictive guardrail for computer-using agents via world models, 2026","venue":null,"work_id":"b3ed3a67-e10f-42dc-bd5b-c0656bfbad4e","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:f40de238c800c8c83460c27c2a7512e21ceb9ffad6aae1aaf910b9a524ba1119","observation_id":"41f83ed8-c676-44b8-b12a-3e0f6cc4c1b1","resolution":{"observed_at":"2026-07-07T18:14:04.125123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-14T23:23:31.683130Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":"2504.19413","doi":"10.48550/arxiv.2504.19413","metadata_source":"pith","pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","venue":"cs.CL","work_id":"a5aed26c-a248-48b6-a59e-f7693fcb180a","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:d37ac926ccbad52550363c973ab2d2f496a7ef5aa056e9b1c5071662035e84a7","observation_id":"6c8dabc8-5385-4bfc-b8ac-b47fd0c4794c","resolution":{"observed_at":"2026-06-30T21:05:03.959834Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.127892Z","title":"Moura, Devi Parikh, and Dhruv Batra","venue":null,"work_id":"a888bac0-b647-4cfc-8a0a-84854ad4c782","year":2017},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:6895ab7f747b8c594a3291a9076ec1b2ce01f465a5cace5410246a82cc16cf2d","observation_id":"45ea6f18-d9df-48b7-a327-419b3e401892","resolution":{"observed_at":"2026-07-07T18:14:04.129173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.25536","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T21:08:58.847332Z","title":"TwinVoice : A multi-dimensional benchmark towards digital twins via LLM persona simulation","venue":null,"work_id":"50436ded-c74f-49b9-ab8d-8cfb7bd51460","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:07c0d29134eb900c7c3080f51d5288ddfd519658c1b82b3978341a64e008c687","observation_id":"5ac24d10-6914-4a61-b33f-fbc0c0fe710e","resolution":{"observed_at":"2026-06-30T21:05:03.986519Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.07624","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:05:04.241916Z","title":"M2A: Multimodal memory agent with dual-layer hybrid memory for long-term personalized interactions, 2026","venue":null,"work_id":"e30c32b1-4e36-4369-b8dc-60ed2ee432c9","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:6003b914cf6e8e03bb564ee889802dc6da293dbc2d2f759988556c294c5d109f","observation_id":"b7de68ea-3a63-4871-b2ee-85c9aeecd5cf","resolution":{"observed_at":"2026-06-30T21:05:03.977331Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.117172Z","title":"Geminiapimodeldocumentation","venue":null,"work_id":"f211caef-5d63-4da1-bf02-76f0ad9e8d27","year":null},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:7e3a42a7bdb30b943a12f30e45c2580dbe05ac960b82209c7ff0ec75f2819e00","observation_id":"f0b262b0-317f-42cb-adab-85d33e290b59","resolution":{"observed_at":"2026-07-07T18:14:04.118433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.01289","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:05:03.991657Z","title":null,"venue":null,"work_id":"06edc96e-bc81-439c-aa8b-8088db9087f7","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:7504761659772df339389c1afff3384e7fe6dc6055b4b53942b24f6541691b81","observation_id":"e5fe067d-1f90-41c0-b36a-2ff8f49dee8b","resolution":{"observed_at":"2026-06-30T21:05:03.993618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.findings-eacl.160","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSieve: Information sieving via LLM-as-a-knowledge-router","venue":null,"work_id":"64ae37d2-ec0a-4cc2-b536-c8380d24e615","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:c6853558aec70775e77e950f5f9550c94d8caf81e34a15929347f062b15c0031","observation_id":"e02254c3-dfad-421b-90d5-a753da93c8da","resolution":{"observed_at":"2026-06-30T21:05:03.224296Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.121388Z","title":"Evaluating memory in LLM agents via incremental multi- turn interactions","venue":null,"work_id":"590f80d7-957f-4e31-b115-2720796172c8","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:72f601e835974063a4a7320638e9c04831b70a7f78c6533118c173a6bf3b6bb4","observation_id":"8dbd6130-60d5-45a6-8f10-a516c7f1cf46","resolution":{"observed_at":"2026-07-07T18:14:04.123037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13564","last_updated":"2026-01-13T09:33:57Z","snapshot_observed_at":"2026-08-13T14:23:02.090859Z","submitted_at":"2025-12-15T17:22:34Z","title":"Memory in the Age of AI Agents","version":2},"cited_work":{"arxiv_id":"2512.13564","doi":"10.48550/arxiv.2512.13564","metadata_source":"pith","pith_arxiv_id":"2512.13564","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory in the Age of AI Agents","venue":"cs.CL","work_id":"1ff75a14-302e-4906-aa86-1f96fbcf12ff","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"cited_paper":"/paper/2512.13564","citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:4256db3c32b4c046ba6cd80344c23fc827c4a66e7353791b5a5ecf186f73cd53","observation_id":"224af769-dc17-40be-b84a-716d9cbb8d02","resolution":{"observed_at":"2026-06-30T21:05:03.989786Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:38:06.749638+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T06:38:06.749638+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.109138Z","title":"Automatic understanding of image and video advertisements","venue":null,"work_id":"6d1d45ba-339d-4da9-9d02-d7cb9fcf271f","year":2017},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:45066a717c371a330d22596083543ca314f79d5a4b37366a5129ab756578ec61","observation_id":"a4cc1bac-ce5f-44f2-928c-58c1165c0c2d","resolution":{"observed_at":"2026-07-07T18:14:04.110389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.1318","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Memory OS of AI agent","venue":null,"work_id":"601ee6ad-09cf-4713-b8f0-cbac91282f5a","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:04d2ee22ca11b5e5ee81f9fcbadb8158934a8717c605c03f6326018fd7f6d271","observation_id":"27d7e761-c29f-453f-a402-f9ffa6dee74c","resolution":{"observed_at":"2026-06-30T21:05:03.227959Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-05-22T07:53:27.319263+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T07:53:27.319263+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.135551Z","title":"Astyle-basedgeneratorarchitectureforgenerativeadversarial networks","venue":null,"work_id":"c2b1a3ac-a115-49ec-9b07-7483e5b9b2c0","year":2019},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:2a8aff008c198e2e397ab1913e391d1e36b6e0ac4a4e703ba08126f8a7f829b7","observation_id":"c9756bde-0447-419a-ad31-f679b3ba91b8","resolution":{"observed_at":"2026-07-07T18:14:04.136956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n19-1058","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"4b5ddd1c-ebc6-4292-904e-f3955d4b50fa","year":2019},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:1a5436368fbb15b845816a5e2f9417331fdf73677d862bfdfc778e8c01de4aad","observation_id":"255b3ef6-11d1-4f38-9daf-52993c58fa57","resolution":{"observed_at":"2026-06-30T21:05:03.209202Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.16641","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:05:03.961156Z","title":"Lee, B.-K","venue":null,"work_id":"6b07d17e-f2fc-4544-bc1a-f518c155e67b","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:6bcf894d693fcfbdba3ae248821310d11c734f8a729a52d00212d00e3304538d","observation_id":"a0f24c27-7d8d-4a8d-995e-6f4fdc84ecbc","resolution":{"observed_at":"2026-06-30T21:05:03.962836Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.02468","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:05:03.971471Z","title":"Avenir-web: Human-experience-imitating multimodal web agents with mixture of grounding experts.arXiv preprint arXiv:2602.02468, 2026","venue":null,"work_id":"feb4b063-3b30-4d8f-a768-3ff684f4b0ce","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:2e809454e84571cd9c2bb337aa9f1c73425484be7ca476336cec56cc8586ad44","observation_id":"f8ec8198-c076-4cdd-ad5d-5028bfdd1303","resolution":{"observed_at":"2026-06-30T21:05:03.973426Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.131784Z","title":"Sohn, Kaidong Hu, Muhammad Usman, and Mubbasir Kapadia","venue":null,"work_id":"c944310f-3900-4d79-bc4a-e1fce1d5ca54","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:9a1befa6adc8fe4e78e42f1268ab76414d386562e2f9f997372e0e2ddf877d3d","observation_id":"b88522e1-2f25-4c3b-9dfe-cc32f5c48a95","resolution":{"observed_at":"2026-07-07T18:14:04.132920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.e","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:05:03.228488Z","title":"Mosaic: Modeling social ai for content dissemination and regulation in multi-agent simulations","venue":null,"work_id":"d22984e7-e646-4e4e-b8bb-8c4f45b589f8","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:24c26bf1928767efd40670e649792e9a3f4dd8961159541f755cec0e3cf94412","observation_id":"5a1aea5c-b47e-456c-a84f-e55c8714beb8","resolution":{"observed_at":"2026-06-30T21:05:03.229657Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-05-23T15:53:57.012001+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T15:53:57.012001+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02553","last_updated":"2026-01-29T15:45:24Z","snapshot_observed_at":"2026-08-16T21:09:13.005372Z","submitted_at":"2026-01-05T21:02:49Z","title":"SimpleMem: Efficient Lifelong Memory for LLM Agents","version":3},"cited_work":{"arxiv_id":"2601.02553","doi":"10.48550/arxiv.2601.02553","metadata_source":"pith","pith_arxiv_id":"2601.02553","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SimpleMem: Efficient Lifelong Memory for LLM Agents","venue":"cs.AI","work_id":"9b5b2649-8727-425e-a2c5-60f49518a5c4","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"cited_paper":"/paper/2601.02553","citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:7e9dde8c40e9c51138d3fbc3f1ce6ff1a183081db08fd47b73696caaa5ba78e2","observation_id":"ae93b7fe-2b02-474f-b2f9-9313a31d405f","resolution":{"observed_at":"2026-06-30T21:05:04.020741Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.104970Z","title":null,"venue":null,"work_id":"3317f917-1cbd-4a49-9691-93e8437b13ce","year":null},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:3042c9a566f09fce8e4f092dd236e1ca1c43337bbc0c81e4670356160b16a9d8","observation_id":"2d63a08b-bf6b-4148-a071-2658e19cd31e","resolution":{"observed_at":"2026-07-07T18:14:04.106194Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2604.01007","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:05:04.025034Z","title":"Omni-SimpleMem: Autoresearch- guided discovery of lifelong multimodal agent memory","venue":null,"work_id":"88b16344-e1f0-4a81-8117-66e7cc2785e9","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:43acc87b3d12618aeee85dbabc33791382c4a54d8df170e0abb22ab125333f69","observation_id":"871996fb-4dd8-42b9-a7e7-94f8bd3c5ada","resolution":{"observed_at":"2026-06-30T21:05:04.027231Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.107065Z","title":"Convbench: a multi-turn conversation evaluation benchmark with hierarchical ablation capability for large vision-language models","venue":null,"work_id":"7fb81df6-3097-4b0a-80bf-2f42b5e17d59","year":2024},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:b60be41a32eff702de9c6e1aa70a62f59dda55031c1c76349571f2dd1c5edaac","observation_id":"c4986161-2c46-48d8-a0dd-ef629011a30a","resolution":{"observed_at":"2026-07-07T18:14:04.108520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11833","last_updated":"2024-10-29T12:34:11Z","snapshot_observed_at":"2026-08-16T13:42:07.554429Z","submitted_at":"2024-06-17T17:59:47Z","title":"MMDU: A Multi-Turn Multi-Image Dialog Understanding Benchmark and Instruction-Tuning Dataset for LVLMs","version":2},"cited_work":{"arxiv_id":"2406.11833","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11833","snapshot_observed_at":"2026-06-30T21:05:04.009666Z","title":"Mmdu: A multi-turn multi-image dialog understanding benchmark and instruction-tuning dataset for lvlms","venue":null,"work_id":"a3d6da8f-0212-4be3-b4d6-993824763192","year":2024},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"cited_paper":"/paper/2406.11833","citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:6424c427e04cfe357a1a5b2f4a251520368a7773977392eb771b39c3a979aaa8","observation_id":"16216f9a-7d11-4345-8490-85ecae3c69a4","resolution":{"observed_at":"2026-06-30T21:05:04.012795Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.16493","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T16:07:08.776183Z","title":"Haipeng Luo, Huawen Feng, Qingfeng Sun, Can Xu, Kai Zheng, Yufei Wang, Tao Yang, Han Hu, and Yan- song Tang","venue":null,"work_id":"e529240b-3254-413f-96b6-a1ae9882fce2","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:98a3599c630cdf32b2476566fe26bb2c43e075233dab962f231ed844b861e9e4","observation_id":"ecec38a1-cbb6-47d4-99fd-ee851fdd6b27","resolution":{"observed_at":"2026-06-30T21:05:04.016711Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.113042Z","title":"Evaluating very long-term conversational memory of LLM agents","venue":null,"work_id":"4d6e228a-5a00-47f2-bf32-3cdade611eeb","year":null},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:ee8db1bbe3222d8e6f29329bb63e8475d5ccbfd8302fcbeb2e410b337707784a","observation_id":"eaa07e85-a027-4926-b36c-c72ba5ec828e","resolution":{"observed_at":"2026-07-07T18:14:04.114389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.747","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:05:47.838003Z","title":"Evaluating Very Long-Term Conversational Memory of","venue":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","work_id":"6bbf9aa9-b06f-489e-8977-aeb1261f2ef8","year":2024},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:13e5ab20e45781a3ebdcae4ed827f30d493167139afa8df6a746d2ec4e3d5ef4","observation_id":"e1bfc279-1952-433a-bc83-e6ce1a72ca4a","resolution":{"observed_at":"2026-06-30T21:05:03.222415Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-13T18:38:56.560693+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T18:38:56.560693+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.01990","doi":"10.48550/arxiv.2603.01990","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"According to me: Long-term personalized referential memory qa","venue":"arXiv (Cornell University)","work_id":"d4f06592-99bc-444a-b470-e03023662eab","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:61c14c169c25ce5899939a1a08d4698465d1eca9cface929ca0a4db7860bbf84","observation_id":"7186bb76-11cb-40fa-a73f-95797280e106","resolution":{"observed_at":"2026-06-30T21:05:03.213669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.11892","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:40:06.144224Z","title":"R-WoM: Retrieval-augmented world model for computer-use agents","venue":null,"work_id":"533dc13c-8508-45d6-ad23-5335bbe55879","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:c63a06bd40f55f4ce64db0a02fec3b7e0ea1d263a1acd18e9c0a33136c5a4b8a","observation_id":"e317c47c-e89d-485f-bec2-4cfe5cc36428","resolution":{"observed_at":"2026-06-30T21:05:04.004780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.114920Z","title":"Openai api model documentation","venue":null,"work_id":"79720172-6fc9-439e-acac-7a298e03b59f","year":null},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:c4bf5a87c3275d730ab43ad2f1d05dc35ce19f876045182c8b6c5da023fca475","observation_id":"64d6d323-9bb2-480a-a13e-bc9eac8c001f","resolution":{"observed_at":"2026-07-07T18:14:04.116143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.111173Z","title":null,"venue":null,"work_id":"2ab933ad-fadc-4910-8fe8-822f0819d33c","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:baa54de0bf50cf520b7eccc0527834bddda772437e5eb5acf501ee2833ad908b","observation_id":"5aec1a0b-ace8-464b-b6f3-f12a6e94b40c","resolution":{"observed_at":"2026-07-07T18:14:04.112278Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.06714","last_updated":"2026-04-08T06:13:16Z","snapshot_observed_at":"2026-08-15T02:39:14.007852Z","submitted_at":"2026-04-08T06:13:16Z","title":"Steering the Verifiability of Multimodal AI Hallucinations","version":1},"cited_work":{"arxiv_id":"2604.06714","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.06714","snapshot_observed_at":"2026-06-30T21:05:03.998916Z","title":"Steering the Verifiability of Multimodal AI Hallucinations","venue":"cs.AI","work_id":"7698c12b-c1f2-4aac-a057-c655e33fc818","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"cited_paper":"/paper/2604.06714","citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:d446adb665d45886411b9a406ec017d6822d58a81bbeebf9d9bac47d4fe14065","observation_id":"59410ef5-3abb-4683-b86d-a4c4d3c401f5","resolution":{"observed_at":"2026-06-30T21:05:04.001196Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6183.360676","doi":"10.1145/3586183.3606763","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"O'Brien and Carrie Jun Cai and Meredith Ringel Morris and Percy Liang and Michael S","venue":null,"work_id":"b5bf85fe-4fb7-4966-b0b2-9ccf9d3b11b9","year":2023},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:1645415396aeccf1a16ff804b7a31c603c4e49e1c87ad36ddd614658de43a098","observation_id":"66b81437-7168-47a1-a98a-45d8954ad4e3","resolution":{"observed_at":"2026-06-30T21:05:03.217364Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:12.695495+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:12.695495+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.137588Z","title":"From commands to prompts: LLM-based semantic file system for AIOS","venue":null,"work_id":"d993843d-cdf1-4bc2-9020-a6ea4a45d386","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:abe2cda09b36db04bcf3d698a745619e76e5c21877b50bdd69ed5108e08356ed","observation_id":"b4e4458d-5c23-4653-9f65-a3a755876678","resolution":{"observed_at":"2026-07-07T18:14:04.138768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.129730Z","title":"Reflexion: language agents with verbal reinforcement learning","venue":null,"work_id":"a0a99d6b-1320-4701-b94f-27d200f2389f","year":2023},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:db80130ae8ae461cd0946ad1279b94eaf1093437d20f787be27eee2d0b8a228a","observation_id":"b91d98c6-57ed-4085-b0fa-88e3dc39fe5f","resolution":{"observed_at":"2026-07-07T18:14:04.131134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.119125Z","title":"Japan open driving dataset sample.https://huggingface.co/datasets/turi ng-motors/Japan-Open-Driving-Dataset-Sample, 2024","venue":null,"work_id":"d26336ae-286a-438c-8677-f15cf5f8a30d","year":2024},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:cbb90f5576e080dd29dc780139c7fe0980d48f628a3b61c7086c5fcedbdb2018","observation_id":"4c79ec94-95c9-4110-9257-40082447a371","resolution":{"observed_at":"2026-07-07T18:14:04.120651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07957","last_updated":"2025-07-10T17:40:11Z","snapshot_observed_at":"2026-08-16T07:12:52.228757Z","submitted_at":"2025-07-10T17:40:11Z","title":"MIRIX: Multi-Agent Memory System for LLM-Based Agents","version":1},"cited_work":{"arxiv_id":"2507.07957","doi":"10.48550/arxiv.2507.07957","metadata_source":"pith","pith_arxiv_id":"2507.07957","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MIRIX: Multi-Agent Memory System for LLM-Based Agents","venue":"cs.CL","work_id":"bcb99885-6f76-4bd6-b442-e5f455bb6447","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"cited_paper":"/paper/2507.07957","citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:cb095fc53865980a5dcf89434aade3a16861aad724d6c543224378c8d0746b0e","observation_id":"ae360296-acea-45ba-8846-31b51aca56da","resolution":{"observed_at":"2026-06-30T21:05:03.982394Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10813","last_updated":"2025-03-04T22:19:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-14T17:59:44Z","title":"LongMemEval: Benchmarking Chat Assistants on Long-Term Interactive Memory","version":2},"cited_work":{"arxiv_id":"2410.10813","doi":"10.48550/arxiv.2410.10813","metadata_source":"pith","pith_arxiv_id":"2410.10813","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LongMemEval: Benchmarking Chat Assistants on Long-Term Interactive Memory","venue":"cs.CL","work_id":"9074870f-aee7-4103-b167-ac6473a8a9b3","year":2024},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"cited_paper":"/paper/2410.10813","citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:24c33f2f7443e3d4ccd2ab50ee18a057c438bd9d33c895378a4528df42b8667d","observation_id":"5b64a924-fb71-471f-a7be-4497be0fafc0","resolution":{"observed_at":"2026-06-30T21:05:03.969896Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15116","last_updated":"2024-02-23T06:04:23Z","snapshot_observed_at":"2026-08-18T11:43:13.450548Z","submitted_at":"2024-02-23T06:04:23Z","title":"Large Multimodal Agents: A Survey","version":1},"cited_work":{"arxiv_id":"2402.15116","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.15116","snapshot_observed_at":"2026-07-03T09:07:48.049036Z","title":"Large multimodal agents: A survey","venue":null,"work_id":"5f1eddc5-e861-484d-a204-926b2bfd8ecc","year":2024},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"cited_paper":"/paper/2402.15116","citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:b0c25a45ce429834320e3b8095dd8e8b7c6026fc2f67f7e73a75a1e19008e7e0","observation_id":"7bd33008-9b59-40b8-a672-5271b09fe1fc","resolution":{"observed_at":"2026-06-30T21:05:04.023680Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.02096","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:00:08.216260Z","title":"Fluxmem: Adaptive hierarchical memory for streaming video understanding","venue":null,"work_id":"b772bceb-41f1-4390-a2bb-e406c445262d","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:72d0eed719473e2b0fd6a404b7b88292df3ac19d85b4588dd88af2ecb3c1226d","observation_id":"16536ae8-c2cf-4de8-9c28-0b61653a3855","resolution":{"observed_at":"2026-06-30T21:05:03.997475Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.139296Z","title":"Crab: Cross-environment agent benchmark for multimodal language model agents","venue":null,"work_id":"5dcc6261-2416-4825-9251-3f5c84278574","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:36410926f67c4ebcb8e1f4c5fd2d0f2a3dac93bbb73c04a40270e6ae843e9940","observation_id":"d4772c42-01e3-45e0-93ac-a5dd6e314324","resolution":{"observed_at":"2026-07-07T18:14:04.140650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:14:04.133557Z","title":"A-mem: Agentic memory for llm agents","venue":null,"work_id":"2caa48ac-fe65-42f0-8a8a-04f1c5627fe3","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:a08d50cb6eca60c2f758d20783cfcc78978b7ee3c540e42fd7f492e23867ccda","observation_id":"d74ee8a4-c114-492e-a1f8-4ca7684a4390","resolution":{"observed_at":"2026-07-07T18:14:04.134825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.21725","last_updated":"2026-04-23T14:29:25Z","snapshot_observed_at":"2026-08-13T08:01:29.713243Z","submitted_at":"2026-04-23T14:29:25Z","title":"AEL: Agent Evolving Learning for Open-Ended Environments","version":1},"cited_work":{"arxiv_id":"2604.21725","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.21725","snapshot_observed_at":"2026-07-02T22:57:25.882212Z","title":"AEL: Agent Evolving Learning for Open-Ended Environments","venue":"cs.CL","work_id":"840da641-8a4f-453d-9a7b-1c7d93a8e413","year":2026},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"cited_paper":"/paper/2604.21725","citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:d89aa67f527cf8e0d122956686725a3686aaffd4ec96c37e97e940c4af7747e5","observation_id":"9bdca8e2-9103-4e3b-9201-4428ed4a8b4b","resolution":{"observed_at":"2026-06-30T21:05:04.008221Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.1096","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MMRC: A large-scale benchmark for understanding multimodal large language model in real-world conversation","venue":null,"work_id":"bf4d7158-7a53-4466-8cf7-351ea87212d7","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:c0af588f7e4e3025c7a93a0abeb8e7405abb4d8e51504628fcf6d981dd33fea4","observation_id":"6906c195-f9fb-4cbb-bd0b-c2c4990ebe06","resolution":{"observed_at":"2026-06-30T21:05:03.226244Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/iccvw690","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:05:03.211283Z","title":"Seed- story: Multimodal long story generation with large language model","venue":null,"work_id":"a967c247-a549-4198-9530-93cd9df056d3","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:798c904e8fb2b3db8bd8bc5ec81afecf0a77dd6a84f853fe99d55555af86617f","observation_id":"01998d90-b943-46c2-99af-98acc0e1db7e","resolution":{"observed_at":"2026-06-30T21:05:03.213946Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3748302","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A survey on the memory mechanism of large language model- based agents.ACM Transactions on Information Systems, 43(6):155:1–155:47","venue":"ACM Transactions on Information Systems","work_id":"523e1a9d-c782-4e01-9644-c33da60ddd2e","year":2025},"citing_paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-30T21:02:58.640918Z"},"links":{"citing_paper":"/paper/2605.15128"},"observation_digest":"sha256:995f1cd0b62171be1b6c2a8fb5d1ac0cd922965e3570a5b146d455604158522d","observation_id":"a4b3d35d-9faf-471d-b903-ddc6ffd8c1ee","resolution":{"observed_at":"2026-06-30T21:05:03.227449Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-01T10:38:14.23452+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T10:38:14.23452+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.15128","last_updated":"2026-05-14T17:37:52Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T12:34:00.114916Z","submitted_at":"2026-05-14T17:37:52Z","title":"MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":5,"parse_uncertain":1,"unresolved":1,"verified_exact":27,"verified_fuzzy":16},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 5 inbound Pith citation observations for arXiv:2605.15128."}