{"as_of":"2026-08-18T08:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:33fe4061f957916bc055160fcb2b4e43e7337750316c9675661fbe5726cb12cd","coverage":[{"denominator":218,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T19:21:59.257857Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.10692/citation-record","integrity":"/paper/2608.10692/integrity","json":"/paper/2608.10692/citation-record.json","paper":"/paper/2608.10692"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.624053Z","title":"Langley , title =","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.624053Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:665b117d00d93fd3e1acec547ab56526b1ff7528b90024532cc7cb1bb4570fdf","observation_id":"0d3d2b53-cf36-4553-99ae-37d9bec5e39a","resolution":{"observed_at":"2026-08-12T19:21:58.624053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00820","last_updated":"2024-10-28T17:05:10Z","snapshot_observed_at":"2026-08-18T00:54:55.289567Z","submitted_at":"2024-10-28T17:05:10Z","title":"AutoGLM: Autonomous Foundation Agents for GUIs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00820","snapshot_observed_at":"2026-08-12T19:21:58.630665Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.630665Z"},"links":{"cited_paper":"/paper/2411.00820","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:a9d4359bffca9cbdba3f402332271da1bad729696b261db71feee0c2fa8bbf61","observation_id":"2e475699-9ac0-4f50-ab64-29a8dff91f87","resolution":{"observed_at":"2026-08-12T19:21:58.630665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.504","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:23:28.856754Z","title":"Exploring the Potential of LLMs as Personalized Assistants: Dataset, Evaluation, and Analysis , booktitle =","venue":null,"work_id":"a09d0ae7-6a19-42bc-b548-401426587a00","year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.637393Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:cf4e7d76bde6541fcca75c29c8bcdef05f61562e6cbc1e4b59fbd2ba02a206b7","observation_id":"2cbf283e-58e2-4f43-a012-a5ff84ee17f4","resolution":{"observed_at":"2026-08-12T19:23:28.892140Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.644209Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.644209Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:afd05051051fb084d4089113e2affba5c98d591ed5df4d2c0048ef146afa4710","observation_id":"262e6737-2251-4969-8689-dc1ad8c3da03","resolution":{"observed_at":"2026-08-12T19:21:58.644209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2602.11964","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:23:28.753001Z","title":"Gaia2: Benchmarking","venue":null,"work_id":"e47727a5-72ff-4aa0-943f-4b4291569408","year":2026},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.650845Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:45de3baf560b7f166d99d03c8f88ac1d55b9907e4f4327329045256e4de8e158","observation_id":"e5bd2610-ebc0-4921-beae-035751c68f56","resolution":{"observed_at":"2026-08-12T19:23:28.824200Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.656643Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.656643Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:46371426ae8d6db503bf97a3bf36f8aeb65b8e039c66d7ca02e7db01af6a5961","observation_id":"5f2f6079-8e0c-423e-9418-3d4d740cc9cf","resolution":{"observed_at":"2026-08-12T19:21:58.656643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.662759Z","title":"AndroidLab: Training and Systematic Benchmarking of Android Autonomous Agents , booktitle =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.662759Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:46dba8ee39c659483072ae3c908d1bab7f3120b7424275b8db0e6f456a0cbe7e","observation_id":"2eed80e8-4fda-4798-b393-f5c232c1374f","resolution":{"observed_at":"2026-08-12T19:21:58.662759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.671216Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.671216Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:e362d44f983f16933764c0aadb55d6e70aa4e2f8e8817e215109e7b143b91414","observation_id":"aab3ff45-1e69-4b58-8a2b-06ba5ec7c50b","resolution":{"observed_at":"2026-08-12T19:21:58.671216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v40i42.40874","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:23:28.522206Z","title":"Mind the Third Eye! Benchmarking Privacy Awareness in MLLM-powered Smartphone Agents , booktitle =","venue":null,"work_id":"1b77cf07-7344-4768-be9c-2c5422cfea7c","year":2026},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.676550Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:761c3ea1897163c63e689e269faed91a8bdf2eb09146cd624c5cffbd07ae2f6e","observation_id":"f6fa389a-5855-47e3-91a9-d72036d08e70","resolution":{"observed_at":"2026-08-12T19:23:28.642993Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.682339Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers),","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.682339Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:1f57ae13fc34ce9587d6fc46302507d007c4c2663a093867dde7ef50ad5eaa98","observation_id":"e2c12d1e-c277-49ae-9edd-0c9fd3d326f0","resolution":{"observed_at":"2026-08-12T19:21:58.682339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.687685Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.687685Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:7157710a29afad066791e9ece8b8cc4fad7065404bcc0a31d8f59d6d5e221f39","observation_id":"1690fc54-620e-43d7-8ebc-5973c210db23","resolution":{"observed_at":"2026-08-12T19:21:58.687685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.693441Z","title":"AppAgent: Multimodal Agents as Smartphone Users , booktitle =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.693441Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:2469a70fa72ca454c15ae9a7e71c1b646e87b5ca9d8ac8b62aa3e69d8a51a929","observation_id":"e7fbe459-18b3-4e79-85f5-3ccb31a31ff5","resolution":{"observed_at":"2026-08-12T19:21:58.693441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-12T19:21:58.698799Z","title":"DeepSeek-V3 Technical Report , journal =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.698799Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:525aee7762c9ffe162b1668e53efc29e84720c22e08db4a7b0743c6188231552","observation_id":"76666871-2092-490d-aa4e-e780c00513fe","resolution":{"observed_at":"2026-08-12T19:21:58.698799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.704359Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.704359Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:bcccd7a90beeb591102ff1adda93725175bb712b88c7f11a5f50e43befff93d1","observation_id":"d908d904-43c2-43cd-8707-8af95370b703","resolution":{"observed_at":"2026-08-12T19:21:58.704359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16944","last_updated":"2025-05-22T17:31:10Z","snapshot_observed_at":"2026-08-16T18:48:25.262848Z","submitted_at":"2025-05-22T17:31:10Z","title":"AGENTIF: Benchmarking Instruction Following of Large Language Models in Agentic Scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16944","snapshot_observed_at":"2026-08-12T19:21:58.709584Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.709584Z"},"links":{"cited_paper":"/paper/2505.16944","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:59ca94cdbf3b94b93b198e9c7584b05151efafee2d1698f2d9e17b86ae8bfd5c","observation_id":"3a3361d7-5ae0-455f-9895-ca98c1e57cfa","resolution":{"observed_at":"2026-08-12T19:21:58.709584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.715967Z","title":"From Complex to Simple: Enhancing Multi-Constraint Complex Instruction Following Ability of Large Language Models , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.715967Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:72be863b71b159e7f26f6ccd2c357dbd0bed3a1f568c719473882f2b30e9b64b","observation_id":"3dda646a-c5d9-4723-85f3-7de59453ace0","resolution":{"observed_at":"2026-08-12T19:21:58.715967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.721936Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.721936Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:b80d5ceba130011edf5e5cd820b1cbfac88d7eed3e3bdc441f181d9cb2d04f73","observation_id":"a46d83d4-d7ba-4869-ae16-463c5eba8be4","resolution":{"observed_at":"2026-08-12T19:21:58.721936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.727753Z","title":"The Twelfth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.727753Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:b695a7642c33cd46395a223b5a61b471e85598401279a79bb86f31093ab16dfc","observation_id":"8999ef49-cbed-404e-9226-2314b38e0b14","resolution":{"observed_at":"2026-08-12T19:21:58.727753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.733603Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.733603Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:9c3cf9f87846963165b286965463ad5a9643c1ba6b5db446c76d77dbbe76ce17","observation_id":"376c67ef-44bd-4260-9b91-fcdda83d8c95","resolution":{"observed_at":"2026-08-12T19:21:58.733603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.739412Z","title":"FanOutQA:","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.739412Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:00c6f7bf7b488d182be8092217e261211afbb869752287e92ae95697fa4d0a86","observation_id":"ab0b0730-1558-44c2-9e1e-c3ae8030677a","resolution":{"observed_at":"2026-08-12T19:21:58.739412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.746854Z","title":"Evaluating Design Decisions for Dual Encoder-based Entity Disambiguation , booktitle =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.746854Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:bff606e5019ef1e09d78cdacd381251720a22e1e9515aa7f1a20eda2c0fa7f10","observation_id":"98778e32-1a63-4115-b78c-204c22101d1d","resolution":{"observed_at":"2026-08-12T19:21:58.746854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.753970Z","title":"Cohen and Ruslan Salakhutdinov and Christopher D","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.753970Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:a5b83148cefdaa33155d78d1ce4d0726e13b7adf0aa94d3399d2ed8575be548c","observation_id":"ef4c0d86-c4b4-4050-bc2c-3b701dc087d9","resolution":{"observed_at":"2026-08-12T19:21:58.753970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02833","last_updated":"2025-11-11T09:40:12Z","snapshot_observed_at":"2026-08-14T11:40:59.457005Z","submitted_at":"2025-07-03T17:44:33Z","title":"Generalizing Verifiable Instruction Following","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02833","snapshot_observed_at":"2026-08-12T19:21:58.763030Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.763030Z"},"links":{"cited_paper":"/paper/2507.02833","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:182e86a20c369d837c67af03e1624413b79a502eefb1c03b91af30967eb8e0e4","observation_id":"713569f4-462e-41df-8ac5-7ab811aef820","resolution":{"observed_at":"2026-08-12T19:21:58.763030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.770692Z","title":"On the Multi-turn Instruction Following for Conversational Web Agents , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.770692Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:9aa3a91587cea82d348b1a8345abdf18a66f5ebfb4f94422af570e73c97f2fba","observation_id":"f677e6b5-217f-4c6d-aa0a-463420e36a22","resolution":{"observed_at":"2026-08-12T19:21:58.770692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v39i22.34551","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:23:28.421624Z","title":"Toward Verifiable Instruction-Following Alignment for Retrieval Augmented Generation , booktitle =","venue":null,"work_id":"d545d076-79c2-422a-8d23-3ab43ef34820","year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.778032Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:7a301086a75e4d083d531dc00c04982e289e204b5916b0e37b3e89430451546f","observation_id":"17883964-782b-490b-a663-6947cb8de8d1","resolution":{"observed_at":"2026-08-12T19:23:28.426948Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.783860Z","title":"TL-Training:","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.783860Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:3c324da42e51ed3bdce4a44db3bc0d92c64231a32177d6bc8f4f5fc8143548fe","observation_id":"9b496bff-8d9a-478d-8414-54874be83004","resolution":{"observed_at":"2026-08-12T19:21:58.783860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-12T19:21:58.790762Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.790762Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:197fb6450d582a5f2620ce243c822504c075bdd89efd9f341d91faf2113ac69e","observation_id":"a707554c-dccf-4d71-8ff1-4964b98cfabc","resolution":{"observed_at":"2026-08-12T19:21:58.790762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19803","last_updated":"2025-03-03T15:13:10Z","snapshot_observed_at":"2026-08-16T13:08:42.253646Z","submitted_at":"2024-10-16T17:59:47Z","title":"First-Person Fairness in Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19803","snapshot_observed_at":"2026-08-12T19:21:58.796199Z","title":"Robinson and Keren Gu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.796199Z"},"links":{"cited_paper":"/paper/2410.19803","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:37b6d0640e12fc07609fb7a534f132c3b97ae4a7fd92e04ac5cca72a18f56dc9","observation_id":"aacb158e-0f82-445c-a4aa-d300ef1634b9","resolution":{"observed_at":"2026-08-12T19:21:58.796199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.802775Z","title":"Tool learning with large language models: a survey , journal =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.802775Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:442c1fbbe995581916abc8c48d25bc38d48d32b5f5b2ba6b50217a5529d4dea3","observation_id":"504da331-f6d2-4bc9-8721-fc5ce57263aa","resolution":{"observed_at":"2026-08-12T19:21:58.802775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.808303Z","title":null,"venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.808303Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:4f3d00e1e2e0fc32a78da9904cf6177b1c509177f6493745ac2b805c880acf1b","observation_id":"e8a15dec-dc31-4a63-9077-949d426406d9","resolution":{"observed_at":"2026-08-12T19:21:58.808303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.814046Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.814046Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:91e8341bc2bd20e0a2801f1e8b4d7ec1a47d70f80278a79950a283a9c1afbebc","observation_id":"60fe019a-b7e9-434c-9d3c-66d7cf60f3aa","resolution":{"observed_at":"2026-08-12T19:21:58.814046Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.819426Z","title":null,"venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.819426Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:7c410b8583343c6998a6eb93c5d851d360dfb033eafa1947f6f911cd5500acea","observation_id":"870b9e98-03eb-4190-9e6f-4636f8289b2e","resolution":{"observed_at":"2026-08-12T19:21:58.819426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.825117Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.825117Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:e43e7dbe2029764828e8147ecc4edd5258a32ac0aca12fa21944ae3d64fffdc2","observation_id":"0f664a46-f911-4e3c-8dec-6054188e3f03","resolution":{"observed_at":"2026-08-12T19:21:58.825117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.830362Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.830362Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:66788a700be90bacfa492d1d5cd3edb9d762f7161dbf30a62c21ff1997c72dbb","observation_id":"28bd6c66-ec43-40bb-a772-66eaeebf9336","resolution":{"observed_at":"2026-08-12T19:21:58.830362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.836583Z","title":"Newell and P","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.836583Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:6cd2ee17dcaf433806f5dfa7d2324576255620379ae2093237f093a66b56768e","observation_id":"84bf6d1d-6af2-4e55-bd46-320b798ddfd3","resolution":{"observed_at":"2026-08-12T19:21:58.836583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.842032Z","title":null,"venue":null,"work_id":null,"year":1959},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.842032Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:e463866d104e2b72b105dfb5a7469f7a5f7beac0a76335938c1b1f7887daa0a0","observation_id":"cc89091e-2067-42c9-906d-0a82fbe3de2c","resolution":{"observed_at":"2026-08-12T19:21:58.842032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.850170Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools , booktitle =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.850170Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:52b255d0e5a6c67d4506a880942fcf280cedad713f3fb6788a2e3fda50351d60","observation_id":"a5ecb3c6-38d4-400a-9903-416c564c4d3a","resolution":{"observed_at":"2026-08-12T19:21:58.850170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.855533Z","title":"and Stoica, Ion and Xing, Eric P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.855533Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:69579a5f04e32273810afea13854a83bd69ee36fbf4766b40cf5a195d84a2ba6","observation_id":"6e94bcfa-ef29-4123-8fa6-6c6146d3122b","resolution":{"observed_at":"2026-08-12T19:21:58.855533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-12T19:21:58.862026Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback , journal =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.862026Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:d08d2498326daadc6f2fd0bc300ea15f6854feb982da3d913e5c04b565c28bc9","observation_id":"eead0c0a-dcdf-469c-a06c-a3382e82d138","resolution":{"observed_at":"2026-08-12T19:21:58.862026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-12T19:21:58.868620Z","title":"Brown and Benjamin Chess and Rewon Child and Scott Gray and Alec Radford and Jeffrey Wu and Dario Amodei , title =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.868620Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:56f701a4c0418433df50025478fb2da463b8826d1e6da473c341f0cbfe70fc30","observation_id":"f503f6ea-2063-4c3e-bdf7-4b9d802ef501","resolution":{"observed_at":"2026-08-12T19:21:58.868620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.875174Z","title":"2011 , publisher=","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.875174Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:8cb09f767caece9941711da0c14361bfb7723150aedf6aa51498fade93969c76","observation_id":"409a4d5f-eb31-4393-b95c-0ab7fa7dbbe1","resolution":{"observed_at":"2026-08-12T19:21:58.875174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06624","last_updated":"2023-08-27T02:55:36Z","snapshot_observed_at":"2026-08-17T18:23:42.349595Z","submitted_at":"2023-06-11T08:53:12Z","title":"RestGPT: Connecting Large Language Models with Real-World RESTful APIs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06624","snapshot_observed_at":"2026-08-12T19:21:58.880808Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.880808Z"},"links":{"cited_paper":"/paper/2306.06624","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:56f918a4044d9c5044c1b158584fcbdb6756f1c746e409989f5ce0038a2529c4","observation_id":"d1bf6ce0-cf16-42e1-801e-9a1d8e4da587","resolution":{"observed_at":"2026-08-12T19:21:58.880808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.886530Z","title":"Improving Language Models by Retrieving from Trillions of Tokens , booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.886530Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:384744ab590bb733218c1698cc9017f01472271fd8dafe9ece32aed65e708729","observation_id":"677d6db5-626c-49a2-8c2c-1758ecae4f89","resolution":{"observed_at":"2026-08-12T19:21:58.886530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09842","last_updated":"2023-10-31T17:43:39Z","snapshot_observed_at":"2026-08-18T03:05:32.170128Z","submitted_at":"2023-04-19T17:47:47Z","title":"Chameleon: Plug-and-Play Compositional Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09842","snapshot_observed_at":"2026-08-12T19:21:58.891620Z","title":"Chameleon: Plug-and-Play Compositional Reasoning with Large Language Models , journal =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.891620Z"},"links":{"cited_paper":"/paper/2304.09842","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:916d434e568a2158b405caf80ba398dae8a0bfb0b0ab7737d323ce24517739da","observation_id":"22ec1c83-0ad8-411f-8276-1f1df8abbe85","resolution":{"observed_at":"2026-08-12T19:21:58.891620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08239","snapshot_observed_at":"2026-08-12T19:21:58.897223Z","title":"LaMDA: Language Models for Dialog Applications , journal =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.897223Z"},"links":{"cited_paper":"/paper/2201.08239","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:fffd251d44185dce13ec4a22b283e9cca9ce0e0fb685c9ae71ff5c66a6ff21ca","observation_id":"559368ef-7b8c-4ab8-a315-6d5ec915e2f3","resolution":{"observed_at":"2026-08-12T19:21:58.897223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12255","last_updated":"2022-05-24T17:58:13Z","snapshot_observed_at":"2026-08-16T16:57:58.786548Z","submitted_at":"2022-05-24T17:58:13Z","title":"TALM: Tool Augmented Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12255","snapshot_observed_at":"2026-08-12T19:21:58.903319Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.903319Z"},"links":{"cited_paper":"/paper/2205.12255","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:9358c153a34bbd4e40b7cf7f4920246036c002bf4516d01ed4b96f4b2c3cbb65","observation_id":"76062a80-5d32-46be-b837-e9e9ab1b69fa","resolution":{"observed_at":"2026-08-12T19:21:58.903319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17580","last_updated":"2023-12-03T18:17:21Z","snapshot_observed_at":"2026-08-12T12:50:51.005571Z","submitted_at":"2023-03-30T17:48:28Z","title":"HuggingGPT: Solving AI Tasks with ChatGPT and its Friends in Hugging Face","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17580","snapshot_observed_at":"2026-08-12T19:21:58.908726Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.908726Z"},"links":{"cited_paper":"/paper/2303.17580","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:22904411290b6029f2b95405db8a38006bb163588bdbe2a4e4a8b962531c2122","observation_id":"16d20607-24fc-42bd-beca-d3ee04d9c111","resolution":{"observed_at":"2026-08-12T19:21:58.908726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11554","last_updated":"2024-01-15T23:52:21Z","snapshot_observed_at":"2026-08-17T00:59:25.531672Z","submitted_at":"2023-05-19T09:54:21Z","title":"ToolkenGPT: Augmenting Frozen Language Models with Massive Tools via Tool Embeddings","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11554","snapshot_observed_at":"2026-08-12T19:21:58.914291Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.914291Z"},"links":{"cited_paper":"/paper/2305.11554","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:bd91165de113ffdb46bbca782af7ab877a60b215e1107d7efdbac28ac81e23d9","observation_id":"6416dcc2-8d0e-40de-be70-bd8c56b2e984","resolution":{"observed_at":"2026-08-12T19:21:58.914291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16504","last_updated":"2023-05-25T22:10:20Z","snapshot_observed_at":"2026-08-16T15:29:32.108538Z","submitted_at":"2023-05-25T22:10:20Z","title":"On the Tool Manipulation Capability of Open-source Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16504","snapshot_observed_at":"2026-08-12T19:21:58.919706Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.919706Z"},"links":{"cited_paper":"/paper/2305.16504","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:4c4ca085ee4939dc7edb49c98044429ba12effd6de469ff3a26a7d0c7b721dda","observation_id":"0d8f8a41-0d7f-467f-9700-deacd409d182","resolution":{"observed_at":"2026-08-12T19:21:58.919706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01560","last_updated":"2024-07-08T05:56:47Z","snapshot_observed_at":"2026-08-02T14:50:04.461434Z","submitted_at":"2023-02-03T06:06:27Z","title":"Describe, Explain, Plan and Select: Interactive Planning with Large Language Models Enables Open-World Multi-Task Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01560","snapshot_observed_at":"2026-08-12T19:21:58.925867Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.925867Z"},"links":{"cited_paper":"/paper/2302.01560","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:30dad348f9ed8ff4c3039892decda618013b85617635da905c8f9e32ff0b0b55","observation_id":"243aed30-d86c-4f25-98f4-3ca26e64c1db","resolution":{"observed_at":"2026-08-12T19:21:58.925867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.932398Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.932398Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:2a1d3894c6ba9f251cf1870fb03d756d353bb8c323303771442c9f1f08257990","observation_id":"02c142c0-e3f2-4826-9212-702502787eff","resolution":{"observed_at":"2026-08-12T19:21:58.932398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-08-07T17:14:39.278754Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-12T19:21:58.938065Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.938065Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:acae403998769f98e3ec0f50a21e08f5c3b82a846b91cffa9a4241a23a56da33","observation_id":"6a088319-384f-4d81-8edc-c2a88aa94bc5","resolution":{"observed_at":"2026-08-12T19:21:58.938065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11416","last_updated":"2022-12-06T21:39:48Z","snapshot_observed_at":"2026-08-17T10:20:11.128461Z","submitted_at":"2022-10-20T16:58:32Z","title":"Scaling Instruction-Finetuned Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11416","snapshot_observed_at":"2026-08-12T19:21:58.944883Z","title":"Zhao and Yanping Huang and Andrew M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.944883Z"},"links":{"cited_paper":"/paper/2210.11416","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:bf7378f5139f0eeff8747b537b61c6f39400b63a4971f761a1302a25bb8b0502","observation_id":"92a932cd-81a9-49f3-abcb-5181cffe8eaf","resolution":{"observed_at":"2026-08-12T19:21:58.944883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.950479Z","title":"Chi and Tatsunori Hashimoto and Oriol Vinyals and Percy Liang and Jeff Dean and William Fedus , title =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.950479Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:865392d382be081e71b83fa5f923eb713906798cb4a55551ca3e814ac3da6967","observation_id":"d0e7730e-4561-43e5-b1b9-12d4d2d64d5c","resolution":{"observed_at":"2026-08-12T19:21:58.950479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.956016Z","title":"Narasimhan and Yuan Cao , title =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.956016Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:a1c9ea71db7c2530e974183a86a6f1e0ed82b68172a2fe6462f8f0df5253d085","observation_id":"ffc3ef02-0713-4f13-9505-a6ef09f776e8","resolution":{"observed_at":"2026-08-12T19:21:58.956016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.961736Z","title":"Chi and Quoc V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.961736Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:ba4f69bd6bb7552f6714a4de2cb2ad7516f2013350e1ed525ff4474010b50709","observation_id":"b290845d-1959-4e9d-aee2-e1cef7ef86fd","resolution":{"observed_at":"2026-08-12T19:21:58.961736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-08-17T06:56:20.644738Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-12T19:21:58.967514Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.967514Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:c774a7b239d743007e35dd9f32f80e3d44df6393cf881b1bf51760d98e3ad624","observation_id":"501493c6-4cda-46d7-af8f-2689efd2876d","resolution":{"observed_at":"2026-08-12T19:21:58.967514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08775","last_updated":"2024-01-31T04:11:42Z","snapshot_observed_at":"2026-08-16T15:15:34.572025Z","submitted_at":"2023-07-17T18:42:05Z","title":"GEAR: Augmenting Language Models with Generalizable and Efficient Tool Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08775","snapshot_observed_at":"2026-08-12T19:21:58.973424Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.973424Z"},"links":{"cited_paper":"/paper/2307.08775","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:b5dee7ea17b5004db68f43bcdfdcb0ffb3d01ff26af6204e95c4cc646233a5bd","observation_id":"18b28abb-e018-486c-b4ec-84c4705b8b48","resolution":{"observed_at":"2026-08-12T19:21:58.973424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04671","last_updated":"2023-03-08T15:50:02Z","snapshot_observed_at":"2026-08-15T10:03:23.497428Z","submitted_at":"2023-03-08T15:50:02Z","title":"Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04671","snapshot_observed_at":"2026-08-12T19:21:58.978942Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.978942Z"},"links":{"cited_paper":"/paper/2303.04671","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:717a65c9e5706c8f63a98e5539f62320795c41c8b415dfb372cbdd61f5d800a7","observation_id":"43770c68-76d8-4d26-97d8-0aa098cde640","resolution":{"observed_at":"2026-08-12T19:21:58.978942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.984416Z","title":"GPT4Tools: Teaching Large Language Model to Use Tools via Self-instruction , booktitle =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.984416Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:3bebabe925db5637804d63e958ae8540c4466eb9e20f3e40e1ff24f153c2831b","observation_id":"67a41b55-0915-4817-b76f-f48acc6c4949","resolution":{"observed_at":"2026-08-12T19:21:58.984416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.990406Z","title":", author=","venue":null,"work_id":null,"year":1947},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.990406Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:74754bd95d995df8832883bdc43a092a1bfbe30577633ea744a21d6654b70771","observation_id":"aca258d9-31f2-48d8-8c41-62638fd2de37","resolution":{"observed_at":"2026-08-12T19:21:58.990406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:58.996026Z","title":"Patil and Tianjun Zhang and Xin Wang and Joseph E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:58.996026Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:45c7a80154b337a19a52f9eb529b142b5d87570e41e50d9013713f2bfb9f683e","observation_id":"cd50d75b-b662-4e67-a8d2-d9eb00453e05","resolution":{"observed_at":"2026-08-12T19:21:58.996026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.001037Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.001037Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:cd21c3e8e50ac43bdf36d55ce7d516d37e38c75a64984c4360b681b6b56449fe","observation_id":"444ba3f7-2efe-410e-9ed9-ad98eb8d3466","resolution":{"observed_at":"2026-08-12T19:21:59.001037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.008901Z","title":"Label Words are Anchors: An Information Flow Perspective for Understanding In-Context Learning , booktitle =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.008901Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:2a56938ca986d02d16a0d17824c328bc7e2eda5a44bea024094f43ef14741531","observation_id":"d61a495b-167e-4bd3-9e9c-9f728b833094","resolution":{"observed_at":"2026-08-12T19:21:59.008901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.014624Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.014624Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:3520ea90afbfae682de1d2fbc85edfdf24295047c17438ee1e6c92e9dc7b5838","observation_id":"06fcce3a-1348-4f1a-8bbc-40eb06386d6c","resolution":{"observed_at":"2026-08-12T19:21:59.014624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.019788Z","title":"Rethinking the Role of Demonstrations: What Makes In-Context Learning Work? , booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.019788Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:7f51d2bfd648f3af76fbfea4c11426e7f6db005d59a9f0e7bba5fa033f21ae56","observation_id":"7d6ee9cc-40a1-4fe8-ba2c-7d3bfa9bf6e4","resolution":{"observed_at":"2026-08-12T19:21:59.019788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-12T19:21:59.028908Z","title":"Nye and Maarten Bosma and Henryk Michalewski and David Dohan and Ellen Jiang and Carrie J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.028908Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:791d8585a1999e8ab6b48277a33271bfe822d30c4e6ad58f789c7f570b35ead5","observation_id":"7a84ff0a-1049-410a-ade2-7db6586bc985","resolution":{"observed_at":"2026-08-12T19:21:59.028908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.034957Z","title":"Measuring Mathematical Problem Solving With the","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.034957Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:d72173212f032ebde1ecbc08d629fe8c4c144f138cd65bd4d333a8809e45648c","observation_id":"5e6bd6cc-eee7-45d3-8a77-6595fb417be9","resolution":{"observed_at":"2026-08-12T19:21:59.034957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.043085Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.043085Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:bd06c9e4df93fbf329105911bfc2b50845fe211e61e7adab1351b3b85d1d6a83","observation_id":"c5f4779d-be23-4e95-a7ed-c12dbb3cf7a2","resolution":{"observed_at":"2026-08-12T19:21:59.043085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-12T19:21:59.049354Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.049354Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:7dad5d336658736531129e87c2f18d65896c40b0885a911d428938c5f40d676c","observation_id":"64e51fcf-4af9-40e3-abb9-65f4ea18934e","resolution":{"observed_at":"2026-08-12T19:21:59.049354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.055383Z","title":"InFoBench: Evaluating Instruction Following Ability in Large Language Models , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.055383Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:96da798b07964f96db673f1a4e0bfb4dd802699ff810e0428b385b87a94a6b5d","observation_id":"3fec37c2-3645-4121-acad-f36ed77b903b","resolution":{"observed_at":"2026-08-12T19:21:59.055383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06208","last_updated":"2025-07-17T08:39:11Z","snapshot_observed_at":"2026-08-18T03:37:34.508746Z","submitted_at":"2024-11-09T15:12:43Z","title":"IOPO: Empowering LLMs with Complex Instruction Following via Input-Output Preference Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06208","snapshot_observed_at":"2026-08-12T19:21:59.062541Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.062541Z"},"links":{"cited_paper":"/paper/2411.06208","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:f13c04f08af8f0a0d1bed7299aa6789d96c6705192c3165f97c81b6f95c9d4b6","observation_id":"43eecf78-d042-48cf-93b1-2fc5599aec3b","resolution":{"observed_at":"2026-08-12T19:21:59.062541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.739","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:22:01.702163Z","title":"CIF-Bench:","venue":null,"work_id":"471974dc-f723-4fc3-bba8-41f854417b2e","year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.069885Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:cb96d119ed646116af877a8d13397f519795de6b488e0e6d65f2600cca0c749a","observation_id":"c381b3c8-f251-46ff-8408-0aeceb4b2af3","resolution":{"observed_at":"2026-08-12T19:22:01.708390Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.077006Z","title":"Manning and Stefano Ermon and Chelsea Finn , editor =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.077006Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:4cdf6774bc0f9af07aef5b3c6b3c069193326b563b6c62fa02522c6122b33b82","observation_id":"219506e4-e879-48af-b797-41ff5f411b71","resolution":{"observed_at":"2026-08-12T19:21:59.077006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09829","last_updated":"2023-11-16T11:53:31Z","snapshot_observed_at":"2026-08-16T14:42:42.510450Z","submitted_at":"2023-11-16T11:53:31Z","title":"FollowEval: A Multi-Dimensional Benchmark for Assessing the Instruction-Following Capability of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09829","snapshot_observed_at":"2026-08-12T19:21:59.082243Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.082243Z"},"links":{"cited_paper":"/paper/2311.09829","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:75aa94de8a65de2ba293de068c19c5a870eab0e48476ae5f8db6318a2fa2804e","observation_id":"e1fda741-9ab2-465b-8824-813dcb2ae246","resolution":{"observed_at":"2026-08-12T19:21:59.082243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.087672Z","title":"From Complex to Simple: Enhancing Multi-Constraint Complex Instruction Following Ability of Large Language Models , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.087672Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:62196fb9071607b952308dbb94fad01c2a291c474972e92d7acdfcd29049df3e","observation_id":"d7131c1c-784a-45c8-924e-ac75120185b5","resolution":{"observed_at":"2026-08-12T19:21:59.087672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02823","last_updated":"2024-04-03T15:55:39Z","snapshot_observed_at":"2026-08-16T14:03:54.671324Z","submitted_at":"2024-04-03T15:55:39Z","title":"Conifer: Improving Complex Constrained Instruction-Following Ability of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02823","snapshot_observed_at":"2026-08-12T19:21:59.093215Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.093215Z"},"links":{"cited_paper":"/paper/2404.02823","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:30d700bbcfc5e2671b12a336409a7fcdeb09b9f4ced117406aaba30e6893448a","observation_id":"37c7d433-dc3e-4ac7-a205-acaa6e91b16b","resolution":{"observed_at":"2026-08-12T19:21:59.093215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13542","last_updated":"2024-07-18T09:00:23Z","snapshot_observed_at":"2026-08-16T13:41:27.031886Z","submitted_at":"2024-06-19T13:29:53Z","title":"Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13542","snapshot_observed_at":"2026-08-12T19:21:59.098498Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.098498Z"},"links":{"cited_paper":"/paper/2406.13542","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:febd9f761a8220576262f634413c210e395149c1901965b199e588fadf9f56f5","observation_id":"89c0deb6-04e4-46e9-a823-fd598e39e6a4","resolution":{"observed_at":"2026-08-12T19:21:59.098498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11605","last_updated":"2025-03-16T09:43:15Z","snapshot_observed_at":"2026-08-16T16:55:47.412176Z","submitted_at":"2024-12-16T09:47:43Z","title":"SPaR: Self-Play with Tree-Search Refinement to Improve Instruction-Following in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11605","snapshot_observed_at":"2026-08-12T19:21:59.104812Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.104812Z"},"links":{"cited_paper":"/paper/2412.11605","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:bc757bcb8659d5145ef36578d6e8e00f5f14961d1f44182f6479ec58343c6cf5","observation_id":"bb77a871-757a-4ad2-842f-b800da01771a","resolution":{"observed_at":"2026-08-12T19:21:59.104812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15553","last_updated":"2024-11-13T04:26:13Z","snapshot_observed_at":"2026-08-16T18:18:26.938255Z","submitted_at":"2024-10-21T00:59:47Z","title":"Multi-IF: Benchmarking LLMs on Multi-Turn and Multilingual Instructions Following","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15553","snapshot_observed_at":"2026-08-12T19:21:59.112477Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.112477Z"},"links":{"cited_paper":"/paper/2410.15553","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:f6750ff058fb49fec12089314f1b4e022d643bb729f1287a028dea4fa21e6527","observation_id":"7cb0ccac-6e5e-4765-8b12-d6536c089f2e","resolution":{"observed_at":"2026-08-12T19:21:59.112477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.118087Z","title":"FollowBench:","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.118087Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:4d7eba6dc3a31025e3fadaba45cb6f7d6f1d46f748b009767df4f7da1b451264","observation_id":"b21da20d-4005-4b86-bb06-3eee258a38e9","resolution":{"observed_at":"2026-08-12T19:21:59.118087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01437","last_updated":"2024-07-12T17:20:34Z","snapshot_observed_at":"2026-08-16T13:38:02.935764Z","submitted_at":"2024-07-01T16:32:16Z","title":"Needle in the Haystack for Memory Based Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01437","snapshot_observed_at":"2026-08-12T19:21:59.129521Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.129521Z"},"links":{"cited_paper":"/paper/2407.01437","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:cb3ce58ba45c2c717742b3264584934d08a88b8b7e71a76c97c8615233e2c88e","observation_id":"8dea1378-933a-4d8f-856b-792e97303e34","resolution":{"observed_at":"2026-08-12T19:21:59.129521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-12T19:21:59.135717Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.135717Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:ad0101f5b7cb9e4f280d4ec9e71132546d91d7a57dc90ee6fe2044d00266b654","observation_id":"f76cd0a4-0968-40aa-a153-c79214cd5fc1","resolution":{"observed_at":"2026-08-12T19:21:59.135717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.143832Z","title":"Findings of the Association for Computational Linguistics,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.143832Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:8a33eb50746483b547d2e0b989e2976ff25416cbe97c98c89e38d479a9e71b16","observation_id":"259dd41d-7df7-40b7-9726-859a10de69a5","resolution":{"observed_at":"2026-08-12T19:21:59.143832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08085","last_updated":"2023-04-17T09:00:50Z","snapshot_observed_at":"2026-08-16T15:39:59.221827Z","submitted_at":"2023-04-17T09:00:50Z","title":"InstructUIE: Multi-task Instruction Tuning for Unified Information Extraction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08085","snapshot_observed_at":"2026-08-12T19:21:59.152621Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.152621Z"},"links":{"cited_paper":"/paper/2304.08085","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:e38e24e4370c51b8972e4d9192aae2e88e834084f58751a7bfb68d5818f861f5","observation_id":"dc5eecb0-ae1b-4ca8-b5ad-b73c7525b84c","resolution":{"observed_at":"2026-08-12T19:21:59.152621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.160015Z","title":"Long Context vs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.160015Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:788fe408866ec059063198c74c4e1e88af3843e446fc3c344c0bb04ccb1bb633","observation_id":"e6d96620-9d51-4b89-af16-2dd3598b649a","resolution":{"observed_at":"2026-08-12T19:21:59.160015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07591","last_updated":"2026-04-15T04:31:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-12T14:16:55Z","title":"MulDimIF: A Multi-Dimensional Constraint Framework for Evaluating and Improving Instruction Following in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07591","snapshot_observed_at":"2026-08-12T19:21:59.166468Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.166468Z"},"links":{"cited_paper":"/paper/2505.07591","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:57c94f9a048d926deabb852a2032f5183fdbca78b8990dc631f18d5faf300250","observation_id":"c183f780-9786-431c-b428-3cd84bbbf6d9","resolution":{"observed_at":"2026-08-12T19:21:59.166468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.172188Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.172188Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:d9d9a1b1f21b6f3b2651c7d9555f54db0303675366b7e756847aa9897bce3243","observation_id":"f43e3356-ddf2-45e9-889f-ebe1c070661a","resolution":{"observed_at":"2026-08-12T19:21:59.172188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.179579Z","title":"Hanjie and Runzhe Yang and Karthik R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.179579Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:ef97bc37d5d638c85018f9703b52724aed9c1d9819e39007f3a905a288616e6d","observation_id":"6edc0562-3a95-46b9-8612-4b61d88ba15b","resolution":{"observed_at":"2026-08-12T19:21:59.179579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.18234","last_updated":"2025-10-21T02:41:44Z","snapshot_observed_at":"2026-08-17T02:37:33.939393Z","submitted_at":"2025-10-21T02:41:44Z","title":"DeepSeek-OCR: Contexts Optical Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.18234","snapshot_observed_at":"2026-08-12T19:21:59.189384Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.189384Z"},"links":{"cited_paper":"/paper/2510.18234","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:b06c40c57b922863002b107f8db68cd666a0ff92d0cc7379f31822220ac96de7","observation_id":"adc69345-6af4-49d4-be9c-d20a6219a7af","resolution":{"observed_at":"2026-08-12T19:21:59.189384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.08791","last_updated":"2026-04-15T06:01:13Z","snapshot_observed_at":"2026-08-14T15:36:23.868569Z","submitted_at":"2025-08-12T09:45:19Z","title":"Feedback-Driven Tool-Use Improvements in Large Language Models via Automated Build Environments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.08791","snapshot_observed_at":"2026-08-12T19:21:59.195991Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.195991Z"},"links":{"cited_paper":"/paper/2508.08791","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:89d95057d2c9fba2e3ef611ed0888252b60c90d0ffc660507086024f88084a59","observation_id":"0a24fd01-5bb2-49dc-9b7f-205d925dea79","resolution":{"observed_at":"2026-08-12T19:21:59.195991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-08-17T01:58:07.850738Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-08-12T19:21:59.203762Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models , journal =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.203762Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:bcf3455e1531b3dc7b7ebe74342221638ef5944946161d42eb0f16eb5210a1f3","observation_id":"2c123124-ae6f-400b-ad14-e6cb13f5a139","resolution":{"observed_at":"2026-08-12T19:21:59.203762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-12T19:21:59.213050Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.213050Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:c813c5c3ef9ca654062253622251ed14153ca572fe9d1b42203a23acab029028","observation_id":"10870325-622c-473c-b126-934be6591ef0","resolution":{"observed_at":"2026-08-12T19:21:59.213050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.219235Z","title":"2024 , url=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.219235Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:327cc1ed00648b464c3600c00696e1942abd15dac035d1337e2691a2202570a3","observation_id":"b581982a-1e51-4025-b3d5-e08152b243f8","resolution":{"observed_at":"2026-08-12T19:21:59.219235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.225271Z","title":"2023 , url=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.225271Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:00143570b5294b097c3cd8b46e4c8daf0aaad2113cd82bbcf744655769616813","observation_id":"478158d4-3e28-4940-9f30-97e5f055682d","resolution":{"observed_at":"2026-08-12T19:21:59.225271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-18T03:59:39.242039Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-12T19:21:59.232907Z","title":"Code Llama: Open Foundation Models for Code , journal =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.232907Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:634cf80d626e7152ba490ee6290bc96ffb09b1c20037276842ba3bf8b328f636","observation_id":"24e30cd2-de56-4bd5-8032-d86f246dcfc0","resolution":{"observed_at":"2026-08-12T19:21:59.232907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.238846Z","title":"ToolHop:","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.238846Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:7a6f9129aebc22c457aa7804f1adc8b3ac2f05d8d5dc174b3a39d218c6c192ff","observation_id":"3a52fc40-6cf4-4664-a5e6-d87f60e13b2b","resolution":{"observed_at":"2026-08-12T19:21:59.238846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.245764Z","title":"2023 , url=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.245764Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:781c7904ecee650585779e0d46125bbe5e80390b6a9d662e8fc38e01168d9d36","observation_id":"bd455ddb-5ec9-46e5-8f49-1a32cc7c7b27","resolution":{"observed_at":"2026-08-12T19:21:59.245764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.252278Z","title":"T-Eval: Evaluating the Tool Utilization Capability of Large Language Models Step by Step , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.252278Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:ddc771d1c7d1f174374b94173ce4badc93a7251bfb81619a765c19638d9158ea","observation_id":"44819e06-aebc-406c-9097-bb6d2c07442b","resolution":{"observed_at":"2026-08-12T19:21:59.252278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:59.257857Z","title":"TaskBench: Benchmarking Large Language Models for Task Automation , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-12T19:21:59.257857Z"},"links":{"citing_paper":"/paper/2608.10692"},"observation_digest":"sha256:4705f192f62337192efb231c10e0b3085890a9fe86f89e94c82972899c9645cf","observation_id":"4081df13-c0af-4874-95c5-8689dd87b6c1","resolution":{"observed_at":"2026-08-12T19:21:59.257857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.10692","last_updated":"2026-08-11T09:14:53Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T17:27:37.003545Z","submitted_at":"2026-08-11T09:14:53Z","title":"SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":94,"verified_exact":5,"verified_fuzzy":0},"total_outbound_references":218},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 100 of 218 outbound references and 0 inbound Pith citation observations for arXiv:2608.10692."}