{"as_of":"2026-08-10T04:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:26751debc1a2712d00ac84374e8c82d2b32679a3428a4edacedbe7d7c4b003cc","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T16:35:28.447005Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T23:51:50.319798Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T10:09:45.028347Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"cited_work":{"arxiv_id":"2502.01118","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01118","snapshot_observed_at":"2026-07-04T10:09:45.028347Z","title":"Large language model-enhanced multi-armed bandits.arXiv preprint arXiv:2502.01118, 2025","venue":null,"work_id":"d5e7c059-cbdd-4b49-9980-906998a23ade","year":2025},"citing_paper":{"arxiv_id":"2604.05859","last_updated":"2026-04-07T13:20:06Z","snapshot_observed_at":"2026-08-03T16:43:40.161272Z","submitted_at":"2026-04-07T13:20:06Z","title":"When Do We Need LLMs? A Diagnostic for Language-Driven Bandits","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-10T18:32:12.396568Z"},"links":{"cited_paper":"/paper/2502.01118","citing_paper":"/paper/2604.05859"},"observation_digest":"sha256:5a5a112517b19283bedff23f4c922a100b434f68fcc08b6f7e4729ac653d3445","observation_id":"7e85714f-417c-4951-a850-a56ad7447dad","resolution":{"observed_at":"2026-05-11T00:25:51.129269Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"cited_work":{"arxiv_id":"2502.01118","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01118","snapshot_observed_at":"2026-07-04T10:09:45.028347Z","title":"Large language model-enhanced multi-armed bandits.arXiv preprint arXiv:2502.01118, 2025","venue":null,"work_id":"d5e7c059-cbdd-4b49-9980-906998a23ade","year":2025},"citing_paper":{"arxiv_id":"2604.14961","last_updated":"2026-04-16T12:55:40Z","snapshot_observed_at":"2026-07-06T23:02:36.062162Z","submitted_at":"2026-04-16T12:55:40Z","title":"Calibration-Gated LLM Pseudo-Observations for Online Contextual Bandits","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T12:22:28.655926Z"},"links":{"cited_paper":"/paper/2502.01118","citing_paper":"/paper/2604.14961"},"observation_digest":"sha256:5aa8d2773f6cca0af071bdc98e582e04da2891973c3e6561cdbe702cb7f0e51e","observation_id":"e24fc470-732f-419d-8a18-c5e79c456709","resolution":{"observed_at":"2026-05-10T12:25:22.579124Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"cited_work":{"arxiv_id":"2502.01118","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01118","snapshot_observed_at":"2026-07-04T10:09:45.028347Z","title":"Large language model-enhanced multi-armed bandits.arXiv preprint arXiv:2502.01118, 2025","venue":null,"work_id":"d5e7c059-cbdd-4b49-9980-906998a23ade","year":2025},"citing_paper":{"arxiv_id":"2606.23299","last_updated":"2026-08-05T05:48:40Z","snapshot_observed_at":"2026-08-08T23:10:24.925029Z","submitted_at":"2026-06-22T13:10:50Z","title":"GRIMIP: A General Framework for Instance-Specific Configuration of MIP Solvers Using LLMs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-26T09:05:56.687400Z"},"links":{"cited_paper":"/paper/2502.01118","citing_paper":"/paper/2606.23299"},"observation_digest":"sha256:7095a223eb0d3977adb1d1a3e8bb31652618fee8135caf25a27ecd4b3524bedc","observation_id":"925a4193-bd9b-4dae-80d2-88e79e406c0b","resolution":{"observed_at":"2026-07-04T10:09:45.029930Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01118","snapshot_observed_at":"2026-07-31T23:51:50.319798Z","title":"arXiv preprint arXiv:2502.01118 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23333","last_updated":"2026-07-25T19:11:15Z","snapshot_observed_at":"2026-08-03T00:37:21.399146Z","submitted_at":"2026-07-25T19:11:15Z","title":"Training with (Swap) Regret Loss in a Single-Layer Self-Attention Model: A Case Study on the Probability Simplex","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-31T23:51:50.319798Z"},"links":{"cited_paper":"/paper/2502.01118","citing_paper":"/paper/2607.23333"},"observation_digest":"sha256:84247bd7b1ce970814b39bd7189b7952908a83cbb1326f9ea6285b087796fbf8","observation_id":"72a679c9-9451-436b-84b2-a0ae00b3e3ba","resolution":{"observed_at":"2026-07-31T23:51:50.319798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.01118/citation-record","integrity":"/paper/2502.01118/integrity","json":"/paper/2502.01118/citation-record.json","paper":"/paper/2502.01118"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.03428","last_updated":"2024-01-07T09:08:24Z","snapshot_observed_at":"2026-07-06T17:12:26.471069Z","submitted_at":"2024-01-07T09:08:24Z","title":"Exploring Large Language Model based Intelligent Agents: Definitions, Methods, and Prospects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03428","snapshot_observed_at":"2026-08-09T16:35:28.399651Z","title":"Ex- ploring large language model based intelligent agents: Definitions, methods, and prospects","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.399651Z"},"links":{"cited_paper":"/paper/2401.03428","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:aaf37ccaedfe3d0fae30a0f29d81e337de637b3239562aab9388ad4f83ccee32","observation_id":"7ac073ff-9d07-4bd0-a484-31bec8094c44","resolution":{"observed_at":"2026-08-09T16:35:28.399651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06826","last_updated":"2024-03-11T15:43:14Z","snapshot_observed_at":"2026-07-06T17:42:41.349428Z","submitted_at":"2024-03-11T15:43:14Z","title":"In-context Exploration-Exploitation for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06826","snapshot_observed_at":"2026-08-09T16:35:28.402832Z","title":"In-context exploration- exploitation for reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.402832Z"},"links":{"cited_paper":"/paper/2403.06826","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:96751c51291d36ed64f724c06c3de094cbc00628c63229b59a25b612b35f610e","observation_id":"6ae5361e-2716-490a-ac7a-b3e893acc484","resolution":{"observed_at":"2026-08-09T16:35:28.402832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00396","last_updated":"2024-06-04T18:35:09Z","snapshot_observed_at":"2026-07-06T17:23:35.004068Z","submitted_at":"2024-02-01T07:32:24Z","title":"Efficient Exploration for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00396","snapshot_observed_at":"2026-08-09T16:35:28.405762Z","title":"M., Hao, B., and Van Roy, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.405762Z"},"links":{"cited_paper":"/paper/2402.00396","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:f8594bdcdf0b6df83fa4d30dbd851c6d033ed2380c4367c26f5a61c290495509","observation_id":"9ef088c9-3e97-4d6a-9054-6f8144f7cdf2","resolution":{"observed_at":"2026-08-09T16:35:28.405762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15371","last_updated":"2024-10-28T19:55:46Z","snapshot_observed_at":"2026-07-06T17:49:07.589781Z","submitted_at":"2024-03-22T17:50:43Z","title":"Can large language models explore in-context?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15371","snapshot_observed_at":"2026-08-09T16:35:28.412559Z","title":"J., Zhang, C., and Slivkins, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.412559Z"},"links":{"cited_paper":"/paper/2403.15371","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:1e20fb0860d7cc783c268ef3a8b519022577d797c2a4b7adbba9e1c4c23d46ca","observation_id":"b3b1b16b-31b2-4072-ac64-9ff18668e5ef","resolution":{"observed_at":"2026-08-09T16:35:28.412559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14215","last_updated":"2022-10-25T17:57:49Z","snapshot_observed_at":"2026-08-08T00:48:37.690583Z","submitted_at":"2022-10-25T17:57:49Z","title":"In-context Reinforcement Learning with Algorithm Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.14215","snapshot_observed_at":"2026-08-09T16:35:28.414618Z","title":"In-context reinforcement learning with algorithm distillation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.414618Z"},"links":{"cited_paper":"/paper/2210.14215","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:ed7fa578c51ad40772bf61c15c5fc8842437aa98626f1d5275439ba2e107486e","observation_id":"11fce7a2-85a6-4237-a1a5-511c898a5531","resolution":{"observed_at":"2026-08-09T16:35:28.414618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06013","last_updated":"2024-04-09T04:45:18Z","snapshot_observed_at":"2026-08-04T01:12:22.696468Z","submitted_at":"2024-04-09T04:45:18Z","title":"Feel-Good Thompson Sampling for Contextual Dueling Bandits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06013","snapshot_observed_at":"2026-08-09T16:35:28.416638Z","title":"Feel-Good Thompson Sam- pling for Contextual Dueling Bandits","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.416638Z"},"links":{"cited_paper":"/paper/2404.06013","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:2ce41cc101e9d936cbb8bdd4172c7a05a629fba9d77cdd2bec17753c8385004e","observation_id":"00a4f45e-0efa-4836-b504-e9d32e48dcd5","resolution":{"observed_at":"2026-08-09T16:35:28.416638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17346","last_updated":"2024-05-27T16:49:29Z","snapshot_observed_at":"2026-07-06T18:20:44.070255Z","submitted_at":"2024-05-27T16:49:29Z","title":"Prompt Optimization with Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17346","snapshot_observed_at":"2026-08-09T16:35:28.419518Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.419518Z"},"links":{"cited_paper":"/paper/2405.17346","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:5205649f45fdab03eb95e3d1cbe73657442f76bb47a115389e0d99893c473268","observation_id":"13f79b30-3afd-46c1-8894-1d1359c4d537","resolution":{"observed_at":"2026-08-09T16:35:28.419518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-09T16:35:28.422266Z","title":"DeepSeek- v3 technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.422266Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:9023330859610e5d06e9a3dbde0f52b79c825187b2795555a95fbc65ad33582b","observation_id":"e19a04e7-8d86-4d17-8419-f2bd12ee4e85","resolution":{"observed_at":"2026-08-09T16:35:28.422266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T16:35:28.427581Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.427581Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:8492651f50dc9aba3f28661abb503fd0e62711f9c3eb1790cd701daf61c214f9","observation_id":"d9640052-2ea4-4ec3-ac20-e542a866f8f9","resolution":{"observed_at":"2026-08-09T16:35:28.427581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:35:29.314276Z","title":"Wikilinks: A large-scale cross-document coreference cor- pus labeled via links to wikipedia","venue":null,"work_id":"88dbfea7-4326-4bab-9712-c112f8ffe6f9","year":2012},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.430202Z"},"links":{"citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:bd80e98b31f3e27872078fa755dcc402d3ab03d781119d3ed256b65018312cec","observation_id":"ef8e30af-bcb0-4fed-aa18-796d22b2f942","resolution":{"observed_at":"2026-08-09T16:35:29.317407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01557","last_updated":"2024-03-17T23:23:31Z","snapshot_observed_at":"2026-08-06T16:46:34.632571Z","submitted_at":"2023-10-02T18:52:11Z","title":"SmartPlay: A Benchmark for LLMs as Intelligent Agents","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01557","snapshot_observed_at":"2026-08-09T16:35:28.435740Z","title":"A survey on large language model based autonomous agents.Frontiers of Computer Science, 18(6):186345, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.435740Z"},"links":{"cited_paper":"/paper/2310.01557","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:97c77924231fad30ea0b4224a52233cdd432eb7555b64a6d3d66161b14132f1a","observation_id":"8e777ba9-046d-4891-8604-e21799a6a796","resolution":{"observed_at":"2026-08-09T16:35:28.435740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-08-09T18:54:02.679174Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07864","snapshot_observed_at":"2026-08-09T16:35:28.438561Z","title":"The rise and potential of large language model based agents: A survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.438561Z"},"links":{"cited_paper":"/paper/2309.07864","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:b2d68afdd1ae90c18317cc28e91168b3e42e86d28d0c185c9dde8f778dc0b207","observation_id":"81caac2d-8707-4acf-ac4f-aa8752b83d8c","resolution":{"observed_at":"2026-08-09T16:35:28.438561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04151","last_updated":"2024-06-06T15:15:41Z","snapshot_observed_at":"2026-08-09T08:52:31.974183Z","submitted_at":"2024-06-06T15:15:41Z","title":"AgentGym: Evolving Large Language Model-based Agents across Diverse Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04151","snapshot_observed_at":"2026-08-09T16:35:28.441317Z","title":"Agentgym: Evolving large language model-based agents across di- verse environments","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.441317Z"},"links":{"cited_paper":"/paper/2406.04151","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:3418be5482dea772b7dc66ffc1e0536b537752d3d12083cef8e3cd869262365d","observation_id":"721aa724-5544-4a75-a6b6-cd19e0770c73","resolution":{"observed_at":"2026-08-09T16:35:28.441317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01887","last_updated":"2025-06-09T14:56:27Z","snapshot_observed_at":"2026-08-05T15:43:37.563068Z","submitted_at":"2024-07-02T02:18:14Z","title":"Beyond Numeric Rewards: In-Context Dueling Bandits with LLM Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01887","snapshot_observed_at":"2026-08-09T16:35:28.444193Z","title":"Beyond numeric awards: In-context dueling bandits with llm agents.arXiv preprint arXiv:2407.01887,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.444193Z"},"links":{"cited_paper":"/paper/2407.01887","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:05173c7463380d9dee34a4caaff8a7b73926555d378cb2aa446c107f87569f7b","observation_id":"da32c694-8115-4e1f-86e5-32a9ef833f86","resolution":{"observed_at":"2026-08-09T16:35:28.444193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:35:28.410526Z","title":"Y ., McAleer, S., Fried, D., and Salakhutdinov, R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.410526Z"},"links":{"citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:0e300b17c667ed18456648d72d9746e7d0da5fdcd7383763ed40d768ff6a484d","observation_id":"4da292a3-76d7-43e0-83ae-7134394e7c3b","resolution":{"observed_at":"2026-08-09T16:35:28.410526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02884","last_updated":"2024-11-21T07:07:59Z","snapshot_observed_at":"2026-08-07T12:03:21.367108Z","submitted_at":"2024-10-03T18:12:29Z","title":"LLaMA-Berry: Pairwise Optimization for O1-like Olympiad-Level Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02884","snapshot_observed_at":"2026-08-09T16:35:28.447005Z","title":"Llama-berry: Pairwise optimization for o1-like olympiad-level math- ematical reasoning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.447005Z"},"links":{"cited_paper":"/paper/2410.02884","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:26207b7af26e4688218625da2f3548a32bd99149ada37c99abf7c330499439c1","observation_id":"4bfc6eeb-f2ca-4590-b52d-89aa034c0b8f","resolution":{"observed_at":"2026-08-09T16:35:28.447005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09078","last_updated":"2025-04-01T12:48:43Z","snapshot_observed_at":"2026-08-08T09:53:22.230954Z","submitted_at":"2024-12-12T09:01:18Z","title":"Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09078","snapshot_observed_at":"2026-08-09T16:35:28.392673Z","title":"Bi, Z., Han, K., Liu, C., Tang, Y ., and Wang, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.392673Z"},"links":{"cited_paper":"/paper/2412.09078","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:76ae118399f94887acd063a99c254d5ad3a2fa42870492bdd2f36b660a6ed6a1","observation_id":"9f9b5af0-f6c9-4a12-b53c-52a27ba770c1","resolution":{"observed_at":"2026-08-09T16:35:28.392673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14992","last_updated":"2023-10-23T07:24:28Z","snapshot_observed_at":"2026-07-06T15:32:25.931739Z","submitted_at":"2023-05-24T10:28:28Z","title":"Reasoning with Language Model is Planning with World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14992","snapshot_observed_at":"2026-08-09T16:35:28.408114Z","title":"J., Wang, Z., Wang, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.408114Z"},"links":{"cited_paper":"/paper/2305.14992","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:9e529c450485674596b82bf6983c30230542bae0e09a312094128bb49fc1e1f1","observation_id":"6fa7b74c-07aa-4730-814e-0f0e3f15ad62","resolution":{"observed_at":"2026-08-09T16:35:28.408114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17112","last_updated":"2025-04-16T11:44:53Z","snapshot_observed_at":"2026-08-02T11:58:52.733003Z","submitted_at":"2024-07-24T09:23:22Z","title":"Neural Dueling Bandits: Preference-Based Optimization with Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17112","snapshot_observed_at":"2026-08-09T16:35:28.432870Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.432870Z"},"links":{"cited_paper":"/paper/2407.17112","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:c7f9a8765356a180e4f00ab635614a3ba9618f4acfeb70c2eb79b002264d4e3b","observation_id":"60bec8d0-2692-46cf-91bb-7a64c7da2c42","resolution":{"observed_at":"2026-08-09T16:35:28.432870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2406.05064","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:35:28.667639Z","title":"P., Xie, Q., and Nowak, R","venue":null,"work_id":"ffe1f0a2-396f-4dc9-8fb4-02debee3facd","year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.425078Z"},"links":{"citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:d8a1470ba21cb1110dcbbed2678d004f71ac2f53da67209b64798fcb81160a4b","observation_id":"14a80937-72c7-4b81-8c85-3dde3647387a","resolution":{"observed_at":"2026-08-09T16:35:28.672114Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12125","last_updated":"2025-06-15T04:49:56Z","snapshot_observed_at":"2026-08-08T06:11:57.491279Z","submitted_at":"2024-06-17T22:13:22Z","title":"Efficient Sequential Decision Making with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12125","snapshot_observed_at":"2026-08-09T16:35:28.396588Z","title":"Efficient sequential deci- sion making with large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T16:35:28.396588Z"},"links":{"cited_paper":"/paper/2406.12125","citing_paper":"/paper/2502.01118"},"observation_digest":"sha256:1ddcdb6a9dbce6aa113a9a87795862b99ea3ef5e37f45ab473f43c94b7401ec0","observation_id":"562233f7-1593-4733-bd40-d1f9d4fb1cd3","resolution":{"observed_at":"2026-08-09T16:35:28.396588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.01118","last_updated":"2025-02-03T07:19:05Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T16:28:13.792150Z","submitted_at":"2025-02-03T07:19:05Z","title":"Large Language Model-Enhanced Multi-Armed Bandits"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 4 inbound Pith citation observations for arXiv:2502.01118."}