{"as_of":"2026-08-09T11:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7baab02ee47685c889f5e177f3ada72a2b1732fc2bf6122f8b99068be068a9de","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T02:44:08.758916Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.18481/citation-record","integrity":"/paper/2602.18481/integrity","json":"/paper/2602.18481/citation-record.json","paper":"/paper/2602.18481"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:05.582245Z","title":"Finqa: A dataset of numerical reasoning over financial data","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:05.582245Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:4caa01b8b2369d145d3df1dc00dffcd3715c4a829826688a4ac503f9a7542048","observation_id":"b0812d55-f753-4046-9ea0-0e381415541c","resolution":{"observed_at":"2026-08-03T02:44:05.582245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.07624","last_updated":"2021-06-01T05:38:50Z","snapshot_observed_at":"2026-08-08T00:40:10.990278Z","submitted_at":"2021-05-17T06:12:06Z","title":"TAT-QA: A Question Answering Benchmark on a Hybrid of Tabular and Textual Content in Finance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.07624","snapshot_observed_at":"2026-08-03T02:44:05.697941Z","title":"Tat-qa: A question answering benchmark on a hybrid of tabular and textual content in finance.arXiv preprint arXiv:2105.07624, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:05.697941Z"},"links":{"cited_paper":"/paper/2105.07624","citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:4a4d2c9d332c741ed6be4427d4435387f3d64accde7394406192bacc711815ba","observation_id":"1cd0d8aa-ee54-48ef-b60b-3b29c037708d","resolution":{"observed_at":"2026-08-03T02:44:05.697941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03849","last_updated":"2022-10-07T23:48:50Z","snapshot_observed_at":"2026-08-07T22:01:39.197177Z","submitted_at":"2022-10-07T23:48:50Z","title":"ConvFinQA: Exploring the Chain of Numerical Reasoning in Conversational Finance Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03849","snapshot_observed_at":"2026-08-03T02:44:05.867024Z","title":"Convfinqa: Exploring the chain of numerical reasoning in conversational finance question answering.arXiv preprint arXiv:2210.03849, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:05.867024Z"},"links":{"cited_paper":"/paper/2210.03849","citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:b25c79678913ceb549c108960010fa3eb6eacf9f4fce06f0c285eea3579ae5e1","observation_id":"66904b42-a271-423a-9ab9-9fc897c66736","resolution":{"observed_at":"2026-08-03T02:44:05.867024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17564","last_updated":"2023-12-21T06:21:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T17:30:36Z","title":"BloombergGPT: A Large Language Model for Finance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17564","snapshot_observed_at":"2026-08-03T02:44:05.991095Z","title":"Bloomberggpt: A large language model for finance.arXiv preprint arXiv:2303.17564, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:05.991095Z"},"links":{"cited_paper":"/paper/2303.17564","citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:8709d84a5a685b21a8357b02948d3cc8c4a0d97452b84594fd610c67fc9099bc","observation_id":"4e44bb75-736b-4eb0-8432-266681f8b2ca","resolution":{"observed_at":"2026-08-03T02:44:05.991095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10485","last_updated":"2023-11-14T16:34:00Z","snapshot_observed_at":"2026-08-07T08:19:17.863147Z","submitted_at":"2023-07-19T22:43:57Z","title":"FinGPT: Democratizing Internet-scale Data for Financial Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10485","snapshot_observed_at":"2026-08-03T02:44:06.137083Z","title":"Fingpt: Democratizing internet-scale data for financial large language models.arXiv preprint arXiv:2307.10485, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:06.137083Z"},"links":{"cited_paper":"/paper/2307.10485","citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:2a9c22727259504db392c5cb5936bf7dd67941297ef784bed690338d4979ca54","observation_id":"e0dd2e07-19ea-49f4-8ee1-6f3f67626372","resolution":{"observed_at":"2026-08-03T02:44:06.137083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:06.238724Z","title":"Pixiu: A comprehensive benchmark, instruction dataset and large language model for finance.Advances in Neural Information Processing Systems, 36:33469–33484, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:06.238724Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:8e454fba918848629fb83be09d7cd3c2ab3e37aaa19896dd0bce4d352a2bbf9c","observation_id":"bd4ed727-80d0-472b-879b-70f78bae9698","resolution":{"observed_at":"2026-08-03T02:44:06.238724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:06.362497Z","title":"Finben: A holistic financial benchmark for large language models.Advances in Neural Information Processing Systems, 37:95716–95743, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:06.362497Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:2ea734a25c67fed5743d4acc6292e52760589dd56fc5a29a19a06d45a312c3a6","observation_id":"492cbb36-17ba-4464-a0ec-d3d6563ce676","resolution":{"observed_at":"2026-08-03T02:44:06.362497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:06.522805Z","title":"Ai trading in real markets, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:06.522805Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:5d4088b146435cd77e5ad2355add55b080afc988a78e3c2d23cc4164930be20a","observation_id":"07a2e252-ee15-4c45-a8ba-aa8e1560ed87","resolution":{"observed_at":"2026-08-03T02:44:06.522805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:06.669703Z","title":"Fintextqa: A dataset for long-form financial question answering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:06.669703Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:2ec6cf110453128f03002f21e3545914a6e4a5aaac432e9567a5f278e86494da","observation_id":"a9317503-4e02-48cd-9bc8-92f1aaf4c481","resolution":{"observed_at":"2026-08-03T02:44:06.669703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:06.753930Z","title":"Cfinbench: A comprehensive chinese financial benchmark for large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:06.753930Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:2815db9215c7b75a6986e4ea85c65a860fb510847c78c381853ade47539359bc","observation_id":"8d44e0c3-bf8a-401f-80a0-f231444efbb2","resolution":{"observed_at":"2026-08-03T02:44:06.753930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:06.874481Z","title":"Fin-eva version 1.0: A chinese financial evaluation benchmark for large language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:06.874481Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:fbe405920a77b338d0835f4c6cd65747d892a8b2320685ba559a2ad208dbd514","observation_id":"40502498-bae6-4b0e-a696-af2b772ce986","resolution":{"observed_at":"2026-08-03T02:44:06.874481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:07.019460Z","title":"Ucfe: A user-centric financial expertise benchmark for large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:07.019460Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:37d5d74995beb46869e0ac34ba06ef885dc74465cac2d25002b3852f15d88b0f","observation_id":"0147cbd5-4d7a-4036-a6d4-2a44d7e4a59c","resolution":{"observed_at":"2026-08-03T02:44:07.019460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:07.106304Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:07.106304Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:8fddbc8548ed2768b9ebc66950dd49cfa6fc749ba366cb53f2228be20a230fb2","observation_id":"0c8b0b80-55d3-4dda-8914-7f6bdab3df46","resolution":{"observed_at":"2026-08-03T02:44:07.106304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:07.162419Z","title":"Stockbench: Can llm agents trade stocks profitably in real-world markets?arXiv preprint arXiv:2510.02209, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:07.162419Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:72d3253e642b8ff48a99f571d912a2f114efb4e1ff06cb802b3448e102e684e5","observation_id":"ffc08876-4477-4d3f-8879-0fdf22e3f47b","resolution":{"observed_at":"2026-08-03T02:44:07.162419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:07.229645Z","title":"Can chatgpt forecast stock price movements? return predictability and large language models.arXiv preprint arXiv:2304.07619, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:07.229645Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:623d3c519c9681dc2d4ef003f9dd2a19df66c3570b5727470927c66b6917d736","observation_id":"0b66d146-fa78-41ce-bda9-b42d5b6d1030","resolution":{"observed_at":"2026-08-03T02:44:07.229645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05351","last_updated":"2023-04-28T12:06:43Z","snapshot_observed_at":"2026-08-06T10:33:18.701502Z","submitted_at":"2023-04-10T04:31:00Z","title":"The Wall Street Neophyte: A Zero-Shot Analysis of ChatGPT Over MultiModal Stock Movement Prediction Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05351","snapshot_observed_at":"2026-08-03T02:44:07.300849Z","title":"The wall street neophyte: A zero-shot analysis of chatgpt over multimodal stock movement prediction challenges.arXiv preprint arXiv:2304.05351, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:07.300849Z"},"links":{"cited_paper":"/paper/2304.05351","citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:363fe336ecaa587fddb9987f644039a71a5b4924730d8479eaa83aade0467ffd","observation_id":"e178ece9-3097-41c5-bb6c-4a764f64e514","resolution":{"observed_at":"2026-08-03T02:44:07.300849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:07.360921Z","title":"Investorbench: A benchmark for financial decision-making tasks with llm-based agent","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:07.360921Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:77283a4540c6f02379acad0241318da647a6f0cc6d387620c5761511ed0d92ac","observation_id":"b846f76a-6b64-4e39-87c8-21a4efec2624","resolution":{"observed_at":"2026-08-03T02:44:07.360921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:07.446248Z","title":"Time travel is cheating: Going live with deepfund for real-time fund investment benchmarking.arXiv preprint arXiv:2505.11065, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:07.446248Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:534b957b27072fc519cca15b7d1b156d4e5084ab994d57a6e45f71268a2b48aa","observation_id":"489bf3cf-e9a6-4c90-aebb-70e4b0b88100","resolution":{"observed_at":"2026-08-03T02:44:07.446248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.11987","last_updated":"2025-09-05T09:15:55Z","snapshot_observed_at":"2026-08-05T19:39:12.827378Z","submitted_at":"2025-08-16T08:54:08Z","title":"FutureX: An Advanced Live Benchmark for LLM Agents in Future Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.11987","snapshot_observed_at":"2026-08-03T02:44:07.502114Z","title":"Futurex: An advanced live benchmark for llm agents in future prediction.arXiv preprint arXiv:2508.11987, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:07.502114Z"},"links":{"cited_paper":"/paper/2508.11987","citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:1ff5aea41ba52453c6d0a05eb107d6c3ddd71fee7a61e83396a08bf3b4e947d3","observation_id":"196c64bf-89fb-413e-b28c-2b56b81bc7d9","resolution":{"observed_at":"2026-08-03T02:44:07.502114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:07.548788Z","title":"Prophet arena: Live llm trading competition platform, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:07.548788Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:158a79afca43754050564c89feb22842ce1949cb142cc4bec3eab1e6591772a7","observation_id":"82585ab6-0f13-4c0b-925d-d184c9a9054a","resolution":{"observed_at":"2026-08-03T02:44:07.548788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:07.598923Z","title":"Rockalpha: Llm-powered quantitative trading platform, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:07.598923Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:017db9d29e3ed36edb9eb3600f634d37855c1b54a57214d270c78596d399287e","observation_id":"9e19e99d-f9a8-4330-b530-bbaa38210e2c","resolution":{"observed_at":"2026-08-03T02:44:07.598923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:07.643930Z","title":"Livetradebench: Seeking real-world alpha with large language models.arXiv preprint arXiv:2511.03628, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:07.643930Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:b50c32860a2ecef847d91bc2301bf0c82f83466a3a1a553200caf0b5b9f004ab","observation_id":"3ecd2a3f-133a-402d-bd54-6c89a014d2f6","resolution":{"observed_at":"2026-08-03T02:44:07.643930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:07.715015Z","title":"Worldquant: Quantitative research platform","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:07.715015Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:689ae923bfc30d41dfb6e9d3dd93a87fea44ecaba7bd642b3ba73904e8eacf7d","observation_id":"32671425-aa86-448f-8cbc-fb29fadd9da5","resolution":{"observed_at":"2026-08-03T02:44:07.715015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:07.914752Z","title":"Joinquant: Quantitative research platform","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:07.914752Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:c216c865669f3f6a054dd7d23d0c5a8e79f5bd36354d577c06064adaa4e2202c","observation_id":"82089f9b-b122-40e4-a4da-d7c42cb0f4c2","resolution":{"observed_at":"2026-08-03T02:44:07.914752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11189","last_updated":"2020-09-22T12:57:10Z","snapshot_observed_at":"2026-08-08T05:44:05.995320Z","submitted_at":"2020-09-22T12:57:10Z","title":"Qlib: An AI-oriented Quantitative Investment Platform","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11189","snapshot_observed_at":"2026-08-03T02:44:08.000177Z","title":"Qlib: An ai-oriented quantitative investment platform.arXiv preprint arXiv:2009.11189, 2020","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:08.000177Z"},"links":{"cited_paper":"/paper/2009.11189","citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:0afb982b5f71e38b453a1078d392f541e998e97d6debe6fed441cb042257b62e","observation_id":"464abaca-9544-4368-bb67-e144b7258f15","resolution":{"observed_at":"2026-08-03T02:44:08.000177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:08.126594Z","title":"Openfe: Automated feature generation with expert-level performance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:08.126594Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:27d1e500ea37d0d5c2a6ec9ad9fc95bc6b020631ec4dcbf73d336aa02b27156e","observation_id":"a3d9cb15-5124-4e36-ae20-fb5636d9b2a8","resolution":{"observed_at":"2026-08-03T02:44:08.126594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:08.234961Z","title":"Www’18 open challenge: financial opinion mining and question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:08.234961Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:44fb85e1687f6ee9322ece014ac01a77f3df2da6f5c3987dc4b4ff89dfd3bed6","observation_id":"1c97c6e6-6780-4609-9006-597acf630081","resolution":{"observed_at":"2026-08-03T02:44:08.234961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:08.357051Z","title":"most reasonable","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:08.357051Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:25bff6d1d64d25fe0d51fc9c5ed3a5b42f83c8932555205d39328be3c94fd52a","observation_id":"0ab82573-c8b4-4ff3-98cd-54f87c614e1f","resolution":{"observed_at":"2026-08-03T02:44:08.357051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:08.407766Z","title":"ema_{period}","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:08.407766Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:38fefe42daea972e6ac47502a4895115d01edf8ec2f3b8cc215736c87e39e0f2","observation_id":"79ba0c93-5c2b-4e9a-8174-a58cf36a91e6","resolution":{"observed_at":"2026-08-03T02:44:08.407766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:08.494563Z","title":"std_{period}","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:08.494563Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:f15e5ed59dd81995821bc7d113fdb8e743cf3da1b4233f2c86fe818509bb4b90","observation_id":"ccc1fc51-0f0c-4dae-8799-98613a528b34","resolution":{"observed_at":"2026-08-03T02:44:08.494563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:08.542718Z","title":"max_{period}","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:08.542718Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:509ed0e7aa1352755dcdf3d0369d3cda3740054c5844817fa0db8171e3e9f86b","observation_id":"e60bf56c-c639-4a40-a2be-0c02f0a4178e","resolution":{"observed_at":"2026-08-03T02:44:08.542718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:08.607132Z","title":"klow2\"] •kmid2: Body Ratio (normalized by candle range). Measures body direction relative to candle range. Formula:kmid2 = (close - open) / (high - low)| Scale: -1 to 1 | Usage:df[","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:08.607132Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:868ecb0bcb03b42924dcd66dd06fc447c9d112e8ed467334bc5cca67e0456cbf","observation_id":"1811b103-936f-43e1-81b9-db227f8f9ba0","resolution":{"observed_at":"2026-08-03T02:44:08.607132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:08.680755Z","title":"vma_{period}","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:08.680755Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:37c79aecb51925e953df00880d24c5d87123e459552acd687d70ab748ff8e378","observation_id":"df1d04c5-e08f-40e1-86b3-75027eb3e3fa","resolution":{"observed_at":"2026-08-03T02:44:08.680755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T02:44:08.758916Z","title":"cntp_{period}","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T02:44:08.758916Z"},"links":{"citing_paper":"/paper/2602.18481"},"observation_digest":"sha256:8b0dc6518a3d33d40d1ebd17f2dd9c36fe1f38fb808b2038d9ea6b9bdbf79ba3","observation_id":"513501b5-b9c3-4d9d-beae-a083a8e250b9","resolution":{"observed_at":"2026-08-03T02:44:08.758916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.18481","last_updated":"2026-05-27T14:41:33Z","latest_version":2,"primary_category":"q-fin.TR","snapshot_observed_at":"2026-08-03T07:13:36.244963Z","submitted_at":"2026-02-10T14:29:33Z","title":"AlphaForgeBench: Benchmarking End-to-End Trading Strategy Design with Large Language Models"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2602.18481."}