{"as_of":"2026-08-09T19:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:15c6e7ede35277eebdefaff33f98dd92a91f3225bbfb1b80211d7b4246e493d4","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:48:53.428642Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T22:18:08.986666Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T21:50:41.269928Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20263","snapshot_observed_at":"2026-08-05T22:18:08.986666Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.13174","last_updated":"2026-06-02T13:19:43Z","snapshot_observed_at":"2026-08-09T18:46:34.271134Z","submitted_at":"2025-08-10T11:19:24Z","title":"AlphaEval: A Comprehensive and Efficient Evaluation Framework for Formula Alpha Mining","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T22:18:08.986666Z"},"links":{"cited_paper":"/paper/2507.20263","citing_paper":"/paper/2508.13174"},"observation_digest":"sha256:1bf03aa80baefadcb50cb68c5113ccbe5a259de7027c6cc51ebfe2bd73540afb","observation_id":"61e2ad78-4e4d-472b-a5d8-ecbb876efbb6","resolution":{"observed_at":"2026-08-05T22:18:08.986666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"cited_work":{"arxiv_id":"2507.20263","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.20263","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning from expert factors: Trajectory-level reward shaping for formulaic alpha mining","venue":null,"work_id":"d334e810-e6d7-435d-ab18-45165eca9cde","year":2025},"citing_paper":{"arxiv_id":"2509.25055","last_updated":"2026-05-19T05:55:24Z","snapshot_observed_at":"2026-07-06T22:31:05.409865Z","submitted_at":"2025-09-29T17:06:07Z","title":"AlphaSAGE: Structure-Aware Alpha Mining via GFlowNets for Robust Exploration","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-21T21:50:26.812048Z"},"links":{"cited_paper":"/paper/2507.20263","citing_paper":"/paper/2509.25055"},"observation_digest":"sha256:48a8bc53a06540fcc20fcabeee79e2a393139b852fd0a0ca749e4b694e5f81c5","observation_id":"2a23f9dc-83e3-4267-853f-68157115cbbf","resolution":{"observed_at":"2026-05-21T21:50:41.272196Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.20263/citation-record","integrity":"/paper/2507.20263/integrity","json":"/paper/2507.20263/citation-record.json","paper":"/paper/2507.20263"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:49:04.301964Z","title":"Saoftrl: A novel adaptive algorithmic framework for enhancing online portfolio selection,","venue":null,"work_id":"1208f2db-4b8e-408b-b0c3-64ca69c9b994","year":2024},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:47.741499Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:abcd2d39504c1bf97c9e0c5e31eaed2b375b73067c93a089b9f6bcfaf8ff542f","observation_id":"7a36d74d-66cc-4f0e-a60e-5c37ec5070c1","resolution":{"observed_at":"2026-08-06T13:49:04.411240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:49:03.760252Z","title":"Optimal mean-reverting port- folio with leverage constraint for statistical arbitrage in finance,","venue":null,"work_id":"05dc002b-18b1-488e-8702-0c1e70b17e8f","year":2019},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:47.852555Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:41822c3d3433b3e0bd47ab0c0e6cca6a402817697412652b22468115fe60fafc","observation_id":"16135359-ee9c-4f15-bf34-25c0f2619ffc","resolution":{"observed_at":"2026-08-06T13:49:03.960343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:49:03.424741Z","title":"Mean-reverting portfolio with budget constraint,","venue":null,"work_id":"67140431-05a0-4e92-b0b6-d04e3b80c1cd","year":2018},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:47.994744Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:46dc081f183588037630ed2169ac735027bf8183431665c6e3f32828b87b2b43","observation_id":"53ad42d5-1485-45bd-bf66-d6d71076d018","resolution":{"observed_at":"2026-08-06T13:49:03.604744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:48.094742Z","title":"101 formulaic alphas,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:48.094742Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:dc9fb22888d6d9ab95e6e12e9e28a283269ba0492b9cb155e3a7ffddb56df7b0","observation_id":"ab21ba52-0414-46f8-9ce4-45aacf6dce32","resolution":{"observed_at":"2026-08-06T13:48:48.094742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:49:03.093215Z","title":"Openfe: automated feature generation with expert-level per- formance,","venue":null,"work_id":"9674e345-fdf1-42d8-81dd-895c6928ea72","year":2023},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:48.214751Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:80d0c1b49cca92ce0100577b72457b325b80f3dc532d72bb0d859223c9b4dd08","observation_id":"a0dbdf02-4e7e-4390-b368-1592c8646543","resolution":{"observed_at":"2026-08-06T13:49:03.228335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:49:02.824452Z","title":"Application research of the xgboost-svm combina- tion model in quantitative investment strategy,","venue":null,"work_id":"a4d86753-5139-47d0-92c5-923c4a798a38","year":2022},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:48.384736Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:08c92fae8bb305404b4e9e04f2dcfc48d87cba5011c89839503ba22bce4783ca","observation_id":"8d69ac73-27c3-4962-b659-3ab4b551729f","resolution":{"observed_at":"2026-08-06T13:49:02.964752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:49:02.494748Z","title":"Research on multi factor stock selection model based on lightgbm and bayesian optimization,","venue":null,"work_id":"1c238710-2666-47d2-9329-a7b5d9a58fef","year":2022},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:48.565998Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:e4d3d9fe5fb413096141cadb0d8f650bf8d41930bb9a44c1762601603a7579f0","observation_id":"486158a6-06ee-4abb-9bb4-c21b72778388","resolution":{"observed_at":"2026-08-06T13:49:02.664884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:49:02.050915Z","title":"Accurate label refinement from multiannotator of remote sensing data,","venue":null,"work_id":"ac042c4b-6a6e-4911-b629-cd52d04f9711","year":2023},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:48.694745Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:4bf55d185b081921541f6fb4bbd2251851bbef16e9c649273fbf4aa553a3fb74","observation_id":"60edc6d0-f206-4439-85ab-08c73374a2b1","resolution":{"observed_at":"2026-08-06T13:49:02.254823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:49:01.518601Z","title":"Multiscale temporal dynamic learning for time series classification,","venue":null,"work_id":"8998533a-f68a-4ae7-9973-7892d76e98c5","year":2025},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:48.785533Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:62d8a80fe64e6d69f3c479fa1a79bd7e9654c6861e450a560b90cd4f15649d53","observation_id":"cb86c464-54dc-4237-8caa-b7cff736a199","resolution":{"observed_at":"2026-08-06T13:49:01.902712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:49:01.143295Z","title":"Q-learning-based spec- trum access for multimedia transmission over cognitive radio networks,","venue":null,"work_id":"fcf1a9f3-6ae4-44c8-8afc-4557a83b38ae","year":2020},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:48.879079Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:71b7e41c28cf245043c2a1ca49aa0ac9f74c4c4af98b96c52f5dce8150930318","observation_id":"036482ee-bd23-4c57-ade5-f5d9da87cdce","resolution":{"observed_at":"2026-08-06T13:49:01.292961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:48.963793Z","title":"Long short-term memory,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:48.963793Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:aee68ebed49dc0f98dc00222df4215e3dab548c2a11119c15e054eb710a3b5e8","observation_id":"bf5da443-33a6-4069-9516-0edf13908587","resolution":{"observed_at":"2026-08-06T13:48:48.963793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:49.055347Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:49.055347Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:836a3bc82988dfc3cf76c59f248ad8dcf000b77ba9bad2e251a7eaae8e502c7c","observation_id":"7b24b2b6-6699-41f1-8bb8-869ca23c3d63","resolution":{"observed_at":"2026-08-06T13:48:49.055347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:49:00.564742Z","title":"Prediction of small-molecule compound solu- bility in organic solvents by machine learning algorithms,","venue":null,"work_id":"bf47a503-126f-4d3d-907e-568b4be66617","year":2021},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:49.264819Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:bbca292bb9daa5dd6e438b175e5e311961b19df238446b94954ea2a056ea8422","observation_id":"43612792-4c59-4de3-a1ea-7df139eed65e","resolution":{"observed_at":"2026-08-06T13:49:00.794875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.08245","last_updated":"2020-04-04T04:27:45Z","snapshot_observed_at":"2026-08-09T04:41:58.005452Z","submitted_at":"2020-02-09T02:26:05Z","title":"AutoAlpha: an Efficient Hierarchical Evolutionary Algorithm for Mining Alpha Factors in Quantitative Investment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.08245","snapshot_observed_at":"2026-08-06T13:48:49.421415Z","title":"Autoalpha: an efficient hierarchical evolutionary algorithm for mining alpha factors in quantitative invest- ment,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:49.421415Z"},"links":{"cited_paper":"/paper/2002.08245","citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:7353789b7a73e91e3cd819c82b9bc6279861944fa4066ee130cac802e105476c","observation_id":"55a8ee4b-abb9-4203-95c2-600527580a30","resolution":{"observed_at":"2026-08-06T13:48:49.421415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:49:00.247554Z","title":"Generating synergistic formulaic alpha collections via reinforcement learning,","venue":null,"work_id":"acdc6641-4154-451b-992e-804a058a600f","year":2023},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:49.564867Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:979235c70c157a2a7d195de5158efe6b79065faf1e4e02ce75732855163b1d45","observation_id":"26380ba5-91dc-47eb-9a9a-7e5ff4d272be","resolution":{"observed_at":"2026-08-06T13:49:00.324938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:59.944995Z","title":"Quantfactor reinforce: Mining steady formulaic alpha factors with variance-bounded reinforce,","venue":null,"work_id":"113deadf-a0f4-4f75-8904-0635522e07aa","year":2025},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:49.666050Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:f3b6855566fb83fc6f3e481be3cd9ac98cbe0e7ba39797970a84e63bdfd46eaf","observation_id":"02cae88a-96b7-475c-8bdf-b4326deaf14c","resolution":{"observed_at":"2026-08-06T13:49:00.038201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:59.664935Z","title":"Policy invariance under reward transformations: Theory and application to reward shaping,","venue":null,"work_id":"f2affc9a-5aa8-44bc-882c-0f19e573620a","year":1999},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:49.727728Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:962cd04735495f3bca1bbbe7bb25d45ce3eebac5d93491c018b94dfda89e8868","observation_id":"7377c4fb-69fe-4c11-9d00-a0aaeb270c26","resolution":{"observed_at":"2026-08-06T13:48:59.762606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:59.324981Z","title":"Principled methods for advising reinforcement learning agents,","venue":null,"work_id":"f40d2eba-9417-4875-bb87-0527ec948fa4","year":2003},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:50.105446Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:4cfba1455b1b6d4376d725a1d4ba04a09e48a7c5ea6e3f23c32992aa0db46995","observation_id":"93556ff4-5f0b-427a-913e-001b6432cd63","resolution":{"observed_at":"2026-08-06T13:48:59.423356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:58.978522Z","title":"Reinforcement learning from demonstration through shaping,","venue":null,"work_id":"f982338d-f7c2-4012-b250-955d1cfa2019","year":2015},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:50.322048Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:4a0356343eb828757c6bdd5fd45b68b274926435a110bb1d82d535e4b074d385","observation_id":"3f270989-9353-4c1d-9951-76935d2d7ce9","resolution":{"observed_at":"2026-08-06T13:48:59.152060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:58.491366Z","title":"Artificial intelligence stock selection: Generalized linear model,","venue":null,"work_id":"02cf3097-19ef-468d-8e38-f4a6d8cc0d3a","year":2017},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:50.464743Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:853393a776a0ca0bf6350d21847faaf776a9e4481fcfcd3a472018aa866ddd58","observation_id":"36b87f15-58b1-40f1-b09a-e397ac252259","resolution":{"observed_at":"2026-08-06T13:48:58.644740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T13:48:50.674812Z","title":"Prox- imal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:50.674812Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:ccf124fe9a1cdf36c5dc541d4ccd63d9b35cc3586275a4fe8d632bd39ed902b9","observation_id":"37ca507a-aa80-42e8-bc63-1dcb26d9c0b5","resolution":{"observed_at":"2026-08-06T13:48:50.674812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:57.981479Z","title":"Robot shaping: Developing autonomous agents through learning,","venue":null,"work_id":"5c55caa7-1388-4d01-9b4f-ad68d197457b","year":1994},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:50.824821Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:febc448d979556da21a48ec615f51658c0111adf780794ac477fca9978c86ae6","observation_id":"4fb1fb80-4375-4499-b491-c7e16d1b0268","resolution":{"observed_at":"2026-08-06T13:48:58.257666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:57.555238Z","title":"A cold-start-free reinforce- ment learning approach for traffic signal control,","venue":null,"work_id":"4a87cf91-b0b0-4839-ad75-a35f78eab44b","year":2022},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:51.074757Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:3db3ded4ae5d33ca1714d2f8465258e1f1ec622fae5e28eab405b502426109b4","observation_id":"35598bd5-1049-460a-aa2d-4abb6dca4ec1","resolution":{"observed_at":"2026-08-06T13:48:57.724864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:51.182953Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:51.182953Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:8d6334b95be543e1b4a3fae98b0561186abe4961a7c526080ed198365171a258","observation_id":"92b1661f-b6e2-4171-9808-0923a857b095","resolution":{"observed_at":"2026-08-06T13:48:51.182953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:57.132443Z","title":"The arcade learning environment: An evaluation platform for general agents,","venue":null,"work_id":"3519daba-b7f4-4ad3-9b7e-02c837023953","year":2013},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:51.358935Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:bfa8fcb1d0979f2e4eeac40fc21039ee94006829cd85d2efd83cf14b000fb7f9","observation_id":"a603f713-12fa-4d21-85e7-904567d212b5","resolution":{"observed_at":"2026-08-06T13:48:57.274870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:51.528680Z","title":"A survey of robot learning from demonstration,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:51.528680Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:d2fe19ff0099b50e6beac934e1770f2526d6f7a389a21a4a2995b1af663ed133","observation_id":"c67883d7-dc90-412b-852f-80a70cf81382","resolution":{"observed_at":"2026-08-06T13:48:51.528680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:56.664872Z","title":"Apprenticeship learning via inverse rein- forcement learning,","venue":null,"work_id":"3cef3675-8c1b-4032-ba97-eb3199f6f9b2","year":2004},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:51.712407Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:834bddc48d1ce4ae51c70cfbb82979d5e5098384dea9d31d19c495b85df421d0","observation_id":"7a080c92-d815-453d-93ec-ed7e9b297bc1","resolution":{"observed_at":"2026-08-06T13:48:56.773524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:56.154743Z","title":"Multi-resolution exploration in continuous spaces,","venue":null,"work_id":"6e0aa7fe-3923-4fab-aea5-3d8b646923cf","year":2008},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:51.851333Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:8c42720c653a48911f3a68c0eddf5cec8e5149a2f9e8ed6b50325d1258d59d75","observation_id":"298f04dc-ee4c-43b2-a040-7f473ed3b31f","resolution":{"observed_at":"2026-08-06T13:48:56.324818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:55.794907Z","title":"Maximum entropy inverse reinforcement learning","venue":null,"work_id":"b3f200a0-8c46-4153-ac25-f5e834c91878","year":2008},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:51.934751Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:c3d888ca594f2004930b3fad285bc5594f5a6478d84a94257c0309cbef0102d8","observation_id":"cb283bbb-adf1-449b-9f61-4cdf92d2d4c5","resolution":{"observed_at":"2026-08-06T13:48:55.934811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:55.456145Z","title":"From mimic to counteract: a two-stage reinforcement learning algorithm for google research football,","venue":null,"work_id":"e62dc426-54eb-44a9-9eed-6de82ab93708","year":2024},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:52.074825Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:0f1e0651de11cdc1ef4c427f8af2fdcc8f18ab19599bca53fd4008c9746a5fcb","observation_id":"2b7c45cc-fe2f-4be4-a79b-4aa3dca2b0cd","resolution":{"observed_at":"2026-08-06T13:48:55.569341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:55.134942Z","title":"Learning continuous semantic representations of symbolic expressions,","venue":null,"work_id":"de0171d5-17ed-4b5e-9c23-731db060cf0b","year":2017},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:52.201721Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:bf0d4d776df2fa60b595890b398fb705955f55d76992f731735d74e891151d2c","observation_id":"59420191-8ae8-4c6a-afd2-a5b37e8bde14","resolution":{"observed_at":"2026-08-06T13:48:55.306444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09999","last_updated":"2024-10-30T14:18:42Z","snapshot_observed_at":"2026-07-06T18:15:11.806744Z","submitted_at":"2024-05-16T11:33:49Z","title":"Reward Centering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09999","snapshot_observed_at":"2026-08-06T13:48:52.362113Z","title":"Reward centering,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:52.362113Z"},"links":{"cited_paper":"/paper/2405.09999","citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:213e015d784e04d56f761a0ccbd46bf094dad62b76abd7af0dafb39453933197","observation_id":"4535117f-df57-4af2-9837-47ca0f6d0c85","resolution":{"observed_at":"2026-08-06T13:48:52.362113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:54.587504Z","title":"Stephens","venue":null,"work_id":"1ad822b9-3479-4c5e-b8b5-e3c10ebbb124","year":2015},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:52.604818Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:e9de6e15ee56a8a688cb1de5132af70495244b35c10da5a764ea83ea5660fb86","observation_id":"12339e63-7eb3-406c-ab15-0c32841767ec","resolution":{"observed_at":"2026-08-06T13:48:54.914859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:53.135126Z","title":"Stable-baselines3: Reliable reinforcement learning implementa- tions,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:53.135126Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:04c6a404a48cbfd7744d019d6ed9f20d8c4382db4946e437d39c21e5cd6a7dd6","observation_id":"6f2afa1e-a017-463f-96f4-0b212e195ba7","resolution":{"observed_at":"2026-08-06T13:48:53.135126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11189","last_updated":"2020-09-22T12:57:10Z","snapshot_observed_at":"2026-08-08T05:44:05.995320Z","submitted_at":"2020-09-22T12:57:10Z","title":"Qlib: An AI-oriented Quantitative Investment Platform","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11189","snapshot_observed_at":"2026-08-06T13:48:53.229166Z","title":"Qlib: An ai-oriented quantitative investment platform,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:53.229166Z"},"links":{"cited_paper":"/paper/2009.11189","citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:7ae992baca598f33fe1e575d2e715f0e542a277abcbf09de5dd008f220cd96a2","observation_id":"cbdf4205-1c33-452d-aff4-f66689ea37fe","resolution":{"observed_at":"2026-08-06T13:48:53.229166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:48:53.428642Z","title":"Learning repre- sentations by back-propagating errors,","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T13:48:53.428642Z"},"links":{"citing_paper":"/paper/2507.20263"},"observation_digest":"sha256:97988f0bedd86ba4bac71498d3cb2e35fd05534f2974c384f8b3e666f825c9b0","observation_id":"d87a0eba-9268-4cb5-8535-88def80396a8","resolution":{"observed_at":"2026-08-06T13:48:53.428642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.20263","last_updated":"2025-07-27T13:14:48Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T04:42:39.447372Z","submitted_at":"2025-07-27T13:14:48Z","title":"Learning from Expert Factors: Trajectory-level Reward Shaping for Formulaic Alpha Mining"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 2 inbound Pith citation observations for arXiv:2507.20263."}