{"as_of":"2026-08-10T13:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cf14f750d52e198f15dffc6643d91678481835d762b08379b70fabef223c7475","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T17:52:45.955765Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03502/citation-record","integrity":"/paper/2608.03502/integrity","json":"/paper/2608.03502/citation-record.json","paper":"/paper/2608.03502"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:48.809209Z","title":null,"venue":null,"work_id":"1648f801-58ac-4572-9db7-8fce4e3ba116","year":2018},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.007858Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:cc4297a3caffdc871ab153956e15858cf4e3b55a0479b6662bc7390e618d2937","observation_id":"eca521a5-94e8-42c0-bdea-477d7231d8d0","resolution":{"observed_at":"2026-08-05T17:52:48.916567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:48.573213Z","title":"Human -level control through deep reinforcement learning,","venue":null,"work_id":"35206f86-7e0c-484f-9a59-9ded5032aca3","year":2015},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.096525Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:76df63b41ba5bd30ddd6c2fa301464b9e363a0f37525795b0fe533964439bbf0","observation_id":"8c52a268-6028-4ca4-829d-535ce9648ece","resolution":{"observed_at":"2026-08-05T17:52:48.681665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T17:52:44.161873Z","title":"Proximal Policy Optimization Algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.161873Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:467d3b90a98ccbe922e28b5cd2346b2f8cebd9026078c9aacb448e2a17a8927c","observation_id":"a99d210d-1c5b-4a59-9226-4389fc8a1654","resolution":{"observed_at":"2026-08-05T17:52:44.161873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:48.396900Z","title":"Soft Actor-Critic: Off-Policy Maximum Entropy Deep RL,","venue":null,"work_id":"c23a2ef1-4a87-4f2e-8039-78fc9b7e06b5","year":2018},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.246953Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:078e5847f5d60efb88f158507474942e065913c5bc34f5e40beaaef5822044d1","observation_id":"4b9051e0-2a97-45c1-b01d-072f5380c34e","resolution":{"observed_at":"2026-08-05T17:52:48.456121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:48.322287Z","title":"Reinforcement Learning Unplugged: Benchmarks for Offline RL,","venue":null,"work_id":"13942a46-6e16-4ac5-887c-5b86940f4c75","year":2020},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.326748Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:2678fab70f0ff6f5583b73848109c91d7544668f9fe5220a88b6eef474449660","observation_id":"d843c560-c625-4da2-bc14-921e0372db2b","resolution":{"observed_at":"2026-08-05T17:52:48.391335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-07T08:29:46.650400Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-05T17:52:44.399729Z","title":"Voyager: An Open -Ended Embodied Agent with LLM -Driven Skill Learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.399729Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:d918004f32926720a66ff11faccfd1784339295c9776df97c80fee998d637ab1","observation_id":"dd13bf29-602d-49ef-9f3d-a4e725215c03","resolution":{"observed_at":"2026-08-05T17:52:44.399729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11366","last_updated":"2023-10-10T05:21:45Z","snapshot_observed_at":"2026-07-06T15:05:53.556198Z","submitted_at":"2023-03-20T18:08:50Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11366","snapshot_observed_at":"2026-08-05T17:52:44.474091Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.474091Z"},"links":{"cited_paper":"/paper/2303.11366","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:8a6c5620b133f349ab23bed1ed0267dc51532d964250c6878ed6011741a358c0","observation_id":"9babcc4e-2d69-4e2c-808b-8871c7ecbfe7","resolution":{"observed_at":"2026-08-05T17:52:44.474091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-05T17:52:44.560783Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.560783Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:5bacec249c9cbc89243bf962e5c3771c994748d131751f575b7bc938a7ce0d36","observation_id":"8f5321e7-3c2b-4115-a645-a968551162ec","resolution":{"observed_at":"2026-08-05T17:52:44.560783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07865","last_updated":"2024-09-14T11:41:49Z","snapshot_observed_at":"2026-08-10T03:17:35.544423Z","submitted_at":"2024-03-12T17:55:38Z","title":"CodeAttack: Revealing Safety Generalization Challenges of Large Language Models via Code Completion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07865","snapshot_observed_at":"2026-08-05T17:52:44.629599Z","title":"Tool-Use by Language Models: A Survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.629599Z"},"links":{"cited_paper":"/paper/2403.07865","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:3048bb3fd027ceb9f92a7df1d52fe6e4f6a019d9d4ca5890139b17fce37cfab3","observation_id":"59738885-9cdd-4ab7-bd73-aff76588b9b8","resolution":{"observed_at":"2026-08-05T17:52:44.629599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10533","last_updated":"2024-09-24T01:14:07Z","snapshot_observed_at":"2026-07-06T17:31:04.675896Z","submitted_at":"2024-02-16T09:38:16Z","title":"APCodec: A Neural Audio Codec with Parallel Amplitude and Phase Spectrum Encoding and Decoding","version":2},"cited_work":{"arxiv_id":"2402.10533","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.10533","snapshot_observed_at":"2026-08-05T17:52:46.222951Z","title":"APCodec: A Neural Audio Codec with Parallel Amplitude and Phase Spectrum Encoding and Decoding","venue":"cs.SD","work_id":"8179902f-b1d3-4ee2-bfeb-5b82f8f48fbe","year":2024},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.693924Z"},"links":{"cited_paper":"/paper/2402.10533","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:8050e8b435a7a12a36d64262c8422098af682a493ce95d3a2195a4afc7bffef7","observation_id":"cba9dc8f-745c-4e70-8b2a-0763c6f61683","resolution":{"observed_at":"2026-08-05T17:52:46.298256Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10003","last_updated":"2023-12-15T18:20:15Z","snapshot_observed_at":"2026-08-04T01:20:21.010579Z","submitted_at":"2023-12-15T18:20:15Z","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10003","snapshot_observed_at":"2026-08-05T17:52:44.777206Z","title":"Plan -and-Solve: LLM-Based Task Planning for RL Agents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.777206Z"},"links":{"cited_paper":"/paper/2312.10003","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:b4b35224c3e555c63fe0d66d1e8766b065ed56f1eed662d43f9f4ae0c4175e3f","observation_id":"63ef0a9b-0eb2-4062-acbb-75db8b113e97","resolution":{"observed_at":"2026-08-05T17:52:44.777206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:48.171346Z","title":"Language-Conditioned Reinforcement Learning,","venue":null,"work_id":"b9fb0ee7-5b42-42c8-94db-f2a3e6404ffa","year":2020},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.884946Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:e52663da86802d52ae97cbc135cb6699e63ca749ad778f3323f5ad9f5537c4a3","observation_id":"f5bf6165-612b-4c71-b364-73539460400a","resolution":{"observed_at":"2026-08-05T17:52:48.260711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00012","last_updated":"2024-03-12T12:59:45Z","snapshot_observed_at":"2026-08-10T08:06:02.554971Z","submitted_at":"2024-02-27T02:23:07Z","title":"PreRoutGNN for Timing Prediction with Order Preserving Partition: Global Circuit Pre-training, Local Delay Learning and Attentional Cell Modeling","version":2},"cited_work":{"arxiv_id":"2403.00012","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.00012","snapshot_observed_at":"2026-08-05T17:52:46.040992Z","title":"PreRoutGNN for Timing Prediction with Order Preserving Partition: Global Circuit Pre-training, Local Delay Learning and Attentional Cell Modeling","venue":"cs.LG","work_id":"60bbd3f4-1ee8-43ee-8639-4b9c4dbfcc51","year":2024},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:44.964876Z"},"links":{"cited_paper":"/paper/2403.00012","citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:150ce87172e9be5798d350d1472f416d95bbf8dbb6b60179d3c8d9b6f37c9c7c","observation_id":"5a961a01-c5c1-4357-8ec0-85ef8cbcc08f","resolution":{"observed_at":"2026-08-05T17:52:46.114688Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:47.997370Z","title":"LLM-Guided Symbolic Planning,","venue":null,"work_id":"7d67c093-4587-49fc-a0e1-4ffcea87e461","year":2024},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.039979Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:fea872800dad1960a475c863277edf832da0b828c9d561981f4e7947ef349658","observation_id":"fdd51f49-66ea-4dd4-944f-60bc90a8f274","resolution":{"observed_at":"2026-08-05T17:52:48.085418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:47.863538Z","title":"Improving Reproducibility in Reinforcement Learning Research,","venue":null,"work_id":"d054e531-a971-4157-8875-f091984e5604","year":2020},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.131198Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:20176eb553eed6d24dfb8ae60989ee09418b8a1d891c21ad5a8065e65a30ef9a","observation_id":"5aa58d80-a10b-4a1a-9b01-a8b2cf53862d","resolution":{"observed_at":"2026-08-05T17:52:47.921425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:47.697546Z","title":"Representation Learning: A Review and New Perspectives,","venue":null,"work_id":"ef9ab27d-b9e5-4c0c-a3a8-c8ef80997901","year":2013},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.201475Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:9fa719d4144230c82a8e10e0e57ae320e2c2f60fb4aa757cb672d79d02d7d6db","observation_id":"f327194e-3b15-4708-98e3-97f18730a82f","resolution":{"observed_at":"2026-08-05T17:52:47.775356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:47.550235Z","title":"Courville, I","venue":null,"work_id":"aced84f7-5c95-4639-aa63-41614ea2090d","year":2016},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.258680Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:b243ad0ea0645f2c274f44b9b39442a4d0a4f8c31cfc7712b507d2024473709e","observation_id":"0ba9a4bf-c66f-44a4-8a4c-e10d85df9e8d","resolution":{"observed_at":"2026-08-05T17:52:47.607490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:47.379272Z","title":"A Geometric Perspective on Optimal Representations for Reinforcement Learning,","venue":null,"work_id":"0ea56169-fe84-443d-82cf-261da624cfff","year":2019},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.347094Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:5994eafb913ad5bee391fcd30f1beb5b3588029915f40b771b66e96141992a2b","observation_id":"a3b46684-97ba-482e-8070-bcf62c816258","resolution":{"observed_at":"2026-08-05T17:52:47.484062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:47.223896Z","title":"Deep Reinforcement Learning that Matters,","venue":null,"work_id":"748a6223-d375-4ab4-b655-673f09254133","year":2018},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.414073Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:961ab9494eec76821b89b4b18c5ce01f4ee05b25a4ad05354f9911c656c1ce88","observation_id":"85594ee2-b6db-4aa6-9fc7-c82b88b4819a","resolution":{"observed_at":"2026-08-05T17:52:47.307755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:47.034911Z","title":null,"venue":null,"work_id":"7a663bbe-7fc5-4f20-9cf4-5d571370aae4","year":2019},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.671139Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:07c8a3d5e3a43a5dc8ff9efcd0f0cdbc0e2ccbd5db0167f788660456a40dfcbf","observation_id":"eb977f77-e46a-4a77-96c1-f02aaaaf45c1","resolution":{"observed_at":"2026-08-05T17:52:47.124525Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:46.886352Z","title":null,"venue":null,"work_id":"ac51d1a3-f209-4a8b-8aca-b6b8d1eecb41","year":2022},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.737692Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:cb6b8a55b57f3489d8fd97bb1bbba4c661f4a5a31540f738dd904eb2a52b7407","observation_id":"d7af8bce-84f6-4ffd-9414-2780caaabab5","resolution":{"observed_at":"2026-08-05T17:52:46.977594Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:46.728909Z","title":null,"venue":null,"work_id":"514f6f3b-a8d1-44d6-8fe8-1817d15ad4ad","year":2017},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.804904Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:f2b077635aefdfa0d630f32f4cf0366b04cd792264e0dae6ec58da4fe3a29ed8","observation_id":"fecb19fb-45d1-49b8-805d-fced83feb892","resolution":{"observed_at":"2026-08-05T17:52:46.806193Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:46.567825Z","title":null,"venue":null,"work_id":"72bd924f-1627-4ac7-ad5b-44788217cd58","year":1986},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.872937Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:f4786cb4e91e70f08813afb39fe7ff0034453ca4a3f37aeddd2cdb8156130165","observation_id":"58dd0910-0449-4b33-9bfa-989fa0fc5661","resolution":{"observed_at":"2026-08-05T17:52:46.660091Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T17:52:46.414371Z","title":null,"venue":null,"work_id":"29f5dcad-04a2-45be-9fce-03b8b7153dd5","year":2017},"citing_paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:45.955765Z"},"links":{"citing_paper":"/paper/2608.03502"},"observation_digest":"sha256:ea5c6334b3638c51a9225c3a9f91a3fdc49b83f5031f8d4221d631b049ea1cb0","observation_id":"4fa53196-163c-4484-b91c-9a8bdab40386","resolution":{"observed_at":"2026-08-05T17:52:46.476976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03502","last_updated":"2026-08-04T11:44:07Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T07:27:49.982758Z","submitted_at":"2026-08-04T11:44:07Z","title":"Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2608.03502."}