{"as_of":"2026-08-10T02:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:172d85b6f1188e5667335a18ce3e3f6ab04955d363e58687a39e6376b9bcb7f3","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:12:46.244220Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.22040/citation-record","integrity":"/paper/2507.22040/integrity","json":"/paper/2507.22040/citation-record.json","paper":"/paper/2507.22040"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.17168","last_updated":"2024-01-22T00:12:20Z","snapshot_observed_at":"2026-08-07T19:16:38.755649Z","submitted_at":"2023-10-26T05:49:13Z","title":"Learning an Inventory Control Policy with General Inventory Arrival Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17168","snapshot_observed_at":"2026-08-06T12:12:46.194341Z","title":"Learning an inventory control policy with general inventory arrival dynamics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.194341Z"},"links":{"cited_paper":"/paper/2310.17168","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:ceff5628318319590274299fcfcbe90f5c9cf7e191005cd3a9f548f9fd493696","observation_id":"05b2c852-8e4a-4f2f-ad38-72e8d7e528ee","resolution":{"observed_at":"2026-08-06T12:12:46.194341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03137","last_updated":"2022-11-28T22:29:58Z","snapshot_observed_at":"2026-07-06T14:01:25.012788Z","submitted_at":"2022-10-06T18:00:25Z","title":"Deep Inventory Management","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03137","snapshot_observed_at":"2026-08-06T12:12:46.227068Z","title":"Foster, and Sham M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.227068Z"},"links":{"cited_paper":"/paper/2210.03137","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:5da15032a012d113bdec06102418ed08b741cbdccda2a366bd7050630c06e445","observation_id":"9e406a1f-0e5d-4dc8-92de-31b22329086a","resolution":{"observed_at":"2026-08-06T12:12:46.227068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.02264","last_updated":"2019-02-27T05:38:15Z","snapshot_observed_at":"2026-07-06T06:48:42.017421Z","submitted_at":"2018-07-06T06:03:06Z","title":"Variance Reduction for Reinforcement Learning in Input-Driven Environments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.02264","snapshot_observed_at":"2026-08-06T12:12:46.230856Z","title":"Variance Reduction for Reinforcement Learning in Input-Driven Environments","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.230856Z"},"links":{"cited_paper":"/paper/1807.02264","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:bdf9dd092b582b8c54191e96b99919cffca434431b8d3a7c5005e0a02a4e8624","observation_id":"7349e878-9e80-4453-8320-521c9158b415","resolution":{"observed_at":"2026-08-06T12:12:46.230856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.03499","last_updated":"2016-09-19T18:04:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-12T17:29:40Z","title":"WaveNet: A Generative Model for Raw Audio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.03499","snapshot_observed_at":"2026-08-06T12:12:46.240981Z","title":"Wavenet: A Generative Model for Raw Audio.arXiv preprint arXiv:1609.03499, 12,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.240981Z"},"links":{"cited_paper":"/paper/1609.03499","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:07c6c12e3d366df4735982f0c235029539834d1668dfb23246f03f60f56b7b74","observation_id":"fc164ae6-e5f3-47aa-9a36-026069e57751","resolution":{"observed_at":"2026-08-06T12:12:46.240981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11246","last_updated":"2025-09-10T21:32:10Z","snapshot_observed_at":"2026-08-02T12:02:04.782439Z","submitted_at":"2023-06-20T02:58:25Z","title":"Deep Reinforcement Learning for Inventory Networks: Toward Reliable Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11246","snapshot_observed_at":"2026-08-06T12:12:46.198333Z","title":"Neural inventory control in networks via hindsight differentiable policy optimization.arXiv preprint arXiv:2306.11246,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":1951,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.198333Z"},"links":{"cited_paper":"/paper/2306.11246","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:914862f94645b8c8954cb56890f68ab8df57d1687aeec3dd953b8a22124d721b","observation_id":"3df5bba4-b0a5-407b-b6e5-fedcd6ece0b9","resolution":{"observed_at":"2026-08-06T12:12:46.198333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T12:12:46.219761Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":1960,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.219761Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:3640bdb57f049d150e8e26fc9afda4400c7000eb5072e1fc1054d844cb1d7cc0","observation_id":"dbec1f3a-0c03-458d-baac-af2ef0ef5510","resolution":{"observed_at":"2026-08-06T12:12:46.219761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10662","last_updated":"2019-12-03T00:08:17Z","snapshot_observed_at":"2026-08-02T08:13:46.167365Z","submitted_at":"2019-09-24T00:24:23Z","title":"How to Incorporate Monotonicity in Deep Networks While Preserving Flexibility?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10662","snapshot_observed_at":"2026-08-06T12:12:46.216238Z","title":"How to incorporate monotonicity in deep networks while preserving flexibility? arXiv preprint arXiv:1909.10662,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.216238Z"},"links":{"cited_paper":"/paper/1909.10662","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:54f720c5804d0ac904b15322d94f367e6bc1bdab22a5ffd280a59090e205bae1","observation_id":"106eef19-5796-41ff-9dd8-8fb842ce39ba","resolution":{"observed_at":"2026-08-06T12:12:46.216238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12182","last_updated":"2022-07-22T11:36:17Z","snapshot_observed_at":"2026-08-09T23:48:42.460698Z","submitted_at":"2022-07-22T11:36:17Z","title":"Effective Dual-Sourcing Through Inventory Projection","version":1},"cited_work":{"arxiv_id":"2207.12182","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.12182","snapshot_observed_at":"2026-08-06T12:12:46.426603Z","title":"Effective Dual-Sourcing Through Inventory Projection","venue":"math.OC","work_id":"b2de38bb-c5f3-43ad-bfba-47db9ed9ecb2","year":2022},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.205491Z"},"links":{"cited_paper":"/paper/2207.12182","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:f5f71b209f52fc4659f03c097a5e5ebf41c74beacb7e847cecbb65221539d9db","observation_id":"982f9912-44ac-4f2b-81a4-4fb83ac32411","resolution":{"observed_at":"2026-08-06T12:12:46.432778Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.01783","last_updated":"2016-06-16T16:38:45Z","snapshot_observed_at":"2026-07-06T04:45:11.148515Z","submitted_at":"2016-02-04T18:38:41Z","title":"Asynchronous Methods for Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.01783","snapshot_observed_at":"2026-08-06T12:12:46.223383Z","title":"Lillicrap, Tim Harley, David Silver, and Koray Kavukcuoglu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.223383Z"},"links":{"cited_paper":"/paper/1602.01783","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:4022d7b7db2cf5fe8ef8b45b6d3af9d2ee3ebc34ad39bd3dd216721f2bdc7451","observation_id":"3b64227f-f450-4e22-a94e-ac4bc865b0ab","resolution":{"observed_at":"2026-08-06T12:12:46.223383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.10641","last_updated":"2019-12-01T23:50:12Z","snapshot_observed_at":"2026-07-06T08:39:35.002141Z","submitted_at":"2019-11-24T23:49:48Z","title":"ORL: Reinforcement Learning Benchmarks for Online Stochastic Optimization Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.10641","snapshot_observed_at":"2026-08-06T12:12:46.201951Z","title":"ORL: Reinforcement Learning Benchmarks for Online Stochastic Optimization Problems","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.201951Z"},"links":{"cited_paper":"/paper/1911.10641","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:2294ac03396dfe99802ffe6537860a9a9d0c411635c9521cda86b9e10ad59ae4","observation_id":"2479b434-f850-4bf6-b985-c99485db8e00","resolution":{"observed_at":"2026-08-06T12:12:46.201951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.01806","last_updated":"2020-10-21T19:16:36Z","snapshot_observed_at":"2026-08-09T23:47:33.591849Z","submitted_at":"2020-04-03T22:59:25Z","title":"On the convergence of physics informed neural networks for linear second-order elliptic and parabolic type PDEs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.01806","snapshot_observed_at":"2026-08-06T12:12:46.234443Z","title":"On the convergence of physics informed neural networks for linear second-order elliptic and parabolic type pdes","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.234443Z"},"links":{"cited_paper":"/paper/2004.01806","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:be194f853915b7391f98d6fb10455dc3ef69c5dcc29260f68520ff290ae83767","observation_id":"319bc03a-a1cc-4dd8-b8d0-0ebf4d9b1e63","resolution":{"observed_at":"2026-08-06T12:12:46.234443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T12:12:46.237815Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.237815Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:439028d301f49e8927969d7ea30a8f0d5c2dc3ddea692bd0bf91ab8dace248f4","observation_id":"a9c5d09a-bfd8-4734-823f-5b0631e18d58","resolution":{"observed_at":"2026-08-06T12:12:46.237815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:12:46.244220Z","title":"VC theory for inventory policies.arXiv preprint arXiv:2404.11509,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.244220Z"},"links":{"citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:ab6d27c56ea3d6f363f743a794a22c05743f34d1cbaae22610b1e3230d71e6bb","observation_id":"ed92f707-0961-49b1-9312-230e91b0f871","resolution":{"observed_at":"2026-08-06T12:12:46.244220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02817","last_updated":"2024-09-24T16:23:10Z","snapshot_observed_at":"2026-07-06T19:27:16.301809Z","submitted_at":"2024-09-24T16:23:10Z","title":"Neural Coordination and Capacity Control for Inventory Management","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02817","snapshot_observed_at":"2026-08-06T12:12:46.208776Z","title":"Neural coordination and capacity control for inventory management.arXiv preprint arXiv:2410.02817,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.208776Z"},"links":{"cited_paper":"/paper/2410.02817","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:52e6c5dc6118d090d24f6265625d897a1b2c08930549694d0e0389c225618378","observation_id":"7cc77b74-c586-4f1f-8888-26808122f5d9","resolution":{"observed_at":"2026-08-06T12:12:46.208776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14799","last_updated":"2022-01-27T03:02:39Z","snapshot_observed_at":"2026-08-08T13:52:23.704772Z","submitted_at":"2020-09-30T17:12:46Z","title":"MQTransformer: Multi-Horizon Forecasts with Context Dependent and Feedback-Aware Attention","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14799","snapshot_observed_at":"2026-08-06T12:12:46.212767Z","title":"MQTransformer: Multi-horizon forecasts with context dependent and feedback-aware attention","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T12:12:46.212767Z"},"links":{"cited_paper":"/paper/2009.14799","citing_paper":"/paper/2507.22040"},"observation_digest":"sha256:2cdaa41947ab9fe1a78fc7a1a66a1a97191b7a05974859ff616496784e2abe56","observation_id":"5bff861f-4b41-423d-8967-2d9d703a3217","resolution":{"observed_at":"2026-08-06T12:12:46.212767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.22040","last_updated":"2025-07-29T17:41:45Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T23:47:48.347176Z","submitted_at":"2025-07-29T17:41:45Z","title":"Structure-Informed Deep Reinforcement Learning for Inventory Management"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2507.22040."}