{"as_of":"2026-08-10T06:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a887e4564d78399ef1f16909b5043beeb08909f0dd43d4389b11a6bef6a947c3","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:29:16.402684Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T05:02:56.825004Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:39:50.829089Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"cited_work":{"arxiv_id":"2507.02698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02698","snapshot_observed_at":"2026-07-04T13:39:50.829089Z","title":null,"venue":null,"work_id":"36081b6d-1ef4-461a-aa22-b833522aa891","year":2025},"citing_paper":{"arxiv_id":"2606.26787","last_updated":"2026-06-25T09:21:42Z","snapshot_observed_at":"2026-07-07T00:01:05.946912Z","submitted_at":"2026-06-25T09:21:42Z","title":"AIGP: An LLM-Based Framework for Long-Term Value Alignment in E-Commerce Pricing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T05:02:56.825004Z"},"links":{"cited_paper":"/paper/2507.02698","citing_paper":"/paper/2606.26787"},"observation_digest":"sha256:7efaacc6e9b891c94eda22b7f54a276e2b327199d74af75ff35a5fe3c6a7bdb6","observation_id":"edac2389-7b61-44b2-aeab-288cf5ea79d9","resolution":{"observed_at":"2026-07-04T13:39:50.830522Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.02698/citation-record","integrity":"/paper/2507.02698/integrity","json":"/paper/2507.02698/citation-record.json","paper":"/paper/2507.02698"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:25.640259Z","title":"Snellius: de Nationale Supercomputer","venue":null,"work_id":"1f06f33a-99c4-415c-ab9b-4f30b6b8ea0f","year":2025},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.004183Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:9b888d4ceb9c1ef47fec15750d3b7e900a92e9a471a18ea4e28a64957fb4c3d1","observation_id":"f9b33be4-66e2-4264-91ab-556638d9865b","resolution":{"observed_at":"2026-08-06T20:29:25.780529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.7717/peerj-cs.2078","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"PeerJ Computer Science","work_id":"4dee2103-08b6-4b12-988e-69e536707589","year":2024},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.136596Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:fb76a28bd9af678d6104e17e91eda55949f3efd0859557363414f852c3073c05","observation_id":"130c883b-500d-4ac0-bb6d-9665e46057b7","resolution":{"observed_at":"2026-08-06T20:29:19.871012Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9442.00151","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:21.654620Z","title":null,"venue":null,"work_id":"812759e2-1f86-4591-af5a-955286553223","year":1999},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.249287Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:fc463a77f4184f8ffd8b74561cb7720f2e436742541708e1f892fc9987d3dff6","observation_id":"9e34861d-2eb6-4727-9f03-cabefa2a09a8","resolution":{"observed_at":"2026-08-06T20:29:21.754111Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.11289","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:21.231596Z","title":null,"venue":null,"work_id":"c1f8e3a4-1549-4311-b863-025bd6bb54f4","year":2020},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.372267Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:6f6dddfedb08882246aff97b7a392b85a148dc9611b80b3e7bb5325e3a9f3d15","observation_id":"01a73798-de4e-4272-a6c3-a62d54d4a92f","resolution":{"observed_at":"2026-08-06T20:29:21.412869Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:08.532013Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.532013Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:4ea271627e6050a288c19fd8f733f2b43d09b6574435b7da337367f774c83468","observation_id":"c6ffe257-82e9-4760-af19-67e278ee98bd","resolution":{"observed_at":"2026-08-06T20:29:08.532013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.ifacol.2015.06.391","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"IFAC-PapersOnLine","work_id":"ba24f0a5-433e-440f-b2c4-d2dc4ccc7e2c","year":2015},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.672609Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:f4e4d5f959de6f88dd77e73151e9300c261f09402b30cad5a03c4c5b65889197","observation_id":"fb148c67-26c4-46dd-ad6c-a6c5e19f4a98","resolution":{"observed_at":"2026-08-06T20:29:19.724333Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:08.782014Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.782014Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:285714c9bfaa96a502fac7c9c245455b6c8fe7970406d9910d0ba6cb63cf4c8c","observation_id":"559f5252-d5a9-4d2b-9b35-6eceef60f269","resolution":{"observed_at":"2026-08-06T20:29:08.782014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:25.446472Z","title":null,"venue":null,"work_id":"21343496-c761-4a47-b693-cc4308f0c52d","year":2010},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:08.953291Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:7e859485d4fae8589c4237425d0d95000f86ad817b87701cb37622e8e8fd2fe8","observation_id":"3133395b-21f5-4b31-960a-af74084e2f6b","resolution":{"observed_at":"2026-08-06T20:29:25.572508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:09.129755Z","title":null,"venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:09.129755Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:ba86f7593a03546c9109354242390e32cdd7e532bf116e0d3b46842fca300178","observation_id":"c186cff5-f5bd-43ba-9da3-9e91ff8643ce","resolution":{"observed_at":"2026-08-06T20:29:09.129755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:09.285434Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:09.285434Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:caa30514ca75fba246add6ab3041499c9a997dc009b4d43497416278c1e3dd46","observation_id":"40c94f40-993f-4fd1-b2ac-c3dcfc969951","resolution":{"observed_at":"2026-08-06T20:29:09.285434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1504/ijbfmi.2015","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:19.550414Z","title":null,"venue":null,"work_id":"33b9c3b3-2f03-4194-82ea-48e8e7eae695","year":2015},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:09.408280Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:6da8d47aa1336bbc3ac236b9fb668863cdb80e54eb0893ccbc0238d95d1350f2","observation_id":"92e2f868-1c65-412a-9641-502c793b38be","resolution":{"observed_at":"2026-08-06T20:29:19.590005Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:09.546123Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:09.546123Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:14e1de1cf3ece6c1528244051be50a3cba85c4ccad860045ad0be95dcae8df0c","observation_id":"4f105b3c-38e8-4090-846a-d2fc5619d556","resolution":{"observed_at":"2026-08-06T20:29:09.546123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:09.682850Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:09.682850Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:95eaa618d7a9a11847f331d165bea50a9b6a97b192b3e62ca6531ce44b797bb7","observation_id":"aba7199e-4514-436a-acac-144f44ef72fa","resolution":{"observed_at":"2026-08-06T20:29:09.682850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:25.261768Z","title":null,"venue":null,"work_id":"97f614f7-e0d7-40c7-afb2-5470d07ba52d","year":null},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:09.834168Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:d14940f2e9d51cef2b0dff9c4d3ed1b85e0a69c9844d499c7eea11e77cb9c7a5","observation_id":"5f94116c-e09d-41a4-9052-34dee9332ecc","resolution":{"observed_at":"2026-08-06T20:29:25.361611Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.37547/tajet/volume06issue12-15","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"The American Journal of Engineering And Technology","work_id":"f8ff3c94-5991-4b7e-8a55-f49c45f5c3bd","year":2024},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:10.162402Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:3809e1c6432cd680f959dbfc744ff0c73daee0c4c23f0c3926dca7e62b980eaf","observation_id":"4b19c71b-0265-461d-aeb2-c1522b35ebee","resolution":{"observed_at":"2026-08-06T20:29:19.421258Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:10.315459Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:10.315459Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:0658beb18cd59855d73aa38f137e40126d98e2108e5e32a1d521e789b34d3eff","observation_id":"3ab3a4a3-f7f7-40c3-a24b-b41fc8a6003c","resolution":{"observed_at":"2026-08-06T20:29:10.315459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0529.2023","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:20.839880Z","title":null,"venue":null,"work_id":"02b54106-55bf-48cd-bdb2-899c08af52aa","year":2023},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:10.440000Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:e3d3355d0fb2483e916be7bff3845337c5f7068d8c97a40fd5d8ac746c81e551","observation_id":"1f9bfaba-3906-45c8-832f-1643718d1f6e","resolution":{"observed_at":"2026-08-06T20:29:20.878731Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"publication/3863826","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:20.602538Z","title":null,"venue":null,"work_id":"d2c4577f-cec9-4925-9683-fd52c23fc871","year":2024},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:10.557031Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:20b3763be9ec6ce6ab6d3c2aca764d1e2ea38c5635dc135339ba5320328d8839","observation_id":"b2d0d898-025b-461c-8ac1-22a393bb5017","resolution":{"observed_at":"2026-08-06T20:29:20.689007Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1605.06676","last_updated":"2016-05-24T18:16:56Z","snapshot_observed_at":"2026-07-06T04:57:08.358661Z","submitted_at":"2016-05-21T17:20:04Z","title":"Learning to Communicate with Deep Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.06676","snapshot_observed_at":"2026-08-06T20:29:10.678948Z","title":"Foerster, Yannis M","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:10.678948Z"},"links":{"cited_paper":"/paper/1605.06676","citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:3f8bb40be4ac7333fa8faeddcdb23376991410b66c7223f4beb4d6996ea1d05b","observation_id":"fc5813b1-70e2-4afc-adf0-64f1ed1159d5","resolution":{"observed_at":"2026-08-06T20:29:10.678948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3115/v1/p14-1047","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"4126f6b4-702c-4078-a4b0-317753e6c858","year":2014},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:10.806992Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:85cba7c8839d35ba47ff2340c164c212e89012ba51fa4ddb71ddc748071c5994","observation_id":"48013670-e915-4484-bc7d-d924f163b261","resolution":{"observed_at":"2026-08-06T20:29:19.184640Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.procs.2014.09.060","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Procedia Computer Science","work_id":"b5e86acf-82f7-4dba-9b79-d1ff3cedf791","year":2014},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:10.969017Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:3791cf7101a216e5985d3a35c96c982ff5c1cad2b726a39bc27fa8b824ea8953","observation_id":"1aec220c-27c7-4825-82f4-da67fae82123","resolution":{"observed_at":"2026-08-06T20:29:18.940791Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:24.939879Z","title":null,"venue":null,"work_id":"30b79f1f-85ac-4d68-82ce-494fde05742d","year":2012},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:11.135560Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:3fd493c0fe23ee58d5519c4247452304b628674a2b15537a3ca25aa74b8002df","observation_id":"2c6957b9-f0d1-4f66-a66b-5a02ed697d60","resolution":{"observed_at":"2026-08-06T20:29:25.082320Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:11.255292Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:11.255292Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:92688d9ccf3cecf5ebd3c72187e64946e5c8a8992fb16705305876c54138cb1b","observation_id":"1565b1f2-d0c2-487b-bace-ed11ace02a2f","resolution":{"observed_at":"2026-08-06T20:29:11.255292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:11.380332Z","title":"Hendricks and Kate W","venue":null,"work_id":null,"year":1936},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:11.380332Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:6f1db436e8c13746266bb7776c9efed84c222a10931e319f4334d8011feb236c","observation_id":"b7dfd59c-3cc2-4fe2-990f-f78697cd1a64","resolution":{"observed_at":"2026-08-06T20:29:11.380332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13442","last_updated":"2023-02-19T01:24:51Z","snapshot_observed_at":"2026-08-06T01:50:31.974402Z","submitted_at":"2023-01-31T06:38:53Z","title":"Scaling laws for single-agent reinforcement learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13442","snapshot_observed_at":"2026-08-06T20:29:11.556414Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:11.556414Z"},"links":{"cited_paper":"/paper/2301.13442","citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:b5a57e9640585a1b1fb27681992dd4a3c84f6c814bd30a126dcc039e1a327a7c","observation_id":"5aac830d-c546-4b4f-ac10-3be925a83dfc","resolution":{"observed_at":"2026-08-06T20:29:11.556414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.indmarman.2003.10.006","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Industrial Marketing Management","work_id":"af3823cd-c744-4a28-ab46-e5a24235389a","year":2004},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:11.716782Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:957473228865b2f323cebdcd12b07f1eb660f71c25caa2fa6cdda838b99e0efe","observation_id":"3783fd37-06d1-4669-bd6f-623111f0a000","resolution":{"observed_at":"2026-08-06T20:29:18.704392Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/1-4020-5263-4_24","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":null,"venue":null,"work_id":"813a5386-1152-437f-8830-90f9ac5996f6","year":2006},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:11.896483Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:d7b2ddc023066acbb89f8072237c0faa2e1ebc3553bb3a3ff5a11e02a4bb4f48","observation_id":"8b6ebe7a-adbe-47eb-9c7c-18dbc1b63198","resolution":{"observed_at":"2026-08-06T20:29:18.593097Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:24.706468Z","title":null,"venue":null,"work_id":"91d5ca56-5c4d-4db1-8554-706f0f010dc1","year":1984},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:12.028638Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:743a78838551e3da1df39453bf60b4dc2c6f008a63a6bf185a4b1cab7bb3a33f","observation_id":"da103f51-ec98-424b-9f5b-34e99cb19b40","resolution":{"observed_at":"2026-08-06T20:29:24.813285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1108/17410380810869923","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Journal of Manufacturing Technology Management","work_id":"b9fe6b69-35ee-4249-b080-c3a74da2cc07","year":2008},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:12.215638Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:8038e974325f24176358df1554d8a8a8d2117fbbc0c62116a7e52b64bee03477","observation_id":"a85e6260-0ec4-4a9b-8b37-f8283aec0154","resolution":{"observed_at":"2026-08-06T20:29:18.460653Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:24.350258Z","title":null,"venue":null,"work_id":"b310579f-002a-4bbd-8363-6f81de52a6b0","year":2017},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:12.331390Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:b095705c98ef068de8ccb27d955371bb020ca162ea708d8180d26fa7da6f78f7","observation_id":"44191092-5e80-421f-bfec-a87690815afb","resolution":{"observed_at":"2026-08-06T20:29:24.543379Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:12.442184Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:12.442184Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:8942338e0303aff610d4288d88c192e399f674c377fdc0d8181d3c2283bd2496","observation_id":"d24e8000-2c92-4f0d-8371-fde89eb8571e","resolution":{"observed_at":"2026-08-06T20:29:12.442184Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:24.020806Z","title":"Konda and John N","venue":null,"work_id":"70c1daf1-1faf-42db-a8bc-11e43ad55f6c","year":2003},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:12.551281Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:3c08ee0bcb590ab7deb64bbdaeffb5acdad4451d187b80cd81803ece68075e96","observation_id":"629e5f4c-f436-422f-a328-33fbbbf43bb7","resolution":{"observed_at":"2026-08-06T20:29:24.195442Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:23.691718Z","title":null,"venue":null,"work_id":"9aa3ba62-bcf6-4372-a7d1-77e849e5e3ef","year":2001},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:12.717425Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:00dc1abc7c04da7b4db15323cafa2a219f2be5656556e28d6bce437b6e52eac5","observation_id":"4198f2bf-1acf-493d-b826-4ae7bf93f792","resolution":{"observed_at":"2026-08-06T20:29:23.854475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:23.274579Z","title":null,"venue":null,"work_id":"7e2d9987-b7fe-4392-b649-6935e4ffb1c4","year":2021},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:12.914533Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:4906b3689abbfb63e7231b111bc111be497c40492327129d2e5e56a13f0a1f3f","observation_id":"2e656425-c613-4a2f-b113-1f116bdf49fc","resolution":{"observed_at":"2026-08-06T20:29:23.532678Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-319-24264-4_37","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":null,"venue":"Lecture notes in computer science","work_id":"e95ccaed-e675-4c9f-bfa2-0fe5112fc590","year":2015},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:13.060715Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:c00ad72a110398285c9720bfd22bee699e4dc3982c093660dd97e6ad75a2d768","observation_id":"e9dabf95-f8b4-4c16-8475-98ee32f6d760","resolution":{"observed_at":"2026-08-06T20:29:18.372843Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:13.171498Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:13.171498Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:53d3cba0626b9b15147de5fdcc31802f2863288cfc65a71c98bec44132a2b798","observation_id":"265b050b-b237-4871-bdbe-d4e05bd60f54","resolution":{"observed_at":"2026-08-06T20:29:13.171498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02572","last_updated":"2021-08-31T01:42:10Z","snapshot_observed_at":"2026-08-09T21:43:51.236977Z","submitted_at":"2019-12-05T13:41:03Z","title":"Dynamic Pricing on E-commerce Platform with Deep Reinforcement Learning: A Field Experiment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02572","snapshot_observed_at":"2026-08-06T20:29:13.303844Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:13.303844Z"},"links":{"cited_paper":"/paper/1912.02572","citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:d9c22157a8f206a184eb6f51e10caf7598b6692c5444267d91efbc9ae8e9e0a0","observation_id":"0b8970af-e32b-4697-9083-cd73952bf2a1","resolution":{"observed_at":"2026-08-06T20:29:13.303844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:13.662558Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:13.662558Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:dd2d2019ea2f973b2c9148760f289cecee761b063786d3cbe4ff8faca417a8d2","observation_id":"9ac9bda0-bb6a-4a68-b6c5-ea9e83d48d8c","resolution":{"observed_at":"2026-08-06T20:29:13.662558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.30574/gjeta","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Global Journal of Engineering and Technology Advances","work_id":"8216187b-c7ef-4677-b804-dbb9ce615b20","year":2024},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:13.984067Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:ea45e5d1d44ee89cdf79e8f1b826c438a395cbc50609feefbaced8c60f5a705a","observation_id":"8cb0c83f-cb0f-4ef2-948f-5f53fd4afc3f","resolution":{"observed_at":"2026-08-06T20:29:18.177842Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:14.147667Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.147667Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:b92c3a9736daec9817eaa7514f2b3f5cc069c1947db0f88c1d93b49f93520638","observation_id":"1d8e33d3-1b1f-41ed-af6c-b5e94d42cdc7","resolution":{"observed_at":"2026-08-06T20:29:14.147667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:22.642830Z","title":"https://github.com/openai/maddpg Archived codebase provided as-is, based on the NeurIPS 2017 paper","venue":null,"work_id":"b7f4a696-2c15-4c9d-a04a-f4186d4874c7","year":2017},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:13.887246Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:1f3e3df7b8c3874f6f9fbde0b3dc6f7bce69b5a5f9764a428b9bc1fbab19c9fc","observation_id":"4952db4d-da68-4135-a4ae-2ee46f75fe64","resolution":{"observed_at":"2026-08-06T20:29:22.769099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:22.310591Z","title":null,"venue":null,"work_id":"38b671c7-7ebc-4474-89bd-c5c978ff1213","year":2005},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.385078Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:138b6f8064af8d30548953c1811b1fccc19d5a70dc968d28db8b3bbd3d4c8c68","observation_id":"2cb7e7bf-0f90-4ba3-a85b-7e5371a0af0b","resolution":{"observed_at":"2026-08-06T20:29:22.471240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:14.456991Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.456991Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:83b1b0004becfd71b5024aa5f814af7d231b7a21e3667ea8c144a23c4cb5d65d","observation_id":"58a15160-1d0d-450b-9635-22da1f0ec849","resolution":{"observed_at":"2026-08-06T20:29:14.456991Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:14.299632Z","title":null,"venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.299632Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:6bbe1d582e7f801d0d1e011c61f12b4cc4cf8a08ad2c4d8210fdfd3f2ab770eb","observation_id":"ab1dc2ac-904a-4720-9104-66b764d8aa8e","resolution":{"observed_at":"2026-08-06T20:29:14.299632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:14.697760Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.697760Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:7507af13f9e52d27420432fa37a763e9ebfdf171e1b2b54270557790565f8136","observation_id":"cddb635d-4787-4a39-a0fb-120a6dfb91bf","resolution":{"observed_at":"2026-08-06T20:29:14.697760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:14.804378Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.804378Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:a4babe4fa86eb333a076d96107a0509f96f08e70c77c8d84dc875a496fa2f09e","observation_id":"77ff5e8f-6f23-4b66-a98e-c981134394d6","resolution":{"observed_at":"2026-08-06T20:29:14.804378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.11485","last_updated":"2018-06-06T17:58:09Z","snapshot_observed_at":"2026-08-06T12:03:41.509273Z","submitted_at":"2018-03-30T14:23:39Z","title":"QMIX: Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.11485","snapshot_observed_at":"2026-08-06T20:29:14.571680Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.571680Z"},"links":{"cited_paper":"/paper/1803.11485","citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:1a2aec8ccee3b8b41ba750bf85db02a097ed7022c9b6f97a054694c1799ffda1","observation_id":"b32f4b0c-3907-41a0-a7e1-c7ce722d5905","resolution":{"observed_at":"2026-08-06T20:29:14.571680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:14.982126Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.982126Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:5a10f6dde9f5afbdbe1d43132fa57238b66de6aa50800b1f8cc2eef47a4c918a","observation_id":"adbe308b-3f23-46e7-91fa-7338549d1c08","resolution":{"observed_at":"2026-08-06T20:29:14.982126Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:15.119548Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.119548Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:902813fa14beccdb03993c21c1c5a80c548f137c7ddf2e66ad3d08f35ce661fb","observation_id":"df34b0e2-df6a-4900-991b-fd32ebce6154","resolution":{"observed_at":"2026-08-06T20:29:15.119548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.07478","last_updated":"2017-11-20T16:40:33Z","snapshot_observed_at":"2026-07-06T06:10:25.736483Z","submitted_at":"2017-11-20T16:40:33Z","title":"Implementing the Deep Q-Network","version":1},"cited_work":{"arxiv_id":"1711.07478","doi":"10.48550/arxiv.1711.07478","metadata_source":"pith","pith_arxiv_id":"1711.07478","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Implementing the Deep Q-Network","venue":"cs.LG","work_id":"f5517430-e65b-4f70-9150-63dba8fed7e6","year":2017},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:14.864682Z"},"links":{"cited_paper":"/paper/1711.07478","citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:12c27d6a923942f51fbf86e397373f2395d8239be1d502a9d76f5d86f86e3288","observation_id":"938d2c47-21cc-4864-a734-f4adea139a82","resolution":{"observed_at":"2026-08-06T20:29:17.885898Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"publication/3848058","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:20.030159Z","title":null,"venue":null,"work_id":"213af0ae-d1d7-4540-9a74-737ff373a459","year":2024},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.338760Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:68a3122dbd07a00e8f8b8b538ef7352561be9d668c9a89ef2e301a4c12e1588f","observation_id":"789d9cc6-724a-4400-a367-7ab64cd6539f","resolution":{"observed_at":"2026-08-06T20:29:20.090430Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07378","last_updated":"2024-10-09T18:53:17Z","snapshot_observed_at":"2026-08-05T11:41:10.476072Z","submitted_at":"2024-10-09T18:53:17Z","title":"Static Pricing for Online Selection Problem and its Variants","version":1},"cited_work":{"arxiv_id":"2410.07378","doi":"10.48550/arxiv.2410.07378","metadata_source":"pith","pith_arxiv_id":"2410.07378","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Static Pricing for Online Selection Problem and its Variants","venue":"cs.GT","work_id":"aed4152e-cbcd-4de0-a2a4-52404f178db4","year":2024},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.475625Z"},"links":{"cited_paper":"/paper/2410.07378","citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:c2fd9178bbb40c8a9487c9aaf9aa519531d20deae513f4fb9051c7c39cf7f1fc","observation_id":"e8df9342-8a68-425b-963a-9e4f20d5d4c2","resolution":{"observed_at":"2026-08-06T20:29:17.348694Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-319-95786-9_24","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":"Graves, Douglas A","venue":"Lecture notes in computer science","work_id":"3e5fd4a1-1e00-427c-841f-facac9b69296","year":2018},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.201620Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:bc75315d759621516b5f7a143eb6d9bfee8f716a8ca6bf05ed91274b1fb2cb2c","observation_id":"50a388a4-6110-4555-ad9f-e552e592439a","resolution":{"observed_at":"2026-08-06T20:29:17.615685Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2139/ssrn.4144905","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"SSRN Electronic Journal","work_id":"b2166aed-b607-4578-8c7f-cc98a7572902","year":2023},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.751883Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:c9105bb08da8ebf9d120018452d792597ac4a4ebb93ff3f2df4c6c5f98f21ab0","observation_id":"d4ceb7cc-3946-4cbe-938c-a57ddeffd2af","resolution":{"observed_at":"2026-08-06T20:29:16.896585Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1509/jmr.16.0453","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Journal of Marketing Research","work_id":"0ae75813-038d-43e6-90db-2e85324d00e7","year":2018},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.888540Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:a71f84166c2f8046c5c18c6614e5e0e42d63aa68856337908ba93d3962a09cf7","observation_id":"62a276e2-5047-40ad-8b21-17f31ae9dd5e","resolution":{"observed_at":"2026-08-06T20:29:16.644044Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1108/02635570210414631","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Industrial Management & Data Systems","work_id":"8cb3ca6f-0f8d-4a06-b7f7-3f0f318ba73c","year":2002},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.612360Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:1153c9284e73d36336472ac75f57f620583ef4a9ce77c5e1233d52d04fe0b1e4","observation_id":"604340aa-9ed8-420c-824f-1cb6e478a121","resolution":{"observed_at":"2026-08-06T20:29:17.098375Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:16.072731Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:16.072731Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:1395e85d5d79cefa4ba5f95ada9cf9709ccafaedf32cff960eb4d9f3a26eca56","observation_id":"a3f585e8-25e4-47bf-baa6-c88266b1eb76","resolution":{"observed_at":"2026-08-06T20:29:16.072731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:16.186185Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:16.186185Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:e32e8873bf57fa693edb169a888a5e2a9b6dc92190c7dba0e199c92831974f78","observation_id":"c49fe91a-fe4e-4a43-9951-8f8c817427a4","resolution":{"observed_at":"2026-08-06T20:29:16.186185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:15.990002Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:15.990002Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:ad6afc58fe5b0873f22379d714365e0a1726842cae03cf0811eba2667f1265d1","observation_id":"6c0955f4-5cc2-496a-a96b-f1db5f1a76d6","resolution":{"observed_at":"2026-08-06T20:29:15.990002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10091","last_updated":"2023-05-17T09:53:13Z","snapshot_observed_at":"2026-07-06T15:28:36.294775Z","submitted_at":"2023-05-17T09:53:13Z","title":"Multi-Agent Reinforcement Learning: Methods, Applications, Visionary Prospects, and Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10091","snapshot_observed_at":"2026-08-06T20:29:16.402684Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:16.402684Z"},"links":{"cited_paper":"/paper/2305.10091","citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:08af5c58de3e1800b5e9d3bda054db0769134062254a2369001c9d0640843dc2","observation_id":"e7aba37b-c24b-4741-8c36-486532749ae4","resolution":{"observed_at":"2026-08-06T20:29:16.402684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:21.917841Z","title":"2016.Automated Pricing Agents in the On-Demand Economy","venue":null,"work_id":"51b9a689-d6d7-4670-b901-8e9b62940a23","year":2016},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:16.275881Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:8b14ad00018525b908bf50e782da571540a458492827bad73c323a83fe50246b","observation_id":"d2dfb5f8-a62b-4cbc-a7ac-3e81f9d1653f","resolution":{"observed_at":"2026-08-06T20:29:22.102766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:22.944734Z","title":"In Advances in Neural Information Processing Systems , Vol","venue":null,"work_id":"18c57120-ead3-48e2-b12d-aed19aa996a4","year":2017},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:13.571233Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:1734f2a4c7d415a7d3545b905762af4469330ac7640ea3f679cb75af7d82e6f8","observation_id":"54fad510-e79a-4083-a5e2-2e6e77d7508d","resolution":{"observed_at":"2026-08-06T20:29:23.108572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:29:09.966441Z","title":"INFORMS Journal on Applied Analytics 51, 1 (2021), 76–89","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T20:29:09.966441Z"},"links":{"citing_paper":"/paper/2507.02698"},"observation_digest":"sha256:20935428d8650c8e08bcb6dcb176752fe219610e27415565aed44ac33107d465","observation_id":"17bdd902-c895-40e5-9916-90d55aad232a","resolution":{"observed_at":"2026-08-06T20:29:09.966441Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.02698","last_updated":"2025-07-03T15:07:37Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T03:41:20.489304Z","submitted_at":"2025-07-03T15:07:37Z","title":"Multi-Agent Reinforcement Learning for Dynamic Pricing in Supply Chains: Benchmarking Strategic Agent Behaviours under Realistically Simulated Market Conditions"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":7,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":31,"verified_exact":20,"verified_fuzzy":4},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 1 inbound Pith citation observation for arXiv:2507.02698."}