{"as_of":"2026-08-10T10:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:331d508bc5da5ed4baf99004526b63cca14e42ac146d9ca020e0c07277bd6d56","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T13:42:44.334821Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.02018/citation-record","integrity":"/paper/2502.02018/integrity","json":"/paper/2502.02018/citation-record.json","paper":"/paper/2502.02018"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.678579Z","title":null,"venue":null,"work_id":"a392a4d1-9f57-4518-8610-d53b0627c7fb","year":2019},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.229413Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:c6326d49ba3093d52638b15c751361e45159f398ab46772b4d4590427dc17cdc","observation_id":"e42d55db-9bc9-4755-9f4f-8a71e7eab56b","resolution":{"observed_at":"2026-08-09T13:42:44.682176Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.668594Z","title":null,"venue":null,"work_id":"33d9c071-8a5f-4137-a589-105f62337d9f","year":2017},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.233275Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:c476d11c0842714bf1e68156c639171bf4ebc5f8a16ad678e521fe3f7e32ac30","observation_id":"a81c60b2-eada-4585-b950-958130b37825","resolution":{"observed_at":"2026-08-09T13:42:44.672097Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.658551Z","title":null,"venue":null,"work_id":"81e2a065-8001-461f-950d-fa6957c54485","year":2015},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.236844Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:ef97ff44c74f219ed99604aeeb6d014cb2d82a6280b3848d32cddf9b4802e531","observation_id":"232466dd-1a3c-4ccc-9ce1-173bb4e4132c","resolution":{"observed_at":"2026-08-09T13:42:44.661930Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.647976Z","title":null,"venue":null,"work_id":"54eb8c6d-fd17-40df-bc44-2c64c6f7235a","year":2021},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.240409Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:05f1a36ad0688efd26c54e6dca81021a052a44d9b0ec2f44b199805d52544efb","observation_id":"c8ecacb2-6bc8-4d1a-9f46-3ff44f72ef0f","resolution":{"observed_at":"2026-08-09T13:42:44.651445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.638128Z","title":null,"venue":null,"work_id":"d9307eac-4c51-48a8-83f5-318a9db46c22","year":2016},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.245081Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:829f692dbed2bebaaae38e688141ddb06ba4ea8dc1be09e928b004c1e2d79dbc","observation_id":"551d8227-63c0-4d3d-8480-a4fc596480f4","resolution":{"observed_at":"2026-08-09T13:42:44.641514Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.628453Z","title":null,"venue":null,"work_id":"06c49051-e1d6-4a8f-8529-da7a5eb7722c","year":2018},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.248595Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:b6e45d1e68c481b885e1d1626ce0f9e015df5cb92cb4e28e560cb3502ed595c4","observation_id":"225fd16b-89a8-485c-8ece-52e79cc2889c","resolution":{"observed_at":"2026-08-09T13:42:44.631783Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.618269Z","title":null,"venue":null,"work_id":"79fc7524-88b2-406d-af87-35ff979f1012","year":2021},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.252361Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:06bb151d1628a0d8168eef74200e256cb0e2c4cc6e49d2da0e3017709f037b5d","observation_id":"704c9f4d-2eb2-45bc-bd73-e4d575def4dc","resolution":{"observed_at":"2026-08-09T13:42:44.621885Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.608075Z","title":"Dai, and Quoc V","venue":null,"work_id":"d14c49b2-63e6-4d5e-9b42-c01f61119de7","year":2017},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.255651Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:7c3cc18728ec9c55f8d9fc73a63f12b9725f7d9d0afd72a0c54b467c3580484c","observation_id":"064ad80c-7b94-41b6-8eed-8388f85335a9","resolution":{"observed_at":"2026-08-09T13:42:44.611625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.596983Z","title":null,"venue":null,"work_id":"78a5d7f1-1674-4ef4-9fc9-51af5c6840d3","year":2018},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.259090Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:3ad018b243107599fdd3b14ec98acb2172581c1b9a3e107ebf0f89a9548655cc","observation_id":"9d6415d5-3632-4c79-804b-be110379d447","resolution":{"observed_at":"2026-08-09T13:42:44.601343Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.586314Z","title":null,"venue":null,"work_id":"10cff4c4-0e75-4ea5-9a30-32511ce6581c","year":2016},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.262256Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:6c061ddc671740e985963aab15d2ce886822a978a7158a10643a2f9d9b75e8b2","observation_id":"7ac3ae6c-a0e8-4303-b5e0-adf324876649","resolution":{"observed_at":"2026-08-09T13:42:44.589988Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.575795Z","title":null,"venue":null,"work_id":"087cebb8-0538-4434-b5d4-2f4c7143e084","year":2021},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.265558Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:73c83dd6229c3d6d47fe497690e5f618610b45cd3744c3fff16957acb65f87e8","observation_id":"d82b2dc5-37c8-4fc2-b633-1d1a501f072e","resolution":{"observed_at":"2026-08-09T13:42:44.579371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.564859Z","title":null,"venue":null,"work_id":"989d9fdd-0202-4b2e-a030-185084817037","year":2020},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.268748Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:2b58fb7294fcfc552024a582c3f1bca7f819415722439d79d3bfb6de35c39c17","observation_id":"da21cce5-2021-445c-a670-034ec39f96aa","resolution":{"observed_at":"2026-08-09T13:42:44.568652Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.554334Z","title":null,"venue":null,"work_id":"b639340b-69fb-4b5a-8ebd-e4407767a75d","year":2022},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.272182Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:393f2d58730b1ccb5ff9ac53445c219cd32823b5d98875dc88c5d44704851a3e","observation_id":"47a63794-fe59-48b9-978c-617267d27b60","resolution":{"observed_at":"2026-08-09T13:42:44.557726Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.543802Z","title":null,"venue":null,"work_id":"360e00a2-5286-4a8a-a502-26d427ad6c62","year":1994},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.275358Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:9294d3f61dcb382e71d03e26991cfe2fd2707ed0982db41e9ee0577c6ff4d460","observation_id":"f055e35c-bf51-4c59-8669-c128b639616c","resolution":{"observed_at":"2026-08-09T13:42:44.547405Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.533164Z","title":null,"venue":null,"work_id":"47551e23-d390-41ca-9a4b-1ff6c036da37","year":2017},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.278808Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:1cd650359d7b799cebc85aea664acb2ffdb30f516a0ef5c72eb9d535332e4ae1","observation_id":"aaec74f2-fadb-4552-b5df-792f6e641416","resolution":{"observed_at":"2026-08-09T13:42:44.536553Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.522898Z","title":null,"venue":null,"work_id":"aa52c691-d147-45d9-86f8-61f549370656","year":2019},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.282043Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:8a20e952947c310f8145e33f18880250f1e967137189cde357888c9eb63a5f02","observation_id":"a089f220-346a-4968-99c7-01c693eda65f","resolution":{"observed_at":"2026-08-09T13:42:44.526410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.512261Z","title":null,"venue":null,"work_id":"f1733d01-d6dd-4b2e-9e4a-4efddc290bc4","year":null},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.285543Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:8a8f243eaf58df1f6ee0d589902434422d6a4954a2a0605d46100fd0bbbd4c2f","observation_id":"5cb94363-9956-4573-8169-ec9cb22f23d3","resolution":{"observed_at":"2026-08-09T13:42:44.516005Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.489682Z","title":"Laurent, and Nadine Le Fort-Piat","venue":null,"work_id":"b192d91a-75f8-4452-acb6-05e81c04c04c","year":2012},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.292422Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:4f44f3ea16a6ef9bf11ba9ab7abdfcfbfbf951ab64f377a0349fcf37ef533221","observation_id":"2311a082-79d4-4eb1-81ac-28c3b1ca0df4","resolution":{"observed_at":"2026-08-09T13:42:44.493505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.295712Z","title":"Rusu, Joel Veness, Marc G","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.295712Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:322e57025d3cbdcf4ad03737b2b1cde0c6719c8160f2f597fba50041fc897dc2","observation_id":"9d062a8a-8bfa-4bfb-8341-2b8d0eb2b8cf","resolution":{"observed_at":"2026-08-09T13:42:44.295712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.472354Z","title":null,"venue":null,"work_id":"c51cb971-a25a-411a-91c9-6345e1256c08","year":2021},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.299464Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:b495475bbbfefc8f07c3aa3d2218b67de31e06585a8b5fbca54cf02ef13e5225","observation_id":"a4088104-2a7d-442f-92c9-c76980afcf89","resolution":{"observed_at":"2026-08-09T13:42:44.475774Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.462012Z","title":"Foerster, and Shimon Whiteson","venue":null,"work_id":"dc270650-c895-40c5-bf9a-8b2e7402dfac","year":2018},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.302652Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:55b7a5666ce3a98e6977cc90a8b9dd6b77f4cb9fb13e18d17c78cab698abb6ce","observation_id":"4ae1ea31-52b1-4e8d-ab02-78802416e4e3","resolution":{"observed_at":"2026-08-09T13:42:44.465620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.451675Z","title":null,"venue":null,"work_id":"facb0f21-600c-4703-a2e7-959cd9a226e9","year":2019},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.305874Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:826042b681992a71df5ae1042ce18b2f423364e6e0702958cb40c6db41b42c73","observation_id":"222616f5-ddb0-4ce4-bb80-bc811bf6e987","resolution":{"observed_at":"2026-08-09T13:42:44.454939Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.442092Z","title":null,"venue":null,"work_id":"fe4084a9-1b3d-401f-99e2-93d92d773f48","year":2021},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.309081Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:495f4759d49ce930578cb33a7eb696f05cc1fef49f700231d3ce98ce0ffc5d48","observation_id":"7eef58cb-2c87-4d1c-8a67-46361c05c3f1","resolution":{"observed_at":"2026-08-09T13:42:44.445278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.431857Z","title":"Leibo, Karl Tuyls, and Thore Graepel","venue":null,"work_id":"980e367a-c55d-446f-bd1a-83068efd13bb","year":2018},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.312292Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:f71540b4eb2a64aa79ac78473e0cd2a1dac1f06fd5026208b6e0c87ad79e06c0","observation_id":"70365e83-980b-45c1-87a5-893740cbb684","resolution":{"observed_at":"2026-08-09T13:42:44.435894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.421693Z","title":"Schwartz","venue":null,"work_id":"ea366e39-cade-4d7d-a4a7-739cfd5c824a","year":1993},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.315595Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:e358ebe637db4944a0c53346964c3dd4494fc7656390140c5a6a87457723e06c","observation_id":"ae019f3d-4b6c-4440-b5e8-980d2a214eec","resolution":{"observed_at":"2026-08-09T13:42:44.425192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.411410Z","title":null,"venue":null,"work_id":"9bca01dc-372b-4ff1-aff2-1f8ce06bebdc","year":2021},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.318720Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:a45662947fa3be88cbf2c7686b5b06cfc4c3d95da0d6a1db3679f54b12a244e2","observation_id":"6b200675-2e8b-4807-a6a5-06a323c991ac","resolution":{"observed_at":"2026-08-09T13:42:44.414659Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.401540Z","title":null,"venue":null,"work_id":"495be8df-ba26-479b-95a9-f7a534c21ea1","year":2020},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.321889Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:dcbfebbc0879c1a428379c8b17e056868da1655c8b7d76f39ce441a78fb3ae21","observation_id":"bac930e3-8263-484c-a7ff-c178f9049543","resolution":{"observed_at":"2026-08-09T13:42:44.404765Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.391776Z","title":null,"venue":null,"work_id":"9865f6c3-a9c8-4087-a7d5-4c386a57b25e","year":1992},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.325270Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:a6c49c2bc1ba3994e97b507c67807476592e048efd3cae0a7b0c0737f9f70271","observation_id":"dd71581b-ee94-4f1e-8ba7-78bacd70cb17","resolution":{"observed_at":"2026-08-09T13:42:44.395107Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.381576Z","title":null,"venue":null,"work_id":"f8519840-18f8-467b-a1be-abdf891f5bc3","year":2022},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.328449Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:7cd92c6766fa4f51650797e6d7ce990da2eba007d6772ee266a480080a8be3a6","observation_id":"69d0503c-5a03-4433-8eda-141135267daf","resolution":{"observed_at":"2026-08-09T13:42:44.384913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.370576Z","title":null,"venue":null,"work_id":"d7cb2a49-0034-4d08-82ed-c247c6fd1109","year":2022},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.331632Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:660ac17394870485f817960ac3aad9c8a0d9c42f87fc868b805a028fe4ad62bd","observation_id":"096d2d83-fc12-45cf-8c30-605d692cf15f","resolution":{"observed_at":"2026-08-09T13:42:44.374720Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.03939","last_updated":"2020-06-09T05:20:11Z","snapshot_observed_at":"2026-07-06T08:56:13.036996Z","submitted_at":"2020-02-10T16:48:03Z","title":"Qatten: A General Framework for Cooperative Multiagent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.03939","snapshot_observed_at":"2026-08-09T13:42:44.334821Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.334821Z"},"links":{"cited_paper":"/paper/2002.03939","citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:f9a575d27ac865dd0a5cdc546ca7db96b30f3eaa01e6236ab92a220bdb3d6238","observation_id":"0384995f-5e91-4b04-acfb-b41d50358b2b","resolution":{"observed_at":"2026-08-09T13:42:44.334821Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T13:42:44.500658Z","title":"In Proceedings of the 38th International Conference on Machine Learning , Vol","venue":null,"work_id":"db5b6fc5-50a1-419f-9394-c0e043b674f7","year":null},"citing_paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T13:42:44.289182Z"},"links":{"citing_paper":"/paper/2502.02018"},"observation_digest":"sha256:133bc5c7b4079e5809541a601cbb94434df237192c7f928be05f316f45ba3245","observation_id":"1e5b9adc-6033-4629-978a-90ef99d3b14f","resolution":{"observed_at":"2026-08-09T13:42:44.504966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.02018","last_updated":"2025-02-04T05:14:58Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-09T13:35:49.900661Z","submitted_at":"2025-02-04T05:14:58Z","title":"Dual Ensembled Multiagent Q-Learning with Hypernet Regularizer"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2502.02018."}