{"as_of":"2026-08-14T15:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:655d4c2d90b09f90ce70c705010960c8efe3dca148aaf56fe85333d0507096d3","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:42:31.969789Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.10251/citation-record","integrity":"/paper/2507.10251/integrity","json":"/paper/2507.10251/citation-record.json","paper":"/paper/2507.10251"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.261353Z","title":"Amato, G","venue":null,"work_id":"517ec0d0-0104-49b3-8c91-05dced4b2c0c","year":2019},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.900918Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:6c595a98c6bd756a417deb3dbd4344e465b26d3fc96257de62bff985b86f2aa1","observation_id":"c25dabca-4b28-44ef-aca6-fc5d86beb1ce","resolution":{"observed_at":"2026-08-06T17:42:32.263964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.254513Z","title":null,"venue":null,"work_id":"d3f97104-1ab9-42a8-8d35-946d48c17df2","year":2017},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.903594Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:48d8984ade2e25a569f60a811bec56e28de4fdcfebc6d33a2701c682978e834e","observation_id":"dd50fff5-d071-4772-8ada-085108eb3937","resolution":{"observed_at":"2026-08-06T17:42:32.256851Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.247597Z","title":"Christopher, D","venue":null,"work_id":"9a93e58d-bea2-4063-b010-cbc8d8c0ab0e","year":2014},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.905919Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:31145e2918f37305bec3ddbf3b4f054d4a6214c70188125db4a1b37b30dfa625","observation_id":"254b6afe-a17d-4c24-92fe-8eb5fd9e4f05","resolution":{"observed_at":"2026-08-06T17:42:32.249983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.241232Z","title":null,"venue":null,"work_id":"3502720e-1096-40aa-8d62-20e6d84ac918","year":2019},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.908315Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:0dc822fa4d254cb922cfcb024dd11b6fa970f5344e4085cf351e9b4f22ee6dea","observation_id":"52688c32-0c2d-4039-9037-fdbf6c6ac072","resolution":{"observed_at":"2026-08-06T17:42:32.243323Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.06979","last_updated":"2022-08-29T10:30:43Z","snapshot_observed_at":"2026-07-06T07:46:06.039145Z","submitted_at":"2019-04-15T12:00:29Z","title":"A Hitchhiker's Guide to Statistical Comparisons of Reinforcement Learning Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.06979","snapshot_observed_at":"2026-08-06T17:42:31.910654Z","title":"Colas, O","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.910654Z"},"links":{"cited_paper":"/paper/1904.06979","citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:55886d40b0c18db2c9d8f44b33b6c0c1743542f65332e15637f73189d1a0dc7b","observation_id":"87ac3d3e-fd49-4e89-ab9b-363cda374d13","resolution":{"observed_at":"2026-08-06T17:42:31.910654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.234689Z","title":null,"venue":null,"work_id":"7bbaf04f-e18f-45ab-9e6b-f4b4ebba84cd","year":2021},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.913173Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:8849efd13bd6f0b9d8e25747a87a3bc01b4e271b8293ca14445a20419b0a354e","observation_id":"2b01d831-0594-4a3e-9116-86fce109ecf0","resolution":{"observed_at":"2026-08-06T17:42:32.236904Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.228013Z","title":null,"venue":null,"work_id":"00b7c4b8-a03a-4416-b2ac-2658307b3488","year":2023},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.915660Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:e442cfc1ed2e03643c86e25e4675ac5edce82d0ece2d777dacc94f1012954931","observation_id":"4e0fe3d0-cf6a-485d-8a92-5a6d53d0bd10","resolution":{"observed_at":"2026-08-06T17:42:32.230238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.220642Z","title":"Gupta, A","venue":null,"work_id":"62c7ea74-2768-4d5c-9c0e-8b442538aaaa","year":null},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.917968Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:5389a96240af6c5ca83f01893d6a1c3e2c46e5f4e253359ca9043c01add0d1a5","observation_id":"13632030-4f3a-4502-8f6c-3f8f5480527f","resolution":{"observed_at":"2026-08-06T17:42:32.223213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.213938Z","title":null,"venue":null,"work_id":"dae89498-fe28-4fff-8c58-5a496028f992","year":1990},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.920152Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:bcd190ca194146232ff90ac28dc910dadf4dc09322aad4ce5100bc458f4e3fe0","observation_id":"8f48adb4-8852-4c19-8d82-0f2ad4709543","resolution":{"observed_at":"2026-08-06T17:42:32.216227Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.207336Z","title":"Liu and J","venue":null,"work_id":"05865756-66b8-42e1-a5a9-19f14cfb8ffd","year":2024},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.922269Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:acdb180c32a065603e3efdf2bc46c4cca31dc913f433e5798a51f949910af4a6","observation_id":"790eb0c5-57ee-453e-830b-a88b36812a67","resolution":{"observed_at":"2026-08-06T17:42:32.209501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.200182Z","title":"Mahajan, T","venue":null,"work_id":"71c5c4c1-8564-4604-817f-81bdde8844d8","year":2019},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.924564Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:3ffdc322a6952ce0e39caf227a24f7c88df76896cf43862b8d4e9abd7c5ca68d","observation_id":"ed8414c3-967e-4153-93c1-d1cedc9678b3","resolution":{"observed_at":"2026-08-06T17:42:32.202893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.193411Z","title":"Marchesini, Y","venue":null,"work_id":"272cd362-7318-4131-a4c0-d04fca40f7de","year":2024},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.926863Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:b7ab91ba685b6fc2bc60a3f1cc2ad60c5b791cc84c001e7ee1b06eab79b9891e","observation_id":"5a1119d7-cb7c-43da-96e7-f94fcee32f4e","resolution":{"observed_at":"2026-08-06T17:42:32.195768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.186969Z","title":null,"venue":null,"work_id":"c0b07ec3-b805-483c-80cb-9beea3e1b2f4","year":2016},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.929012Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:93cd2bf308a5ebaa79b5dac3c3a1aa9f653bd2362f2fac102a5174a4ba724a00","observation_id":"67c0c2a2-3264-4785-9487-05e1d6858dab","resolution":{"observed_at":"2026-08-06T17:42:32.189160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.180460Z","title":"Omidshafiei, A.-A","venue":null,"work_id":"96463c2f-0f68-4fa9-8591-b5da22c16e17","year":2017},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.931025Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:1ab3ffbe8dad366d99f1683704d454250abf9cecfcc2c0872c17aa435fba07b7","observation_id":"82f40597-9b22-4d56-8372-52b0f7ac358f","resolution":{"observed_at":"2026-08-06T17:42:32.182632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.172609Z","title":"Rashid, G","venue":null,"work_id":"ed0510b1-ea07-4e51-9404-696026316cae","year":2020},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.933128Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:04f06e175d430cffb3373cae7a93cf8df6d824b5114c192d7f4907e5d37d3ffa","observation_id":"49742869-cd09-48bf-a46f-e9c9af372feb","resolution":{"observed_at":"2026-08-06T17:42:32.175255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.165323Z","title":"Rashid, M","venue":null,"work_id":"95c959de-9656-4835-ad83-81fb3839ddea","year":2020},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.935270Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:1bb2e4d68c9f408e2c7ac2524729355a42920b4fadaab2804f9821b1e848a0f1","observation_id":"4a7f6d14-3b7f-4e10-9d34-2c72b9679b40","resolution":{"observed_at":"2026-08-06T17:42:32.167625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1206.5295","last_updated":"2012-06-20T15:19:47Z","snapshot_observed_at":"2026-08-13T16:23:28.922508Z","submitted_at":"2012-06-20T15:19:47Z","title":"Improved Memory-Bounded Dynamic Programming for Decentralized POMDPs","version":1},"cited_work":{"arxiv_id":"1206.5295","doi":null,"metadata_source":"pith","pith_arxiv_id":"1206.5295","snapshot_observed_at":"2026-08-06T17:42:32.075513Z","title":"Improved Memory-Bounded Dynamic Programming for Decentralized POMDPs","venue":"cs.AI","work_id":"8fe12442-453d-4ee5-a00d-012961a58dc7","year":2012},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.937356Z"},"links":{"cited_paper":"/paper/1206.5295","citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:4a8cfa3ced5631e5b9158fb2445654a0766d1a070e81ad20f310de738dbd4829","observation_id":"213fe555-0bf7-4a43-9fdf-ed13993412af","resolution":{"observed_at":"2026-08-06T17:42:32.078285Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.157443Z","title":null,"venue":null,"work_id":"2c858ee4-3b09-4162-939f-817598ea2845","year":2019},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.939852Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:3c406b92a944090486163985a6212c5f5e28e2dee380ec26c8dc3f85efaba428","observation_id":"f70f9ac5-1bf7-4c74-89bb-bcd46b022d46","resolution":{"observed_at":"2026-08-06T17:42:32.159833Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.150243Z","title":"Tuyls and G","venue":null,"work_id":"03751625-2033-41ab-8ee7-4f465728a1d1","year":2012},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.941942Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:2e58098e4a5a64b05a780fd385e0b6d3d2f506cc11193a470583d9792f66b453","observation_id":"663f352d-5a3c-455a-8d73-f8f2d404acd0","resolution":{"observed_at":"2026-08-06T17:42:32.152705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2112.04454","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.063831Z","title":null,"venue":null,"work_id":"1545eca8-916d-438d-a855-f6909612c4a0","year":2021},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.943955Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:f0bc955981adc6f6d2b11799a17c2d242796f72f43da5543fc062fc1ae0e0f57","observation_id":"c27bcdf6-02d5-44d5-af66-852287f41051","resolution":{"observed_at":"2026-08-06T17:42:32.067921Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.01062","last_updated":"2021-10-04T01:36:59Z","snapshot_observed_at":"2026-08-13T21:57:18.537825Z","submitted_at":"2020-08-03T17:52:09Z","title":"QPLEX: Duplex Dueling Multi-Agent Q-Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.01062","snapshot_observed_at":"2026-08-06T17:42:31.946134Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.946134Z"},"links":{"cited_paper":"/paper/2008.01062","citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:468cdf931134545a3656d18b46f08e49676cf424f9daa7801bc5c5497e0ffe41","observation_id":"37a69add-050c-4d38-a5dd-7115c7cca8c4","resolution":{"observed_at":"2026-08-06T17:42:31.946134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.143554Z","title":null,"venue":null,"work_id":"96140612-e720-470f-ab16-bd61a5b303a1","year":2020},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.948359Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:6f5829bbad9b8dcbdc4431695762798a22bccb0f4823c1465dcd55b82256f996","observation_id":"8eaf9bc8-6a94-4169-b974-c3bc0d905bc9","resolution":{"observed_at":"2026-08-06T17:42:32.145781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.136423Z","title":null,"venue":null,"work_id":"3b96f87e-7b4e-4600-9668-a2567364df68","year":2020},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.950455Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:895716bdb6e7c5312e8a22e4702b1236dc3d6392d8e4362a74d5e37345c26fd2","observation_id":"7adf4894-07da-4228-8204-e490ebb307f9","resolution":{"observed_at":"2026-08-06T17:42:32.139040Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.129154Z","title":null,"venue":null,"work_id":"bf0096fa-8b88-4549-a9ff-d1a2f10c23e5","year":2022},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.952475Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:3c1ad0a88b44751d5a3d23592a2acde9f7670490505cf1cc5e61441e4906e0b7","observation_id":"306e5843-c729-450b-854d-c68a2f77800e","resolution":{"observed_at":"2026-08-06T17:42:32.131597Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.121470Z","title":null,"venue":null,"work_id":"ec84e8ba-ed2e-4269-98e2-da596ca392b3","year":2020},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.954837Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:baebe27ec2460f6ae11c12b0e598826533af37c81b9bc0e6063666aa2b35b944","observation_id":"f4077a1d-1ad6-48a4-a211-96b6b5ffbbe6","resolution":{"observed_at":"2026-08-06T17:42:32.123834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.113871Z","title":null,"venue":null,"work_id":"51b2b70d-2436-49fc-bfe4-53940eefbdc6","year":2020},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.957866Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:0ec18ea143b5354bc08018bdb6ebf0e80da44af24d8f91c12eff127169f7027e","observation_id":"2d14c30f-4a84-43d3-a9f9-fb1a9a123e85","resolution":{"observed_at":"2026-08-06T17:42:32.116283Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.106011Z","title":null,"venue":null,"work_id":"d41f3e29-4068-44ad-809e-48d34430f0ec","year":2022},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.960123Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:42b9ff616e41e7e9421365e84b498173e63a56d80765e04d1f707c3e7804233a","observation_id":"250ed19e-5f67-42e3-af7c-257086c5631a","resolution":{"observed_at":"2026-08-06T17:42:32.108364Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.03939","last_updated":"2020-06-09T05:20:11Z","snapshot_observed_at":"2026-08-11T00:14:06.610457Z","submitted_at":"2020-02-10T16:48:03Z","title":"Qatten: A General Framework for Cooperative Multiagent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.03939","snapshot_observed_at":"2026-08-06T17:42:31.962434Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.962434Z"},"links":{"cited_paper":"/paper/2002.03939","citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:c8b0f4ad086c1289bc2f0af44824c7d8901c24a1d912d824f262fb3c8337d2b2","observation_id":"ccc3942c-aaf4-42c8-af05-541c2d1dae88","resolution":{"observed_at":"2026-08-06T17:42:31.962434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.098877Z","title":null,"venue":null,"work_id":"483bd9f5-7c88-4878-a7c3-8929be90732b","year":2021},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.964784Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:be69773096d8194f16b155344207d60ae4467a8bbcb1bdfffd467995c6acccf8","observation_id":"df4d22d7-557a-4d19-8be0-0ee404368ebc","resolution":{"observed_at":"2026-08-06T17:42:32.101132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.08004","last_updated":"2019-06-21T06:37:40Z","snapshot_observed_at":"2026-07-06T07:28:34.096059Z","submitted_at":"2019-01-23T17:08:15Z","title":"Hierarchical Reinforcement Learning for Multi-agent MOBA Game","version":6},"cited_work":{"arxiv_id":"1901.08004","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.08004","snapshot_observed_at":"2026-08-06T17:42:31.990660Z","title":"Hierarchical Reinforcement Learning for Multi-agent MOBA Game","venue":"cs.LG","work_id":"734b9c03-e8b8-4e57-a6e4-6f9578d7d6ca","year":2019},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.967163Z"},"links":{"cited_paper":"/paper/1901.08004","citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:6b05e475d3b74dccbce207afaa6e021acc938ffd0dcd7ec569fa87303172c0be","observation_id":"d79e2eba-811b-4f73-8619-f2cc41268c39","resolution":{"observed_at":"2026-08-06T17:42:31.995475Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.091281Z","title":"go to tomato","venue":null,"work_id":"256a2e6d-00a3-4c3c-ab57-bfff1a1afb09","year":2020},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.969789Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:9b3516d4888c469976564da1a44210c04cfebd136b5042ba62f0ef99712ef926","observation_id":"5e005ef1-12af-435f-aa95-f5422e99adac","resolution":{"observed_at":"2026-08-06T17:42:32.093800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-11T00:15:30.328882Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":3,"verified_fuzzy":11},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2507.10251."}