{"as_of":"2026-08-09T20:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cd48d6a56c66088cb7b74e401405ac2aee60637701c55b72c0fae4b4de267d9c","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:33:42.542887Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04663/citation-record","integrity":"/paper/2608.04663/integrity","json":"/paper/2608.04663/citation-record.json","paper":"/paper/2608.04663"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:29.200050Z","title":"In: Proceed- ings of the Twenty-First International Conference on Machine Learning","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:29.200050Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:ee7b72a02fbf8481c728deb88a39222113656099f05b107704675cfeed33d0f2","observation_id":"8396b6df-2ca5-4a32-b69b-f2cdfeda95f4","resolution":{"observed_at":"2026-08-06T19:33:29.200050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-06T19:33:29.315989Z","title":"ArXivabs/2212.08073 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:29.315989Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:a62df03bfce2d28fcfc3575036010c3f6d7e702f93328ed4ca0dc3678dd6d5e6","observation_id":"78d85c3b-7350-4ff7-9078-e8378a23a0f9","resolution":{"observed_at":"2026-08-06T19:33:29.315989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:53.055135Z","title":"The American Economic Review97, 170–176 (2007)","venue":null,"work_id":"b8cef3bc-418f-410b-b72f-28f179090fb1","year":2007},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:29.472725Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:ea88a8806eece7795e117a1ad57dbe5c5b696269cdf9d773efa47478606f6a6b","observation_id":"84b5b1d1-d2a2-4dd8-80d6-01eab7642ee7","resolution":{"observed_at":"2026-08-06T19:33:53.142614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:52.903536Z","title":"The American Economic Review 90(1), 166–193 (2000)","venue":null,"work_id":"8becf265-d7da-4254-9d40-87888701c8dc","year":2000},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:29.687781Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:8a1952c52f8afe4a6a4aecdd97a6ae0c942ef53b2bdbcd2cfc561e7fd1c2a4ce","observation_id":"ee2c18e6-74e1-4616-92f4-bda95f7a977e","resolution":{"observed_at":"2026-08-06T19:33:52.984560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:52.751756Z","title":null,"venue":null,"work_id":"c653a908-a297-487c-9c2d-cc10de9db789","year":2020},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:30.757013Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:f7a8791a09a4aec3c577a3ad739fd3089ff4f3d18bc218bddc5c475910435521","observation_id":"a5086cc4-d738-40b8-a14b-081d3b074565","resolution":{"observed_at":"2026-08-06T19:33:52.806134Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12894","last_updated":"2018-10-30T17:44:42Z","snapshot_observed_at":"2026-07-06T07:11:32.319931Z","submitted_at":"2018-10-30T17:44:42Z","title":"Exploration by Random Network Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.12894","snapshot_observed_at":"2026-08-06T19:33:33.468203Z","title":"ArXiv abs/1810.12894 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:33.468203Z"},"links":{"cited_paper":"/paper/1810.12894","citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:17e071b5c3d29ae54fab1212e71aaf32c019f24938ab96c328bc61879411adb6","observation_id":"410daedf-6e82-4cb2-a2fa-6b3db632c4e6","resolution":{"observed_at":"2026-08-06T19:33:33.468203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:52.575712Z","title":"Neuron70(3), 560–572 (May 2011)","venue":null,"work_id":"ae484fb9-0cfc-4f0c-b11b-0e2ea462c555","year":2011},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:35.639979Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:b5131a4e06fd897a797e1e9abcf6f05a736a4de9642418de7152c7b6ac2fdb29","observation_id":"e432191d-c25a-4cf4-9728-86cb1cfda8e6","resolution":{"observed_at":"2026-08-06T19:33:52.664551Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:52.356854Z","title":"Econometrica 74(6), 1579–1601 (2006)","venue":null,"work_id":"5c4ce8b7-4edd-4ed5-a2de-79530b3bbd15","year":2006},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:35.874471Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:460960b5f4b81bdcfde09c6fec700ccbf3644f743ed5c95570815d9c293de6e5","observation_id":"65163888-9c0e-4b3b-89d9-2a9b4886bef5","resolution":{"observed_at":"2026-08-06T19:33:52.443205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:52.076016Z","title":"The Quarterly Journal of Economics117(3), 817–869 (2002)","venue":null,"work_id":"520a2fb4-d3d9-4063-94a4-715a6958fb2b","year":2002},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:36.001338Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:0f22fa7c499f3d3be2cccee88408f6ccb45688e26ec1c82f75203e063dbb0ba8","observation_id":"84cd0994-495f-442c-8446-400e0681aa4f","resolution":{"observed_at":"2026-08-06T19:33:52.202438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:51.900496Z","title":"In: Proceedings of the 31st International Conference on Neural Information Processing Systems","venue":null,"work_id":"23c3f569-7691-4634-ae22-e87213273f84","year":2017},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:36.071563Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:3168346969510c6ba29f1cf9e2b59132458cf457e453de4f4156b01a57fc8e8c","observation_id":"e5f0ad2b-369d-4131-b532-392d3566e486","resolution":{"observed_at":"2026-08-06T19:33:51.979393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.08630","last_updated":"2020-12-15T21:39:50Z","snapshot_observed_at":"2026-08-09T08:09:12.994031Z","submitted_at":"2020-12-15T21:39:50Z","title":"Open Problems in Cooperative AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.08630","snapshot_observed_at":"2026-08-06T19:33:36.139614Z","title":"ArXivabs/2012.08630 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:36.139614Z"},"links":{"cited_paper":"/paper/2012.08630","citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:287add14ae7d898710d101c79e6285c747d97c89ad8703bb7f6c48b601ac3838","observation_id":"50b3e0a7-3e23-4f10-9bac-136fc627a070","resolution":{"observed_at":"2026-08-06T19:33:36.139614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.08082","last_updated":"2019-03-19T16:18:00Z","snapshot_observed_at":"2026-08-04T22:51:28.264183Z","submitted_at":"2019-03-19T16:18:00Z","title":"Learning Reciprocity in Complex Sequential Social Dilemmas","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.08082","snapshot_observed_at":"2026-08-06T19:33:36.228005Z","title":"ArXivabs/1903.08082 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:36.228005Z"},"links":{"cited_paper":"/paper/1903.08082","citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:fd8c080e28f87221e99e86a06cb123fa2725d00c1e2c532e1898301877928f48","observation_id":"49660852-900f-4521-9cb1-08d4ae90d097","resolution":{"observed_at":"2026-08-06T19:33:36.228005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:51.652201Z","title":"Nature protocols15, 2186 – 2202 (2019)","venue":null,"work_id":"e731e629-2433-438c-b484-f9656fcab333","year":2019},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:36.337979Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:a11a2cc048b9667a82c8cb557350b502c2f441b5ace9a09b310215277cc4afc6","observation_id":"4ab89963-0e5c-40c4-aa6a-ce31af799499","resolution":{"observed_at":"2026-08-06T19:33:51.757637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06070","last_updated":"2018-10-09T23:19:52Z","snapshot_observed_at":"2026-07-06T06:23:52.853341Z","submitted_at":"2018-02-16T18:57:57Z","title":"Diversity is All You Need: Learning Skills without a Reward Function","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.06070","snapshot_observed_at":"2026-08-06T19:33:36.404948Z","title":"ArXivabs/1802.06070 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:36.404948Z"},"links":{"cited_paper":"/paper/1802.06070","citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:61ed0ecdb481dd659ca7e753b37a0eb1b93df336c178650b13ba5c53e1a77077","observation_id":"da4b2955-c016-4337-ba82-1b67fd4d11c2","resolution":{"observed_at":"2026-08-06T19:33:36.404948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:51.433882Z","title":"Munich Reprints in Economics 4 (1998)","venue":null,"work_id":"9fb76d96-4e36-4ecc-8e71-6004c2f5ab40","year":1998},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:36.516222Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:6ddfe63151b914289d39297744e4b777af867b292d352e933b6b628773c90919","observation_id":"e75926bc-3a33-47d3-9db0-811c77cfa9d7","resolution":{"observed_at":"2026-08-06T19:33:51.557299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:51.122014Z","title":"In: Adaptive Agents and Multi-Agent Systems (2017)","venue":null,"work_id":"572606c4-a5b2-4392-a7d0-3b96391deed4","year":2017},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:36.681525Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:ff058cf37a47292383d778a857c784c052a3436c281266ecb1222476c0ced3ab","observation_id":"6e91f87a-c47e-4a9a-8957-72f523fff728","resolution":{"observed_at":"2026-08-06T19:33:51.215837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.7554/elife.105391","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:44.522828Z","title":"eLife 14 (Mar 2026)","venue":null,"work_id":"33cf651d-d104-406c-9a07-b925dbdb6f6b","year":2026},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:36.857767Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:3937e72eb6ff72163e435b944d8ba3b3f6bbd703f85d6e7283039544cf994ebd","observation_id":"163e9a46-6460-4096-8222-432c18a552fc","resolution":{"observed_at":"2026-08-06T19:33:44.635964Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:37.056586Z","title":"Scientific Data3(1) (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:37.056586Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:2975708258ab39b7a399c6ed7ec7915a63d4da087fe0cca5c6361adf0424ce96","observation_id":"75f7ee88-b1a6-48a2-a12e-d4b2fe927094","resolution":{"observed_at":"2026-08-06T19:33:37.056586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:50.979975Z","title":"In: Neural Information Processing Systems (2016)","venue":null,"work_id":"bd2a3f4c-0217-44eb-8d7f-d47e30dff36a","year":2016},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:37.229698Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:f482ab7c91a034cb97c56fa1bdfd498106e0f3f922119cb7f0004087c5301a08","observation_id":"31e81301-0f18-4b63-88b3-8b6bcf89b79a","resolution":{"observed_at":"2026-08-06T19:33:51.045845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:37.421484Z","title":"Neuron 95(2), 245–258 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:37.421484Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:e9e5dd45e2bcacde9de2d286258474e38f5db32462f653552b48134bb66851cd","observation_id":"677ff567-b919-4397-a22a-de46ef2e785f","resolution":{"observed_at":"2026-08-06T19:33:37.421484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10458-019-09421-1","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:44.215866Z","title":"Autonomous Agents and Multi-Agent Systems33(6), 750–797 (Nov 2019)","venue":null,"work_id":"63b0f4c6-43c3-4db9-b1d3-e88038b42431","year":2019},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:37.627524Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:0d787203b99e9c1b4d81fcfcd5dfecb8ca80031916a75c410edfebd7e1a7d56d","observation_id":"0fb3bcc8-5db6-426d-ba46-147b1e39dfe6","resolution":{"observed_at":"2026-08-06T19:33:44.338511Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:50.754138Z","title":"In: Proceedings of the 32nd International Conference on Neural Information Processing Systems","venue":null,"work_id":"8a3cf4d1-9fae-451f-b3db-a3e24baa5d8e","year":2018},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:37.791361Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:38c7d5966b37180c02ba1b88e48cd6d6935bb543d09a265eddbfd404c8789d16","observation_id":"bcebd6d3-8c10-4771-a1ef-e3442d0333f0","resolution":{"observed_at":"2026-08-06T19:33:50.845318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:50.511427Z","title":"In: International Conference on Machine Learning (2018)","venue":null,"work_id":"001c4125-adc1-43fb-aa91-138af0809e80","year":2018},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:37.924045Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:78ccc557a6d059732267315176d50565dcd5f0ce21d5d70c9cde97acab1ee08c","observation_id":"f9c2dcf3-25f4-4132-bb91-f86f6aee8f2f","resolution":{"observed_at":"2026-08-06T19:33:50.648746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:50.281062Z","title":"Journal of Cognitive Neuroscience25, 258–272 (2013)","venue":null,"work_id":"87a947af-11da-4750-ad10-a7c93dc0b853","year":2013},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:38.068135Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:8c1939f937622ccb3e1e7e54cec1d326048165de48fe0d4cb361516b0bf69ba8","observation_id":"cf25fbc7-fac8-4c80-be86-f2b3abbce3bc","resolution":{"observed_at":"2026-08-06T19:33:50.390148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:49.986906Z","title":null,"venue":null,"work_id":"65edda18-83dc-4228-88d3-1471c2230bc4","year":2022},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:38.270382Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:8a80e68c413d92ef9b651a3c3ca522d55cbd2d3623bd2da5a4e3e736523e2134","observation_id":"56adbf06-bda9-459f-b4dc-46e530b4df3f","resolution":{"observed_at":"2026-08-06T19:33:50.103175Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:49.736338Z","title":"In: Proceedings of the 31st International Conference on Neural Information Processing Systems","venue":null,"work_id":"d0b023c6-6ca7-4073-8102-a0c16a154249","year":2017},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:38.416113Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:497b9ddbd411ab66e4d90ca7691975088081eb87813b2cffa85ae9a911e92328","observation_id":"3042361f-532f-4fe3-823a-c471c0d0fced","resolution":{"observed_at":"2026-08-06T19:33:49.835034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:49.505214Z","title":"In: Proceedings of the 16th Conference on Autonomous Agents and MultiAgent Systems","venue":null,"work_id":"513a6fc8-4732-4e30-b38e-6f854416331f","year":2017},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:38.615717Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:a9ea0368fa420cff5fc4df7b503f0d02afc60dc095f962ce056c7ffd5658f488","observation_id":"d9ed95e0-ac6f-4caa-9430-5c3265d8783c","resolution":{"observed_at":"2026-08-06T19:33:49.658205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.07871","last_updated":"2018-11-19T18:48:04Z","snapshot_observed_at":"2026-07-06T07:15:51.575438Z","submitted_at":"2018-11-19T18:48:04Z","title":"Scalable agent alignment via reward modeling: a research direction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.07871","snapshot_observed_at":"2026-08-06T19:33:38.747570Z","title":"ArXivabs/1811.07871 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:38.747570Z"},"links":{"cited_paper":"/paper/1811.07871","citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:e9adc3ae147f3a8d498ffd7b8b27f26df22d8bddb5e2921a9e55d27b9141f8eb","observation_id":"e4a00365-adb6-467d-b5f8-9001742877bb","resolution":{"observed_at":"2026-08-06T19:33:38.747570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.01068","last_updated":"2018-03-02T14:39:55Z","snapshot_observed_at":"2026-07-06T05:49:43.427852Z","submitted_at":"2017-07-04T17:02:05Z","title":"Maintaining cooperation in complex social dilemmas using deep reinforcement learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.01068","snapshot_observed_at":"2026-08-06T19:33:38.899509Z","title":"ArXivabs/1707.01068 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:38.899509Z"},"links":{"cited_paper":"/paper/1707.01068","citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:cb5bf582bfcb5009929aee9c1a0b5817e6700009793d58e0eaaf87e291b4f0ef","observation_id":"69b9993c-ec61-46cc-bd41-0eac67a77339","resolution":{"observed_at":"2026-08-06T19:33:38.899509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02275","last_updated":"2020-03-14T20:33:00Z","snapshot_observed_at":"2026-08-04T19:23:21.346128Z","submitted_at":"2017-06-07T17:35:00Z","title":"Multi-Agent Actor-Critic for Mixed Cooperative-Competitive Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.02275","snapshot_observed_at":"2026-08-06T19:33:39.032751Z","title":"ArXivabs/1706.02275 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:39.032751Z"},"links":{"cited_paper":"/paper/1706.02275","citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:39cf8e1122f796ac7ec1a2f5b88c6adac269c0d443bff18f91257ee91bc904c2","observation_id":"0910d91b-5b46-4b2a-9236-01e8c16802e6","resolution":{"observed_at":"2026-08-06T19:33:39.032751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:49.140665Z","title":"Frontiers in Computational Neuroscience10 (2016)","venue":null,"work_id":"bcb1bcf4-ba60-40b3-a730-5c7c788f9845","year":2016},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:39.185333Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:001c284b035e2c585b88adb2a874dfeebe860eacca1d8932969ce8d6dbc331da","observation_id":"1f6a46da-7384-4c35-9d4e-d172c418c657","resolution":{"observed_at":"2026-08-06T19:33:49.305874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:39.319245Z","title":"eLife10(Oct 2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:39.319245Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:accc58fb8f57559cb52773f2c425fd654c7d874144e166913f4a2d872f676e24","observation_id":"30548c03-03f0-413a-bf7f-56ea0ac35b45","resolution":{"observed_at":"2026-08-06T19:33:39.319245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:48.745425Z","title":"Proceedings of the Na- tional Academy of Sciences103, 15623 – 15628 (2006)","venue":null,"work_id":"75bee73d-6373-4b9d-9a5b-292874157e0a","year":2006},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:39.434433Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:e737d8022087f591daca15aa93560194034335ed9c95259c219a5f31f52c2677","observation_id":"e2f9813f-9c2d-42d6-b5d2-14b8db39d83d","resolution":{"observed_at":"2026-08-06T19:33:48.952248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:48.419484Z","title":"In: International Conference on Machine Learning (1999)","venue":null,"work_id":"f73e5a78-5bd3-4cd9-9aa8-f015c6659733","year":1999},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:39.631762Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:08255d852aa473386ec57860bb8ad6d454002fdd3f90c6966ed724bdc5ed1fe2","observation_id":"945207b0-a4f8-41d7-8673-24089d7fa8d8","resolution":{"observed_at":"2026-08-06T19:33:48.628708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:48.158429Z","title":"In: International Confer- ence on Machine Learning (2000)","venue":null,"work_id":"c266aa64-0170-4153-a621-9d13b1710df3","year":2000},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:39.783574Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:79fad991b5629beeea209123de32be6fc79a2b6577951e514ea291c6e87cdb99","observation_id":"ac6956ee-02e1-4d97-81b2-901a998f0926","resolution":{"observed_at":"2026-08-06T19:33:48.251927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:47.920776Z","title":"In: Proceedings of the 36th International Conference on Neural Information Processing Systems","venue":null,"work_id":"20b773d5-dca6-443a-817e-2ce6c22b9b0f","year":2022},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:39.883944Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:731ec94dc16d5c4813a48fc9d89039baafe830999f7dadb1a494384b55f716e1","observation_id":"10df4032-f56e-4e73-9e61-612058f4d611","resolution":{"observed_at":"2026-08-06T19:33:48.031227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:47.687004Z","title":"2017 IEEE Conference on Computer Vision and Pattern Recognition Workshops (CVPRW) pp","venue":null,"work_id":"65bb5d89-e6fb-406c-9f7f-8abc46c35f03","year":2017},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:39.961600Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:93c5a89576c31a42ecba95cf46540a5bf40940242e0853daacf3b4eb1137149f","observation_id":"260f8604-3cb5-40e9-9211-b3dbcba6b0fc","resolution":{"observed_at":"2026-08-06T19:33:47.763400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:47.451982Z","title":"In: Proceedings of the 31st International Conference on Neural Information Processing Systems","venue":null,"work_id":"4cb8c555-f1d5-4eef-a1f9-4b56439c9edf","year":2017},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:40.111429Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:d85acfb189749f76656313cb6de11eb4bc746c82b5217dc9745d8a559def4980","observation_id":"0cbf9120-7591-4e6d-afed-f82a2ab55c04","resolution":{"observed_at":"2026-08-06T19:33:47.564921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:47.234290Z","title":"In: Proceedings of the 17th International Conference on Autonomous Agents and MultiAgent Systems","venue":null,"work_id":"c71ecf9c-be03-4542-9074-a6f74cced47f","year":2018},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:40.276663Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:2971731d510830c326ccfd7578afd5430b2d9f156c46eecc79936fcc37d74b0b","observation_id":"14b87cc4-e2fc-4ed9-af7e-bbdbb52e71b7","resolution":{"observed_at":"2026-08-06T19:33:47.337199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:46.975955Z","title":"The American Economic Review 83(5), 1281–1302 (1993)","venue":null,"work_id":"94cc680e-aeb0-4e81-83df-9d39bdee464a","year":1993},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:40.393405Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:d44dddc68794c6539233d32cda5e2ae734358597c7a81d98b32a6c9bb5d18842","observation_id":"492d25ad-8077-4513-92ed-131595dc383a","resolution":{"observed_at":"2026-08-06T19:33:47.101473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:46.745828Z","title":null,"venue":null,"work_id":"406a7d78-a273-4445-b6aa-9aa2749e0ac7","year":2020},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:40.506510Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:b34190fdb727bf7f4c4093b9c3888f8bc0739ac245d25bc7511e3c53df3132e1","observation_id":"75e1b542-5da4-4c95-bfa2-f644565a76ab","resolution":{"observed_at":"2026-08-06T19:33:46.878221Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:40.620601Z","title":"Neural Comput","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:40.620601Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:fd2d637fe082dd53f632343cd30494c5249e3087c63b7f2dbaf150bc155d0f47","observation_id":"0bc7a5ba-baad-4969-83e7-dd5bc4c5f59a","resolution":{"observed_at":"2026-08-06T19:33:40.620601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1073/pnas.1407535111","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:43.953640Z","title":"Proceedings of the National Academy of Sciences111(33), 12252–12257 (2014)","venue":null,"work_id":"ca68a1e1-4767-4d98-b689-8f739b422747","year":2014},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:40.758024Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:7fc416209f51ffa52a5863cd330ce3c7cb1724f5d09ce84d5b634673fcae8096","observation_id":"d80ec77e-ff52-4749-a27d-78e4628f9037","resolution":{"observed_at":"2026-08-06T19:33:44.047241Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T19:33:40.904748Z","title":"ArXiv abs/1707.06347 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:40.904748Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:6211b0c81d4164d821f40e5b7aab613bc72cf194c74de0238c52f9661a5c524d","observation_id":"788df31a-18bf-4c4b-ae3f-20542152cf07","resolution":{"observed_at":"2026-08-06T19:33:40.904748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:46.515310Z","title":"https://doi.org/10.18112/ OPENNEURO.DS005588.V1.0.1","venue":null,"work_id":"f5e14fdc-d400-493a-8adc-65e9a48bd56b","year":2025},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:41.080782Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:2505cdb95676d2386d1550de4d2402d01de54d3876c3ff98ba96215039d655c1","observation_id":"3c50de25-549e-4d59-a31f-7e8f0bcffdb2","resolution":{"observed_at":"2026-08-06T19:33:46.613549Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:46.361083Z","title":"In: Proceedings of the 17th International Conference on Autonomous Agents and MultiAgent Systems","venue":null,"work_id":"887b03e6-6705-4acf-8019-2aba747f1095","year":2018},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:41.266459Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:1f195289a14242fd60eb22f3b549b04d61b25d01a952be83d8b491275be3d305","observation_id":"1fc92eea-1930-47a2-8a23-73755eb25299","resolution":{"observed_at":"2026-08-06T19:33:46.416007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:46.199754Z","title":null,"venue":null,"work_id":"b74aaa3e-f298-4528-bb39-5cfff845aa34","year":2021},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:41.440748Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:8b88030f16d41d879dfc4de268d8c821b89f9338b0fca63cf25e80fcda57808d","observation_id":"4db8086d-cb90-4206-9cb0-a29f0bd53c2c","resolution":{"observed_at":"2026-08-06T19:33:46.306449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:45.959915Z","title":null,"venue":null,"work_id":"8f0e5d30-f4aa-4c76-a79e-8d1062e9f60a","year":2025},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:41.544030Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:dfa5955505887275909626bb9ee0c02b1735b36feb2afdba7609f66dcfeac943","observation_id":"11b3e504-d8cb-45ef-bc83-cb40c5afaed9","resolution":{"observed_at":"2026-08-06T19:33:46.064232Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:45.781034Z","title":"Nature575, 350 – 354 (2019)","venue":null,"work_id":"40f3971f-a229-4eaa-adf8-e5a16a2c7f50","year":2019},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:41.647015Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:dbc5e36f13f33f3262c63d230f65b07a9744e3c8092e63c8242d093ec43456ea","observation_id":"dbf562bd-e335-45cb-9a8c-8017ed6ec810","resolution":{"observed_at":"2026-08-06T19:33:45.861525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/cercor/bhr016","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:43.669949Z","title":"Cerebral Cortex21(11), 2461–2470 (Mar 2011)","venue":null,"work_id":"5ad1d53e-306e-4166-859d-14f777b18d65","year":2011},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:41.742531Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:50ecea3ac2d074f1ce0969480ca810ce9fe38e83f0c3a469a2fb366191e9c0fc","observation_id":"76f9a889-1d77-46a0-83ea-faa3ab446358","resolution":{"observed_at":"2026-08-06T19:33:43.811164Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:45.594978Z","title":null,"venue":null,"work_id":"12ec81bc-690f-45cd-bbb6-ed015f067d81","year":2019},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:41.863989Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:d909d23532448eaa4247c8ebfe292e92c3355b8c1eb9ec99645139cf19259455","observation_id":"6273f1ff-9dc0-46cd-ad32-70f7c47932a5","resolution":{"observed_at":"2026-08-06T19:33:45.698891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41593-018-0147-8","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:43.377903Z","title":"Nature Neuroscience 21(6), 860–868 (May 2018)","venue":null,"work_id":"eb3b455b-253b-44b1-bdbf-837d6a6fb682","year":2018},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:41.959694Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:924ca348f51688bbc1eb069846467e5d8da576a5481c66261aacbe6094af70ae","observation_id":"816361bf-2898-4bbc-bcc3-17661e607241","resolution":{"observed_at":"2026-08-06T19:33:43.509030Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:45.295126Z","title":null,"venue":null,"work_id":"6cc1ef06-6f7e-4154-bb97-1f79554164bd","year":2003},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:42.065699Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:2af5d443ba5d6979c3558eb5ce10f28a9e4e2e96d8dfe901d7420d430374f159","observation_id":"563f8482-0866-4d17-b6bc-a22fe52700dd","resolution":{"observed_at":"2026-08-06T19:33:45.457836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:44.989950Z","title":"In: Proceedings of the 36th International Conference on Neural Information Processing Systems","venue":null,"work_id":"3cd3d36c-b910-4cb6-8df7-eeb59fce165d","year":2022},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:42.197546Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:db38c2f9c144a7ae7460ccbf529b1ca22df5106a3c6b174c6c3d1c47957d279a","observation_id":"e10a2bcd-64f3-4eda-9170-3b2d57b13ca3","resolution":{"observed_at":"2026-08-06T19:33:45.174240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/scan/nst090","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:43.057654Z","title":"Social Cognitive and Affective Neuroscience9(8), 1150–1158 (Aug 2013)","venue":null,"work_id":"7711f8db-8cc5-4e5f-9de4-6a67c02f646d","year":2013},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:42.392806Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:7db8df4a413b870d2099480ca863a01b5235b1af8ef1d89f3c3095387ddd9e68","observation_id":"eefb90eb-b513-45a3-8d1b-3ce2674b16f9","resolution":{"observed_at":"2026-08-06T19:33:43.191975Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/cercor/bhn080","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:33:42.738942Z","title":"Cerebral Cortex19(2), 276–283 (May 2008)","venue":null,"work_id":"fd30d6b9-2c8f-4db3-baba-17578f2921fc","year":2008},"citing_paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T19:33:42.542887Z"},"links":{"citing_paper":"/paper/2608.04663"},"observation_digest":"sha256:89cada40ba0caa293702c18d616adcb12f15cd8f203782fb6f82fc89d548521e","observation_id":"12cac709-ecbc-45e6-85d1-03afa278073e","resolution":{"observed_at":"2026-08-06T19:33:42.894261Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.04663","last_updated":"2026-08-05T10:21:11Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T18:37:54.581897Z","submitted_at":"2026-08-05T10:21:11Z","title":"Calibrating Artificial Guilt: Neurally Grounded Reward Shaping for Prosocial Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":7,"verified_fuzzy":26},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2608.04663."}