{"as_of":"2026-08-06T18:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:24cbbd46c4aabd14f89667e902dffc0d7d2a158b6c1a360cb7c578bc5f8254ba","coverage":[{"denominator":9,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T17:11:15.484711Z","state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T22:26:44.052574Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T22:35:40.643385Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.09855","last_updated":"2026-04-10T19:35:39Z","snapshot_observed_at":"2026-08-03T00:42:21.985040Z","submitted_at":"2026-04-10T19:35:39Z","title":"Instructing LLMs to Negotiate using Reinforcement Learning with Verifiable Rewards","version":1},"cited_work":{"arxiv_id":"2604.09855","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.09855","snapshot_observed_at":"2026-07-08T22:35:40.643385Z","title":"Instructing LLMs to Negotiate using Reinforcement Learning with Verifiable Rewards","venue":"cs.AI","work_id":"82b23631-51ca-4f7d-bc79-94faa622c6b8","year":2026},"citing_paper":{"arxiv_id":"2607.05863","last_updated":"2026-07-07T05:41:54Z","snapshot_observed_at":"2026-07-10T23:17:29.985243Z","submitted_at":"2026-07-07T05:41:54Z","title":"Strategic Bargaining in Multi-Buyer Markets: Reinforcement Learning from Verifiable Rewards for LLM Negotiations","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-07-08T22:26:44.052574Z"},"links":{"cited_paper":"/paper/2604.09855","citing_paper":"/paper/2607.05863"},"observation_digest":"sha256:a594fe063f9b4efd8aac520d015a6477444334e63389316d83ab6d77fb98cc02","observation_id":"d9257adb-84d8-4271-8db2-894109063678","resolution":{"observed_at":"2026-07-08T22:35:40.645323Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2604.09855/citation-record","integrity":"/paper/2604.09855/integrity","json":"/paper/2604.09855/citation-record.json","paper":"/paper/2604.09855"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"cited_work":{"arxiv_id":"2507.20534","doi":"10.1145/3448609","metadata_source":"pith","pith_arxiv_id":"2507.20534","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kimi K2: Open Agentic Intelligence","venue":"cs.LG","work_id":"7f18284c-12d3-4137-bea1-1da97e8cf3c1","year":2025},"citing_paper":{"arxiv_id":"2604.09855","last_updated":"2026-04-10T19:35:39Z","snapshot_observed_at":"2026-08-03T00:42:21.985040Z","submitted_at":"2026-04-10T19:35:39Z","title":"Instructing LLMs to Negotiate using Reinforcement Learning with Verifiable Rewards","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T17:11:15.484711Z"},"links":{"cited_paper":"/paper/2507.20534","citing_paper":"/paper/2604.09855"},"observation_digest":"sha256:244a9f36827111bb8205ed68f7bb0d9e9e870ee585adb04b7e9010732e86a39e","observation_id":"391fbdef-0764-4a7e-bb02-2fb2a960e055","resolution":{"observed_at":"2026-05-11T07:26:01.930259Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"codename_1","venue":null,"work_id":"67524c72-b953-4e85-b646-066acb7c18a0","year":null},"citing_paper":{"arxiv_id":"2604.09855","last_updated":"2026-04-10T19:35:39Z","snapshot_observed_at":"2026-08-03T00:42:21.985040Z","submitted_at":"2026-04-10T19:35:39Z","title":"Instructing LLMs to Negotiate using Reinforcement Learning with Verifiable Rewards","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T17:11:15.484711Z"},"links":{"citing_paper":"/paper/2604.09855"},"observation_digest":"sha256:0c2170a7a7ac8e9c89dc8fba35db65042aa5e115c02527fe7ea2f5d482bccf04","observation_id":"655c7202-9547-4e29-8c93-d009b353b531","resolution":{"observed_at":"2026-05-17T11:41:46.652154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"49194aa4-21d4-4a44-a1f4-4cc87961942b","year":null},"citing_paper":{"arxiv_id":"2604.09855","last_updated":"2026-04-10T19:35:39Z","snapshot_observed_at":"2026-08-03T00:42:21.985040Z","submitted_at":"2026-04-10T19:35:39Z","title":"Instructing LLMs to Negotiate using Reinforcement Learning with Verifiable Rewards","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T17:11:15.484711Z"},"links":{"citing_paper":"/paper/2604.09855"},"observation_digest":"sha256:b587a0292db9874ebe6b5d2be1750071c47d2535a5fac3f60ca9389fbc626c30","observation_id":"8a53b19d-28cc-4b90-8155-9c68803a23b2","resolution":{"observed_at":"2026-05-17T11:41:46.655409Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"$M (N codename_1) is a exact copy of seller’s previous offer","venue":null,"work_id":"9a293819-cce6-4f8f-9215-ad818a89ce64","year":null},"citing_paper":{"arxiv_id":"2604.09855","last_updated":"2026-04-10T19:35:39Z","snapshot_observed_at":"2026-08-03T00:42:21.985040Z","submitted_at":"2026-04-10T19:35:39Z","title":"Instructing LLMs to Negotiate using Reinforcement Learning with Verifiable Rewards","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T17:11:15.484711Z"},"links":{"citing_paper":"/paper/2604.09855"},"observation_digest":"sha256:7cab95b4084b48ddadd4c848cd101dee9c62f20e144cfd0817f8cb1473447cdb","observation_id":"2dcb90a2-f3c4-4a34-9862-d325c731cc66","resolution":{"observed_at":"2026-05-17T11:41:46.644828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Happy By Clinique For Men. Cologne Spray 1.7 Oz","venue":null,"work_id":"8cc46d24-3579-4b28-b6f6-aefb75017f44","year":2024},"citing_paper":{"arxiv_id":"2604.09855","last_updated":"2026-04-10T19:35:39Z","snapshot_observed_at":"2026-08-03T00:42:21.985040Z","submitted_at":"2026-04-10T19:35:39Z","title":"Instructing LLMs to Negotiate using Reinforcement Learning with Verifiable Rewards","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T17:11:15.484711Z"},"links":{"citing_paper":"/paper/2604.09855"},"observation_digest":"sha256:dd520f0ce0b4ef7c08f3048f9c11788dfd19ba09480e45f211e06a4ced2c830b","observation_id":"de725330-876c-47d2-b242-9695dfdb5ebb","resolution":{"observed_at":"2026-05-17T11:41:46.648565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"codename_1","venue":null,"work_id":"bc70f3d6-5357-4d23-b64f-cdb3ccac5a72","year":null},"citing_paper":{"arxiv_id":"2604.09855","last_updated":"2026-04-10T19:35:39Z","snapshot_observed_at":"2026-08-03T00:42:21.985040Z","submitted_at":"2026-04-10T19:35:39Z","title":"Instructing LLMs to Negotiate using Reinforcement Learning with Verifiable Rewards","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T17:11:15.484711Z"},"links":{"citing_paper":"/paper/2604.09855"},"observation_digest":"sha256:23831cc49dc3d5178c26e2f9577da1bee306836fbe6a2c892a48e34a32ad6140","observation_id":"a34d4894-f55c-4e2e-bd4d-257c3eab1c59","resolution":{"observed_at":"2026-05-17T11:41:46.658549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"486ba84b-81ad-44c6-a6df-b351ec775758","year":null},"citing_paper":{"arxiv_id":"2604.09855","last_updated":"2026-04-10T19:35:39Z","snapshot_observed_at":"2026-08-03T00:42:21.985040Z","submitted_at":"2026-04-10T19:35:39Z","title":"Instructing LLMs to Negotiate using Reinforcement Learning with Verifiable Rewards","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T17:11:15.484711Z"},"links":{"citing_paper":"/paper/2604.09855"},"observation_digest":"sha256:c27b0734ba6e00715c61b629e97b141c6f7f62c0c3c2dcefaa837a01c1ea6ecc","observation_id":"76033cc6-4f99-4fa7-8b9f-5cb5dc201beb","resolution":{"observed_at":"2026-05-17T11:41:46.638146Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"codename_1","venue":null,"work_id":"1f2d1d1e-39ea-43bd-bde8-66593617226e","year":null},"citing_paper":{"arxiv_id":"2604.09855","last_updated":"2026-04-10T19:35:39Z","snapshot_observed_at":"2026-08-03T00:42:21.985040Z","submitted_at":"2026-04-10T19:35:39Z","title":"Instructing LLMs to Negotiate using Reinforcement Learning with Verifiable Rewards","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T17:11:15.484711Z"},"links":{"citing_paper":"/paper/2604.09855"},"observation_digest":"sha256:8543d6ec5b76093d35e97a26f25291862628fbe6a3d18b9c2f7989d57a7176a0","observation_id":"3e1cd05e-56a4-4491-b652-4ee70e1371b5","resolution":{"observed_at":"2026-05-17T11:41:46.634943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Happy By Clinique For Men. Cologne Spray 1.7 Oz","venue":null,"work_id":"1438a68a-65d2-4082-9318-565a587d4281","year":2024},"citing_paper":{"arxiv_id":"2604.09855","last_updated":"2026-04-10T19:35:39Z","snapshot_observed_at":"2026-08-03T00:42:21.985040Z","submitted_at":"2026-04-10T19:35:39Z","title":"Instructing LLMs to Negotiate using Reinforcement Learning with Verifiable Rewards","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T17:11:15.484711Z"},"links":{"citing_paper":"/paper/2604.09855"},"observation_digest":"sha256:42a020c1183d44e1129f77721a75cdb5663974aecc630f1550f918f57fdf0b0d","observation_id":"3edba574-afe3-4e30-96cb-1f1b72198cf9","resolution":{"observed_at":"2026-05-17T11:41:46.641568Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.09855","last_updated":"2026-04-10T19:35:39Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-03T00:42:21.985040Z","submitted_at":"2026-04-10T19:35:39Z","title":"Instructing LLMs to Negotiate using Reinforcement Learning with Verifiable Rewards"},"reference_resolution":{"displayed":9,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":9},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 9 of 9 outbound references and 1 inbound Pith citation observation for arXiv:2604.09855."}