{"as_of":"2026-08-09T20:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1364429a87fc328375ca97e566ff1d6ba72c3dcb8384eff0fc7bdc35861d1646","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T15:44:28.204969Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.24407/citation-record","integrity":"/paper/2607.24407/integrity","json":"/paper/2607.24407/citation-record.json","paper":"/paper/2607.24407"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.147533Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.147533Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:e053328019622274cada636ef3fb781dce6b4c71fee82eb51793df672e1287ac","observation_id":"eecb9ee0-7889-4866-ba21-0b09db89d1fc","resolution":{"observed_at":"2026-07-31T15:44:28.147533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.150978Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.150978Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:da99270adac71a1c8b9d3435955dd087edc90177f4246755c848367a78f9a955","observation_id":"c5e66dc9-616e-4629-bef3-29870bf1100f","resolution":{"observed_at":"2026-07-31T15:44:28.150978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.153719Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.153719Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:785f5a53b178cfb4977dece655fe667188a1e6f2dfb815cc74708e3b0ad5ea0e","observation_id":"72eae22a-cd5c-4ceb-85be-1f4f5a5bd9d4","resolution":{"observed_at":"2026-07-31T15:44:28.153719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.156338Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.156338Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:a8e66d35882041d0d77d3c510bc42656f4dad75f79f37ce0cc2ec44720dd5e7e","observation_id":"b6307e0e-7894-4be4-91f9-f7d436b4f340","resolution":{"observed_at":"2026-07-31T15:44:28.156338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.159023Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.159023Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:da3e1ac1a7ce8899c4601d99d85583fc16e11be78a34ae651096a857fe4ecc8e","observation_id":"b8874a13-7ef8-4730-a1d6-3b2cb93b4521","resolution":{"observed_at":"2026-07-31T15:44:28.159023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.161801Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.161801Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:1c4207182acf78179c433c6c4acf3272a759869d38085c3af2d9f7dcc3fc4cec","observation_id":"9e1cc2b1-243b-4d24-894c-3915299cc70e","resolution":{"observed_at":"2026-07-31T15:44:28.161801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.164735Z","title":"Direct Grounding Prompt Reflection Prompt You are an expert multimodal grounding annotator","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.164735Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:a11991ae7d95dc601c8eee3a283668a18184a9282ef5ce52d88f2f2ef117aed6","observation_id":"392f1e59-6d56-4cd5-b2aa-f8c18b7eb700","resolution":{"observed_at":"2026-07-31T15:44:28.164735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.169363Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.169363Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:c82b2483dd15e710252ddaeeca7f950485b279f1495c97a138bc7a053c8dbb30","observation_id":"f2679ebe-d20d-4648-a34c-70886b3833cc","resolution":{"observed_at":"2026-07-31T15:44:28.169363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.171632Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.171632Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:a90b16aa6f013bb5e78243962e5871eac01a8f367e6b21d22036c5cdeaedd593","observation_id":"3389078a-37d2-4cd3-9ce4-e162a9cfd276","resolution":{"observed_at":"2026-07-31T15:44:28.171632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.173914Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.173914Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:06f43079ed656c43eaff314534a564d4f6fed7fa4f6013a0e61f8d257cd6feef","observation_id":"00af1e62-d1bd-4a96-ab43-b6b091a17aa0","resolution":{"observed_at":"2026-07-31T15:44:28.173914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.176556Z","title":"You are an expert multimodal grounding annotator","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.176556Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:edc9a48070bc0e5552c0474e2f1fe3844cdc0c6b8ae285e85d5ccb5aba7e5653","observation_id":"de6bfa11-1969-46fe-917a-c6d34adfe218","resolution":{"observed_at":"2026-07-31T15:44:28.176556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.178723Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.178723Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:ba7773df1e5906e9a4707744d61ea71bf208799d9e1514b8d72e8c7d3eb76509","observation_id":"d4f65a20-4eb6-46a4-baff-ee8a189dd412","resolution":{"observed_at":"2026-07-31T15:44:28.178723Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.181024Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.181024Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:f5aadfe668afcdcbb2d3e1e455dc02566228917cf97e0f268923259970cef2bc","observation_id":"5a45f584-2ef5-49c5-893d-d890defc97cc","resolution":{"observed_at":"2026-07-31T15:44:28.181024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.183340Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.183340Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:d807a0cb8758601f21d96edd99c215076250fa5b2946939fbc2d477f9b239738","observation_id":"ade672cf-40e5-4c9a-b3fc-b10c2b256f8c","resolution":{"observed_at":"2026-07-31T15:44:28.183340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.185655Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.185655Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:1792b3927bcd69f0db091f519833ec929b974d9d24cdd3c7aab0ba8e0b6a06e4","observation_id":"de7a5527-3be0-4686-af8a-af1c00374736","resolution":{"observed_at":"2026-07-31T15:44:28.185655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.188031Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.188031Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:8f85c27b1b860e6da4ec1096c2598be168e1393f09a547110d1051f274926fef","observation_id":"ec973c2e-d77c-4d1d-93b1-c16eda5ec49d","resolution":{"observed_at":"2026-07-31T15:44:28.188031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.190210Z","title":"Evidence Diagnosis Prompt Figure 8Prompt templates used in referring grounding data construction","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.190210Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:ea3ac54df57df487f32330c2d064ccaff6392300cf475bf5f78253079518d98e","observation_id":"6127bcc5-98cb-4594-8cbd-39d4b65425ba","resolution":{"observed_at":"2026-07-31T15:44:28.190210Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.193532Z","title":"Assign a clear and concise class label to each object (e.g., 'person', 'laptop', 'coffee mug', 'dog’)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.193532Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:0895b2760b82a6d80b90b42d85f47c0201366a727306d54934078d8245df4a78","observation_id":"f5f7940f-18e9-46a9-bd35-fb7e6c3f0c02","resolution":{"observed_at":"2026-07-31T15:44:28.193532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.195768Z","title":"Each instance requires its own property dictionary","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.195768Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:e040c85c44e96bed522ef7c1eac9742781a02b09d173a4246677e51843d9faf8","observation_id":"4c3e23ce-c607-4369-bd59-f04259601b66","resolution":{"observed_at":"2026-07-31T15:44:28.195768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.197963Z","title":"Populate this object with all observable visual properties","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.197963Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:818d17550d74b4cd56b4d52aef7fea7198b8738cf1c75ca10c9a45c51fb8dc0a","observation_id":"7a5ae56a-ba3c-4ec8-9e36-a01c48611bad","resolution":{"observed_at":"2026-07-31T15:44:28.197963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.200326Z","title":"to the left of the monitor","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.200326Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:393a0599bf44227476223ac20e4c8bc198f854c2c6f7ec198d1abe44865dc2ca","observation_id":"544a2b64-8b45-4217-a012-dc142ac14e74","resolution":{"observed_at":"2026-07-31T15:44:28.200326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.202547Z","title":"a white ceramic mug filled with dark coffee","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.202547Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:d9196e2ddd601f5f9d5852b8685b74c2df828fef12713c61a25f2cafe9f14e10","observation_id":"48bee4ce-e966-42c0-8e37-1aa6652fb9a5","resolution":{"observed_at":"2026-07-31T15:44:28.202547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T15:44:28.204969Z","title":"scene_properties","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-31T15:44:28.204969Z"},"links":{"citing_paper":"/paper/2607.24407"},"observation_digest":"sha256:ce8cabd094c3b79426013d3e89d338a7475cf3c9b94dcfcfc353b561707d8588","observation_id":"82c90e8b-771f-49dd-9056-2f8681840651","resolution":{"observed_at":"2026-07-31T15:44:28.204969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.24407","last_updated":"2026-07-27T13:24:35Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T01:37:38.202649Z","submitted_at":"2026-07-27T13:24:35Z","title":"Mixture-of-Thought-Tokens: Unifying Perception and Reasoning for Free-form Multimodal Grounding"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":21,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2607.24407."}