{"as_of":"2026-08-21T23:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c0bcc77f9f1157cca9f38b2861a41418af49e198470fcdd660732c49982abd7f","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:14:02.334299Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T04:17:28.017071Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19714","snapshot_observed_at":"2026-08-03T04:17:28.017071Z","title":"Mt 3: Scaling mllm-based text image machine translation via multi-task reinforcement learning.arXiv preprint arXiv:2505.19714, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05547","last_updated":"2026-08-05T16:57:37Z","snapshot_observed_at":"2026-08-19T02:40:24.388078Z","submitted_at":"2026-02-05T11:06:37Z","title":"Multi-Task GRPO: Reliable LLM Reasoning Across Tasks","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-03T04:17:28.017071Z"},"links":{"cited_paper":"/paper/2505.19714","citing_paper":"/paper/2602.05547"},"observation_digest":"sha256:2296548ee7a09659fba0454834b2540c19aa2884be2f580c1bb6eca6b89dc515","observation_id":"f7a59fed-1928-45ab-8d96-c5839908803a","resolution":{"observed_at":"2026-08-03T04:17:28.017071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19714/citation-record","integrity":"/paper/2505.19714/integrity","json":"/paper/2505.19714/citation-record.json","paper":"/paper/2505.19714"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:05.313562Z","title":"Improving end-to-end text image translation from the auxiliary text translation task","venue":null,"work_id":"f56c0985-9bfe-4b2b-b152-6c029ec08ed6","year":2022},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:58.641037Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:73f3bfa488dce71e05d70c7fdfabe4c7c6acf23ac8ec425dc4711ae4d3b4d54a","observation_id":"7b9d031e-9169-4714-a0ac-1e375370713e","resolution":{"observed_at":"2026-08-07T14:14:05.437206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:05.098374Z","title":"Exploring better text image translation with multimodal codebook","venue":null,"work_id":"f70d7c5b-6681-42cb-a1b5-d2247de41005","year":2023},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:58.722492Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:16823d66d1457ca28858ca0345429601365bd8edd889f21a4bf2f1f84cdfbd09","observation_id":"a297e907-4ceb-4b7f-bdaa-4bad07857890","resolution":{"observed_at":"2026-08-07T14:14:05.230742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:04.931693Z","title":"Document image machine translation with dynamic multi-pre-trained models assembling","venue":null,"work_id":"0f20993f-56a4-43cc-bfbd-b49e05102fff","year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:58.863335Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:4c7f3cce44c74897d37bf04ac403c5f288c216ba53418c42ef8a3f4775be1329","observation_id":"8d0289b7-7e2d-46d4-a8b8-2a9463734673","resolution":{"observed_at":"2026-08-07T14:14:04.999357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03115","last_updated":"2025-03-02T05:16:38Z","snapshot_observed_at":"2026-08-19T12:53:10.332650Z","submitted_at":"2024-10-04T03:17:27Z","title":"X-ALMA: Plug & Play Modules and Adaptive Rejection for Quality Translation at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03115","snapshot_observed_at":"2026-08-07T14:13:58.918731Z","title":"X-alma: Plug & play modules and adaptive rejection for quality translation at scale","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:58.918731Z"},"links":{"cited_paper":"/paper/2410.03115","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:2f194971c2a46b808164cc2a556c9e4d21b17dcc522a12fa260389810a24d7d9","observation_id":"4bfba9eb-207b-4f5a-9427-16ead2573713","resolution":{"observed_at":"2026-08-07T14:13:58.918731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16379","last_updated":"2024-06-21T07:35:53Z","snapshot_observed_at":"2026-08-16T14:15:24.534227Z","submitted_at":"2024-02-26T07:58:12Z","title":"TEaR: Improving LLM-based Machine Translation with Systematic Self-Refinement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16379","snapshot_observed_at":"2026-08-07T14:13:58.952388Z","title":"Improving llm-based machine translation with systematic self-correction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:58.952388Z"},"links":{"cited_paper":"/paper/2402.16379","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:d327b1837bb6030de792c5ed47ad33ddf7316fbdce967e67d7acc351eeffdfb1","observation_id":"0c29c512-5d09-4072-8db4-4edac912a1d6","resolution":{"observed_at":"2026-08-07T14:13:58.952388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:04.724375Z","title":"Towards fully automated manga translation","venue":null,"work_id":"497e2ccc-0b78-40db-808b-b993a9471a22","year":2021},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.051159Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:05ac46565293c489e7d3dc0c8db0b5126d1fc1c7e804620508d54e87541849fd","observation_id":"2db436a2-94c8-4f04-a1e7-f478d1825759","resolution":{"observed_at":"2026-08-07T14:14:04.822417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:04.489730Z","title":"Doc-handler: Document scanner, manipulator, and translator based on image and natural language processing","venue":null,"work_id":"f5458be5-4ee2-44de-a05f-a63835343387","year":2023},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.138157Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:e5397f5e316362f174032333d177d2da8e73e4542304b039005f477a283bdaae","observation_id":"b88b2cfb-05ff-4100-b79b-c6f58616f4e2","resolution":{"observed_at":"2026-08-07T14:14:04.602806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:04.348893Z","title":"A novel dataset and benchmark analysis on document image translation","venue":null,"work_id":"d1ea4fb9-b994-44c6-aa69-c9b090073897","year":2023},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.242079Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:e52dd5a4f6d0ec9bd4dd9c76daaf5a6cc512cc8ffc3a240d15b2fd6b8e13d9b1","observation_id":"fcbd4c83-9b94-4581-8147-d3779a3ffeb4","resolution":{"observed_at":"2026-08-07T14:14:04.437848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:04.215011Z","title":"Understand layout and translate text: Unified feature-conductive end-to-end document image translation","venue":null,"work_id":"d36c9309-e410-44dc-88d6-76534121c256","year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.329408Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:36f6b7a60006f292266a48a585ef4d3d8dcd657ddd6be4adc6c533a020d366e4","observation_id":"84599604-fd47-42d1-80e3-94fe0accb12b","resolution":{"observed_at":"2026-08-07T14:14:04.266082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:04.058196Z","title":"Peit: bridging the modality gap with pre-trained models for end-to-end image translation","venue":null,"work_id":"71493064-7792-4e77-969c-81ab24af99bd","year":2023},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.452079Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:3ce692a2ce4ddf03553d8db1d5c939f0b441f562781623775d1fd3aba1b07448","observation_id":"fa117ddf-2327-4491-8ab4-d939013c384e","resolution":{"observed_at":"2026-08-07T14:14:04.142137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:03.860921Z","title":"Born a babynet with hierarchical parental supervision for end-to-end text image machine translation","venue":null,"work_id":"884bf016-7fd0-453b-bfc3-46bc999ada9a","year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.605511Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:c2a31637ba368d470d86944642d747dca3f2beaa42ff76e2533e9dd4e5c90e5c","observation_id":"7eb808bc-a1d9-4499-83d1-9063bd20ccbd","resolution":{"observed_at":"2026-08-07T14:14:03.928447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:03.714743Z","title":"Umtit: Unifying recognition, translation, and generation for multimodal text image translation","venue":null,"work_id":"4bb63c5b-9fcd-4f08-801a-bbe1860338f2","year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.691677Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:afbce3cce869ecba275f826ea049a5345c62d7799edf1816efb659229aab13c6","observation_id":"f2fd6f25-9fe1-4f6d-b18a-b04a8c1aefe9","resolution":{"observed_at":"2026-08-07T14:14:03.772522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-21T16:02:41.546193Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T14:13:59.814191Z","title":"Qwen2.5-vl technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.814191Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:4df964254cd8eafd6c3dde5c36b4e16e35b27bfacd9df62eab3bc62ddbef457f","observation_id":"7db1058f-f4c4-492b-bc71-e42c40294a12","resolution":{"observed_at":"2026-08-07T14:13:59.814191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-07T14:13:59.949559Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:59.949559Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:7906874edf5cf7f0e7b647ef7b4571441f5fd109b817b4aa0709b4ea0bc88e54","observation_id":"2bf1845f-f9b1-4086-930c-d38c6ee018da","resolution":{"observed_at":"2026-08-07T14:13:59.949559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:00.084026Z","title":"Qvq: To see the world with wisdom, December 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.084026Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:cb6456d89ea0024c693f35daab4d49827253659a64d613f98911484919db4d8a","observation_id":"011e98e9-b803-431d-82c9-185df12c0503","resolution":{"observed_at":"2026-08-07T14:14:00.084026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:14:00.195720Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.195720Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:bb4d2dcf83078872cd79c7fb6e5f4565362094ed3764be8afe3b303610244cfa","observation_id":"f47fd1cf-41f0-418d-b310-a04514489007","resolution":{"observed_at":"2026-08-07T14:14:00.195720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:03.551122Z","title":"Kimi k1.5: Scaling reinforcement learning with llms","venue":null,"work_id":"4928b274-bacc-408f-b6fc-473bb2b96e91","year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.301704Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:3df6533b7e5a688ef0c72fbab2c8cba7d3a963a42bae630f1d412a1d02442a0f","observation_id":"f9f90ec2-3c9e-46b9-b572-a7f041e22ada","resolution":{"observed_at":"2026-08-07T14:14:03.612372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:00.396181Z","title":"Qwq-32b: Embracing the power of reinforcement learning, March 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.396181Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:791b8b481de35dfb618a1ac2bb60970f0abe176ab0e16d62eac116b864a8904f","observation_id":"0bd6ec55-df4d-4264-8d83-b82c5cc732ea","resolution":{"observed_at":"2026-08-07T14:14:00.396181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-16T02:03:48.252223Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-07T14:14:00.498814Z","title":"Vision-r1: Incentivizing reasoning capability in multimodal large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.498814Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:b1ef2ac94663fc67b7cc35574eaf6f4bac38f67c7a711eaba7070b9911982413","observation_id":"a5f2a814-4646-4e86-909d-c9f07717bcc1","resolution":{"observed_at":"2026-08-07T14:14:00.498814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12937","last_updated":"2025-08-04T04:22:09Z","snapshot_observed_at":"2026-08-13T01:30:54.104133Z","submitted_at":"2025-03-17T08:51:44Z","title":"R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12937","snapshot_observed_at":"2026-08-07T14:14:00.582740Z","title":"R1-vl: Learning to reason with multimodal large language models via step-wise group relative policy optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.582740Z"},"links":{"cited_paper":"/paper/2503.12937","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:99f82d6f94fe6c39e6612263105ae323a2857f9d0a22e0451417343b3510ee55","observation_id":"3398ef41-7d5f-4aed-8636-b2a1051d9b93","resolution":{"observed_at":"2026-08-07T14:14:00.582740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07615","last_updated":"2025-04-14T15:15:54Z","snapshot_observed_at":"2026-08-14T23:38:19.973422Z","submitted_at":"2025-04-10T10:05:15Z","title":"VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07615","snapshot_observed_at":"2026-08-07T14:14:00.742150Z","title":"Vlm-r1: A stable and generalizable r1-style large vision-language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.742150Z"},"links":{"cited_paper":"/paper/2504.07615","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:dcfb86d231503d18c40dbb3816b3e435fe64f0bc9753920af36e1120b483f8b9","observation_id":"747cb31e-cc82-47f3-81d3-efbbbd61326d","resolution":{"observed_at":"2026-08-07T14:14:00.742150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01785","last_updated":"2025-03-03T18:16:32Z","snapshot_observed_at":"2026-08-19T07:59:58.721057Z","submitted_at":"2025-03-03T18:16:32Z","title":"Visual-RFT: Visual Reinforcement Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01785","snapshot_observed_at":"2026-08-07T14:14:00.855627Z","title":"Visual-rft: Visual reinforcement fine-tuning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.855627Z"},"links":{"cited_paper":"/paper/2503.01785","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:4c7f7c932d4893262c555e385342a0c6d02108b9556b38257eb9e0d5d8b3ee39","observation_id":"cc78ef3e-8682-4e19-a0e3-0d45b7c6a15e","resolution":{"observed_at":"2026-08-07T14:14:00.855627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-08-13T20:16:31.803514Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-07T14:14:00.965350Z","title":"Mm-eureka: Exploring the frontiers of multimodal reasoning with rule-based reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:00.965350Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:eba2979b727e97720827451fcf5908f4b12626d390bbc17c0660568dd7d57ab3","observation_id":"7fa60082-4020-47cd-b5bb-c0f92981b7ad","resolution":{"observed_at":"2026-08-07T14:14:00.965350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:01.061657Z","title":"R1-v: Reinforcing super generalization ability in vision-language models with less than \\ 3","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.061657Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:9950d4507078372d4df32cd038d0084fb247d38d22631bc552a0d9d03dcabf0e","observation_id":"843b5793-aed7-4f43-b81c-4b2f26517bdc","resolution":{"observed_at":"2026-08-07T14:14:01.061657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07147","last_updated":"2024-12-16T09:28:53Z","snapshot_observed_at":"2026-08-16T18:30:54.203586Z","submitted_at":"2024-12-10T03:12:35Z","title":"MIT-10M: A Large Scale Parallel Corpus of Multilingual Image Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07147","snapshot_observed_at":"2026-08-07T14:14:01.162482Z","title":"Mit-10m: A large scale parallel corpus of multilingual image translation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.162482Z"},"links":{"cited_paper":"/paper/2412.07147","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:394a1a3fbea689541612eb628ecad91a5c1b4e0b9d647bb98ff116a3056be662","observation_id":"94e68b34-4a67-44e6-b338-989af900c6ee","resolution":{"observed_at":"2026-08-07T14:14:01.162482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-08-15T22:38:53.825110Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T14:14:01.267361Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.267361Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:5d914c61263f5c00bc9f89ce44c90c3b4975592a0ccc29a2e5753bd35e6bcaff","observation_id":"42d4d390-4d3c-4478-8d98-9318e8527c08","resolution":{"observed_at":"2026-08-07T14:14:01.267361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T14:14:01.404958Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.404958Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:0669cb446494c047c6caeb5e96a9234df9980efbae3659725a8c15b55af9e2b4","observation_id":"3bb5ca55-f5fb-441c-a276-f01b8b9e0538","resolution":{"observed_at":"2026-08-07T14:14:01.404958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:03.387164Z","title":null,"venue":null,"work_id":"6b665b0b-72d3-433a-aa91-3191b690ff92","year":2022},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.507949Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:de6a5e6690b29081fe37352d29ff47bc90ac32eb0dc4de4d876e36fb8e7bf2af","observation_id":"a06f41ee-f846-40e9-bd74-d419b355d93a","resolution":{"observed_at":"2026-08-07T14:14:03.447765Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:01.629109Z","title":"Results of WMT 23 metrics shared task: Metrics might be guilty but references are not innocent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.629109Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:ebd548a5a5c84aad131241f911311cd0f85bcad64767b5e0438045adfb6be6ed","observation_id":"9bfd95f3-3fcb-46c7-be81-a6b2b414545c","resolution":{"observed_at":"2026-08-07T14:14:01.629109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10160","last_updated":"2025-04-14T12:14:18Z","snapshot_observed_at":"2026-08-16T12:41:22.322867Z","submitted_at":"2025-04-14T12:14:18Z","title":"MT-R1-Zero: Advancing LLM-based Machine Translation via R1-Zero-like Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10160","snapshot_observed_at":"2026-08-07T14:14:01.716379Z","title":"Mt-r1-zero: Advancing llm-based machine translation via r1-zero-like reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.716379Z"},"links":{"cited_paper":"/paper/2504.10160","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:0a3862db77736a3fdac8f4fe49ce3ee9bbe5b7cfb1312e665f6b103d35a180c9","observation_id":"25423da9-622c-4e82-b194-c93f4694c9a8","resolution":{"observed_at":"2026-08-07T14:14:01.716379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:01.816152Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.816152Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:a97676e57395410691d9c51a2c403458f5742516a504c666f513ba562bdb03c7","observation_id":"a70b5dee-780a-4925-ba71-b32baa6ae6a3","resolution":{"observed_at":"2026-08-07T14:14:01.816152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:03.208311Z","title":"A call for clarity in reporting BLEU scores","venue":null,"work_id":"6e0244d7-7b09-48c6-85e4-e15cd832c625","year":2018},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.887679Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:ae4e94d384c0fecf7062604ddb41f90b88604059017473d11e33aad6ca901230","observation_id":"814b935f-bf68-4e35-a9bc-0bb090857f4f","resolution":{"observed_at":"2026-08-07T14:14:03.300772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:03.063190Z","title":"chrf++: words helping character n-grams","venue":null,"work_id":"e7b52174-c958-4957-ae58-3db8920545c5","year":2017},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.929513Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:f3a5ac7ba2be16e836c3e9a23ce5f298930e3f5704802ebd553322f8b6c77257","observation_id":"80f028a1-8817-42d7-bc7e-81395417c64e","resolution":{"observed_at":"2026-08-07T14:14:03.129649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:02.891446Z","title":"Meteor: An automatic metric for mt evaluation with improved correlation with human judgments","venue":null,"work_id":"de925b56-7137-48fd-ad69-86722f7c4d7e","year":2005},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:01.986290Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:6fe7b89a8c83be1cdbf75fdc55e044f737138d65e2ef3cd00cbae34e7100d324","observation_id":"fbcc3b8e-3264-4326-8858-a49a43a0420d","resolution":{"observed_at":"2026-08-07T14:14:02.982521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00321","last_updated":"2025-06-05T02:59:05Z","snapshot_observed_at":"2026-08-12T17:21:52.298102Z","submitted_at":"2024-12-31T07:32:35Z","title":"OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00321","snapshot_observed_at":"2026-08-07T14:14:02.099149Z","title":"Ocrbench v2: An improved benchmark for evaluating large multimodal models on visual text localization and reasoning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:02.099149Z"},"links":{"cited_paper":"/paper/2501.00321","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:73fc9afb9d9284bdc017816da5c936475ae1950cdd4a620be9ef819d2ec91d9a","observation_id":"b1ba5894-f2a8-4e0a-96b1-97ec66c90f86","resolution":{"observed_at":"2026-08-07T14:14:02.099149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T14:14:02.163845Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:02.163845Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:50119b67eeadff17e9b7e667930a4f2d76da579337c6e0ee1c0392d59d310db8","observation_id":"5967fad5-0f27-4407-8282-6a21ff33cf33","resolution":{"observed_at":"2026-08-07T14:14:02.163845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.04672","last_updated":"2022-08-25T17:10:53Z","snapshot_observed_at":"2026-07-06T13:29:47.927628Z","submitted_at":"2022-07-11T07:33:36Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.04672","snapshot_observed_at":"2026-08-07T14:14:02.254773Z","title":"No language left behind: Scaling human-centered machine translation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:02.254773Z"},"links":{"cited_paper":"/paper/2207.04672","citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:51c51de03f9dc14a9fa986b7fc684ca428547199af84d316b9098126697a41b6","observation_id":"4990aa5c-23f1-4509-ab9d-3c5349673d46","resolution":{"observed_at":"2026-08-07T14:14:02.254773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:02.733850Z","title":"Deep nn for nsfw detection","venue":null,"work_id":"f8c3de16-11da-4995-b8d1-916bf2e49b50","year":null},"citing_paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:02.334299Z"},"links":{"citing_paper":"/paper/2505.19714"},"observation_digest":"sha256:0de8e712bdeb3dc3b10a0680d26edcd247c4d0be6004e62c68d71a8dd9c7de94","observation_id":"ea34ad3b-0316-42a7-a15a-ce7bdd82a941","resolution":{"observed_at":"2026-08-07T14:14:02.804453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19714","last_updated":"2025-05-26T09:02:35Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T13:26:43.384529Z","submitted_at":"2025-05-26T09:02:35Z","title":"MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":15},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2505.19714."}