Pith. sign in

Paper Citation Record · LEDGER

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan

As of 8 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2508.01274.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2508.01274 v1

Coverage vector

measured 40 of 40 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T05:49:51.633826Z

measured 40 of 40 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

40 of 40 outbound references displayed

  • verified exact3
  • verified fuzzy0
  • unresolved34
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch2

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation dc5a86d8-dd3d-48ca-a4c8-8cc0eb4a778d · outbound

This paper cites Flamingo: a Visual Language Model for Few-Shot Learning.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Flamingo: a Visual Language Model for Few-Shot Learning

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.471076Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.471076Z digest=sha256:fb6b624cb01c32c4dd982ccaccdba14a1f4bacefb3515216aa732ba511a2281b

Observation 7c3760e2-6b13-4238-9598-afa4c68ef494 · outbound

This paper cites PaLM 2 Technical Report.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan PaLM 2 Technical Report

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.476645Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.476645Z digest=sha256:d8c3fb1f35129f0eec19b209e8b88b44c31eea298429b38c1c70063d6506b236

Observation 954b39b7-564b-4757-a8f4-c23729d4b035 · outbound

This paper cites Qwen Technical Report.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Qwen Technical Report

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.481291Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.481291Z digest=sha256:846bcd2494be24659d4bc55720917517c16321a0cf0e03c614bbb07cabc9a6ea

Observation 8478b6f7-e84a-480a-9064-26039c21df75 · outbound

This paper cites Qwen2.5-VL Technical Report.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Qwen2.5-VL Technical Report

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.486412Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.486412Z digest=sha256:99755deb860a6bbeeb9801af25cebfa4525f905431b1272f252552f3e0fcabca

Observation fa26fd49-b609-4ebc-bc3f-caa9c3ce5658 · outbound

This paper cites AudioLM: a Language Modeling Approach to Audio Generation.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan AudioLM: a Language Modeling Approach to Audio Generation

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.490677Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.490677Z digest=sha256:2d1152f01280f063647a3542d3a7a16a158265afe0cbf4ee9648548f39bb32f0

Observation 464b06ab-5ea6-4f0e-9008-c258dc984a71 · outbound

This paper cites an unresolved cited work.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Unresolved cited work

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.494989Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.494989Z digest=sha256:0c531b9daa8b210296ab227fb92c004da937ab9d2706f777fa4e3ff00634f5d7

Observation 5f6d1483-0f00-4886-8580-df48b871d38b · outbound

This paper cites Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.503929Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.503929Z digest=sha256:5a59f00406aab4c1ff87ec6e572246d39e26245146957d7540128271f3602fea

Observation 2ca8ade5-cbda-499e-9b66-a7fee0937720 · outbound

This paper cites Advancing the Evaluation of Traditional Chinese Language Models: Towards a Comprehensive Benchmark Suite.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Advancing the Evaluation of Traditional Chinese Language Models: Towards a Comprehensive Benchmark Suite

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-08-06T05:49:52.312171Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T05:49:51.507893Z digest=sha256:99ffa6a51eca3c1a90c31253a1a021aeca509a841a1aa51551f0be1fbf9963ca

Observation 9abc9593-2302-40ae-9e90-8a2a30723b4a · outbound

This paper cites Pushing Boundaries: Exploring Zero Shot Object Classification with Large Multimodal Models.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Pushing Boundaries: Exploring Zero Shot Object Classification with Large Multimodal Models

Reference 9

Resolution
metadata mismatch
local_arxiv, observed 2026-08-06T05:49:52.295911Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T05:49:51.511885Z digest=sha256:98071f98f2d0f3e19d82427885c534b348a4b7ad61efefc810fbb13879fb6223

Observation 52fed0d3-eb66-4725-b249-4535076df960 · outbound

This paper cites Sparks of Large Audio Models: A Survey and Outlook.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Sparks of Large Audio Models: A Survey and Outlook

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.515683Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.515683Z digest=sha256:a8972a880790a2bd01d094cbda1a065fa70e7ab56da45983b71927bece4ecf73

Observation 94c8b40b-c7d3-4a27-8637-b0d0cda626e3 · outbound

This paper cites What matters when building vision-language models?.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan What matters when building vision-language models?

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.519985Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.519985Z digest=sha256:62f7b30baee8d82a891f5de4ce8208df13d2f49fb18bab5844d60ef105d92ec6

Observation 4443a859-1e0a-4085-b415-398d5bf08a6e · outbound

This paper cites an unresolved cited work.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Unresolved cited work

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.523705Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.523705Z digest=sha256:1a7bd83c8a6d952b5d7ec62e71dc273f2cd04d469a787f981c341afbdf44b864

Observation 9dc37bcf-276c-4b5d-8840-87b530acbf19 · outbound

This paper cites an unresolved cited work.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Unresolved cited work

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.527589Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.527589Z digest=sha256:e34df5d04070c64834401586b4424462bd4c0e7b8a039d0131bc1d851e09818c

Observation 0e151fc7-433a-4cbe-a98c-fea04d225d58 · outbound

This paper cites A Survey of State of the Art Large Vision Language Models: Alignment, Benchmark, Evaluations and Challenges.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan A Survey of State of the Art Large Vision Language Models: Alignment, Benchmark, Evaluations and Challenges

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.532048Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.532048Z digest=sha256:c792a92a66cd15accbb2f2b15f5d682b22251e1376a17ee8e0b793ec736d1207

Observation c0061773-5485-4a23-ac3d-f3f2e8d5b07e · outbound

This paper cites an unresolved cited work.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Unresolved cited work

Reference 15

Resolution
metadata mismatch
raw_fallback, observed 2026-08-06T05:49:52.129584Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T05:49:51.537137Z digest=sha256:c4847e339595b4f95c6144bfef24ea786f0715af3b66e69a663a31980c9f0c9a

Observation f850a393-35f4-4544-9e8d-3016414b342a · outbound

This paper cites Improved Baselines with Visual Instruction Tuning.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Improved Baselines with Visual Instruction Tuning

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.541245Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.541245Z digest=sha256:b2f52d948c1bcfb1e1894f2f17f677ee50eb1b18a78207d4a25b5de0e254f31e

Observation 2e351de5-1f16-41ee-ba07-365d0832fabb · outbound

This paper cites Unified-IO 2: Scaling Autoregressive Multimodal Models with Vision, Language, Audio, and Action.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Unified-IO 2: Scaling Autoregressive Multimodal Models with Vision, Language, Audio, and Action

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.545721Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.545721Z digest=sha256:005ebabe75468aea5fae79eb160c856e41ad22fcd5d80c81c11c8f792f7a6431

Observation 8e47b658-d696-4523-b3dd-705168a89a24 · outbound

This paper cites an unresolved cited work.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-06T05:49:52.413724Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T05:49:51.549680Z digest=sha256:1590c01b334db95bac0ce002740dcd30571f7fac0081cea79a3443d3f0f87249

Observation b60a8aef-585f-46c8-b57e-7e0c20c69c0d · outbound

This paper cites an unresolved cited work.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Unresolved cited work

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.553420Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.553420Z digest=sha256:d2b0d61380ff431b9687ddd76114b3e9c187cb14edb7fce3dce0a93adc688528

Observation 781239df-d54f-4db6-a466-e88b33e7efd7 · outbound

This paper cites UI-TARS: Pioneering Automated GUI Interaction with Native Agents.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan UI-TARS: Pioneering Automated GUI Interaction with Native Agents

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.557351Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.557351Z digest=sha256:1b3a804c66627c186310b08c3278885abef6078aeb01aa816df6c74a7087ebdf

Observation 951980de-f011-4bca-999e-e6bf5f847499 · outbound

This paper cites Qwen2.5 Technical Report.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Qwen2.5 Technical Report

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.561890Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.561890Z digest=sha256:6755e7b3517c1a9992d51d382ad202c4b150ea1d1417d0fe5d319f1febb48b2d

Observation 4156e41e-bcd0-4c2d-a4d1-341cb8b40ca1 · outbound

This paper cites Learning Transferable Visual Models From Natural Language Supervision.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Learning Transferable Visual Models From Natural Language Supervision

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.565299Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.565299Z digest=sha256:bf67513cc150f574a849608341b7dac6c8ab59aef570b8cc206d6e7f20054148

Observation 2726712a-3e7d-4f50-8701-4b8e4e9825d3 · outbound

This paper cites Robust Speech Recognition via Large-Scale Weak Supervision.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Robust Speech Recognition via Large-Scale Weak Supervision

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.570094Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.570094Z digest=sha256:3ba66e4b0308330782366f1be511c610392da90f500fc505ad74397f805b2e44

Observation 512dc07b-01b1-40b9-8aec-f52d171a6f9d · outbound

This paper cites AudioPaLM: A Large Language Model That Can Speak and Listen.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan AudioPaLM: A Large Language Model That Can Speak and Listen

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.574197Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.574197Z digest=sha256:703360853ddc625874f140b713fbdbfb5ea895a9cb8a0e53bc04143e50d099b7

Observation baf34838-8818-4543-9f52-90c9110f8a37 · outbound

This paper cites PaliGemma 2: A Family of Versatile VLMs for Transfer.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan PaliGemma 2: A Family of Versatile VLMs for Transfer

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.577941Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.577941Z digest=sha256:66b2143585be84e6d180e28029462b0944c6b08766c064a9df41b0b0419b940c

Observation 78135712-2999-478e-b7f1-745c2641a127 · outbound

This paper cites An Improved Traditional Chinese Evaluation Suite for Foundation Model.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan An Improved Traditional Chinese Evaluation Suite for Foundation Model

Reference 26

Resolution
verified exact
local_arxiv, observed 2026-08-06T05:49:51.893428Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T05:49:51.582399Z digest=sha256:82c4328e1a77b9f302033f2c26f180e0b2754468bf987ef790416203135ab8c1

Observation 22ba5860-1755-499a-b8e8-de9e7eb105d0 · outbound

This paper cites VisTW: Benchmarking Vision-Language Models for Traditional Chinese in Taiwan.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan VisTW: Benchmarking Vision-Language Models for Traditional Chinese in Taiwan

Reference 27

Resolution
verified exact
local_arxiv, observed 2026-08-06T05:49:51.875346Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T05:49:51.586304Z digest=sha256:823b519ff9423ce8325f7e306c180ec22818c9dd2dbea9c135c513198fa1815c

Observation b1c98d8c-6bf4-4c85-8212-e1339376e2aa · outbound

This paper cites Hashimoto.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Hashimoto

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.590032Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.590032Z digest=sha256:3cebdbb13d1d8faf86d130093644e759713e01fb8ee5b4dffa92d09b8bbe710f

Observation cfd6b74b-d94d-4395-a69f-30d8ace9b657 · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan LLaMA: Open and Efficient Foundation Language Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.593351Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.593351Z digest=sha256:5c4ee6257646a4e7424825aedd59649e2471eb65c42b13d4417ab35e865905ae

Observation ca80e7d3-91fb-4d44-af98-966e19321006 · outbound

This paper cites Llama 2: Open Foundation and Fine-Tuned Chat Models.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Llama 2: Open Foundation and Fine-Tuned Chat Models

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.597318Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.597318Z digest=sha256:e8671c7ebb6409037399f0fbc43f9a93b559ae51fd5604a6f7d1faaf632cd0e3

Observation 7901e85c-568a-4313-bff0-1ac5f285c8a9 · outbound

This paper cites an unresolved cited work.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Unresolved cited work

Reference 31

Resolution
unresolved
raw_fallback, observed 2026-08-06T05:49:52.394377Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-06T05:49:51.601137Z digest=sha256:af261ee125ce38a0bf83ec260a0e61d254d917ef1b751c3f12623853ac9a5bea

Observation 9d6818eb-e463-4cf5-8a03-e44237d8a785 · outbound

This paper cites NExT-GPT: Any-to-Any Multimodal LLM.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan NExT-GPT: Any-to-Any Multimodal LLM

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.608775Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.608775Z digest=sha256:6dcadff92f96b56a2a1af589e0dcddad83279fedde00fb01fdb5f0781222bfca

Observation c471a939-5148-4b67-b08c-e653c1b02032 · outbound

This paper cites Qwen2.5-Omni Technical Report.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Qwen2.5-Omni Technical Report

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.612343Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.612343Z digest=sha256:e0ed1a84714ba496ed062c0534076e034dae01bd7088fdf012c178c559fdfdf1

Observation ad72b08f-cd06-409b-a456-7baf9d73d505 · outbound

This paper cites mT5: A massively multilingual pre-trained text-to-text transformer.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan mT5: A massively multilingual pre-trained text-to-text transformer

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.616635Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.616635Z digest=sha256:9b212fecafad55ffed536cac36aa00052405f6bfe3d77a53e921cc85a61b622b

Observation 5f25729c-21ce-41dc-8e41-ff2e4d09c075 · outbound

This paper cites Qwen2 Technical Report.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Qwen2 Technical Report

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.620971Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.620971Z digest=sha256:03d28836485585e37884c8c604636fedcd36fe8e653b1d35160c595d9b911caa

Observation e4a42ff3-5375-46fa-859f-e25a3a93e91e · outbound

This paper cites A Survey on Multimodal Large Language Models.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan A Survey on Multimodal Large Language Models

Reference 36

Resolution
malformed identifier
no resolver link, observed 2026-08-06T05:49:51.625753Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.625753Z digest=sha256:867d4cd1bd0d70c7ac1cc261c640ebadbe22cc1dd3f6280b8422931c9c54f8e7

Observation e19c2b0d-7237-4140-a787-c1e5cbbf9be9 · outbound

This paper cites AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.629751Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.629751Z digest=sha256:a193cb731ca08cd73337e4898b3375a39b2985cdf3ffa51385d741fb18fd243a

Observation 980b3d77-fb56-4d2b-95f1-4a89297c6834 · outbound

This paper cites Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.633826Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.633826Z digest=sha256:3a892f37a3e13dbe44c03892c25c9f3b949455a2525e0b4504b42b44cefbc5af

Observation 99981462-a7fa-4aac-9aa8-99338b81a894 · outbound

This paper cites Qwen2-Audio Technical Report.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan Qwen2-Audio Technical Report

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.499143Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.499143Z digest=sha256:8df882db9a1ec70506cdf5e3d08e1c94c5934f79a3ebcf1d8a635d263fee8ca2

Observation 518f67d6-ad7f-485a-9f1a-34a293fbc990 · outbound

This paper cites All Languages Matter: Evaluating LMMs on Culturally Diverse 100 Languages.

Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan All Languages Matter: Evaluating LMMs on Culturally Diverse 100 Languages

Reference 2025

Resolution
unresolved
no resolver link, observed 2026-08-06T05:49:51.605060Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:49:51.605060Z digest=sha256:eb8d55bee74671e3e48816ea4767e63fca14a93493910642e373108a8e9fb19f

Pith citing papers

No inbound Pith citation observations are available.