AI++
Google多模态模型2025-03-14 上线

Gemma 3 4B

Google的Gemma 3 4B模型具备多模态能力,支持图文输入与文本输出,可处理最长达128k token的上下文窗口,能理解超过140种语言,在数学运算、逻辑推理及对话交互等方面的性能均得到了显著提升。

去评测榜
上下文 131K结构化输出能看图

适合做什么

根据公开评测与能力标签,一句话帮你判断用途

整体来看,还能看图一起分析。

实力怎么样

Artificial Analysis 公开指数,分数越高越好,大约按 0–100 理解

写代码
写程序、改 bug、读仓库时的表现
一次能读多长
约 131K tokens(很长文档也能一次读完)
上下文较宽裕,适合项目级阅读与长对话

大概要花多少钱

按每百万 tokens 计价(约等于几十万到上百万汉字量级)

读入内容
$0.050/M
你把资料/问题喂给模型的费用
写出回答
$0.100/M
模型生成回复的费用,通常更贵

举个例子:读进约 50 万 tokens、写出约 5 万 tokens,大约花费 $0.03(按公开标价估算)。

能处理什么

输入、输出与常见能力开关

能看懂
文本图像
能产出
文本
还会这些
工具调用JSON / 结构化指定输出格式推理参数可见思考过程