
Gemini 3.8 Flash:推理和代码能力全面提升
Gemini 3.8 Flash 和 3.8 Flash Cyber 正式发布,推理和代码能力都进行了升级,同时保留了 3.7 Flash 系列的低延迟和低成本优势。 两个版本面向不同的场景,但共用了同一套底层权重,都靠长时间运行的 Age...

Gemini 3.8 Flash 和 3.8 Flash Cyber 正式发布,推理和代码能力都进行了升级,同时保留了 3.7 Flash 系列的低延迟和低成本优势。 两个版本面向不同的场景,但共用了同一套底层权重,都靠长时间运行的 Age...

Gemini 3.7 Flash 正式发布!它在软件工程、知识类工作、Web 开发流程上的表现都有明显提升,首发价格仅为 3.6 Flash 单价的一半,是 Google 目前在代码编写和 Agent 场景中最强的主力模型。 更强的复杂工作...

开发者和企业在搭生产级 AI Agent 时,往往最在意这 3 件事:Token 效率、低延迟表现和性能稳定性。为了在效率和生成质量之间找到平衡,更好的支撑大规模智能体工作流,Google 在 Gemini 3.5 Flash 的基础上,正...

Google 正式推出实验性开源模型 DiffusionGemma,首次落地文本扩散(Text Diffusion)高速文本生成技术。模型基于 Apache 2.0 协议开源,采用 26B MoE 架构,打破了传统自回归 LLM 逐个生成 ...

从 Gemma 4 发布开始,Google 就一直在迭代其能力:先是引入了多 Token 预测解码技术来加速推理,随后又推出了 12B 无编码器多模态版本,来填补 E4B 和 26B MoE 模型之间的空白。 现在,又搞出来个 QAT(量化...

Google 正式推出 Gemma 4 12B!它的性能强于 E4B,体量又比 26B 要轻得多,填补了 E4B 与 26B 模型之间的空档。同时,它也是 Gemma 首个原生支持音频输入的中等规模模型,只需要很低的内存占用就能输出不错的效...

Gemini 3.5 Flash 正式上线,专为智能体高效运行与原生代码场景优化,擅长处理复杂长流程任务,是 Google 布局 AI 智能体赛道的核心产品。 4 倍提速,全面反超 3.1 Pro Gemini 3.5 Flash 保留了 ...

Google 正式为 Gemma 4 模型家族开源了 MTP Drafter(多 Token 预测草稿模型)。基于「预测解码」架构,它能在不牺牲输出质量与推理逻辑的前提下,把生成速度最高提升 3 倍。 为什么要使用「预测解码」 大语言模型(...

Gemma 4 正式发布,全面采用 Apache 2.0 协议。它专为高阶逻辑推理与 AI 智能体工作流而生,实现了破纪录的「参数智能比」,是 Google 迄今为止能力最强的开源大语言模型家族。 自初代 Gemma 发布以来,全...

Gemini 3.1 Flash Live 音频与语音模型正式上线,进一步突破了 Gemini 系列的「实时对话」能力。它拥有下一代「语音优先 AI」所需的响应速度与自然对话节奏,为开发者、企业及大众用户,带来了更直观、更流畅的交互体验。 ...

Google 基于 Gemini 架构打造的首款全能型原生多模态嵌入模型——Gemini Embedding 2 正式发布。它可以将文本、图像、视频、音频和文档,毫无障碍地映射到同一个向量空间中,让跨媒介的检索与分类变得轻而易举。 Gemi...

Gemini 3 系列中速度最快、性价比最高的模型——Gemini 3.1 Flash-Lite 正式发布!该模型专为大规模、高频负载场景量身打造,在同级别模型中有着极高的「质价比」。 从现在开始,你就可以在 Google AI Studi...
最新评论
有多亮,是blingbling的吗🤣
这个网站眼前一亮
不要装,千万不要装,无法自定义鼠标指针,主题和壁纸需要重新设置,但是鼠标指针完全被像素版大白指针替代,无法更改。
鼠标指针也没了qwq