Gemini 1.5 001 是 Gemini 1.5 系列大型语言模型的首个稳定版本,由Google DeepMind开发。该系列于 2024 年 2 月 15 日发布,001 名称指其组成模型的初始 API 版本。这些模型是生成式 AI的实例,属于人工智能的一个子领域,接受文本、图像、音频和视频输入,并基于Transformer 架构和混合专家设计构建。
Gemini 1.5 系列出现在公共 LLM 排行榜上,包括 Chatbot Arena 和 Artificial Analysis,其变体与其他模型进行了基准测试。001 版本是首批通过 Google AI Studio 和Google Cloud的 Vertex AI 平台向开发者提供的版本。
背景与发布
Google DeepMind 于 2024 年 2 月 15 日宣布 Gemini 1.5,作为早期 Gemini 1.0 模型的升级版。初始发布包括旗舰模型 Gemini 1.5 Pro,随后扩展至 Gemini 1.5 Flash,这是一种更轻量、更快速的变体,针对高容量任务进行了优化。模型名称中的“001”后缀(如 gemini-1.5-pro-001 和 gemini-1.5-flash-001)标识了该系列中每个模型的第一个稳定版本。这些版本通过 Google AI Studio 和 Vertex AI 提供给开发者和企业客户,定价基于 token 使用量。
架构
Gemini 1.5 模型采用基于 Transformer 的架构,具有混合专家神经网络设计,每个 token 仅激活部分参数,从而提高效率。它们支持高达一百万个 token 的上下文窗口,允许处理长文档、代码库和视频。这些模型使用深度学习技术在各种数据类型上进行训练,可以执行跨文本、图像、音频和视频的任务。该架构包括多头注意力和位置编码,这是现代大型语言模型中的常见组件。
变体
001 版本在公共基准快照中包括三个主要变体:
- Gemini 1.5 Pro:旗舰模型,专为复杂推理和多模态任务设计。
- Gemini 1.5 Flash:更快速、更具成本效益的模型,适用于大规模应用。
- Gemini 1.5 Flash-Lite:后来推出的轻量级变体,针对更低延迟和成本进行了优化。
这些变体共享相同的基础架构,但在参数数量和推理速度上有所不同。Flash 和 Flash-Lite 模型适用于响应时间和成本至关重要的用例。
推理与部署
开发者可以通过 Google AI Studio 和 Vertex AI 访问 Gemini 1.5 001 模型。在推理过程中,他们可以调整生成参数,如top-k 采样、top-p 采样和温度,以控制输出的随机性。这些模型还支持通过束搜索进行确定性解码。API 端点托管在 Google Cloud 基础设施上,模型支持流式响应,适用于低延迟应用。
性能与评价
Gemini 1.5 001 模型在 Chatbot Arena 和 Artificial Analysis 等公共排行榜上进行了评估,与OpenAI、Anthropic和其他组织的模型竞争。这些模型在推理、编码和多模态基准测试中表现出强劲性能,反映了机器学习的进步。一百万个 token 的上下文窗口是一个显著特点,使该系列区别于许多同期模型。
遗产
001 版本后来被更新版本取代,包括 002 系列,该系列提高了性能并减少了延迟。Gemini 1.5 系列本身在 2024 年底被 Gemini 2.0 系列接替。尽管有更新,001 版本仍然可供需要稳定、长期 API 端点的开发者使用。