谷歌的多模态大模型,与搜索及办公套件深度打通,实时信息与多模态理解是强项,免费档功能与上下文有所收紧,适合日常使用。
Gemini 是谷歌推出的多模态大模型系列,能力覆盖文本、图像、音频与视频理解,用户可上传图片或文档直接提问。它与谷歌生态结合紧密,能在搜索、邮件、文档与表格等产品中直接调用,便于把 AI 融入既有办公流程,对实时信息的获取也较为便捷。模型提供从轻量到旗舰的多个规格版本,上手门槛不高,输出质量较为稳定,支持多端使用,可与日常工作流衔接。