概述
前段时间,申请了一下Gemini 1.5 Pro的wishlist。之后,就忘到一边去了。今天登录了一下Google AI Studio,发现,我已经可以用Gemini 1.5 pro了。于是,测试了一下。后边准备把现在正在用的Gemini 1.0 pro切换到Gemini 1.5 pro。
Gemini 1.5 pro 可以支持文字、图片、视频、文件、文件夹作为prompt输入。
输入文字
倒是没什么太特别的。

输入图片+文字
输入图片,Gemini1.5 pro返回结果的时间直接超过30秒。
我特意说它是错的,它竟然承认。看来Gemini分辨是非的能力比较差。

输入视频+文字
输入视频,Gemini1.5 pro的返回结果的时间超过200秒。

输入文件+文字
输入文件,Gemini1.5 pro返回结果的时间也超过200秒。

输入文件夹+文字
输入文件夹,内容太多,再加上之前的内容,导致prompt的token超过限额,无法返回结果。

总结
作为一个多模态的大模型,Gemini 1.5 pro比起1.0来,最明显的特点就是可以输入的类型比较全面了。文字、图片、视频、文件和文件夹。
但,似乎推理能力,并没有明显的进步。至少还是做不到分辨是非。
相关文章
Gemini:王者归来?
掉队近一年的Gemini突然动作频频:Gemini 4曝光、Antigravity集成Claude 5.5、Google收紧Gemini模型权限。免费版Gemini,基本就是个强化版的搜索引擎了。
Token Plan:一个黑盒好生意
Token正在成为继水、电、煤、云计算之后的又一个日常用品。云厂商纷纷推出看起来很便宜的Token Plan,但真实体验下来,ChatGPT和Claude的订阅反而更划算。而且很多Token Plan是个黑盒——用积分计价,积分与token的转换系数只有厂商自己知道,还可以随意控制。
DeepSeek Harness不止是一个Agent
亲测DeepSeek Harness:与Claude Code对比之后,发现DeepSeek自家Agent配上自家大模型更好用。它不止是一个Agent工具,更是开源、可以完全定制化成各种专用Agent产品的平台。