谷歌9月15日发布Gemini 3.8 Live,边说话边干活,打断它还能接着聊。音频到音频的实时对话模型,免费层就能用。不用打字,对着手机说,它一边听一边想一边答。实测三个新玩法。
先讲清楚这是啥。3.8 Live是谷歌最强实时语音模型,能听懂你的话,也能看懂你发的图、视频、屏幕内容,用声音回答你。Extended Thinking版本更狠,一边推理一边说话,你问完它当场算给你听。
实测一:边推理边说

普通模型要等它想完才开口,3.8 Live Extended Thinking能边想边说。你问一道难题,它一边推理一边把思路讲出来,像人思考时自言自语。问到一半发现理解错了,当场打断纠正,它立刻调整继续。
实测二:多模态实时

不只是说话。给它看屏幕、发图片、丢视频,它边看边答。比如对着婚礼场地照片问什么风格合适,它看完直接给建议。能接语音、视频、图片、文本,全程一个对话。
实测三:免费怎么用
Google AI Studio直接开,免费层包含3.8 Live和Extended Thinking。API也有免费层,音频输入、图像视频输入、文本输出全免费。重度用再上付费:文本输入每百万0.75美元,音频3美元,输出4.5美元。
对比小结

跑完一圈,结论明确:实时对话能力是当前第一梯队,边推理边说话独一份;免费层包含两个模型,白嫖党直接上手;多模态实时交互,写代码、查资料、当翻译都顺手。比3.8 Flash多了实时语音,各有用处。
几个使用细节
模型名gemini-3.8-live和
gemini-3.8-live-extended-thinking,API直接换名。Live版不支持调思考深度,Extended Thinking版可以。免费层有速率限制,实时对话按分钟计费在付费层。语音输入适合碎片时间,通勤开车都能用。
最后问一句:你会拿实时对话模型干什么?评论区聊聊,翻译还是陪聊。
(Gemini 3.8 Live功能与价格以Google官方为准)
更新时间:2026-09-28
本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828
© CopyRight All Rights Reserved.
Powered By 61893.com 闽ICP备11008920号
闽公网安备35020302035593号