作者asahi98 (あさひ)
看板MobileComm
标题[问题] Gemini烂到不行Siri底层是它,结果一样吗
时间Sun Sep 20 00:03:48 2026
https://i.imgur.com/m5h8hIL.png
看了油土伯频道影片
推荐商品还都有写在说明栏,附上连结
想知道台湾有没有卖,Gemini一直鬼打墙
叫我去门市买就会有,我跟他说要确定
有线上商场的话先帮我优先搜寻看看
台湾门市没有我再订国外的
後来就跳出附近的门市地点,说该商品热销
去现场如何询问店员,就会找到了
同样事情我也问了GPT,GPT还没办法读取油土伯的影片
我只是把商品的名称跟图片给他,就全部帮我找好
还说哪里有,跟国外现场差价多少
出国的话优先怎麽带回来,哪些不建议
问完後我请他帮我列一下优先顺序
GPT举一反三,直接把行程规画好,哪边门市才有的怎麽移动
最後连MAP都标示出来,落差好大
GPT我只给文字还有图片,包含影片连结,GPT没办法读影片
Gemini我叫他搜寻说明栏它也一样回应,读影片它说只读到内部的音乐
图像内容它办法读取,说明栏我直接指责他,都已经叫读取说明栏了
还说没有,最後我直接复制说明栏给他才说有
太差了,年底打算退掉,那空间5TB没在使用
网路放出Gemini 4 跑分多强讯息,去查根本没看到权威网站有数据
以後每年这样搞,每年只强一季,软三季,那就不用续订了
--
https://i.imgur.com/Kc4llBM.jpeg
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 203.222.16.55 (台湾)
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/MobileComm/M.1789833831.A.0BD.html
1F:→ Crios : 可能吃到Siri的口水吧 09/20 00:28
2F:推 a3619453 : Gemini要用3.8flash,现在3.1pro过时又烂很久了 09/20 01:21
3F:推 ouyang2009 : 跟你的使用体验一样。早期Gemini表现还可以,後来 09/20 01:28
4F:→ ouyang2009 : 它采用降价策略收割了许多GPT的用户,可能算力设备 09/20 01:28
5F:→ ouyang2009 : 没跟上脚步提升,鬼打墙或随意敷衍的错误答案就越 09/20 01:28
6F:→ ouyang2009 : 来越多了 09/20 01:28
7F:→ NassirLittle: 3.8flash日常还行 09/20 02:32
8F:嘘 adios881 : 他们就策略压在免费flash啊 09/20 05:20
9F:→ adios881 : 我是觉得蛮杰出的一手 09/20 05:20
10F:→ adios881 : 目标放在海捞大众跟以前gmail一样 09/20 05:20
11F:→ adios881 : 不去跟人拼三角顶的专业模型 09/20 05:20
12F:→ adios881 : 结果就是pro输爆但是flash38当今免费最强 09/20 05:20
13F:→ LoveSports : 这个案例是Gemini能读音讯所以才翻车吧,GPT没办法 09/20 06:41
14F:→ LoveSports : 读音讯直接抓网页文字才答对。不用这麽气。 09/20 06:41
15F:→ LoveSports : 这样你就知道下次给YT的时候有音乐会阻碍,指示词直 09/20 06:41
16F:→ LoveSports : 接要求读网页文字就好了。 09/20 06:41
17F:→ LoveSports : 刚好从股板逛过来发现你在这边也写一篇,所以就直接 09/20 06:41
18F:→ LoveSports : 复制贴上了XD 09/20 06:42
19F:→ LoveSports : 我看懂原PO生气的点了,如果一开始就说抓不到,原PO 09/20 07:40
20F:→ LoveSports : 可以改要求抓网页文字,可是因为没讲变成浪费时间卢 09/20 07:40
21F:→ LoveSports : 原PO拍拍 09/20 07:40
22F:推 john0628 : 我光是用他搜寻国外官网比价,chatgpt价格退税都正确 09/20 09:03
23F:→ john0628 : 用g是一堆错误价格更正也没用XD 对了一项另一个又错 09/20 09:04
24F:推 visa829 : 用gemini做事,花在校验正确性跟修正gemini的蠢问 09/20 09:17
25F:→ visa829 : 题就饱了 09/20 09:17
26F:推 JSLee914 : 我用3.8 flash的模型还是一样弱智,查个一般资料还 09/20 09:54
27F:→ JSLee914 : 是只会说,我只是个语言模型,帮不到你 09/20 09:54
28F:→ NoneWolf : 苹果动画做漂亮一点就没问题了 09/20 10:16
29F:→ asahi98 : 3.8试过没办法读取YT影片内容长推理还是要Pro 09/20 10:37
30F:→ asahi98 : 3.8用了给出来的答案跟26楼一样,要改Pro才能推理 09/20 10:38
32F:→ whatthe8078 : /87b9WKWA.jpg 09/20 11:02
34F:→ asahi98 : 试着让3.8长推理就知道了 09/20 11:21
36F:→ shengshampoo: 3.8 flash 支援多模态,也支援YouTube输入, 09/20 11:37
37F:→ shengshampoo: 纯粹只是用户到底知道怎麽用,API 乡民版友会用吗 09/20 11:37
38F:→ shengshampoo: ? 09/20 11:37
39F:→ shengshampoo: 还是到现在还只是网页聊天而已?AI agent 问乡民版 09/20 11:39
40F:→ shengshampoo: 友是什麽? 09/20 11:39
41F:→ shengshampoo: 能拿来网路安全攻防的工具,被乡民版友吐嘲,只能 09/20 11:40
42F:→ shengshampoo: 说乡民版友好棒棒。 09/20 11:40
43F:→ shengshampoo: 乡民版友的AI技能,就是问问魔镜,世界最漂漂的人 09/20 11:55
44F:→ shengshampoo: 是不是我?问问AI,今天早晨起来要吃什麽? 09/20 11:55
46F:→ asahi98 : 上面3.8 延伸推理,下面改3.1Pro延伸推理就出来了 09/20 11:56
47F:→ asahi98 : 还是说用简体回应的模组是以为我是中国用户想蒸馏, 09/20 11:57
48F:→ asahi98 : 故意这样回答我。这也是有可能 09/20 11:57
49F:→ asahi98 : 我是现在这边写遇到的状况,後来看到股版说Gemini骇 09/20 12:06
50F:→ asahi98 : 入什麽,我想那个Gemini一定不是我用的Gemini 09/20 12:06
51F:→ asahi98 : *先在 09/20 12:11
52F:→ shengshampoo: 所以说,用API取得AI模型回覆,对楼上大大有难度? 09/20 12:19
54F:→ shengshampoo: 乡民版友大大,好歹翻翻官方文档吧,至少有中文可 09/20 12:26
55F:→ shengshampoo: 看。 09/20 12:26
56F:→ shengshampoo: 不是AI模型不行,而是乡民版友到底知道怎麽用? 09/20 12:27
57F:→ shengshampoo: 板上说一下乡民版友,他们不悦,放话要APP拉黑,吓 09/20 12:28
58F:→ shengshampoo: 鼠你,怕了吗?能说什麽。 09/20 12:28
确实,要去弄这些花时间就可以改善,尤其是PTT的乡民
但也不能把世界上使用者都当成会这种方式的乡民
Gemini的消费者要全部假设都会这一层吗?
我刚刚认真测试过了,不是没能力读取。是它看起来是故意要省算力感觉
59F:→ eyecolor : Siri底层不是Gemini 09/20 13:40
60F:→ eyecolor : Siri AI是苹果亲自训练的,运算力借用Google 09/20 13:41
61F:推 karst10607 : 修扣和分析还是一堆幻觉,别家的分析都正确就他一 09/20 14:23
62F:→ karst10607 : 直幻觉可以那样做或这样改,真的做下去烂摊子收不 09/20 14:23
63F:→ karst10607 : 完 09/20 14:23
64F:推 venatici : 苹果根本没自己建模型,是拿gemini模型来调整。 09/20 14:36
65F:→ VOCALOID2609: 的确是烂不用找什麽藉口,处理能力输给ChatGPT Cl 09/20 15:23
66F:→ VOCALOID2609: aude 就算了,连查资料的准确性都输GROK,唯一能说 09/20 15:23
67F:→ VOCALOID2609: 嘴的就是多模态里Gemini 的知识最多,问一些很冷门 09/20 15:23
68F:→ VOCALOID2609: 的问题时它反而能回答,但是不用多模态甚至打不过 09/20 15:23
69F:→ VOCALOID2609: 开源大模型,还好我只是去年价格战的时候买一年, 09/20 15:23
70F:→ VOCALOID2609: 等过期就蛋雕,再不进步就乖乖当AI检索总结模型就 09/20 15:23
71F:→ VOCALOID2609: 好,这部分满不错的 09/20 15:23
72F:→ square4 : 合作的部分可能只有蒸馏模型,不含真正有价值的编 09/20 15:39
74F:→ gottsucher : gemini就一直蒸馏自己 然後偷算力 直接半残 09/20 16:35
75F:推 LoveSports : 那个YT网页说明栏有类似电话号码的数列吗? 09/20 16:48
76F:→ LoveSports : 防诈骗有时候一刀切,安全层可能会不让Gemini读取 09/20 16:49
77F:推 harry155007 : 以前没这麽蠢,感觉被限制了 09/20 16:58
78F:推 junorn : 我的API用途是短句翻译,就翻译来说理解能力从一开 09/20 17:45
79F:→ junorn : 使有点强到後面有时会完全翻译成另外的意思,还蛮明 09/20 17:46
80F:→ junorn : 显得退化,现在都不知道要怎麽调整才比较好了,但也 09/20 17:46
81F:→ junorn : 没办法更换因为他的TTFT在目前来说还是比较好的,这 09/20 17:47
82F:→ junorn : 个我蛮需要的所以没办法... 09/20 17:47
API要特地指定很多有的没的,很花时间
每个消费者都要这样去做,这产品就不适合普罗大众使用
我刚刚测试影像读取能力
※ 编辑: asahi98 (203.222.16.55 台湾), 09/20/2026 20:11:19
挑选四个说明栏没有特别说明文字内容
其中两个是新闻,新闻一个有字幕,一个没有
新闻都是在五小时内上传的
另外两个是油土伯
都是在四天内上传的影片,皆有字幕
但说明栏没有东西,字幕跟语音我检查过
没有说明我要求辨识的物体跟颜色
明显就是算力不足或节省状态挡掉又或解省状态省掉一些步骤
导致输出有问题,答案有出错,判断失误甚至跟你说它没办法辨识
测试3.8延伸跟3.1延伸两个模型
测试後把所有结果都给GPT判断
结论也让GPT给了,我就不多说了
※ 编辑: asahi98 (203.222.16.55 台湾), 09/20/2026 20:30:08
85F:推 Litfal : 你用Pro?3.1 prp不如3.8 flash阿 09/21 01:32
86F:推 Litfal : 不过你跟GPT比的确较差 但3.8 flash便宜量大 你用 09/21 01:37
87F:→ Litfal : 量都用不完的话的确GPT更好 09/21 01:37
88F:嘘 akimu : 又一个不懂的人 用起来名不差 09/21 02:45
89F:嘘 basacola : 一堆人分不清楚开发用的Gemini跟网页聊天用的Gemin 09/21 06:33
90F:→ basacola : i是两个不同应用...... 09/21 06:34
92F:→ JH10 : apple哪可能用安卓产品,apple商品全是自己研发的 09/21 07:57
93F:→ JH10 : 好吗?连晶片记忆体都是自己的怎麽可能跟别人一样 09/21 07:57
94F:→ asahi98 : Antigravity Gemini 3.8 Flash High有测试,3.1 Pro 09/21 08:04
95F:→ asahi98 : 只有Low可以选。就没测了,不过应该要测3.8看看,AP 09/21 08:04
96F:→ asahi98 : I模式下会遇到503没有呼叫程式 09/21 08:04
97F:推 SHR4587 : 个人体验就AI查资料来说,Gemini的能力算是比较强 09/21 08:13
98F:→ SHR4587 : 的了 09/21 08:13
99F:推 a3619453 : 虽然有点大材小用,蛋gpt开work用astra,那各项能力 09/21 09:38
100F:→ a3619453 : 真的是飞天 09/21 09:38
101F:推 griffiths : Gemini 用起来很像增强版的Google Search,感觉 没 09/21 10:16
102F:→ griffiths : 有很聪明 09/21 10:16
103F:→ demintree : notebookLM可以读影片啊... 09/21 11:57
104F:推 TWkiller : 处理地理的时候我也是用gemini,又不是每件事都要当c 09/21 20:38
105F:推 horb : Gemini真的烂。新版本变笨。如果是短时间就算了。已 09/21 21:38
106F:→ horb : 经好几个月都笨笨的。对了。我有付费 09/21 21:38
在这边最後总结一下测试重点:
Gemini 3.8 模型能力没问题,差异主要出在各产品怎麽把影片喂给模型。
Gemini API/AI Studio:可以原生把 YouTube 当 Video Input。
Antigravity:目前不会把 URL 原生送进 Video Input。
但 Antigravity Agent 可以自己补出 yt-dlp → ffmpeg → Vision 工作流。
Antigravity 这条路径根本绕过了「原生 YouTube video input」
无法判断是不是算力不足或其他网路问题造成的壅塞
但可以知道网路方式直接读取都有机会遇到卡住乱给答案或回答办不到
API的方式好点知道是什麽原因,给503 high demand的答案
※ 编辑: asahi98 (203.222.16.55 台湾), 09/22/2026 15:47:34
108F:→ Merrill : gemini这几版刚更新都有一样问题 说不能做是被审查 09/22 21:14
109F:→ Merrill : 挡 确定是不应该触发的东西就按重试->不要个人化通 09/22 21:14