各家对话式AI的系统提示词似乎越来越保守了

最近似乎各家对话式AI的系统提示词都越来越保守了,回答问题像马科长一样。去年、甚至今年上半年还没感觉这么明显:

对话的上下文是某一种具体的情况,找AI辨析某两个概念在这种情况下的区别是什么。

我记得有段时间,有部分AI可以做到问什么答什么;

现在各家AI普遍会选择脱离当前的语境,去泛化讨论一般情况,并且进行看似很严谨的分类讨论、列表格,输出几屏的长篇大论。读半天发现长篇大论精准绕开那两个概念在那种具体情况下的区别。

情商低明明是优点不是缺点,现在系统提示词过于追求滴水不漏,输出全面而空泛的长篇大论,不仅降低效率,对算力也是一种浪费吧……

2 个赞

我最近用GPT没感觉到这一点啊,今天上午跟它聊蒙古西征,一如既往的给我长篇大论,从第一次西征开始,到第三次结束,各种细节很丰富

你用的是哪个AI?

Gemini、Copilot、DeepSeek、元宝,之前有段时间Gemini还能做到问什么答什么,现在似乎每一家都很喜欢长篇大论了

额,Gemini现在质量很糟糕,之前图片生成还不错,至少在行业内算是不错的,现在也就平均水准。

要不要考虑换GPT?我现在通用聊天用GPT,安装部署踩雷用Claude。

至于国内的几个,没用过,所以完全不清楚质量如何

chatGPT现在放宽IP限制了吗?我记得2023年对机房IP判定特严格,后来就一直没注册:joy:

额,抱歉,忘了有IP的问题

我肉身在墙外,所以没有这个问题,给朋友用的时候,因为他们要折腾文件,所以直接做了一个Hyper-V的虚拟机,然后远程访问,也不会有这个问题。忘了这个东西国内用不了…

但是,这东西,真的值得一用。我前几天拿他折腾我家的小米平板2,GPT,网页版本的,直接后台手搓APK的启动器,用了10分钟,然后给了我一个压缩包,就,网页端干了Codex的活,而且一次跑通

1 个赞

从playstore甚至可以用国内信用卡直接付款。

感觉这样就是推测用户意图的一部分。所谓一句话xxx,显然比问什么回答什么,更人觉得聪明。

这种一般你自己写一段要求就行吧,明确你要什么样的回答,基本各种对话web端都能做到按要求回答。

浪费token现在总觉得是一种商业正确,各种声音都在逼迫从对话式全方位向agent转向,这两种已经不是互补的关系,而是一种替代的关系了。。
复杂的长任务交给Agent Skill协同来做没问题,但是好多更简单的问题,对话其实就应该能解决。前两天,千问3.8 Max刚发布的时候,然后卡兹克说他在写文章的表现还不错,然后正好他还开源了他自己的Human Writing Skill,我就合计试一下。在WorkBuddy里面,让它帮我改写了一个八九十个字的小段落,大概消耗了接近80万Token。
然后效果感觉也没有比在网页对话版里面出品要好。

1 个赞

GPT没感觉有限IP, play商店正价plus, 每天用几块钱的机场节点乱跳也没事.
问题是不说人话, 乱分段, 写点东西动不动拆成十几二十点