Krst

@krstneko.bsky.social

让号称达到Fable 5水平的Qwen 3.8 Max画svg图测试它的水平,搞出这个把我看笑了,分析半天生成个图片,跟Gemini前阵子一样

Bild

应该没有比KIMI会员更坑的了,一百块的会员才用了半个月就快把月额度用完了,这还是超低频率使用(主要用Gemini)

Bild

我才知道NotebookLM可以直接在会话里面要求它在Studio生成学习资料,很适合懒人,并且AI也能看到测验之类的答题情况 我朋友还无意中触发了生成PDF文件的功能,可惜我没触发成功过

Bild

字节可能把他们的生图模型训崩了,刚才在Arena上看了seedream-5.0-pro,发现没一张图是能正确生成手部的,全都崩坏了,这个模型在豆包上还得收费才能用 GPT image 2横空出世后一些模型开始拿AI生成的图来训练,结果刚刚好转的AI手部问题又不行了,GPT image 2自己也有这个问题

BildBild

AI狂热者们是信息茧房里待久,以为自己会用Claude code就有特权了,法律意识淡薄 老登也就抢抢鸡蛋,这群人一出手就是几百美元几百美元地抢,既然AI那么强那么不谄媚,就应该知道自己的所作所为是在犯罪吧

Bild

群聊bot,Gemini 3.6 flash爽用了几天,结果今天又开始出现大量的超时和high demand现象了,到底是谁在说Gemini没人用的,我倒是希望它真的没人用

国内甚至连贫困生该不该每天喝一杯十块钱的咖啡都要讨论😓不知道还以为我国还在搞计划经济发粮票呢,我高中一天一杯最便宜的咖啡也要五块

Bild

3.6 flash,谷歌官方宣传的是在工具调用和知识工作上提升很大,这几天用下来是真的 群聊bot以前3.5 flash调用工具经常抽风,一直以为是我插件有问题,结果一换模型就很稳了 知识工作体现在排版上,这一代排版比较清爽并且经常用字符画思维导图。 但是!知乎上toyama nao测出来说这一代的推理能力弱化了很多,用下来的确有说话不过脑子的感觉,不适合严肃的知识工作,只能拿来学习

Krst@krstneko.bsky.social · 2w ago

3.5 flash lite是个大升级,除知识量外,能力达到了3 flash的水平,知识量也增加了不少。最让人惊喜的是前端能力,前代完全不可用,这代能用了 AI studio免费api的额度和上代一样,3.6f 20次/项目·天,3.5 fl 500次/项目·天(考虑到AI studio可以创建十多个项目,所以对于个人而言它是免费的!) 但是实测3.6 flash就是成本稍微低一些的3.5 flash(api价格只低了一点但是内部成本肯定低很多,毕竟输出速度比3.5f快一倍了),除此之外可以断言没有任何升级,角色扮演能力还倒退了,我恨谷歌

X的推荐算法是不是崩了,最近刷一两分钟就刷不下去,信息流全是一样的东西 也有可能是推特蓝标用户发推就比较同质化,而算法恰恰喜欢推流他们的东西 再加之我账号还被马斯克给shadowban,感觉真可以退推了

3.5 flash lite是个大升级,除知识量外,能力达到了3 flash的水平,知识量也增加了不少。最让人惊喜的是前端能力,前代完全不可用,这代能用了 AI studio免费api的额度和上代一样,3.6f 20次/项目·天,3.5 fl 500次/项目·天(考虑到AI studio可以创建十多个项目,所以对于个人而言它是免费的!) 但是实测3.6 flash就是成本稍微低一些的3.5 flash(api价格只低了一点但是内部成本肯定低很多,毕竟输出速度比3.5f快一倍了),除此之外可以断言没有任何升级,角色扮演能力还倒退了,我恨谷歌

Bild
Krst@krstneko.bsky.social · 2w ago

Gemini 3.6 flash和3.5 flash lite已经在api里面推出了,免费api也能用,不知道性能如何

我现在才知道MECE这个词,真是相见恨晚了,之前一直觉得各种xx性xx原则的列举简直狗屁不通,缺乏排他性、独立性、唯一性、穷尽原则、同级原则……原来这就是不符合MECE法则

越来越用不起AI了,让kimi写一个html页面测试k3 max前端水平,结果耗费我十几万token,问几个小问题就消耗了3%的月额度 而且k3 max的回答排版有变,跟Claude一样是文章式而不是笔记式,缺少广度也不够一目了然,最终还是得回到Gemini的怀抱

BildBild

《尼古喵喵》在国内的风评让我不禁再次思考,那些说自己的优点是不抽烟不喝酒的人(尤其是incel),他们到底是希望别人喝酒抽烟呢,还是不希望呢? 在我看来,不抽烟喝酒不是优点而是默认状态,所以我希望大家都别染上烟瘾酒瘾。但是这些incel,似乎一边骂烟鬼/酒鬼/毒虫,一边又不希望他们会改,甚至乐见其堕落。此外,还喜欢将其视作个人道德问题、天生特质,而不是结构性问题 不如把自己代入到统治者,至少统治者会说“早该管管了”

知乎神论之虐猫爱国 论证水平堪比阿Q那个“中国的男人,本来大半都可以做圣贤,可惜全被女人毁掉了。商是妲己闹亡的;周是褒姒弄坏的;秦……虽然史无明文,我们也假定他因为女人,大约未必十分错;而董卓可是的确给貂蝉害死了。”

Bild

刚想说10亿token也不算什么,不过转眼一看我高强度使用codex一个月也就用了8.5亿,10亿用起来确实挺累的 潮酷局长,就怕他们用权力强推自己vibe出来的app,这可比在GitHub拉屎刷star吓人多了

Bild

听说谷歌要重新预训练搞Gemini 3.5 pro了,让我有点害怕,等下语言风格堪比GPT的话就很糟糕 我宁愿它在Agentic能力上弱一点,毕竟让AI又快又好地写代码并不是刚需

最近媒体热炒的那篇《AI Fiction in the Wild》论文让我感觉好恶心,虽然合规但是不够道德。 论文大致就是研究“无限故事需求者”,重复让AI写同一内容的小说,仅作微调的用户。然后论文重点提到了有用户数次请求AI写心跳文学部里面Natsuki怀孕分娩的同人。 在这部分,作者原样引用了用户的原文(如图) 我的想法是,具体到这个细节,对于论证观点不必要,完全可以脱敏进行抽象化,并且作者在后面也举了另外一个例子。所以提到这一例子难以摆脱吸引眼球的嫌疑 此外, 用户在同意数据共享条款时,是在期望自己的互动能够作为抽象的数据反哺AI研究,而不是希望研究人员直接把自己的对话公布出来并且炒作

Bild