V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  maolon  ›  全部回复第 1 页 / 共 24 页
回复总数  474
1  2  3  4  5  6  7  8  9  10 ... 24  
18 小时 7 分钟前
回复了 EyebrowsWhite 创建的主题 问与答 Jev 有没有已经上手用过的
@sampeng #19 llm 很多场景都是大炮打蚊子,特殊场景用特殊模型才是最优解。

我不爽 jev 就两点,一个是他的 api 居然收这么贵(作为这个特定的用途,特别是比较其他同类模型),二是他的隐私政策完全不透明,那么默认应该当成这次测试所有的请求他们都会拿来训练,就限制了很多用途我不想用他来做分类
18 小时 28 分钟前
回复了 EyebrowsWhite 创建的主题 问与答 Jev 有没有已经上手用过的
概念是花里胡哨的,因为实际用途就是一个意图分类模型(基于 bert ),也早就有人做过了,主要用于像是比如过信息过滤(垃圾邮件过滤),模型路由,安全过滤这些用 llm 太重太慢的场景。

除了楼上那些用小型 llm 去模拟他的效果,这个应该才是跟 jev 同源的最接近的模型( https://github.com/NandhaKishorM/laya ),作者提供了和 jev 的直接对比而且比 jev 还快(以及暗搓搓的暗示 jev 是抄他们的),非常适合本地部署。

但是话又说回来了,你的料再扎实也不如这个包装的好牛逼,这个 system one 营销是真的牛逼
是 gemini ,没想到吧
另外 gpt 6 astra 现在说话也还行,可能不符合你要求就是了
1 天前
回复了 kennylam777 创建的主题 Google Gemini Gemini 好像在上線新模型
reddit 上好像昨天就有人提到有些人的 3.8 flash 被路由到了其他模型上了
2 天前
回复了 river010 创建的主题 macOS 暂时碰到的 macOS27 的连锁“BUG”。
@lloyds #8 我也复现不了,可能触发条件比较刁钻
2 天前
回复了 river010 创建的主题 macOS 暂时碰到的 macOS27 的连锁“BUG”。
https://i.imgur.com/MRBOgh4.png 可能是中文的 bug ,英文没有复现
申请到了 还没测
扣语言细节我觉得没什么用了,你扣的再多能比 ai 写得好?
现在最多说项目一大 ai 因为 context 的原因会首尾不顾会逐渐偏移设计目标,但是具体到细节上我可以说 90%的人写的东西都不可能比他标准比他好,甚至如果你有特定的性能指标要求他也比你人手优化的更好。

我觉得以后最多有个什么新东西上去看一眼原理,理解一下能干啥,但是还要专门练习那是大可不必
5 天前
回复了 bouts0309 创建的主题 程序员 GLM Coding Plan 新老 Pro 的额度差有多少?
我那个老的 pro 账号好像只计费 5hr 限制,最多的一天用了 4.5 亿,也就是一周打满能 30 亿左右?
https://i.imgur.com/iBxGVtO.png
8 天前
回复了 msg7086 创建的主题 OpenAI 估算了一下 Pro 20X 的周限额度
@chjqpmain #13 这个我个人的看法是 如果你的任务能依靠他的智力明显缩减 turns 那就上 xhigh 甚至 max ,如果你的任务是那种能力不怎么影响 turns 长短的那就上 low 或者 medium ,

turns 之所以是主要因素,是因为 astra 的读特别贵
@kloudmuka #9 是的,都是完全机翻,夹具就是 fixture 😂
deepseek 何止不说人话,claude 现在的说话方式叫 claudish ,deepseek 应该改个名叫 dsish 。
蒸馏蒸傻了,说话比机翻还机翻
https://i.imgur.com/frjyOId.png
8 天前
回复了 msg7086 创建的主题 OpenAI 估算了一下 Pro 20X 的周限额度
@msg7086 #2 因为他读的价格是一致的,agent 工作不可能不读东西,然后 max 和 xhigh 完成工作的 turns 要明显少于 medium 和 low ,多的那点 thinking tokens 被多的 turns 给抵消了。
8 天前
回复了 msg7086 创建的主题 OpenAI 估算了一下 Pro 20X 的周限额度
pro 20x 确实是 2000+左右,所以之前就一直有人在说 astra 的订阅是在 api 价格上再 x1.8~x2 了。

另外最近还有一个反直觉的讨论就是 astra 开 xhigh-max 反而比 medium 和 light(low)省钱
他默认 258k 就是卡在分段收费之前,不然你订阅用量爆炸,本身模型支持 1M 上下文。

至于楼上说不计双倍 openai 那边只在 enterprise 计划下写不计双倍,如果有勇士想试可以试下
glm 5.3 (非 flash)和 kimi k3 max 就这两,适合写码的只有 glm 5.3 / flash ,还有新的 ds v4.1 (还在灰度)可以关注一下,
另外国产模型没有 sol 和 opus5 这一个等级的,kimi 只是接近 sol
13 天前
回复了 zhangli2946 创建的主题 程序员 面对越来越贵的 token 我们能做什么
并不贵,不如说如果按同智能算还便宜不知多少了,去年的旗舰模型的编程能力今年一个 27b 的模型就能复刻,而 27b 的模型在各大 provider 这里基本都是 free 这一档的

而且尖端智能的价格前面也有人回过了,o1 和 4.5 的价格还摆在那呢
1  2  3  4  5  6  7  8  9  10 ... 24  
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   958 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 0ea82b4c · 34ms · UTC 22:05 · PVG 06:05 · LAX 15:05 · JFK 18:05
♥ Do have faith in what you're doing.