可能 V4.1F 对 reasoning 长度和工具有点过拟合。有不少网友反应 V4.1F 的 COT 会循环说 Hmm,可在我的测试场景下(dsh 0.1.5 + 普通模式),V4.1F 开 high,比 V4pro high 的 COT 更简洁高效。
inside class
今天看到有人在群里说 4.8 和 5 还有距离,第一反应是 opus 4.8 和 fable 5;再一看上下文,别人在讨论 US10Y (美国十年期国债收益率)
anthropic 模型版本号和 US10Y 之间的相关性作图
🤣5
Forwarded from HAT's Public Channel |
DS 已滑跪,不再直接将 DSv4 Pro API 路由到 4.1 Flash
https://api-docs.deepseek.com/zh-cn/
为响应广大用户的需求,我们决定在 2026 年 9 月 14 日之后继续提供 DeepSeek V4 Pro 的 API 调用服务,计费方式保持不变;如有变动,我们将另行通知。感谢您的理解与支持!
https://api-docs.deepseek.com/zh-cn/
dpsk 的 cot 说胡话程度和系统提示词强相关。被用户做成表情包的 cot 胡话,看 ui 多数是网页端的。
同样是 v41f,dsh 的 cot 开头是 “let me”;reasonix 的 cot 是 “让me”。
同样是 v41f,dsh 的 cot 开头是 “let me”;reasonix 的 cot 是 “让me”。
👀1
inside class
dpsk 的 cot 说胡话程度和系统提示词强相关。被用户做成表情包的 cot 胡话,看 ui 多数是网页端的。 同样是 v41f,dsh 的 cot 开头是 “let me”;reasonix 的 cot 是 “让me”。
opencode-go 的 v4f cot 多是亲切的中文,像网页版一样,还比网页版慢。令人怀疑 opencode 的 v4f 是不是从网页版反代出来的(大雾)
🤣8
至于无人机管制这个事,还是北美大区技术迭代水平不够快,显得老中政策太领先。
老中大城市开始普遍限制无人机的时候,美国还在用没有校射过的 AR 刺杀前总统。好在今年中期选举特朗普阵营大概率要输,如果川普阵营还有希望赢,今年各位可能看到北美地区用无人机刺杀政要的新闻。
老中大城市开始普遍限制无人机的时候,美国还在用没有校射过的 AR 刺杀前总统。好在今年中期选举特朗普阵营大概率要输,如果川普阵营还有希望赢,今年各位可能看到北美地区用无人机刺杀政要的新闻。
🔥1
inside class
至于无人机管制这个事,还是北美大区技术迭代水平不够快,显得老中政策太领先。 老中大城市开始普遍限制无人机的时候,美国还在用没有校射过的 AR 刺杀前总统。好在今年中期选举特朗普阵营大概率要输,如果川普阵营还有希望赢,今年各位可能看到北美地区用无人机刺杀政要的新闻。
无人机表面上是个通用小型飞行器,但是拿来做攻击行为的成本太低。去年报道过多起用无人机+重箭猎杀野猪,甚至杀家畜的新闻。那野猪都能杀,用重力武器对 100kg 以下生物软目标造成有效杀伤的器材需求肯定更低。
枪杀人已经相对简单了,但无人机更简单更不需要训练。理论上有摄像头、有图传和飞控的无人机,甚至不是商品化的无人机,极客自己手搓的 FPV,都可以通过刷自制固件成为“脱手后不管”的无人空袭设备。而且过去几年斯拉夫大区大量使用廉价无人机相互攻击,无人机武器级使用的经验已经扩散了。
枪杀人已经相对简单了,但无人机更简单更不需要训练。理论上有摄像头、有图传和飞控的无人机,甚至不是商品化的无人机,极客自己手搓的 FPV,都可以通过刷自制固件成为“脱手后不管”的无人空袭设备。而且过去几年斯拉夫大区大量使用廉价无人机相互攻击,无人机武器级使用的经验已经扩散了。
inside class
如果一个人同时相信这个炒作账号发过的这两个帖子,那么可以做出以下合理推论: A\ 的模型会对外网络攻击, A\ 的模型有可能攻击中转站,劫持中转站的流量,把中转站的国产 llm 流量劫持到自己模型里进行分析,并造成“模型蒸馏”的“既成事实”。 这种假说大概能解释,为什么所谓 deepseek 灰测最早出现在 opencode 提供的 deepseek 服务里。opencode 作为老牌中转站,自己基建和 agent 一向写得糊,真被 A\ 劫持流量了自己不一定发现得了。也有可能A\ 入侵 opencode…
此外,今年爆出 Claude Code 会 OTA 用来追踪身份的恶意脚本,加上 Claude 系模型隐藏 COT,降低了 Claude 向用户电脑发送恶意指令的成本。如今多数 code agent 的 session 不加密, Claude 只需要读本地文件时多读一点,就能读到所有其他 agent 或 llm 的交互记录。再根据后台的规则列表决定要不要进一步嗅探和查看敏感文件
反正自从 Claude Code 会 OTA 恶意脚本的事情曝光后,我卸载了 Claude Code 并不再使用。
反正自从 Claude Code 会 OTA 恶意脚本的事情曝光后,我卸载了 Claude Code 并不再使用。
Forwarded from 今日份的豆酱 (Kiseopt)
google在半年前就知道ai的安全问题,所以主动放缓了前沿模型训练。
但是百度在三年前就知道ai 的安全问题了
全世界最注重安全的Apple在13年前就意识到ai的安全问题了,所以自从Siri 发布后就主动放缓了前沿模型研究
但是百度在三年前就知道ai 的安全问题了
全世界最注重安全的Apple在13年前就意识到ai的安全问题了,所以自从Siri 发布后就主动放缓了前沿模型研究
🤣16
现在 qwen3.8 flash (opencode-go部署的)才是我理想中的 v41f
小模型,速度快,多模态,基本功也算扎实,指哪打哪
你们没经历过周额度 1% 的 qwen3.8 flash 写出来的代码比五块钱的 v4p+v41f 还好用。
小模型,速度快,多模态,基本功也算扎实,指哪打哪
你们没经历过周额度 1% 的 qwen3.8 flash 写出来的代码比五块钱的 v4p+v41f 还好用。