inside class
1.29K subscribers
4.53K photos
232 videos
124 files
3.61K links
大号云同步剪贴本,有趣的文章和书籍都会摘抄。提醒自己给词条打上tag
Download Telegram
感觉自己的可支配时间被 token 质量定价了
Forwarded from MD Link Bot
リフ@μ'sic forever:
イキヅライブにチュン先生(32)…!!!!

https://x.com/rifu58/status/2100817561290186951
月初:不是 kimi-k3 我不用
月中:deepseek-v4.1-flash 栓好了也不是不能用
月末:workbuddy2api 怎么装
🤣5
😁8
inside class
现在 qwen3.8 flash (opencode-go部署的)才是我理想中的 v41f 小模型,速度快,多模态,基本功也算扎实,指哪打哪 你们没经历过周额度 1% 的 qwen3.8 flash 写出来的代码比五块钱的 v4p+v41f 还好用。
现在 dsh+v41f 的使用体验真不行,感觉 dsh 的提示词有问题,跑长程任务容易跑偏;而且自己的目标管理也有问题,经常一断网就不再显示断网前的分步目标了;另外 dsh 有一阵子太容易断网,很影响使用体验。

v41f 的指令跟随能力也有问题,每次我在 omp 里和它对话,一定要在说完我想表达的内容后,写上更多的约束条件。如果向它提问,一定要在提问完补上一句“我们先讨论问题,你不要做任何代码的执行和修改。”如果让它执行,一定要说明它一定不要去做什么,一定要不管哪些问题。

还有,v41f 容易记住自己最初 400k 上下文中出现的问题(负面场景),这些问题经过几轮上下文压缩都忘不掉,吃掉你几 B token 后还会像幽灵一样向你提起;但是对于它在任务中间发现的结论(积极场景),它经过几轮长上下文就忘了,需要我不停提醒它。
👍4
Forwarded from Bilibili Feed Bot
Media is too big
VIEW IN TELEGRAM
【崩铁】花3000块让最强AI打深渊!能满星吗?星启模式贪饕和博识尊的战斗!立界开篇/水温/平民/低金/全程自动/虫王/呼雷/知更鸟/虚构叙事/智识/欢愉
虽然订阅的套餐,实际支出没有400+刀,但也花了很多 T T
大出血了!你的每一个投币都能帮浪浪回血,爱你!

喜欢还望点个【关注】,谢谢啦!这对我很有帮助!
@浪浪团长:
发布视频
播放量:4.64万 弹幕:286 评论:415
点赞:2409 投币:805 收藏:523 转发:867
发布日期:2026-09-19 05:54:36

🔝> :
大出血了![惊喜]
你的每一个投币都能帮浪浪回血,爱你![给心心][给心心][给心心]
inside class
今年下半年,300B 尺寸的国模及其工具链,批发多模态批发 CUA。到时候二游 skill 到处批发,连看号、养成建议、代肝代练的生意都要完蛋。
二游将很快实现,一个有足够比例的消费者成为有限理性人的市场,因为不理性的在人人有 AI 用的环境下迟早会透支付费意愿,从而退出市场。

你数值策划再挖空心思,游戏发版端上来,Astra 跑几轮就把各项数值收益、装备、配队都算出来了。能让长期付费用户小头战胜大头的成本只有钱(这句话怎么听怎么像是正确的废话),但是真的有钱的用户每月买 token plan 顺便算一算抽卡建议、养成方案,也花不了多少边际成本。

#脑洞
😁5
Forwarded from 气得跳jio
你别管对不对,你就说缓存命中率高不高吧
inside class
现在 qwen3.8 flash (opencode-go部署的)才是我理想中的 v41f 小模型,速度快,多模态,基本功也算扎实,指哪打哪 你们没经历过周额度 1% 的 qwen3.8 flash 写出来的代码比五块钱的 v4p+v41f 还好用。
隔壁频道(https://t.me/hatschannel )频道主推荐的逆向工具 Ghidra 挺有用的,节省了很多前期准备工作。

就是小肥鱼天天吃 token 拖后腿,时不时吐点 GPT 味的支离破碎的思考和发言。我得不停拿以前逆向得到的结论去纠正小肥鱼的错误。
👍3
Forwarded from Bilibili Feed Bot
This media is not supported in your browser
VIEW IN TELEGRAM
救命!大肥鱼在长任务里越来越笨 DeepSeek v4.1+DeepSeek harness
我让 DeepSeek v4.1 做长任务,刚开始很好用,战线一拉长,它就开始忘掉前面定下的约束,重提几个小时前已经否掉的方案,反复犯已经纠正过的错误。
@兴趣使然的哲学爱好者:
发布视频
播放量:330 弹幕:1 评论:7
点赞:9 投币:1 收藏:4 转发:2
发布日期:2026-09-20 12:00:00
上传日期:2026-09-19 19:21:00

🔝> :
每天都在与大肥鱼斗智斗勇
inside class
救命!大肥鱼在长任务里越来越笨 DeepSeek v4.1+DeepSeek harness 我让 DeepSeek v4.1 做长任务,刚开始很好用,战线一拉长,它就开始忘掉前面定下的约束,重提几个小时前已经否掉的方案,反复犯已经纠正过的错误。 @兴趣使然的哲学爱好者: 发布视频 播放量:330 弹幕:1 评论:7 点赞:9 投币:1 收藏:4 转发:2 发布日期:2026-09-20 12:00:00 上传日期:2026-09-19 19:21:00 🔝> : 每天都在与大肥鱼斗智斗勇
省流:v41f 目前在 dsh 里的上下文压缩机制有问题:
1. 技术上需要压缩上文的 ctx 长度(792k)小于标称长度(839k,1048k 的 80%);如果超过 792k 再压缩上下文,那么下一次输出有可能直接溢出 1M 的上下文窗口,导致上下文丢失。
2. 低估了中文 token 的消耗,界面显示 1 的 token 消耗,实际上平均消耗了 1.34 的 token,极端情况下消耗了 1.57 的 token。
上述两个机制导致 v41f + dsh 容易遗忘已知结论,上下文压缩时没有记录前一轮的结论和要素。
作者的对策是:超过 300k ctx 就开始准备交接文档,一旦出现模型围绕旧问题打转就开新会话。

该作者的结论和我的实际使用体验基本一致。
This media is not supported in your browser
VIEW IN TELEGRAM
inside class
😚 Sticker
这张表情包怎么还更新了
(加了一行小字)
🤣6
笔记本现在这个价格真是活全家了

前几个月知乎B站还拿“笔电男大”踩头,现在都没声音了,当年男大买的笔电都升值快一倍了。
😇8
苍穹の下 @blueskyxnblog· SKY的🤡💦日常😅😅😅
Photo
大模型汪峰又要发布新东西了。 qwen 就是模型迭代循环的那个指针。
这位网友自称已经加码到 7 张 pro 20x,
俺寻思这科研是非做不可吗?