连算卦这种传了上千年的老行当,AI也进来插了一脚。
有人搞了个Claude Code的插件叫bazi-skill,上手基本不用动脑子,打个算八字”仨字就启动。
AI问完出生年月和时辰,自动把四柱排好、五行断清、格局看透,末了还递给你一份事业感情健康的详细分析。
不是乱编,是正儿八经把命理体系灌进去了。
装起来也很顺手,clone到skills文件夹完事。
🔗 https://github.com/jinchenma94/bazi-skill
有人搞了个Claude Code的插件叫bazi-skill,上手基本不用动脑子,打个算八字”仨字就启动。
AI问完出生年月和时辰,自动把四柱排好、五行断清、格局看透,末了还递给你一份事业感情健康的详细分析。
不是乱编,是正儿八经把命理体系灌进去了。
装起来也很顺手,clone到skills文件夹完事。
🔗 https://github.com/jinchenma94/bazi-skill
听英语材料总觉得长播客太费劲?
BBC Learning English 的 Classic Stories 栏目挺适合过渡。
它把《1984》《小妇人》《双城记》《罗密欧与朱丽叶》这类文学经典压缩成短篇音频故事,顺带拆解高频词和不同用法。
每集不长,读速也克制,既能过故事瘾,又能顺手补补听力、词汇和语感,对初中级水平的人特别友好。
🔗 https://bbc.co.uk/programmes/p02pc9s1/episodes/player?page=1
BBC Learning English 的 Classic Stories 栏目挺适合过渡。
它把《1984》《小妇人》《双城记》《罗密欧与朱丽叶》这类文学经典压缩成短篇音频故事,顺带拆解高频词和不同用法。
每集不长,读速也克制,既能过故事瘾,又能顺手补补听力、词汇和语感,对初中级水平的人特别友好。
🔗 https://bbc.co.uk/programmes/p02pc9s1/episodes/player?page=1
语音克隆这东西又往前拱了一大截。
LuxTTS这个轻量级TTS模型上手试完,
快:单卡干到150倍实时,CPU都比真人说话还利索
清:原生48khz高保真输出,好多模型还卡在24khz磨蹭
省:1GB显存就管够,你那块老卡也能跟着焕发第二春
克隆出来的效果还敢正面跟比它大10倍的模型掰手腕,
关键是本地就能跑
🔗 https://github.com/ysharma3501/LuxTTS
LuxTTS这个轻量级TTS模型上手试完,
快:单卡干到150倍实时,CPU都比真人说话还利索
清:原生48khz高保真输出,好多模型还卡在24khz磨蹭
省:1GB显存就管够,你那块老卡也能跟着焕发第二春
克隆出来的效果还敢正面跟比它大10倍的模型掰手腕,
关键是本地就能跑
🔗 https://github.com/ysharma3501/LuxTTS
以前做个短视频得写脚本、找素材、配音、加字幕,折腾一下午。现在扔个关键词进去,全程自动跑完。
MoneyPrinterTurbo这个开源项目,输入主题就直接给你生成一条完整的高清视频。
脚本自动写,素材智能匹配,字幕和配音自动合成,背景音乐也顺手加上。
Web界面、API调用、命令行都能用,Docker一键部署省了不少事。
GitHub上已经堆了11万多Star,热度确实猛。
🔗https://github.com/harry0703/MoneyPrinterTurbo
MoneyPrinterTurbo这个开源项目,输入主题就直接给你生成一条完整的高清视频。
脚本自动写,素材智能匹配,字幕和配音自动合成,背景音乐也顺手加上。
Web界面、API调用、命令行都能用,Docker一键部署省了不少事。
GitHub上已经堆了11万多Star,热度确实猛。
🔗https://github.com/harry0703/MoneyPrinterTurbo
This media is not supported in your browser
VIEW IN TELEGRAM
DeepSeek Harness 最近爆火,但很多人卡在第一步:环境配置、命令行、依赖安装。
这个开源项目直接把 DeepSeek Harness 做成了桌面 App。
不用折腾 Node、终端,直接进入本地 AI Agent 工作台。
支持 Sessions、项目管理、文件处理、Web Research、插件系统、Office 自动化等能力,全部整合在一个界面里。
这个开源项目直接把 DeepSeek Harness 做成了桌面 App。
不用折腾 Node、终端,直接进入本地 AI Agent 工作台。
支持 Sessions、项目管理、文件处理、Web Research、插件系统、Office 自动化等能力,全部整合在一个界面里。
This media is not supported in your browser
VIEW IN TELEGRAM
这个开源 Skill 有点意思,直接把 AI 生成的视频,变成能被网页操控的交互动画。
页面滚动,产品自动拆解,鼠标移动,角色跟着转头,拖动进度,动画还能前进、后退、停在任意位置。
Oil Motion 会让 Agent 自动完成关键画面设计、连续动作生成、逐帧清洗、资源压缩,以及 WebP 图集 / MP4 + WebGL 的前端接入。
你只需要给素材、想表达什么,以及动画跟随什么操作。
很适合产品官网、角色互动、功能演示。
页面滚动,产品自动拆解,鼠标移动,角色跟着转头,拖动进度,动画还能前进、后退、停在任意位置。
Oil Motion 会让 Agent 自动完成关键画面设计、连续动作生成、逐帧清洗、资源压缩,以及 WebP 图集 / MP4 + WebGL 的前端接入。
你只需要给素材、想表达什么,以及动画跟随什么操作。
很适合产品官网、角色互动、功能演示。
This media is not supported in your browser
VIEW IN TELEGRAM
发现一个能直接省掉每天2小时重复劳动的东西。
文档提取、信息结构化这块,之前靠正则、靠手写NER、靠天价API、靠人工熬夜抄数据,现在基本可以宣布进入倒计时了。
Google 刚开源了 LangExtract。
一句话讲清楚它能干嘛:把任何乱七八糟的长文本(合同、报告、论文、会议纪要,哪怕上百页),直接变成干净、结构化、还能回溯原文的数据。而且不是那种“大概提取一下就行”的半成品。
它会把每一条结果精确映射回原文的具体位置,生成一个可交互的HTML页面,点进去就能核对。做合规、做审计、做知识库的人,看到这个功能基本会直接尖叫。
支持 Gemini、Ollama、本地模型,想省钱就本地跑,想效果好就上云。
安装极其简单:pip install langextract,几分钟就能跑起来。以前那些脆弱的正则表达式、自己维护的NER管道、一年几十万的提取服务,现在看着都有点滑稽了。
免费、开源、真能干活。
文档提取、信息结构化这块,之前靠正则、靠手写NER、靠天价API、靠人工熬夜抄数据,现在基本可以宣布进入倒计时了。
Google 刚开源了 LangExtract。
一句话讲清楚它能干嘛:把任何乱七八糟的长文本(合同、报告、论文、会议纪要,哪怕上百页),直接变成干净、结构化、还能回溯原文的数据。而且不是那种“大概提取一下就行”的半成品。
它会把每一条结果精确映射回原文的具体位置,生成一个可交互的HTML页面,点进去就能核对。做合规、做审计、做知识库的人,看到这个功能基本会直接尖叫。
支持 Gemini、Ollama、本地模型,想省钱就本地跑,想效果好就上云。
安装极其简单:pip install langextract,几分钟就能跑起来。以前那些脆弱的正则表达式、自己维护的NER管道、一年几十万的提取服务,现在看着都有点滑稽了。
免费、开源、真能干活。
This media is not supported in your browser
VIEW IN TELEGRAM
InkOS直接把AI从聊天写小说升级成真正的创作Agent。
统一Pi Agent内核,长篇短篇剧本互动影游翻译全搞定,角色伏笔状态全管住,再也不怕写崩。
不再只生成文字,而是全流程托管:世界观、角色、记忆、审稿、修订、封面、互动剧情、多语言,全塞进一个工作台。
Skill还能继续扩展。
统一Pi Agent内核,长篇短篇剧本互动影游翻译全搞定,角色伏笔状态全管住,再也不怕写崩。
不再只生成文字,而是全流程托管:世界观、角色、记忆、审稿、修订、封面、互动剧情、多语言,全塞进一个工作台。
Skill还能继续扩展。
This media is not supported in your browser
VIEW IN TELEGRAM
用 Codex 搓了一个会呼吸的 3D「天空之城」。
从一张插画开始,一点点把城堡、浮岛、房间、人物和光影做成可交互的 3D 场景。
现在里面已经有人走动、聊天、看书、晒太阳,云和旗帜也会慢慢飘。
从一张插画开始,一点点把城堡、浮岛、房间、人物和光影做成可交互的 3D 场景。
现在里面已经有人走动、聊天、看书、晒太阳,云和旗帜也会慢慢飘。
Media is too big
VIEW IN TELEGRAM
MotionSites,把顶级网页美学做成了 Prompt。
里面收录了 500+ 高质量网页设计 Prompt,涵盖 Landing Page、SaaS、3D、作品集、动效等。
看到喜欢的效果,直接复制 Prompt 丢给 Claude、Cursor、Codex,就能开始做。
还支持 MCP,把整套设计灵感直接接进 AI 编程工具。
做 Vibe Coding,代码已经不是问题,现在连审美都有人帮你打包好了。
里面收录了 500+ 高质量网页设计 Prompt,涵盖 Landing Page、SaaS、3D、作品集、动效等。
看到喜欢的效果,直接复制 Prompt 丢给 Claude、Cursor、Codex,就能开始做。
还支持 MCP,把整套设计灵感直接接进 AI 编程工具。
做 Vibe Coding,代码已经不是问题,现在连审美都有人帮你打包好了。
Media is too big
VIEW IN TELEGRAM
花了差不多一天时间,用 Codex + Three.js 把一张中国古代闹市图,做成了能直接逛的 3D 场景。
现在已经有河道、拱桥、古建筑、摊位、船只、NPC,主角也能自动寻路、避让行人、从桥头正常过桥,基本把走完整个闹市跑通了。
目前还得继续磨:人物动作有点僵,偶尔会穿栏杆,NPC 和摊位细节也不够,担子、货物、店铺陈设都还很粗。
现在已经有河道、拱桥、古建筑、摊位、船只、NPC,主角也能自动寻路、避让行人、从桥头正常过桥,基本把走完整个闹市跑通了。
目前还得继续磨:人物动作有点僵,偶尔会穿栏杆,NPC 和摊位细节也不够,担子、货物、店铺陈设都还很粗。
Media is too big
VIEW IN TELEGRAM
Bruno Simon 用 Three.js 做的个人站,简直是 3D 神级作品!
直接开一辆小车在 3D 世界里乱撞、探索、解锁成就、找隐藏彩蛋……
完全把作品集做成了一款超有趣的小游戏。
Three.js + WebGPU 拉满,手感、细节、性能都绝了。
而且作品已开源,非常值得 3D 玩家 star 学习!
直接开一辆小车在 3D 世界里乱撞、探索、解锁成就、找隐藏彩蛋……
完全把作品集做成了一款超有趣的小游戏。
Three.js + WebGPU 拉满,手感、细节、性能都绝了。
而且作品已开源,非常值得 3D 玩家 star 学习!
This media is not supported in your browser
VIEW IN TELEGRAM
发现个超香的开源GIS神器!
GeoLibre:轻量云原生GIS平台,
浏览器、桌面、手机、Jupyter全通吃。数据全程本地跑,隐私拉满。
更猛的是:
1000+地理处理工具用WebAssembly浏览器里跑,
地形、水文、LiDAR、遥感全包,零安装、零服务器、数据不外传。
可视化探索分析一把梭,MapLibre+DuckDB加持,顺手还能玩月球火星地图。
免费开源,真香警告~
GeoLibre:轻量云原生GIS平台,
浏览器、桌面、手机、Jupyter全通吃。数据全程本地跑,隐私拉满。
更猛的是:
1000+地理处理工具用WebAssembly浏览器里跑,
地形、水文、LiDAR、遥感全包,零安装、零服务器、数据不外传。
可视化探索分析一把梭,MapLibre+DuckDB加持,顺手还能玩月球火星地图。
免费开源,真香警告~
This media is not supported in your browser
VIEW IN TELEGRAM
卧槽,看到一款视频出海的神器。
就是这款KrillinAI,免费的视频翻译+字幕+配音+声音克隆一体方案。
不用在剪映手动调半天,
用懒人最喜欢的就是丢链接或本地视频
Whisper精准识别 + LLM智能分段翻译
中英效果都稳,上下文不崩
CosyVoice配音/声音克隆,听起来自然到发麻
横屏竖屏一键适配
下载即用,Win/Mac都有,内容创作者必备的。
就是这款KrillinAI,免费的视频翻译+字幕+配音+声音克隆一体方案。
不用在剪映手动调半天,
用懒人最喜欢的就是丢链接或本地视频
Whisper精准识别 + LLM智能分段翻译
中英效果都稳,上下文不崩
CosyVoice配音/声音克隆,听起来自然到发麻
横屏竖屏一键适配
下载即用,Win/Mac都有,内容创作者必备的。
Media is too big
VIEW IN TELEGRAM
天空之城又磨了一版,直接切成夜晚氛围。
月光、暖灯、浮岛、小屋全加上了,周围 360° 都有房子。
Codex 的额度也被我彻底干完了,终于有点我想要的感觉了
月光、暖灯、浮岛、小屋全加上了,周围 360° 都有房子。
Codex 的额度也被我彻底干完了,终于有点我想要的感觉了
This media is not supported in your browser
VIEW IN TELEGRAM
有人把 X 上那些超顶的设计,全聚到一起了。
Inspora,专门收集 X 上的高质量设计作品,Web、Branding、Product、Motion、3D……分类非常清楚,而且每小时持续更新。
不用再一条条刷 X、翻收藏夹挖灵感了,打开就能直接看精选。
做设计、UI、Landing Page,甚至 Vibe Coding 找视觉参考都很爽。
设计师日常灵感库,快收藏。
Inspora,专门收集 X 上的高质量设计作品,Web、Branding、Product、Motion、3D……分类非常清楚,而且每小时持续更新。
不用再一条条刷 X、翻收藏夹挖灵感了,打开就能直接看精选。
做设计、UI、Landing Page,甚至 Vibe Coding 找视觉参考都很爽。
设计师日常灵感库,快收藏。
This media is not supported in your browser
VIEW IN TELEGRAM
这个猛啊!NVIDIA MotionBricks 快要把游戏动画师干失业了!
一个神经网络,35万种动作技能,15000 FPS,2毫秒延迟。
不需要手动混合、不需要足部锁定、不需要碰撞检测、不需要任何手写过渡。
你只需要告诉它速度、方向、风格,它自己就把走路、受伤、僵尸、跳跃全给你拼出来。
换风格随时换,中间不停。
想让角色抓东西?随便丢四个关键帧,它自己补完整套接近、抓取、收尾动作,而且每次都不一样,像真人。
同一套模型已经在 NVIDIA GR00T 里驱动真实人形机器人了。
游戏角色和真人机器人,共用一个大脑。
30年传统动画技术,受到很大的冲击啊。
一个神经网络,35万种动作技能,15000 FPS,2毫秒延迟。
不需要手动混合、不需要足部锁定、不需要碰撞检测、不需要任何手写过渡。
你只需要告诉它速度、方向、风格,它自己就把走路、受伤、僵尸、跳跃全给你拼出来。
换风格随时换,中间不停。
想让角色抓东西?随便丢四个关键帧,它自己补完整套接近、抓取、收尾动作,而且每次都不一样,像真人。
同一套模型已经在 NVIDIA GR00T 里驱动真实人形机器人了。
游戏角色和真人机器人,共用一个大脑。
30年传统动画技术,受到很大的冲击啊。
Media is too big
VIEW IN TELEGRAM
腾讯混元刚开源了WorldClaw,世界之爪。
你随便打一句话,它就能直接整出一个能随便逛、还能改的大3D世界。
地形整体不乱,想要细节的地方也拉满,全是一个个能单独动的游戏资产,不是视频也不是高斯糊的。
自己还会检查修正,穿模悬浮这些都能搞定,游戏引擎直接就能用。
一句话就能造世界,牛呀~
你随便打一句话,它就能直接整出一个能随便逛、还能改的大3D世界。
地形整体不乱,想要细节的地方也拉满,全是一个个能单独动的游戏资产,不是视频也不是高斯糊的。
自己还会检查修正,穿模悬浮这些都能搞定,游戏引擎直接就能用。
一句话就能造世界,牛呀~
This media is not supported in your browser
VIEW IN TELEGRAM
8GB显存的关键不是模型越大越好
这次实测让我确认了一件事:
8GB显存不是不能做本地AI短剧,而是不能把所有任务都交给一个巨大模型。
更现实的方案是把任务拆开:
Z-Image负责人物抽卡
角色母卡负责人物身份
Wan 1.3B负责短镜头
Real-ESRGAN负责清晰度
FFmpeg负责标准化成片
每个模型只负责自己最擅长的阶段,用完立即释放。
这样不需要几十B参数的视频模型,也不需要24GB显卡,就能建立一条真正可以重复使用的本地AI视频生产线。
最终效果
这套工作流已经实际完成:
中文人物抽卡
4张真实女警角色候选
角色母卡锁定
中文动作提示词
832×480本地视频
33帧稳脸短镜头
720P自动放大
项目成片保存
桌面MP4副本
ComfyUI健康检查
显存溢出自动降档
任务中断安全恢复
整套流程最终可以概括为一句话:
输入一句中文,先抽出角色,再让角色逐镜表演,最后组合成一部AI短剧。
对于只有8GB显存的普通电脑来说,这可能比追求一次生成几十秒视频,更接近真正能够长期使用的AI短剧生产方式。
这次实测让我确认了一件事:
8GB显存不是不能做本地AI短剧,而是不能把所有任务都交给一个巨大模型。
更现实的方案是把任务拆开:
Z-Image负责人物抽卡
角色母卡负责人物身份
Wan 1.3B负责短镜头
Real-ESRGAN负责清晰度
FFmpeg负责标准化成片
每个模型只负责自己最擅长的阶段,用完立即释放。
这样不需要几十B参数的视频模型,也不需要24GB显卡,就能建立一条真正可以重复使用的本地AI视频生产线。
最终效果
这套工作流已经实际完成:
中文人物抽卡
4张真实女警角色候选
角色母卡锁定
中文动作提示词
832×480本地视频
33帧稳脸短镜头
720P自动放大
项目成片保存
桌面MP4副本
ComfyUI健康检查
显存溢出自动降档
任务中断安全恢复
整套流程最终可以概括为一句话:
输入一句中文,先抽出角色,再让角色逐镜表演,最后组合成一部AI短剧。
对于只有8GB显存的普通电脑来说,这可能比追求一次生成几十秒视频,更接近真正能够长期使用的AI短剧生产方式。
Media is too big
VIEW IN TELEGRAM
8G独显笔记本跑通 MiniMax H3!
本地 ComfyUI 中文工作流已跑通:
🎉中文文生视频、图生视频
🎉5秒 1980×1080,24FPS
🎉原生中文对白+口型同步
🎉同步生成环境音与背景音乐
🎉W4A8 主模型+Q2 文本编码器
RTX 5060 Laptop 可运行,5分钟生成5秒钟视频。
8GB 显存也能真正体验原生多模态视频了!
本地 ComfyUI 中文工作流已跑通:
🎉中文文生视频、图生视频
🎉5秒 1980×1080,24FPS
🎉原生中文对白+口型同步
🎉同步生成环境音与背景音乐
🎉W4A8 主模型+Q2 文本编码器
RTX 5060 Laptop 可运行,5分钟生成5秒钟视频。
8GB 显存也能真正体验原生多模态视频了!