大模型AI编程前沿
2.11K subscribers
483 photos
300 videos
445 links
AI工具、币圈实事、资金流温度及风险提醒
Download Telegram
Seedance 2.0 Skill OS,核心就一件事:
把Seedance 2.0从「随便糊弄个提示词撞大运」直接拽到专业影视流程那个级别。
镜头调度、运镜逻辑、剪辑节奏、分镜设计、场景构建、动作编排、视觉风格,全给你拆解得清清楚楚,再也不用自己瞎摸索。
以前全靠碰运气出片,现在是按片场工业规矩干活。
🔗 https://github.com/Emily2040/seedance-2.0
剑桥这波直接放大招了!!
AI & ML 经典教材全集免费公开,PDF随便下。
想入坑机器学习又不想被割韭菜买天价课的,这十本啃完,地基基本就稳了。
顺序排好了,从入门到进阶:
1️⃣ 机器学习理解,讲透理论和算法,入门首选
🔗 https://cs.huji.ac.il/~shais/UnderstandingMachineLearning/understanding-machine-learning-theory-algorithms.pdf
2️⃣ 机器学习数学基础,数学欠火候的先补这本
🔗 https://mml-book.github.io/book/mml-book.pdf
3️⃣ 机器学习算法的数学分析
🔗 https://tongzhang-ml.org/lt-book/lt-book.pdf
4️⃣ 深度学习理论原理
🔗 https://arxiv.org/pdf/2106.10165
5️⃣ 神经网络与机器学习
🔗 https://arxiv.org/pdf/1901.05639
6️⃣ 图深度学习
🔗 https://yaoma24.github.io/dlg_book/dlg_book.pdf
7️⃣ 机器学习的算法视角
🔗 https://people.csail.mit.edu/moitra/docs/bookexv2.pdf
8️⃣ 概率论:理论与实例
🔗 https://sites.math.duke.edu/~rtd/PTE/PTE5_011119.pdf
9️⃣ 应用概率基础
🔗 https://sites.math.duke.edu/~rtd/EP4A/EP4A_April2021.pdf
🔟 高级数据分析
🔗 https://stat.cmu.edu/~cshalizi/ADAfaEPoV/ADAfaEPoV.pdf
说实话,这些书难度都不低,别指望躺着刷完。
但只要你真下定决心啃两三本,比在群里听人吹AI牛逼强一百倍。
3D Gaussian Splatting 是近两年计算机视觉领域现象级的热门方向。然而,拍完 3DGS 数据后,想进行编辑和优化,却发现好用的工具屈指可数。
SuperSplat 正是你需要的答案——它是由 PlayCanvas 团队打造的一款浏览器端 3DGS 编辑器。
无需安装,打开即用。你可以在里面自由查看、检查、裁剪、合并和优化 Gaussian Splat 数据,基于 WebGL/WebGPU 的渲染让操作体验相当流畅。
它还内置了视频渲染功能,编辑完的场景能直接发布到网页上,方便分享和展示。
直接访问 http://superspl.at/editor 就能上手,零门槛,完全免费。
🔗https://github.com/playcanvas/supersplat
想实现无摄像头、无视频的接触式空间感知和健康监测?
RuView 是一个基于普通 WiFi 信号的感知平台,能通过 ESP32 等低成本硬件实现人体存在检测、呼吸心率监测、动作识别等功能。
主要:
1️⃣ 利用 WiFi CSI 信号实现穿墙存在检测和人数统计
2️⃣ 实时监测呼吸率和心率,支持睡眠质量分析
3️⃣ 支持跌倒检测、动作识别和姿态估计
4️⃣ 完全无视频,隐私友好,可集成 Home Assistant 等系统
5️⃣ 支持边缘端运行,硬件成本低(ESP32 节点约 9 美元)
这是一个用现有 WiFi 基础设施实现非接触式感知和健康监测的开源方案,适合智能家居、养老监护等场景。
🔗 https://github.com/ruvnet/RuView
GitHub上扒到个开源神器,专治抖音视频下载各种不服!
功能特点:
1️⃣ 搜用户、扒主页作品、收藏点赞全都能拉下来
2️⃣ 扔个分享链接就解析单条,视频图集连Live Photo都吃得下
3️⃣ 批量下载还能按用户、合集自动归档,省心到家
4️⃣ Windows、macOS、Linux三端通吃,浏览器和无界面模式也都有
Cookie、下载记录全存本地,不上传服务器,隐私党可以把心放肚子里。就一条:非商业自用,别拿去收费代下。
🔗 https://github.com/anYuJia/better-douyin/
不同 AI 模型的系统提示词(System Prompt)设计差异很大,这些提示词直接影响模型的行为模式和输出质量。
这个仓库系统性地收集并整理了大量来自 Claude、GPT、Gemini、Grok、Cursor 等模型和工具的系统提示词,并持续更新维护。
特点:
1️⃣ 按厂商和模型分类整理(Anthropic、OpenAI、Google、xAI 等)
2️⃣ 包含多个版本的提示词,以及版本间的差异对比
3️⃣ 覆盖聊天模型、编码工具、设计工具等多种类型
4️⃣ 定期更新,方便跟踪最新模型的提示词变化
🔗 https://github.com/asgeirtj/system_prompts_leaks
agentmemory 是一个专门为 AI Coding Agent 打造的持久化记忆系统,支持 Claude Code、Cursor、Gemini CLI、Codex 这些主流工具。
相当于给 Agent 装了个“大脑”,让它能跨会话记住你之前说过什么、项目架构是什么、编码偏好有哪些。
它的记忆架构很有意思,模仿人脑分了四层:工作记忆、情景记忆、语义记忆、程序记忆,从短期到长期,一层层巩固。你跟它说过的项目细节,会自动从临时记忆沉淀到长期知识库里。
搜索方面用了混合检索:BM25 + 向量搜索 + 知识图谱三路并行,在 LongMemEval-S 基准上,前 5 条结果的召回率能做到 95.2%。
🔗https://github.com/rohitg00/agentmemory
在构建 AI 应用时,引入传统向量数据库往往需要额外部署服务,增加了系统复杂度和运维成本。
Zvec 是阿里开源的一款轻量级进程内向量数据库,能直接嵌入应用运行,无需独立服务即可提供高效的向量检索能力。
功能特点:
1️⃣ 完全进程内运行,部署极简,适合本地、边缘或嵌入式场景
2️⃣ 支持稠密向量和稀疏向量,以及全文检索和混合搜索
3️⃣ 性能极高,延迟低,适合对速度要求严格的应用
4️⃣ 通过 Write-Ahead Logging 提供数据持久化能力
5️⃣ 轻量且易于集成,资源占用小
对于希望在 AI 应用中加入向量检索功能,但又不想承担额外服务部署和维护成本的场景,Zvec 提供了一个轻便且高效的选择。
🔗 https://github.com/alibaba/zvec
Sora这波真的杀疯了!
现在不把AI视频玩明白,过俩三月真会被身边人甩得连尾灯都看不见!
文生视频 + 分镜脚本 + 变现野路子,全套一条龙直接给你打包好了!
🔗https://pan.quark.cn/s/fcdc2dfd8f34
自己搞服务器,最烦两头堵——上K8s跟开坦克碾蚂蚁似的,托管平台又贵得肉疼。
ServerKit就卡在中间给你架了座桥:开源、清爽、一个面板握全局。
它还真不是虚架子:
1️⃣ Web应用统统拿下:PHP、Python、Node.js、Docker全给你编排好;
2️⃣ 数据库三件套:MySQL、PostgreSQL、SQLite,浏览器里直接敲SQL,比客户端还顺手;
3️⃣ 安全带拉满:ClamAV查毒、防火墙、Fail2Ban,一条龙护体;
4️⃣ 全家桶伺候:域名SSL、自动备份、邮件系统、监控告警……你能想到的,它全包。
只要手里攥着VPS、又想从运维杂活里脱身的,这玩意儿值得你花两分钟去扫一眼。
🔗 开源地址:https://github.com/jhd3197/ServerKit
找工作时手动投简历、写求职信、准备面试很耗时间?
ai-job-search 是一个基于 Claude Code 的 AI 求职框架,能帮助自动化完成简历定制、求职信撰写和面试准备等工作。
主要功能:
1️⃣ 自动抓取和评估职位匹配度,按适合程度排序
2️⃣ 根据个人背景自动生成定制化的 CV 和求职信(支持 LaTeX 输出)
3️⃣ 生成针对性面试准备材料和模拟问题
4️⃣ 支持申请结果追踪和后续分析
5️⃣ 可自定义模板和职位来源,适应不同市场
这是一个把 AI 深度整合进求职全流程的开源框架,适合想用 AI 提升求职效率的人使用。
🔗 https://github.com/MadsLorentzen/ai-job-search
微信群聊天天爆炸,几百上千条消息往上翻到手抽筋,重要的日程、干货、别人答应你的事,全跟垃圾信息埋一块儿了。。
WeChat Radar 专门来拆这个雷的,关键数据在本地跑,不上云,隐私有保障:
1️⃣ 自动把群里的链接、话题、待办给你扒出来,不用再当考古学家;
2️⃣ 全文搜索贼快,实测七十多万条消息也不带卡的;
3️⃣ 还能接个大模型帮你深度分析聊天记录,洞察力直接拉满。
🔗https://github.com/huangserva/wechat-radar
jcode 是一款基于 Rust 构建的 Coding Agent 外壳,专为追求极致性能而生。
它的内存占用仅为 Claude Code 的十四分之一,首次渲染仅需 14 毫秒,而后者需要 3.4 秒——这悬殊的差距仿佛来自不同代际的技术产物。
从终端渲染引擎到底层实现,jcode 完全自研,没有丝毫妥协。甚至连 Mermaid 图表渲染,它也专门编写了自己的库,执行速度比官方方案快上 1800 倍。
它还具备 Swarm 多智能体协作模式:你可以在同一个仓库中启动多个 Agent,它们会自动协调分工、检测冲突并进行内部通信。比如,一个负责前端,一个负责后端,彼此独立工作,互不干扰。
内置的语义记忆系统同样令人印象深刻——每一轮对话都会自动进行向量嵌入,下一轮则通过余弦相似度检索相关记忆并注入上下文,使它越用越能理解你的习惯。
目前,该项目已获得超过 8200 颗 Star,增长势头强劲。Swarm 模式虽然仍处于实验阶段,但已经可以实际使用。
🔗https://github.com/1jehuang/jcode
看完书、刷完长视频、听完播客,脑子依然空空如也?
cangjie-skill 能把那些高密度干货,硬生生蒸馏成AI能直接调用的实操技能。
它会自动帮你:
严选硬货:从看过的内容里,只捞出真正能落地的方法论,废话一律过滤掉;
喂饭级教学:每个技能都给你拆透了——啥场景用、具体咋操作、前人踩过的坑全标出来;
一键打包带走:生成精华摘要 + 可安装的Skill文件,直接丢给Claude或Cursor,随叫随到。
现在连巴菲特、芒格、吴恩达、《孙子兵法》 这些顶级大脑的方法论,都已经被做成了现成的技能包。
你的知识终于从“我好像在哪看过”,进化成“我随时能用”的生产力了!
🔗https://github.com/kangarooking/cangjie-skill
《动手学大模型》(Dive into LLMs)是上海交通大学出品的系列编程实践教程,在GitHub上已收获4.2万+Star,是备受认可的优秀学习资源。
教程内容覆盖了大模型从微调部署到安全对齐的完整技术路径,共包含11个章节,主题非常前沿:
提示学习与思维链
知识编辑
数学推理
模型水印
越狱攻击
大模型隐写
多模态
GUI Agent
RLHF安全对齐等等。
每一章都贴心地提供了三件套:PPT课件、详细的教程文档,以及可以直接运行的Jupyter Notebook代码,非常适合动手实践。
最近,该项目还与华为昇腾联合推出了国产化课程线,聚焦大模型开发全流程,同样提供了PPT、实验手册和配套视频,为开发者提供了新的选择。
🔗 项目地址:https://github.com/Lordog/dive-into-llms
ian-handdrawn-ppt 是一个能把你文章、笔记或提纲直接变成一套手绘风技术解释图的 Codex Skill,主打风格统一和开箱即用。
画风很有辨识度:近白纸底色、细铅笔线条排线、柔和淡蓝与淡绿标记色,加上克制留白,整体就像专业画师的草稿手稿,完全没有模板感。
生成流程不是直接画图,而是先理解材料、提炼叙事结构,再自动匹配最合适的版式,比如封面隐喻、左右对比、流程图或矩阵图。输出规格很实用,包括 21:9 封面图和 16:9 正文配图,纯 PNG 格式。
推荐使用 ChatGPT Image 2.0 模型来获得最佳效果,并尽量保持整套图由同一模型生成以确保风格锁定。使用时,你可以在 Codex 中通过类似 Use $ian-handdrawn-ppt 把这篇文章做成 1 张封面图 + 3 张正文配图 的指令调用。需要注意的是,AI 生成图像可能出现错字或风格漂移,建议多生成几次再挑选最稳定的一张。
🔗https://github.com/helloianneo/ian-handdrawn-ppt
OpenMontage,出自calesthio之手。你不用懂剪辑、调色、特效——只要用大白话丢过去一个想法,AI就自动帮你把调研、写本子、找素材、配音、配乐、剪辑、渲染,一整条流水线全包圆了。
它不是那种只能吐几秒碎片的小玩具,而是能输出多场景、剪好的成品大片。背后是12条生产流水线、52个专业工具、400多项智能体技能堆出来的。
划几个重点:
1️⃣ 题材通吃:解说、预告、纪录片、教程、动画、产品发布,基本你能想到的视频类型它都能搞;
2️⃣ 供应商矩阵:一口气接了Kling、Runway Gen-4、Google Veo 3等14家视频生成服务商;
3️⃣ 素材白嫖术:直接从http://Archive.org、NASA、维基媒体、Pexels这些地方薅免费资源;
4️⃣ 真·视频流水线:做纪录片时能从http://Archive.org、NASA建语料库,检索真实的动态素材剪进时间轴——不是那种把几张静态图硬晃出伪动画的套路。
自由视频人接一单收你2000到10000刀,制作公司开口就是5000到50000刀。而OpenMontage做一部电影级科幻预告片,成本大概3美元;一条精良的解说视频,只要0.15美元。注意,这不是月费,是单片成本。
AGPLv3协议开源,支持Claude Code、Cursor、Copilot、Windsurf、Codex。
🔗https://github.com/calesthio/OpenMontage
美团这波真的炸了!LongCat-2.0 已正式开源,直接甩出王炸!
1.6万亿总参数的超大MoE模型,全程用5万张国产芯片集群从头训练,英伟达含量0% !
原生支持1M超长上下文,Agentic Coding能力硬刚甚至吊打一堆闭源模型,之前还匿名冲上过OpenRouter全球调用量前三。
之前DeepSeek没搞定的纯国产血统大模型,美团这次实打实干出来了!国模+国芯,真·自主可控。
🔗 https://github.com/meituan-longcat/LongCat-2.0
对于经常折腾 AI Agent、知识管理或复杂项目规划的人来说,无限画布 + Agent 这个组合绝对值得你花时间了解。
Agent 终于不再被锁在聊天窗口里了——现在它能直接在无限画布上完成组织、分析、执行整个工作流。
🔗
https://github.com/basketikun/infinite-canvas
给刷剧人递两个宝藏影视站,免费看片又有新去处了:
1️⃣ 这个站的片库更新速度是真的快,新上映的、冷门老片基本一网打尽,再也不用为了找资源翻好几页。
2️⃣ 分类和搜索做得相当顺手,找片子不费劲,平时追剧、淘老电影当备用库完全够格。
关键是干净,比那些广告糊脸、点一下弹三个窗的糟心站强太多了。
🔗 https://flixflop.com
🔗https://mtyy4.com