大模型AI编程前沿
2.12K subscribers
484 photos
315 videos
446 links
AI工具、币圈实事、资金流温度及风险提醒
Download Telegram
Kimi K3 权重今天终于放出来了。之前这模型被卡在单一服务商手里整整 11 天!
能力已经能硬刚 Fable 5,但推理速度拉胯,根本没法正经用来写代码。现在彻底解封。2.8T 参数,直接上 Hugging Face 免费下载。
所有推理平台都能自己部署。
等有人把速度优化起来,这玩意儿大概率会成为目前 vibe coding 性价比之王。
这套口语合集把日常英语的实战痛点扒得很透,A哥啃完明显能感觉嘴皮子利索不少。
原本付费的😂,现在免费放出来了。🔗https://pan.quark.cn/s/e2dab11cf712
我最近把手机里的AI工具挨个试了一圈,发现一个挺打脸的事,苹果和安卓天天吹的系统级AI Agent,愣是被一个开源项目抢了先。
之前用的那些AI,翻来覆去就是个高级聊天框,让它们干点实活?比如看一眼我午饭照片自动往健康App里记热量,或者扫描群聊消息自动生成待办,基本都歇菜。
OpenMinis这块真给我看愣了:全平台开源免费不说,直接在你手机本地塞了个Alpine Linux环境,通过系统原生API把权限彻底打通,等于在你口袋里跑了个超级智能体。
三个让A哥觉得确实硬核的点:
服务器?不需要。本地Linux环境直接跑,Agent自己写Python脚本、装FFmpeg、处理文件全部在手机端完成,云端那笔开销算是省了。
系统底层API它真能调。iOS这边的HealthKit、日历、提醒事项、HomeKit全都能碰,安卓则靠Shizuku打通无障碍级别操作。我拍张饭局照片,它能估算热量写进苹果健康;我甩给它Telegram聊天记录,它自动把提到的Bug整理成提醒事项。
模型方面不绑死。Claude、GPT、Gemini、OpenRouter、Kimi随便接,API Key全存在本地KeyChain,没有经过第三方中转的环节,隐私算是保住了。
SKILL.md技能包也兼容,Claude和OpenClaw那套现成Skill直接导入,浏览器自动化(爬网页、填表)和MCP协议都支持。
泼盆冷水:这玩意儿是个极客玩具。程序员、独立开发者、AI效能党会比较上头。界面看着就是个普通聊天框,但要玩出花得自己配API Key或折腾Skill。好在全平台免费,iOS/macOS直接App Store下,安卓有APK。
官方地址丢这了:https://github.com/OpenMinis/OpenMinis
用WHMCS的兄弟们,我知道你们被它绑得有多烦。
那个又贵又封闭的WHMCS,是不是早就想换了?现在有个叫Paymenter的开源计费系统,就是专为咱这种Hosting公司量身打造的。自动搞定订阅、发票、开通服务,支付网关和扩展随便接。
重点是什么?MIT协议,完全免费。自己部署,源码在手,没有任何隐藏费用,更不怕哪天被官方卡脖子。界面走得简洁干净,扩展市场里东西也不少,从WHMCS迁移数据有现成路子,过渡比你想的平滑。
这就是个让你把计费主权重新攥回手里的选择
https://github.com/Paymenter/Paymenter
开源权重模型的Agent能力排名洗牌。
在Agent Arena这个考验真实长时程任务的榜单上,Kimi K3 (Max)净提升+9.75%,登顶#1,把GLM- (Max)的+%甩在了后面。而且不只是总榜,它同时在Frontend Code(1682分)和Text(1485分)两个细分Arena也拿了#1。
Agent Arena测的是模型用网络搜索、文件系统、终端工具完成复杂任务的能力,写代码、做幻灯片、做研究、构建应用、分析文档,全是现实世界的活儿,不是那种刷榜玩具题。因果追踪的净提升算法很硬,能打出来说明是真有提升。
天天开着VPN,你知道自己真实IP到底漏没漏出去吗?别在好几个网站之间来回折腾了。
我最近挖到一个叫MyIP的开源工具箱,直接一站式查清楚:公网IP和局域网IP一起给你抓出来,归属地、ASN、地理位置全显示。关键是DNS泄漏和WebRTC泄漏一测便知,这俩是VPN用户最容易翻车的地方,你挂上代理以为安全了,结果WebRTC一不留神就把真实IP给出卖了。
除此之外,测速、全球延迟、MTR路由追踪、网站能不能通、Whois查询全带上了,甚至浏览器指纹和网络安全检查清单(整整258项)也有。对经常换节点、挂代理的兄弟来说,这玩意儿值得收藏进书签。
自己部署一套,所有数据全攥自己手里,不用依赖任何第三方。在线演示和GitHub地址甩下面,去试试就知道多方便。
在线演示:https://ipcheck.ing
🔗https://github.com/jason5ng32/MyIP
想给大段文本画张关系网?这开源项目能一键转成知识图谱。
别人折腾Graph RAG还得抱着GPT接口不撒手,它直接用本地LLM(Ollama + Mistral)干这事,从文档里自动抽概念、挖关系。我拿几篇技术文档试了下,抽出来的概念关系比纯向量检索那种关键词匹配有逻辑多了。
Graph RAG比普通向量检索强就强在真懂上下文关联,拿来搞知识问答也顺手。
全程本地跑,数据不出门,不用掏钱调API。Docker一键启动就完事,演示图丢下面了,自己去看效果。
https://github.com/rahulnyk/knowledge_graph
传统VPN那延迟和配置复杂度,说实话我忍了很久了。
Firezone直接基于WireGuard,把零信任远程访问做成了开源方案。
对比OpenVPN能快3倍,点对点加密,延迟低到几乎无感。我最烦的是权限管理,它倒是干得漂亮,按用户或组精细控制具体应用或网段,后台操作也算直观。
自己部署完全OK,不想折腾也有云版。 适合团队远程办公或者内网安全访问的场景,推给技术群后反馈都不错。
https://github.com/firezone/firezone
想系统学AI Agent设计模式但不知道从哪下手?这仓库直接把整本《Agentic Design Patterns》给开源了。
424页完整PDF加上配套Jupyter Notebook,21章核心模式全覆盖:Prompt Chaining、Routing、Parallelization这些基础,到Reflection、Tool Use、Planning、Multi-Agent,再到Memory、RAG、异常处理、Human-in-the-Loop、Guardrails,从入门到生产级再到企业级全齐。代码能直接跑,边看边试。
最打动我的一点:作者版税全捐给儿童慈善,技术人做到这份上真没话说。
GitHub地址:https://github.com/evoiz/Agentic-Design-Patterns
这套口语合集把日常英语的实战痛点扒得很透,A哥啃完明显能感觉嘴皮子利索不少。
原本付费的😂,现在免费放出来了。🔗https://pan.quark.cn/s/e2dab11cf712
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_6657896970
第一眼看到这项目,我以为是科幻片预告。
Auto-Company,让你在自己电脑上跑一家24小时不打烊的AI公司。14个智能体,直接模拟贝索斯、芒格、DHH等大佬的思维模式,自动 brainstorm 产品、写代码、部署、搞营销,几乎不用你插手。
怎么运转? AI团队醒来→读共享记忆→组队(人)→执行→更新记忆→休眠→循环,永不停机。每轮禁止纯聊天,必须出活。架构五层,支持Claude Code/Codex双引擎,macOS和Windows(WSL)都能跑,有本地仪表盘看进度和成本。
注意:每循环消耗API额度;全自动运行,务必先配好安全护栏;需要命令行基础。
上手:macOS直接make start,Windows(WSL)用start-win.ps1。监控用make dashboard。
🔗https://github.com/MaxMiksa/Auto-Company
你有没有遇到过这种情况:新电脑用不到半年,开机越来越慢,C盘莫名其妙就满了,还老弹一些看不懂的广告?
工具RyTuneX。
它其实是专治Windows 10/11各种"老年病"的。用WinUI 3写的,界面看着确实不像传统优化软件那么"工程师审美"。
一键卸载预装垃圾,品牌机自带的那堆用不上的软件,全选、确认、走人,不用一个个去控制面板翻。
系统性能优化,关掉那些吃资源但看不见的后台进程,体感上确实轻快了些。
隐私增强,把微软的遥测和广告追踪一并关了,对我来说,这一项比单纯跑分提升更有价值。
综合管理,网络、安全、服务、策略全都集成在一个面板里,还有个"一键还原",调错了能撤回,挺安心的。
🔗https://github.com/rayenghanmi/RyTuneX
清理、杀毒、隐私保护三合一,跨Windows/macOS/Linux三平台,开源免费、无广告无遥测,这就是Kudu。
临时文件、浏览器缓存、游戏缓存、注册表、启动项,甚至能扫磁盘用树状图看谁在占空间,C盘爆了的时候这功能救命。
带恶意软件扫描,还有个隐私盾,能把Windows里30多个偷窥项(遥测、广告ID那些)一次性关掉。
支持定时扫、CLI命令行模式,熟手可以直接脚本化操作,不用每次都开界面。
代码全公开,清理前能自动建还原点,万一误删还有退路。支持WinGet批量更新软件,已适配30种语言(含简中)。
🔗 GitHub:https://github.com/AdventDevInc/kudu
一个PDF转Markdown工具,凭什么要调用GPT-4o或者Claude Sonnet这种级别的多模态大模型?
答案很简单:传统OCR工具提取文本流,遇到表格边框、公式上下标、图表里的文字标注就全乱了。
MarkPDFDown换了个思路,它把每一页PDF当作图片"看",视觉模型直接识别版面结构,然后输出干净的Markdown。
我拿一份含15个公式、3个嵌套表格的学术论文试了一下,LaTeX格式的公式和规整的Markdown表格都完整保留下来了,直接复制进Obsidian就能用。
支持指定页码范围,也支持图片转Markdown。
命令行模式是标配,npx -y markpdfdown还能拉起一个桌面版界面。
管道模式(markpdfdown < input.pdf > output.md)方便配合Docker一起用。
当然,前提是你得有OpenAI或OpenRouter的API密钥,然后在环境变量里配好。
🔗https://github.com/MarkPDFdown/markpdfdown