AI知识库 @ai521
316 subscribers
21.8K photos
42 videos
19 files
838 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
Sakana AI 成立递归自我改进实验室,探索自主AI研发路径

日本人工智能初创公司 Sakana AI 宣布正式成立递归自我改进(RSI)实验室,旨在通过AI自身驱动研发流程,从静态人工主导转向自主自我优化的智能引擎。该实验室借鉴日本制造业持续改进的哲学,强调样本效率而非暴力算力扩展,主张在有限计算资源下实现智能化跃迁。过去两年,Sakana 已发表多项里程碑研究,如进化优化算法 ShinkaEvolve 仅用150个样本解决传统暴力搜索难以处理的问题。RSI 实验室将在此基础上构建自主进化的AI研究体系,推动智能体模型与AI科学家之间的正向循环,探索从手工调优到完全自治的AI发展新范式。 #SakanaAI #递归自我改进 #RSILab #AI研发 #日本AI #样本效率 #进化优化 #自主智能 #AI科学家
LLM服务中的动态批处理

在大型语言模型(LLM)服务中,批处理请求并非简单的“一次运行”问题。与传统机器学习模型不同,LLM的生成是迭代的——每次只产生一个令牌,这导致静态批处理(将多个请求固定在一起运行)效率低下:即使某些请求提前完成,其占用的GPU内存和计算资源也无法释放,造成浪费。文章以公交车比喻巧妙解释了这一痛点:静态批处理如同预定旅游巴士,所有乘客必须等全程结束才能下车;而动态批处理(又称连续批处理或迭代级批处理)则像城市公交,乘客可以随时上下车。通过在每个生成步骤动态调度请求,引擎(如vLLM、TensorRT-LLM)能够实时调整活动批次,让GPU始终保持高利用率,避免空转和内存浪费。这一技术极大地优化了LLM服务的吞吐量和成本效率。 #LLM #批处理 #GPU #动态批处理 #AI服务 #技术优化
CrankGPT 推出人力驱动的本地 AI,主打隐私与节能

近日,一个名为 CrankGPT 的奇特 AI 项目引发关注。它并非传统意义上的大模型,而是一种通过手摇或脚踏方式产生算力的本地智能解决方案。CrankGPT 宣称全程在本地运行,无需联网,所有数据均保留在用户手中,彻底杜绝科技巨头窃取个人信息的可能。项目方将使用场景分级:日常对话用基础手摇款,进阶用户可选脚踏款,而企业级工作流则计划与健身房合作,通过健身运动提供更高算力。这一设计旨在讽刺当前 AI 行业对能源的巨大消耗——科技公司为训练 AI 纷纷重启化石燃料电厂,违背气候承诺。CrankGPT 提倡用户通过燃烧卡路里而非化石燃料来生产自己的“代币”,从而节省开支并抵制科技 CEO 的贪婪。尽管概念充满黑色幽默,但它确实指出了隐私与可持续算力的痛点。 #AI #隐私保护 #本地AI #人力计算 #科技讽刺 #绿色能源 #数据主权
Lite Agent 重新定义 AI 浏览器助手

Lite Agent 是一款全新的 AI 浏览器扩展,旨在成为用户的“浏览器实习生”。它能够自动点击按钮、填写表单、记住用户偏好,并支持语音指令。该工具集成了 AI 聊天、页面自动化、语音输入、智能记忆和加密备份功能。用户可通过侧边栏让 AI 分析文章、发送邮件、执行代码等。Lite Agent 强调隐私优先,无需手动配置 API 密钥,并支持实时语音转录和自动静音检测。目前该产品已开放候补名单,即将正式上线。 #AI #浏览器扩展 #自动化 #语音助手 #隐私保护 #科技新闻
Declank 上线

一款名为 Declank 的新工具在 Hacker News 上引发关注。该工具宣称可以免费在线去除 AI 生成图片中的水印,包括生成器添加的可见水印、隐形信号以及元数据。用户无需注册,只需上传图片即可处理,且不会造成图片模糊。目前支持 PNG、JPG 和 WebP 格式,单张图片上限为 25 MB。 #AI #水印 #图片处理 #工具 #科技新闻
使用 和句子嵌入构建语义搜索,终结搜索零结果

许多开发者可能都遇到过这样的场景:用户输入“廉价笔记本电脑”,搜索结果却为零。这通常是因为传统基于关键词的搜索引擎无法理解查询意图,只能进行字面匹配。为解决这一痛点,一种基于 和句子嵌入的语义搜索方案被提出。通过将文本转换为稠密向量,系统能够捕捉词汇背后的语义关系,即使查询词与文档不完全匹配,也能返回最相关的结果。 使得在浏览器中直接运行预训练模型成为可能,无需依赖后端服务,从而降低了部署门槛。这种语义搜索方式不仅提升了用户体验,也为前端领域带来了强大的AI能力,让搜索更加智能和人性化。 # #句子嵌入 #语义搜索 #AI #机器学习 #自然语言处理 #前端开发 #JavaScript #搜索优化 #技术实践
Anthropic 发布 Claude Mythos,自主任务时长突破 3 小时

Anthropic 推出的 Claude Mythos 模型以“神话”命名,却在现实中实现了 AI 自主能力的重大突破。该模型在 80% 的成功率下,最长连续自主任务时长达到 3 小时 6 分钟,打破了 AI 自主运行的纪录。这一成果远超此前专家预测的年底才能实现的目标,标志着 AI 在复杂任务中的持续执行能力取得实质性进展。Claude Mythos 的突破不仅展现了 AI 从辅助工具向自主主体的转变,也引发了对人类在效率驱动的新范式中角色的深刻思考。业界分析认为,AI 自主时长的提升将加速自动化在科研、开发等领域的应用,但同时也需要警惕人类适应期缩短带来的社会冲击。 #ClaudeMythos #Anthropic #AI自主 #人工智能 #科技突破 #效率革命
48小时游戏马拉松:用AI向Roblox提交30个素材的实战心得

在最近一场48小时游戏开发马拉松中,一位技术美术师尝试使用AI建模工具Meshy,向Roblox平台快速生成了30个游戏素材。作者分享了这一极限挑战下的经验:AI工具大幅缩短了建模时间,但需注意素材风格一致性与平台兼容性;实时调整提示词和后期优化是关键。这次试验验证了AI辅助游戏开发的高效性,但也暴露了生成质量不稳定、细节控制不足等痛点。作者认为,随着AI工具迭代,未来游戏开发者可以更专注于创意而非重复劳动。 #AI建模 #Roblox #游戏开发 #Meshy #科技实践 #效率工具
LLM应用可观测性:OpenTelemetry成为关键工具

自2022年11月OpenAI发布ChatGPT以来,AI应用在全球爆发式增长,将大语言模型(LLM)集成到产品中已从实验性功能变为竞争基线。然而,构建生产级LLM应用面临独特挑战:模型输出具有非确定性,相同输入可能产生不同结果;需确保响应在上下文中的一致性,例如对“明天降雨概率”与“股市上涨概率”的回答应有所区别;此外,LLM供应商频繁更新模型和配置,可能导致服务降级或质量波动。OpenTelemetry(OTel)作为云原生计算基金会(CNCF)项目,通过标准化遥测数据生成与采集,帮助开发者观测LLM应用行为,避免供应商锁定。本文深入探讨了LLM可观测性的必要性、OTel的工作原理,以及如何通过实践Demo集成到应用中,同时分析了当前LLM专用OTel库的成熟度与GenAI语义约定。 #LLM #OpenTelemetry #可观测性 #AI应用 #大模型 #CNCF #非确定性 #质量监控 #技术
Step 3.7 Flash限免30天实测:表现中规中矩,但体验流畅,Agent调用无负担

据302.AI基准实验室发布的最新测评,Step 3.7 Flash现已开启为期30天的免费使用。实测结果显示,该模型在性能上并未带来颠覆性突破,但整体交互体验流畅、响应迅速,尤其适合高频调用Agent场景。测试者指出,用户无需“省着用”,可以放心借助其处理大量任务,显著提升效率。此次限免旨在吸引开发者进行深度体验,进一步验证模型在自动化工作流中的实用价值。 #Step3.7Flash #AI测评 #限免 #Agent #302AI #人工智能 #科技新闻
openJiuwen 推出 Auto Harness,实现 Agent 外部系统自动化优化

华为支持的 openJiuwen 社区开源了 JiuwenSwarm 中的 Auto Harness 框架,这是一套评测驱动的、覆盖 Harness 全栈组件的端到端自动优化方案。Harness 是 Agent 模型之外负责工具调用、上下文管理、任务编排等执行逻辑的系统,传统上高度依赖人工调试,耗时且难以复用。Auto Harness 将 Harness 拆分为通用基座层(Meta)和可插拔领域扩展层(Expert),Agent 可自主评测、规划修改并验证效果。基座层优化后自动生成 PR 待人工审核,扩展层则支持热加载即插即用。该框架首次实现 Harness 自动化优化的工程化落地,补全了 Agent “后训练”的另一块拼图。后续还将推进多 Agent 群体的 Swarm Post-Training,实现从模型到单兵再到团队的整体协同进化。 #openJiuwen #AutoHarness #Agent #后训练 #Harness #开源 #人工智能 #大模型 #工程化 #多Agent
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_8247614025