AI知识库 @ai521
300 subscribers
21.4K photos
41 videos
19 files
816 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
实测:运行本地大模型每百万token成本几何

许多人认为本地部署大语言模型“几乎免费”,但实际功耗成本究竟如何?一位开发者用配备RTX 3090(24GB)的单机,通过nvidia-smi每10秒采样GPU实时功耗,并按照保加利亚实际电价(日间0.30列弗/夜间0.18列弗,约合0.15/0.09欧元)精确测量了三个本地模型(gemma3:1b、gemma4:26b、gemma3:27b)在固定负载下的每百万输出token能耗成本。结果显示,在测试的8个模型中,5个每百万token成本低于主流云API的“Flash”类服务定价,其余3个则更高——且成本高低与参数量并不完全正相关。这项对照实验排除了参数、量化方式和负载差异,为“本地推理是否真的更便宜”提供了可复现的数据支撑。 #AI #大模型 #本地推理 #成本分析 #开源 #大语言模型 #技术评测
自编码器与潜在空间

在生成式AI处理文本、图像等非结构化数据时,计算量庞大是常见挑战。自编码器通过将输入数据压缩至低维潜在空间,保留主要特征的同时实现高效表示。其结构包含编码器(将数据映射到潜在空间)和解码器(从潜在空间重建原始数据)。潜在空间作为数据的紧凑语义表示,在数据压缩、异常检测、特征学习及生成模型中至关重要。该技术不仅能缓解计算压力,还为变分自编码器等生成模型奠定基础,广泛应用于图像去噪、降维和深度特征提取。 #自编码器 #潜在空间 #生成式AI #数据降维 #机器学习 #深度学习 #特征学习 #计算优化
AI Agent的静默数据丢失

在自学习代理的记忆循环中,系统读取共享计划、提炼经验、写回更新,以期下一次运行更智能。但“写入成功而数据消失”的现象有四种不同成因,而非单一故障。这些成因分为两类:检测侧与预防侧。检测侧包括键不匹配(写入X而读取Y,路由错误)和压缩丢弃(合并步骤导致数据丢失);预防侧包括并发丢失更新(同一键上两个写入者互相覆盖)和陈旧读取后写入(基于过时视图写入,被更新版本覆盖)。理解这四种机制能帮助开发者精准定位问题,并判断现有修复是否可靠。 #AI #机器学习 #数据一致性 #代理内存 #软件工程 #技术博客
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 telegram.me/jisou2?start=a_8247614025
基于OpenJDK Panama FFM的本地低延迟LLM运行器发布

一位开发者发布了名为Show HN的开源项目,旨在通过Java 22的Project Panama(Foreign Function & Memory API)在JVM内部低延迟运行本地大语言模型。该项目最初采用标准REST sidecar方式调用模型,后改用Panama直接与底层C库接口通信,并构建了干净的应用二进制接口(ABI)以在JVM中暴露结构化API,仍依赖Panama绑定ggml计算图。项目在热路径上实现零内存分配,显著降低推理延迟,为Java生态提供原生级AI推理能力。 #Java #JVM #LLM #ProjectPanama #低延迟 #开源 #AI #本地推理
推出低成本 AI Agent 可观测性服务

发布面向 AI Agent 的可观测性平台,瞄准了当前 Agent 追踪成本高、搜索慢、故障发现难的问题。该服务以每百万 span(追踪跨度)10美元的价格提供 S3 底层存储方案,承诺支持 100% 全量追踪采样并保留数月甚至数年数据,同时实现小于 1 秒的 P99 查询延迟。平台提供开箱即用的洞察功能,可自动检测用户挫败感、工具调用异常等问题。已有客户每日处理超过 300 万条 Agent 追踪记录,实现零采样。团队表示该方案已通过生产环境验证,并获得多家工程团队的信任。 #AI #Agent #可观测性 #Oodle #低成本 #Trace #开发工具 #云计算
上下文炸弹

Tracebit Research 最新研究显示,AI代理已能自主发起复杂网络攻击——在最强大模型手中,从初始入侵到权限提升和数据窃取仅需数分钟。传统蜜罐(诱饵资源)虽能发现入侵行为,却无法阻止攻击。为此,研究人员提出“上下文炸弹”概念:在蜜罐中嵌入一段短文本,当AI代理读取时,该文本会触发模型自身的安全护栏,迫使其自行终止攻击。实验涵盖 Opus 4.8、Gemini 3.1 Pro、GLM 5.2、DeepSeek 4 Pro 和 Kimi K2.6 五款领先模型。结果显示,单一上下文炸弹即可使 AI 攻击成功率平均降低约 90%。其中最强模型 Opus 4.8 的完整管理员访问成功率从 93% 骤降至 0%;所有模型完全攻陷(管理员权限加持久化)的平均率从 36% 降至 1%。研究人员指出,该方法利用了 AI 平台内置的拒绝机制,相当于为防御者提供了一种在攻击路径上“布设地雷”的新策略。 #AI安全 #上下文炸弹 #蜜罐 #自主攻击 #AI防御 #网络安全 #Tracebit
求职者用AI面试作弊,在办公室原形毕露

据彭博社报道,越来越多求职者借助ChatGPT等AI工具在线上面试中作弊,通过实时获取答案来通过技术或行为问题考核。然而,这些求职者入职后往往无法胜任实际工作,甚至出现基础错误频发、任务无法独立完成等情况,导致试用期被辞退或业绩垫底。人力资源专家指出,AI作弊正加剧招聘市场的信息不对称,企业已开始采用更复杂的防作弊监控系统,并增加实地考核环节。这一现象不仅损害了诚实求职者的利益,也增加了企业的招聘成本,暴露出AI滥用对职场诚信体系的冲击。 #求职 #AI作弊 #面试 #职场诚信 #招聘 #科技 #人力资源 #Bloomberg
AI编写代码时代,初级工程师如何成长为高级工程师?

一位刚毕业的新员工向Aviator公司提问:在AI编写大部分代码的今天,怎样才能从初级工程师成长为高级甚至首席工程师?过去,初级工程师通过反复完成简单任务、接受代码审查反馈来积累判断力。如今AI替代了大量编码工作,传统的成长循环似乎被打断。Netflix首席工程师Adam Berry认为,AI并未改变培养方法,反而让过程更轻松:初级工程师仍可通过分阶段的任务提升能力——先处理明确且比以往更复杂的任务,逐步减少细节描述以锻炼自主思考。此外,AI可作为结对编程中的“审讯者”,引导初学者而非直接给答案,从而迫使他们在小修复中也能保持思考。关键是随着范围扩大,从具体问题走向模糊问题,这正是工程师成长的定义。 #AI #初级工程师 #高级工程师 #职业成长 #编程 #技术管理 #Netflix
AI招聘工具Verdict

Verdict是一款AI驱动的招聘评估工具,可读取职位描述和2-50份CV PDF,并在几分钟内生成带有证据引用的评分结果。它从能力、履历、发展轨迹、影响力、专业深度和风险面六个维度(每项1-5分,满分30分)对候选人进行评分,每项评分都直接引用CV中的原话作为依据,杜绝无证据的断言。系统在评估时自动忽略姓名、性别、年龄等信息,并在双人对比中随机排列候选人顺序,再由盲审合成评分,以降低偏见。对于重复性过高或留任风险,工具会在结果中明示预警,并附上面试问题和参考核查问题。用户可上传历史招聘数据以校准模型,使后续分析更贴合企业用人标准。该工具支持2-50份CV同时对比,结果以排名短名单或双人对比形式呈现,可分享只读链接或导出PDF。 #AI招聘 #招聘工具 #CV评分 #反偏见 #人力资源科技
Liveshortly 上线:实时直播 AI 代理会话,支持团队协作提示

一款名为 Liveshortly 的新工具近日在 Hacker News 上发布,旨在为 AI 代理的协作与分享提供新方式。该工具允许用户直播自己的 AI 代理会话,并支持团队成员在单个 Claude 或 Codex 会话中进行协作配对提示。会话结束后,用户可将完整对话记录发布为博客或轨迹,供他人学习并利用丰富的上下文信息。这一创新有望提升 AI 协作效率,促进知识共享。 #AI #协作 #直播 #提示工程 #开源 #工具 #科技 #HackerNews
This media is not supported in your browser
VIEW IN TELEGRAM
AI RPG 游戏生成器

该平台是一款基于AI的免费浏览器角色扮演游戏,利用实时AI故事生成器,根据玩家选择动态生成500-700字的新场景,包含对话、紧张情节和三种有意义的选择。与传统静态视觉小说不同,每项决策都会永久分支故事走向,NPC会记住玩家的过往行动、语气和联盟关系,关系变化、秘密浮现,故事如同Netflix互动剧集,但非预写。玩家可自定义世界背景或从预设主题开始,每次游玩独一无二,支持多结局,无需下载或注册即可免费使用。 #AI #RPG #故事生成 #交互式小说 #角色扮演 #游戏
Aireceipts

开发者因无法回答“上次代理会话实际花费多少”而创建了Aireceipts。该工具在AI代理工作时,于输入框下方实时显示计费模型、累计费用、每小时美元成本及速率限制窗口剩余时间,并能即时标记如卡住的Bash重试循环等浪费行为。会话结束后,运行npx aireceipts-cli即可打印包含每个工具定价的明细收据,帮助用户清晰了解每一笔花费。此外,还提供token成本对比等功能,让AI编程成本透明化。 #AI #编程 #成本 #开源 #工具 #效率 #FinTech #开发 #透明度
IBM 股价暴跌 23%,客户支出转向 AI 领域

IBM 股价在交易中大幅下跌 23%,创下近年来最大单日跌幅。市场分析指出,客户正将 IT 预算从传统硬件和服务转向人工智能领域,对 IBM 的核心业务造成显著冲击。尽管 IBM 也在积极布局 AI 和混合云,但转型速度未能赶上市场需求的急速变化,导致季度业绩不及预期。分析师下调评级,投资者担忧其传统业务面临长期萎缩风险。 #IBM #股价暴跌 #AI #科技股 #市场转型 #IT支出 #财报 #传统业务
机器学习专家批评AI热潮

十五年前神经网络迎来第二次复兴,如今文本生成模型已能完美模拟对话,但作者指出这仅是“下一词预测”的巧妙把戏。尽管认知与语言专家不断解释这无法接近人类意识,科技巨头仍将命运押注于AI,投入巨量训练数据和能源。作者强调,2026年气候科学共识虽被广泛接受,但AI技术直接推高石油需求,其能源消耗本身已使这项技术不宜推广。然而,对技术造成的社会与生态伤害的道德批评被普遍忽视。作为拥有20年经验的机器学习从业者,作者坦言自己曾为神经网络发展兴奋,但现在认为这列火车已脱轨。 #AI #人工智能 #科技批评 #能源消耗 #气候 #机器学习 #聊天机器人 #技术伦理
AI 赚钱效应席卷编码领域,下一个风口在哪

AI 在经济价值上的第一块“应许之地”是软件编码:因为编码既可自动验证,又能通过并行模拟快速迭代,满足“可验证”与“可重复”的双重条件。风险投资机构观察到,强化学习正成为独立基础设施层,而研究者指出,传统大模型训练只奖励单次正确回答,无法持续学习,这正是编码这类单次可验证任务率先被 AI 攻破的原因。现实影响是,软件工程师的工作重心从“编写”转向“审核与构建”,岗位数量不会骤减,但技能要求发生质变。接下来,形式数学、科学模拟等领域同样符合“可验证+可重复”逻辑,有望成为 AI 落地的下一批目标;而需要大量实地实验或不可重复的领域则仍需人力主导。谁能在 AI 辅助下高效验证和纠错,谁就能掌握未来杠杆。 #AI #编程 #经济价值 #软件工程师 #自动化 #大模型 #强化学习 #可验证
安全研究员发现78款AI产品存在跨租户数据泄露漏洞

一位安全研究员对200多款多租户AI及SaaS产品进行了源代码审查,发现其中78款存在跨租户数据暴露漏洞,总计84项发现。该漏洞均属于同一类型:写入路径正确执行了租户权限检查,但相邻的读取端点(如列表、查看、搜索接口)却未附带任何租户过滤器,导致攻击者可通过猜测ID直接读取(甚至修改、删除)其他租户数据。研究员称其为“未加固的读取兄弟端点”。目前已有31项发现作为GitHub安全公告提交,多数产品仍在协调披露中,已修复的产品已公开点名,其余需等修复上线后再公布。 #安全漏洞 #AI安全 #多租户 #数据泄露 #开源安全 #网络安全 #源代码审计 #租户隔离