AI知识库 @ai521
371 subscribers
24.4K photos
45 videos
20 files
930 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
_done 发布 AI 行动扩展工具,无需账户即可执行真实任务

一款名为 _done 的 AI 工具在 Hacker News 上公开,旨在扩展 AI 的实操能力。该工具允许智能体按需执行真实世界任务,采用 x402 付费模式,每次使用无需注册账户、登录或密钥。此设计大幅降低了 AI 自动化执行线下操作的门槛,开发者可快速将 _done 集成到工作流中。目前该工具已上线,但评论区尚无回应,市场反响待观察。 #AI #工具 #自动化 #HackerNews #无登录
Velonus 推出 AI 原生 DevSecOps 工具,Beta 版支持一键修复 PR

Velonus 正式进入 beta 阶段,这是一款 AI 原生的 DevSecOps 工具,专注于 Python 项目安全。通过并行运行 Bandit、semgrep、gitleaks、pip-audit 和 safety 等主流扫描器,Velonus 能够在单次扫描中覆盖全攻击面,且无需手动配置。其 AI 引擎自动对发现结果进行重要性排序,过滤掉 93% 的误报,并直接生成修复代码,用户可通过 CLI、GitHub Action 或 REST API 一键合入 PR,实现从终端到仓库的自动修复流程。整个扫描中位耗时不足 60 秒,单次 AI 成本仅约 0.04 美元。Velonus 致力于让安全团队聚焦真正重要的少数风险,目前已在 GitHub、GitLab、Bitbucket 等平台提供原生集成。 #DevSecOps #AI #安全 #Python #自动化 #代码扫描 #漏洞修复
KB金融与谷歌云达成战略合作,加速AI转型

据韩国《亚洲经济》报道,KB金融集团宣布与谷歌云签署战略合作协议,共同推动集团人工智能(AI)转型。双方将结合谷歌云的最新AI技术与KB金融在金融领域的专业能力,开展基于AI的业务创新、改善客户金融体验、推进数据驱动型决策,并建设AI金融平台。作为合作首项成果,KB金融利用谷歌云的生成式AI模型Gemini,成功开发了面向员工的数据分析AI代理“KB Dav”。该代理可辅助员工高效处理和分析金融数据,提升决策效率与精准度。此次合作标志着KB金融在金融科技领域的深化布局,旨在通过引入顶尖云AI技术,实现业务模式革新与全球化竞争力提升。 #KB金融 #谷歌云 #AI转型 #生成式AI #Gemini #金融科技 #数据分析 #人工智能 #战略合作 #韩国金融
AI 每日一游戏挑战第106天

一位开发者利用AI(主要为Claude)进行“每天创作一款新游戏”的个人挑战,目前已持续106天。第106天的作品是他首次涉足僵尸生存题材。通常只需少量提示即可完成游戏,但这次为了完善武器系统和玩法细节,他在每月20美元的Pro订阅时段内(约5小时窗口),借助Opus 5模型用了近1小时才完成。随后他外出休息并回答网友提问。该项目仅为其个人业余爱好,但他乐在其中。 #AI #游戏开发 #每天一款游戏 #僵尸生存 #Claude #编程挑战 #个人项目 #创造力 #技术实验
Moonshot AI 免费发布 Kimi K3 模型权重,中国最强代理 AI 开放下载

Moonshot AI 近日通过 Hugging Face 免费发布了其旗舰代理模型 Kimi K3 的权重。该模型拥有 2.8 万亿参数和 1 万亿 token 的超长上下文窗口,能够高效处理长文档与复杂推理任务,在 Agent Arena 排行榜上位列第三。此次开源使得企业、研究人员与开发者无需支付昂贵 API 费用即可本地部署这一顶级模型。但当前完整模型体积超过 1TB,运行门槛极高,需配备如 Nvidia DGX B200(1440GB GPU 内存)等专业系统。未来经过蒸馏后有望在消费级设备上运行,用户亦可通过网页端直接体验对话功能。 #KimiK3 #MoonshotAI #大模型 #AI开源 #国产AI #代理AI #科技新闻
Google AI Studio 删除功能被指不彻底,仅移除云端文件而非对话记录

用户发现 Google AI Studio 的“Delete”按钮并未真正从服务器删除聊天记录。测试表明,该功能仅移除 Google Drive 中的 JSON 文件,而聊天会话、上下文数据继续保留在服务器端。这一行为被指并非程序错误,而是有意设计。倡议者呼吁更多用户重复测试,以形成证据链迫使谷歌承认问题。该事件引发对数据隐私与用户控制权的质疑,尤其是在 AI 工具广泛应用的背景下,数据残留可能带来安全隐患。 #Google #AIStudio #隐私 #数据删除 #科技新闻 #用户权益 #网络安全
OpenAI, Google, and Anthropic Absent from Nvidia-Led Open Secure AI Alliance

OpenAI, Google, and Anthropic, companies behind proprietary,
不要向LLM索要置信度分数

近期,关于要求大语言模型(LLM)生成自身答案置信度分数的做法引发讨论。多位技术专家指出,这一方法从科学角度看完全无效:模型给出的0到100连续置信度评分缺乏任何可验证的依据,本质上是一种心理安慰而非真实可靠性度量。尽管Anthropic等机构的研究表明模型在生成过程中存在潜在内部状态,如提前规划词语,以及能够觉察激活层中的概念注入,但这些能力高度不可靠且依赖上下文。更重要的是,试图通过模型的推理过程来评估置信度会陷入“谁监督监督者”的无穷回归问题——每个置信度评分都需要另一个置信度来验证。因此,向LLM索要置信度分数不仅无助于提升结果可信度,反而可能误导开发者与用户。 #AI #LLM #置信度 #可靠性 #大模型 #人工智能 #科学研究 #科技
实测 Apple Silicon 大模型推理速度,原始数据公开

一项针对 Apple Silicon 芯片(M4 Pro、M4 Max、M3 Ultra)的大模型推理速度基准测试正式发布。测试基于实际生产环境,使用 Ollama 0.31.2 和 macOS 15.3.1,通过固定提示词和 512 token 生成预算,每款模型运行三次取中位数。结果显示,生成速度主要受内存带宽限制,呈近似线性扩展。原始数据以 JSON 格式公开,遵循 CC BY 4.0 协议,可供开发者参考复现。该测试旨在提供真实可比的性能指标,而非理论纸面数据。 #AppleSilicon #LLM #推理速度 #Ollama #基准测试 #M4Max #M3Ultra #开源数据
Kimi K3

月之暗面(Moonshot AI)在其模型页面汇总了近期多篇重要文章。7月16日发布的《,以及我们仍能从鹈鹕基准测试中学到什么》聚焦模型推理能力评估及其带来的启示;7月21日的《与Claude Code团队Cat和Thariq的炉边谈话》分享了开发经验;7月22日的《OpenAI对Hugging Face的意外网络攻击
AI支出激增导致大型科技公司信用风险大幅上升

据英国《金融时报》报道,随着对人工智能领域的大规模投资持续膨胀,多家大型科技公司的信用风险指标近期显著恶化。市场分析指出,尽管科技巨头纷纷争相布局AI基础设施,但高昂的资本支出与不确定的盈利前景加剧了债务压力。评级机构警告,若AI业务无法在短期内产生足够回报,部分企业的信用评级可能面临下调风险。这一趋势已引发投资者对科技行业整体财务健康度的担忧。 #AI支出 #科技巨头 #信用风险 #债务压力 #金融市场 #投资风险 #评级机构 #资本支出
Call Me 应用上线:AI 代理可直接给你打电话,无需额外运营商费用

一位开发者近日展示了其个人项目“Call Me”,这是一款允许 AI 代理直接拨打电话给用户的应用程序,且无需额外承担运营商通话成本。该应用不仅限于 AI 场景,也可以与任何 AI 框架配合使用,或直接作为 API 调用。开发者在展示中表示,这只是一个有趣的小工具,旨在探索 AI 与电话通信的轻量集成。 #AI应用 #电话代理 #开源项目 #开发者 #API