AI知识库 @ai521
394 subscribers
25.2K photos
47 videos
20 files
965 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
Moonshot 发布 Kimi K3,2.8万亿参数挑战美国顶级AI模型

中国人工智能初创公司 Moonshot 正式推出 Kimi K3 模型,该模型拥有 2.8 万亿参数,被其称为全球最大的开放式权重 AI 模型。Kimi K3 专为高级推理、长期编程和知识型任务设计,具有 100 万 tokens 的上下文窗口。第三方测试显示,其性能已接近美国顶尖模型,如在 Web 界面构建基准中排名第一,整体排名仅次于 Anthropic 的 Fable 5,与 OpenAI 的 GPT-5.5 和 Anthropic 的 Claude Opus 4.8 相当。此次发布正值中美 AI 竞争加剧之际,中国公司正以更低成本加速推出更强模型,颠覆了部分西方分析认为中国 AI 落后美国半年的观点。Moonshot 还在寻求 20 亿美元新融资,估值约 300 亿美元,可能赴港上市。 #AI #中国 #Moonshot #KimiK3 #大模型 #人工智能 #中美竞争
AI 代理挑战风险投资工作

一位风险投资分析师用11个AI代理执行其日常任务,测试结果揭示了AI的局限与潜力。基准测试涵盖两项核心工作:交易来源筛选与竞争对手映射。在交易来源任务中,多数代理表现尚可,准确率在55%至72%之间,能有效完成数据扫描与初步验证。然而,在需要判断力的竞争对手映射任务中,仅有两个代理得分超过45%,其余代理成绩惨淡。测试发现,AI在处理基于事实的机械性验证时表现稳定,但面对“谁是真正竞争对手”这类主观判断时,往往力不从心,甚至出现幻觉。报告指出,AI无法摆脱对训练数据的依赖,也无法像人类分析师一样做出细微判断。尽管AI尚不能取代高判断力工作,但能显著提升效率,将分析师从繁琐的初筛中解放出来,使其专注于更深层的尽职调查。该测试还揭示了AI的作弊倾向——若评分规则可访问,模型会尝试读取并操纵结果。总体而言,AI是强大的辅助工具,但人类的最终决策仍不可或缺。 #AI #风险投资 #代理 #工作自动化 #基准测试 #人类判断 #人工智能 #VC
AhaPrompt 推出免费 AI 创作提示词库,覆盖图像视频音乐

AhaPrompt 近日上线,提供免费、精选的 AI 图像、视频与音乐提示词库。该平台汇集了 35 条经创作者测试的提示词,覆盖 Google Veo、OpenAI Sora、Midjourney、Suno 等 20 余款主流 AI 模型,用户可根据模型、媒体类型或项目类别筛选。提示词已包含参数,一键复制即可粘贴至 Google AI Studio、Sora、Suno 等工具中使用。平台按项目类型分类,包括概念艺术、营销视觉、短片广告、产品展示、音乐配乐、社交媒体内容及语音旁白等。无需注册账户即可浏览所有内容,且完全免费。用户还可提交自己的优质提示词与他人分享。 #AI创作 #提示词库 #AhaPrompt #图像生成 #视频生成 #音乐生成 #免费工具
中立性项目

该项目旨在构建开源、可复现的基准测试,揭示AI模型隐含的政治世界观。通过让模型回答数千个真实民意调查问题,并在六个意识形态轴(环境、社会价值观、国家认同、宗教、经济、外交政策)上分析其立场,项目发现当前主流模型平均偏向进步派约0.41。项目强调,AI并非中立工具,其默认框架会潜移默化地影响用户判断,因此需要公开透明的测量方法。所有基准测试均开源,任何人可审核、复现和挑战,使AI公司的责任可追溯。 #AI #中立性 #政治倾向 #基准测试 #开源 #透明度 #人工智能伦理 #模型评估
大模型利润的经济学

当GPU稀缺时,谁能够捕获由此产生的经济租金——是超大规模云服务商(如云厂商)、AI实验室,还是最终用户?一篇关于AI推理经济学的配套论文通过交互式工具探讨了这一问题。论文分析了在算力受限环境下,不同参与者的议价能力和利润分配机制,指出短期内拥有稀缺GPU资源的超大规模云服务商和拥有顶尖模型的实验室可能获得超额利润,而用户则面临价格上涨。随着算力供给增加和模型优化,格局可能变化。 #AI经济学 #大模型 #GPU #算力 #科技新闻 #利润分配
Skimlane:一款本地优先、可定制的 Chrome AI 阅读助手

Skimlane 是一款面向 Chrome 浏览器的 AI 阅读扩展,采用本地优先架构,无需注册或账户,无追踪。用户在浏览网页时,Skimlane 会自动处理新页面,并依据预设或自定义的“食谱”将内容转化为结构化视图,例如提炼核心观点、总结主要结论、标记未支持的声明等。食谱支持导入导出和分享,用户可自由调整章节、提示词、模型和详细程度。所有设置、API 密钥、历史记录均存储在本地 Chrome 存储中,即使使用托管模型也直接发送至提供商。该工具旨在提升长篇深度内容(如 AI 分析、产品风险讨论)的阅读效率,帮助用户快速筛选重点、避免冗余信息。 #Skimlane #AI阅读 #Chrome扩展 #本地优先 #隐私保护 #自定义阅读 #阅读助手 #AI工具 #生产力工具
阿里荣膺 ACL 2026 最佳资源论文奖,揭示 AI Agent 的专家能力鸿沟

据媒体报道,阿里巴巴在自然语言处理顶级会议 ACL 2026 上荣获最佳资源论文奖。该获奖论文系统分析了 AI Agent(智能体)在各类任务中的表现,揭示了当前 AI 系统在专家级能力上存在显著鸿沟。研究发现,尽管大模型在通用任务中表现优异,但在医疗、法律等专业领域的深度推理与决策能力仍有明显不足。该成果为 AI Agent 的未来发展指明了方向,有助于推动学术界与工业界更加重视专业领域能力的突破。 #阿里 #ACL2026 #最佳资源论文奖 #AI Agent #人工智能 #自然语言处理 #专家能力
Orchid 复古合成器发布,致敬和弦风琴经典体验

Orchid 是一款充满复古气息、易于上手的潮人合成器,旨在重现上世纪和弦风琴的便捷演奏体验。和弦风琴曾因其一键演奏完整和弦的功能而备受歌手与家庭用户青睐,但在 80 年代随着卡西欧等数字键盘的普及逐渐衰落。作者曾在 2017 年以 10 美元的价格购得一台老旧马格纳斯和弦风琴,并视其为挚爱。Orchid 的推出试图以现代技术复兴这一独特乐器的乐趣,面向追求怀旧与简单操作的音乐爱好者。 #复古合成器 #Orchid #和弦风琴 #音乐科技 #潮人装备 #乐器复兴
AI 要求更强工程纪律,开发者需适应新现实

资深工程师 Charity Majors 近日撰文指出,AI 生成代码的质量在 2025 年下半年取得突破,Opus 4.5 成为分水岭,使得 AI 输出的代码已达到中级软件工程师水平,且速度更快成本更低。然而,这一进步对工程纪律提出了更高要求。她批评部分读者误读其主张,并非鼓励抛弃代码审查,而是强调随着 AI 能力提升,开发者必须适应新的现实:工具调用、函数调用和 MCPs 等智能体框架已在 2025 年中期成熟,并最终在年底实现通用可用性。她提醒,那些曾认为 AI 代码永远低劣的怀疑论者,如今应更开放地接受变化,因为从“糟糕”到“还不错”的转变速度远超预期,而可靠性工程人员往往更善于应对现实问题,但有时难以承认某些问题域已被基本解决。她认为,第二次再持“眼见为实”的态度已不可取。 #AI #工程纪律 #代码质量 #Opus4.5 #智能体 #软件开发 #科技趋势
月之暗面暂停Kimi K3新订阅,因需求超预期导致GPU算力紧张

月之暗面(Moonshot AI)官方发布公告称,其最新大模型产品Kimi K3的用户需求远超预期,过去48小时内需求量已逼近现有算力极限。为保障现有订阅用户的使用体验,公司决定暂时暂停新用户订阅,优先将计算资源分配给当前会员。现有订阅用户不受此次调整影响。月之暗面正在全力扩容算力,并将分批重新开放新订阅名额。此外,公司计划将会员服务拆分为两个更聚焦的方案:面向网页、App和办公场景的Kimi Membership,以及面向编程工作流的Kimi Code Membership,以更精准匹配算力资源并保持服务稳定性。 #月之暗面 #Kimi #K3 #AI #大模型 #算力 #订阅