AI知识库 @ai521
316 subscribers
21.8K photos
42 videos
19 files
837 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
Anthropic 推出 Claude 应用网关,助力企业集中管理 AI 开发工具

企业在跨开发团队部署 Claude Code 和 Claude Desktop 时,常面临访问权限、成本与策略分散管理的难题。为此,Anthropic 发布了面向 AWS 的 Claude 应用网关(Claude apps gateway for AWS),这是一个自托管控制平面,为组织提供对 Claude Code 和 Claude Desktop 的单一控制点。该网关可替代为每位开发者单独配置云凭证、手动推送设置或自建追踪工具的做法。企业可通过 Amazon Bedrock 部署以将数据保留在 AWS 安全边界内,或通过 AWS 上的 Claude Platform 获得原生体验。网关内置于 Claude Code CLI 二进制文件中,以无状态容器运行,后端使用 PostgreSQL 存储短期登录状态和速率限制计数器。开发者通过现有身份提供商(IdP)进行入职和离职,无需在机器上保留长期密钥。网关负责身份验证、策略执行、成本追踪等核心功能,配置通过单一 YAML 文件完成,密钥通过环境变量管理。 #Anthropic #Claude #AWS #企业AI #网关 #集中管理 #安全 #开发工具 #AmazonBedrock #ClaudePlatform
晶泰科技发布生命科学专属AI智能体epiXora,加速Multi

晶泰科技近日宣布推出面向生命科学与医药研发场景的专业级AI调研智能体epiXora。该智能体以可信决策为基座,旨在通过自主调研、数据分析与策略推演,提升药物研发流程的效率与可靠性。epiXora能够整合多源信息,生成可验证的决策支持,从而完善Multi-Agent体系下的研发闭环。这一发布标志着AI在生命科学领域的应用进一步深化,有望缩短新药发现周期并降低试错成本。 #晶泰科技 #AI智能体 #生命科学 #医药研发 #Multi-Agent #epiXora #技术发布 #AI制药 #药物研发
OpenAI 公布政府与国家安全合作原则

OpenAI 近日发布声明,阐述其与政府和国家安全机构合作的基本立场与原则。该公司强调,在涉及国家安全领域的合作中,将坚持负责任的人工智能使用、民主问责制以及公共安全优先三大核心准则。OpenAI 表示,此类合作旨在确保 AI 技术服务于公共利益,同时防范潜在风险,并承诺在合作过程中保持透明度和伦理审查。此举反映了 AI 企业在全球安全格局中日益重要的角色,以及平衡技术创新与国家安全需求的挑战。 #OpenAI #人工智能 #国家安全 #政府合作 #负责任AI #公共安全 #科技伦理
Ghost:实时AI面试助手,帮你精准回答面试问题

Ghost是一款专为求职面试设计的实时AI工具,能在面试中快速生成自然、精准的回答。用户只需在面试前打开Ghost标签页,输入岗位和个人背景,面试官提问后输入问题,Ghost即可在3秒内给出答案,并支持自信、简洁、故事化、技术化四种语气模式。该工具适用于行为面试、技术面试、薪资谈判、电话筛选及大学申请等场景,强调回答自然、不露AI痕迹,且数据仅在用户浏览器中处理,不上传服务器。免费版每天提供5次会话,Pro版每月12美元,可无限使用并解锁薪资谈判模式。 #AI面试 #求职工具 #实时AI #面试技巧 #科技产品
OpenAI 分析揭示编码基准测试 SWE

OpenAI 最新发布的一项分析指出,流行的编码能力评估基准 SWE-Bench Pro 存在显著缺陷,导致难以区分 AI 模型真实能力与测试中的噪声。该基准常用于衡量大模型在软件工程任务上的表现,但 OpenAI 发现其设计中的某些因素可能引入偏差,影响评估结果的准确性和可靠性。这一发现引发业界对当前 AI 编码评估方法有效性的广泛讨论,并可能推动更严谨的测试标准制定。 #OpenAI #SWEBench #编码评估 #AI模型 #基准测试 #可靠性 #准确性 #科技新闻
Anthropic 推出 Claude Cowork 全平台版本,AI 办公从编程转向业务流程

Anthropic 近日面向 Max 订阅用户正式上线 Claude Cowork 的网页版及移动端应用,使其从单一桌面编程工具升级为覆盖全场景的智能协作平台。用户可在电脑端创建任务,并通过手机随时跟踪进度,即便笔记本电脑关闭,后台任务仍能持续运行,仅在关键决策点向用户确认。这一“始终在线”特性让 Cowork 成为跨设备的 AI 行政同事。Anthropic 基于 60 万家机构、120 万次会话的数据分析显示,该工具实际核心应用并非代码编写(仅占 8.7%),而是业务流程运营(占 33.4%),包括整合报告、整理入职清单、对账及维护表格等,主要服务财务、人力资源及行政岗位。目前产品已开启移动端与网页端便捷接入,未来将统一聊天与协作功能,标志着 AI 代理竞争从代码编辑器转向更广阔的办公空间。 #Anthropic #ClaudeCowork #AI办公 #智能协作 #业务流程 #移动端 #科技新闻
公开LLM基准测试大多不可靠,专家揭露四大造假方式

OpenRouter吞吐量、Design Arena ELO和代币价格等指标显示应跳过Opus 4.7,但作者自建的3D评估套件却得出相反结论。专家指出,公开LLM基准测试存在四大欺骗手段:测试集污染(模型在训练时已见过题目)、评估指标选择偏差(只展示有利结果)、任务设计脱离实际应用场景、以及过度优化单一指标导致泛化能力下降。这些虚假基准误导开发者选择模型,实际表现与宣传严重不符。行业呼吁建立更透明、可复现的评估体系。 #LLM #基准测试 #AI评估 #模型欺骗 #科技新闻
AI时代印度科技业转型

印度依赖三十年的外包技术服务业实现了经济增长,但AI的扩张正迫使该行业转型。金融时报记者调查发现,印度正成为全球第二大AI劳动力市场,大量工人从事数据标注和机器人训练工作。在泰米尔纳德邦卡鲁尔的一家纺织厂,工人每天佩戴GoPro或Meta智能眼镜6-8小时,记录日常操作以训练机器人,每月额外获得1万卢比补贴。这种看似反乌托邦的工作模式,本质上是将人类行为转化为AI训练数据。尽管新工种涌现,但底层数据标注岗位缺乏技术含量,且面临被自动化取代的风险。印度虽自称拥有独特的AI发展路径,但缺乏西方和中国的资本与技术积累,仍主要为全球提供“后台服务”。AI技术设计上会集中权力,印度能否在AI时代真正繁荣仍是未知数。 #AI #印度科技 #数据标注 #机器人 #劳动力转型 #自动化 #外包 #科技新闻 #FT #人工智能
开源AI堆栈差距地图v0.1发布,揭示生态碎片化与机遇

Current AI 发布开源 AI 堆栈差距地图 v0.1,该地图调查了超过 24,626 个项目,深入评估了 421 个产品,包括 266 个软件工具、85 个模型、50 个数据集和 20 个硬件项目,涵盖模型组件、产品/用户体验和基础设施三个层次。地图通过开放性、能力和采用率三个维度评分,旨在识别开源 AI 生态中的关键空白,帮助开发者、投资者和政策制定者明确优先建设方向。项目源自哥伦比亚会议、MOF 和 Hugging Face 等专家推荐,并经过严格评分。该工具是 Current AI 系列工具的首个版本,旨在将复杂生态可视化,推动社区围绕集体路线图行动,解决当前开源 AI 堆栈碎片化、重复建设的问题。 #开源AI #差距地图 #AI堆栈 #CurrentAI #AI生态 #技术工具 #模型评估 #开放AI #AI基础设施
阶跃星辰将推出首款AI手机,国内大模型厂商布局硬件终端

继海外OpenAI等加速布局AI手机后,国内大模型独角兽阶跃星辰拟推出首款AI智能体手机,已有多家消费电子供应链厂商参与配套开发,产品有望近期落地。业内人士表示,手机牌照问题仍在等待,技术层面已无大碍。此前荣耀、谷歌等厂商已将AI Agent作为新一代操作系统方向,终端系统成为全球AI竞争新焦点。阶跃星辰多轮融资中已出现硬件产业链资本身影,包括华勤技术、龙旗科技、豪威集团、中兴通讯等。国内成熟的手机制造体系为大模型企业进入硬件提供了条件,AI产业竞争正从云端训练转向终端入口,模型厂商希望借助手机建立更稳定的用户入口和商业化能力。 #阶跃星辰 #AI手机 #大模型 #终端硬件 #科技新闻 #消费电子