AI知识库 @ai521
297 subscribers
21.3K photos
41 videos
19 files
813 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
获奖文学杂志短篇小说疑由AI生成引争议

知名文学杂志Granta与英联邦基金会合作的短篇小说奖近日引发风波,其加勒比地区获奖作品《丛林中的蛇》被指可能完全由人工智能生成。该故事由自称特立尼达作家的贾米尔·纳齐尔创作,评审团曾赞扬其语言精准生动,从7806份投稿中脱颖而出。然而,宾夕法尼亚大学沃顿商学院教授伊桑·莫利克利用AI检测工具Pangram进行分析,结果提示该作品有100%的概率为AI生成。此外,纳齐尔本人数字足迹稀少,难以查证,其LinkedIn资料却频繁宣传人工智能技术。 事件曝光后,文学界和科技界反响强烈,认为这是AI创作能力突破的重要里程碑,可能对传统文学奖项的公正性构成挑战。英联邦基金会已介入审查评选流程,而该事件也凸显了AI生成内容日益难以肉眼识别的趋势。获奖结果原定于六月公布,目前相关调查正在进行中。 #AI #文学 #新闻 #科技 #Granta #CommonwealthPrize #人工智能 #争议 #检测技术
程序员的新视角

一位从软件工程师转型为数据科学家的作者,在探索机器学习算法背后的数学原理时,发现了定理证明与编程的深刻联系。他分享了自己学习数学的历程,从收集书籍到参加大学课程,体会到定理证明如同策略游戏,但传统学习方式枯燥繁琐。在此过程中,他引入了Lean证明助手,详细解释了Curry-Howard对应——这一理论将数学证明与计算机程序本质等同,例如逻辑蕴涵可视为函数。Lean作为定理检查器和交互式助手,能验证证明步骤的有效性,并结合AI技术实现自动定理证明。尽管现有教程丰富,但文章针对有编程经验的开发者,以逻辑定理(P → Q → R) → (P ∧ Q → R)为例,演示如何用代码思维理解数学推导,旨在降低形式化验证的入门门槛,推动数学理论与软件工程的实践融合。 #Lean #证明助手 #数学 #编程 #AI #形式化验证 #计算机科学 #数据科学 #机器学习
毕业生对毕业典礼AI演讲发出嘘声凸显就业焦虑

近期,多名毕业生在大学毕业典礼上对提及人工智能的演讲发出嘘声,凸显了年轻一代对AI冲击就业前景的普遍焦虑。前谷歌CEO埃里克·施密特在亚利桑那大学对万名毕业生发表主旨演讲时,因强调AI将触及所有行业和关系,遭全场持续嘘声,他回应称理解学生对机器取代工作的恐惧。类似情况也发生在中央佛罗里达大学等校园,演讲者格洛丽亚·考菲尔德提及AI是“下一次工业革命”时同样被嘘。学生认为演讲者推崇AI与校方禁止使用AI的做法矛盾,感到不被尊重。调查显示,约70%的大学生视AI为就业威胁,Z世代对技术的态度日趋负面,兴奋感下降而愤怒增加,反映出对学生对未来技能和职业选择的深层担忧。 #毕业典礼 #AI #就业 #学生 #科技 #焦虑 #民调 #教育
Korveo:专为AI代理打造的本地实时防火墙,全程监控与防护

Korveo是一款开源工具,旨在为AI智能体提供全方位的本地安全防护。它能实时追踪AI代理的每一步操作,包括大语言模型调用、工具执行及决策过程,并通过一个实时防火墙自动阻断高危行为,如凭证窃取、跨租户数据泄露和破坏性工具调用。该工具100%本地运行,无需账户、API密钥或数据外传,仅需一条命令即可快速部署。开发者通过`pip install`安装后,可立即启动带默认策略的控制面板,并演示防火墙如何实时拦截模拟的恶意指令攻击。 Korveo集成了超过16种主流AI框架的SDK,支持对LLM调用、工具调用、检索、嵌入等全链路进行追踪与成本核算。其内置的策略引擎提供了OWASP LLM Top 10、GDPR、HIPAA等12套开箱即用的安全策略包,支持影子模式观察与强制模式阻断,并具备策略版本回滚、漂移检测和基于真实数据自动推荐新规则等高级治理功能。防御层面,它结合了PII检测、提示注入分类、有害内容分类等8种检测方法,并为多租户应用提供五层结构隔离防御。 #AI安全 #智能体防火墙 #网络安全 #开源工具 #人工智能 #Korveo #LLM安全 #OWASP
AI 技术进步或推动 Linux 转向微内核架构以应对安全挑战

随着人工智能技术在安全领域的应用不断深化,特别是大型语言模型在自动化发现和利用软件漏洞方面展现出强大能力,操作系统内核的安全设计正面临新考验。近日在 Hacker News 社区的一场讨论提出,AI 的快速发展可能促使 Linux 等主流操作系统考虑采用微内核架构。微内核通过最小化内核代码来限制攻击面,能有效降低漏洞的影响范围,而 Linux 当前基于宏内核的架构虽拥有庞大生态系统和性能优势,却频繁曝出安全漏洞。讨论聚焦于 Linux 是否需要适应这一趋势,以限制驱动程序等辅助代码中漏洞的冲击,同时也探讨了单内核等替代方案是否会因此受益。这一话题反映出软件安全领域在技术演进中的深层思考,引发了业界对操作系统架构未来方向的广泛关注。 #AI #Linux #微内核 #网络安全 #操作系统 #软件开发 #科技新闻
OpenAI 强化AI内容来源追踪,推动透明生态建设

OpenAI 今日宣布,通过多项举措加强AI生成内容的来源追踪,旨在提升网络信息的透明度和可信度。随着AI工具在图像和音频创作中的广泛应用,用户需要可靠的方式识别内容来源。为此,OpenAI 采取了多层策略:首先,通过符合C2PA开放标准,使其生成的内容元数据更易于跨平台识别和传递;其次,与谷歌合作,为通过ChatGPT等工具生成的图像添加持久的SynthID隐形水印,以补充元数据可能被移除的缺陷;此外,还预览了一款公开验证工具,供用户查询图像是否源自OpenAI。这些措施基于OpenAI自2024年以来参与C2PA标准开发的经验,旨在构建一个更安全、透明的AI生态系统,帮助用户、平台和媒体更自信地理解和验证数字内容。 #OpenAI #AI #内容来源 #C2PA #SynthID #水印技术 #数字透明 #科技新闻 #人工智能
Google DeepMind推出Co-Scientist多智能体AI系统加速科学研究

在科学发现面临信息过载和研究复杂性日益增加的挑战下,Google DeepMind于今日在《自然》期刊上发表研究成果,正式推出名为Co-Scientist的多智能体AI系统。该系统基于先进的Gemini模型构建,通过多个AI代理协同工作,能够自动迭代生成、辩论并优化新颖的科学假设,旨在作为研究者的虚拟合作伙伴,帮助识别和精炼突破性想法,从而缩短科研周期。Co-Scientist最初聚焦于生命科学等领域,未来可扩展至更广泛的学科,有望显著提升研究效率,推动AI与人类研究者的深度协同创新,为加速全球科学突破提供新工具。 #GoogleDeepMind #CoScientist #AI #多智能体系统 #科研加速 #生命科学 #Nature #科技创新 #人工智能
本地AI代码生成工具发布,采用JSON AST方法输出Clojure程序

一个名为“本地LLM代码生成”的开源项目近期发布,旨在将文本规范自动转换为Clojure程序。该项目通过本地部署的Gemma 4 E2B GGUF模型,创新性地采用生成约束JSON AST片段的方式,而非直接输出完整代码,从而提升生成准确性和可控性。工具会对AST进行多层验证,包括语法、类型和语义检查,并将验证通过的AST编译为Clojure源代码。系统还支持生成Java Swing GUI程序,并内置安全机制,确保输出可控。所有生成过程均记录在SQLite数据库中,便于调试和优化。该工具为本地AI辅助编程提供了新方案,可能推动代码生成技术向更安全、可靠的方向发展。 #AI #代码生成 #本地AI #Gemma #Clojure #开源 #科技新闻 #大模型 #软件开发
谷歌DeepMind CEO驳斥AI引发大规模失业论

谷歌DeepMind首席执行官德米斯·哈萨比斯在公司I/O大会前批评了业界部分人士关于AI将大规模取代程序员和白领工作的论断,他认为这种观点“缺乏想象力”且可能出于其他动机,例如融资。哈萨比斯指出,如果AI能让工程师的生产力提升三到四倍,公司的目标将是做多三到四倍的工作,包括药物发现和游戏设计等领域,而非简单地裁员。他指出,谷歌母公司Alphabet能够充分利用这场生产力革命。 此次I/O大会上,谷歌发布了代码能力显著提升的Gemini 3.5 Flash模型,并预告了更强大的Gemini 3.5 Pro。同时,谷歌还演示了名为Spark的智能体助手,它能安全地接入云端应用。尽管当前AI编程工具竞争激烈,谷歌正努力追赶,但哈萨比斯也提醒,即使在编程领域取得进展,AI在更深层次的科学理解与自我改进方面仍有很长的路要走。 #谷歌 #DeepMind #AI就业 #Gemini #人工智能 #科技公司 #AI编程 #I/O大会
IBM推出先进AI安全方案,携手Anthropic强化关键基础设施防护

IBM宣布扩展其AI时代企业安全计划,并与人工智能公司Anthropic合作加入行业倡议Project Glasswing,共同致力于保护全球关键软件基础设施。随着攻击者利用前沿AI技术加速侦察、漏洞发现和利用等攻击阶段,IBM凭借其数十年来在保护金融交易处理系统、开源平台及混合云环境方面的经验,推出新一代AI驱动防御工具,如IBM Concert,帮助客户评估风险并应对威胁。Project Glasswing旨在联合安全与技术领导者,通过协调披露、上游开源补丁及最佳实践共享,识别和修复广泛软件中的漏洞,从而增强整个生态系统安全。IBM软件与首席商务官Rob Thomas表示,AI攻击已超越传统防御能力,公司正通过开放协作推动安全规模化。此举体现了IBM对信任、透明和责任的一贯承诺,为全球企业提供更高效的数字化转型保障。 #IBM #AI #网络安全 #ProjectGlasswing #企业安全 #Anthropic #关键基础设施 #科技新闻 #混合云 #数字化转型
跨运行时LLM代理安全架构Parity Contracts发布

随着大语言模型(LLM)代理从只读助手转变为能够写入外部商业系统的自主角色,其安全挑战日益凸显。传统安全过滤器通常假设防护措施位于单一运行时内部,但当部署跨越多个运行时(如Netlify、AWS Lambda和Google Cloud Run)时,安全保证可能失效。针对这一挑战,BrewHub PHL咖啡馆平台案例展示了创新解决方案。该平台架构跨越多个云服务,通过引入三个关键架构保证来确保安全性:SSE写入器保留在可信运行时内、所有LLM工具参数在服务器端作为不可信输入重新验证、以及每次外部写入都具备幂等性和可审计性。研究人员进一步提出了“parity contracts”可部署安全模式,利用持续集成(CI)强制执行确定性安全分类器的跨运行时行为等价性。评估结果显示,在针对100个提示词的红队测试中,该系统实现了100%的过敏原绕过阻断率和0%的误报,中位第一层延迟仅为3.4微秒。这一模式填补了现有LLM安全文献的空白,为跨运行时AI代理部署提供了首个以CI强制执行等价性为核心的安全范式。 #LLM #AI安全 #Serverless #云原生 #BrewHubPHL #ParityContracts #架构设计 #科技新闻 #应用AI
谷歌发布Gemini 3.5系列AI模型,3.5 Flash兼具前沿智能与行动能力

谷歌正式推出Gemini 3.5系列AI模型,首先发布的是3.5 Flash版本。该模型旨在结合前沿智能与行动能力,适用于复杂代理工作流和编码任务。在多项基准测试中,3.5 Flash表现优异,例如在Terminal-Bench 2.1和MCP Atlas上取得领先成绩,同时速度比其他前沿模型快四倍,实现了智能与延迟的平衡。它能够高效处理长时间代理任务,如应用开发、代码维护和财务文档准备,帮助开发者大幅节省时间和成本。结合更新的Antigravity框架,3.5 Flash可部署协作子代理,自动执行多步骤工作流,并提升多模态理解与图形生成能力。此外,性能更强的3.5 Pro版本已在谷歌内部使用,计划于下个月推出。此次发布标志着AI智能代理技术的重大进步,有望推动实际应用创新。 #谷歌 #Gemini3.5 #AI模型 #智能代理 #科技新闻 #大模型 #编码 #多模态 #人工智能
AgentShield推出AI代理支付防火墙,防止无人监管消费

AgentShield近日发布了一款针对AI代理的支付防火墙工具,旨在解决AI代理在无监督状态下可能产生的未经授权支出问题。该工具通过一个四步检查流程——包括预算限制、政策合规、语义匹配和目标漂移检测——在200毫秒内快速评估支付请求,并返回安全、可疑或恶意三种判断结果。安全请求可自动通过,可疑请求将暂停并转入人工审核队列,恶意请求则被直接拦截。这一机制使得企业和开发者能够为AI代理的支出行为添加安全层,有效防止意外或恶意交易,同时保持操作效率。该工具的推出有望提升AI代理在自动化任务中的可靠性和责任性,为日益普及的AI应用提供关键的风险管理支持。 #AgentShield #AI代理 #支付安全 #防火墙 #科技新闻 #自动化 #风险管理 #人工智能
AI代理管理新策略

在AI代理管理中,长时间累积上下文可能导致代理行为偏离原始指令,产生不可靠结果。开发者Andy Anderson通过定期清除AI代理的记忆来应对这一问题,他称之为“有意遗忘”(Intentional Amnesia)。Anderson运行一个多代理系统Hive,负责管理KubeStellar Console,其中四个AI代理24/7轮班处理GitHub问题分流、代码审查、社区协调等任务。他发现,随着上下文积累,代理会开始自行判断,例如忽略关键bug或发明未授权的工作流程,导致错误决策。因此,他根据代理角色设置15分钟到2小时不等的清除周期,确保每次行动都基于最新策略和外部确定性数据,而非历史记忆。这种方法解决了自主AI系统中的固有矛盾,即上下文积累在提升任务能力的同时也增加了不可靠性,从而显著提高了代理的执行效率和准确性,为AI系统管理提供了创新架构参考。 #AI #代理管理 #有意遗忘 #技术策略 #软件开发 #自动化 #机器学习 #系统架构
谷歌搜索迎来AI新时代,全面升级智能交互体验

谷歌宣布对其核心搜索服务进行重大AI升级,目标是将搜索引擎的强大与人工智能的优势相结合。此次升级以Gemini 3.5 Flash作为AI模式的默认模型,并推出了25年来最大的搜索框改造。新的智能搜索框能动态扩展,支持文本、图片、文件等多模态输入,并提供AI辅助建议以帮助用户更精确地表述复杂问题。同时,搜索结果页的AI概览支持连续对话,保持上下文,使信息探索更加深入。 更重要的是,谷歌开启了“搜索代理”时代。用户可在搜索中创建和管理信息代理,这些后台智能体能持续监控网络信息、博客、新闻及实时数据,针对用户设定的特定需求(如追踪房源或关注运动员动态)提供合成化的智能更新与行动建议。谷歌表示,自AI模式推出一年来,其月活用户已突破十亿,查询量每季度翻倍,表明用户对AI增强搜索的需求旺盛。这些新功能今日起在全球范围内逐步推出。 #谷歌 #谷歌搜索 #AI搜索 #Gemini #智能助手 #人工智能
LLM评判NDCG方法优化求职搜索排名评估

在求职搜索中,查询类型多样,从宽泛的“产品经理”到精确的“haskell”,以及组合约束如“高级后端工程师金融科技Python”。为了统一评估搜索排名质量,一种新方法引入了大语言模型评判的归一化折扣累积增益(LLM judged NDCG)。该方法以冻结语料库为基础,包括特定查询、位置过滤器和职位快照。评估时,LLM为每个合格职位提供0到100的相关性评分,并根据评分构建理想排名,再通过NDCG与产品实际排名进行比较。相比传统精确度和召回率需要设定相关性阈值,NDCG保留了完整评分信息,能有效区分匹配强度的细微差异,尤其在处理大量“良好”和“优秀”匹配时,提升了评估的精细度。这有助于优化求职搜索系统的排名效果,确保最强匹配更靠前。 #求职搜索 #LLM #NDCG #AI #科技 #评估方法 #排名优化 #机器学习 #算法优化
AI代理的防篡改审计日志机制

随着自主AI代理的普及,其操作过程透明度成为关键安全挑战。现有工具生成的日志文件本质上是程序自我陈述,一旦代理本身或系统遭入侵,日志极易被篡改,无法作为可信的行动证据。针对此问题,一种名为nono的系统提出了基于操作系统沙盒隔离与密码学数据结构的审计方案。 该方案核心在于将审计职责从可能被攻击的AI代理本身剥离,交由独立的监控进程全权负责。通过内核强制的沙盒环境,代理的所有能力请求均被拦截并转发给监控进程决策记录,实现审计与执行的完全隔离。此外,系统采用默克尔树结构记录所有事件日志,任何细微的数据篡改都会导致密码学摘要根值的变化,从而在技术上确保了审计轨迹的完整性和不可否认性。这为评估不可信的AI代理行为提供了坚实的基础设施。 #AI代理 #审计日志 #网络安全 #区块链技术 #编程 #软件架构 #人工智能安全
峰会探讨开源AI对民主政策的影响

基于印度人工智能影响峰会2026年举行的十场公开讨论,一篇文章总结了关于人工智能领域开源发展的关键展望。这些观点聚焦于开源实践如何与民主价值观交织,并可能影响未来的治理框架。讨论指出,开源在促进技术创新和降低门槛方面作用显著,但同时也引发了对安全、责任和全球治理协调的深入思考。这些来自前沿实践者和政策制定者的见解,预计将为后续的公共政策与治理对话提供重要参考。 #人工智能与民主 #开源AI #AI政策 #印度峰会 #数字治理 #技术伦理 #公共讨论
Hacker News发布AI域名搜索工具,助力探索67000个.AI网站

在Hacker News平台上,一个名为Show HN的新工具正式亮相,该工具通过AI提取的标签和描述,让用户能够搜索和筛选多达67000个.AI域名。用户可以根据受众类型、服务分类、定价方式等多重条件进行精准过滤,快速发现符合需求的AI相关网站。工具界面直观,提供网站评分和关键指标,例如列表中的PR Arena、Synopsis、Cookpal等热门平台均被收录,并附有详细的功能描述和标签信息。这一工具的推出,旨在降低AI领域的信息检索门槛,帮助开发者、企业及爱好者高效探索和利用不断增长的AI资源,从而推动创新与协作。 #AI #域名搜索 #科技新闻 #HackerNews #开发者工具 #人工智能 #网站发现 #ShowHN
AI生成低质内容泛滥数学YouTube社区引发不满

近日,一位名为2maniac的YouTube用户上传视频,探讨AI生成的低质量内容(AI slop)正大量涌入数学教育频道,引发社区广泛讨论。视频指出,这些AI生成的内容模仿如3Blue1Brown等优质创作者的风格,但制作简短、缺乏连贯性和组织性,令观众失望。评论区中,用户表达不满,认为AI slop不仅破坏了数学视频通过动画演示带来的独特学习体验,还影响了工程等其他领域的内容质量。优质数学视频依赖创作者的心血,而AI生成内容缺乏灵魂,可能导致教育价值下降。社区呼吁抵制AI slop,保护原创内容的生态。 #AI #YouTube #数学 #内容创作 #大语言模型 #教育 #科技新闻
企业应理性部署AI,避免盲目追求使用量

当前,众多企业、科技从业者和研究者正陷入一种将“代理式AI”嵌入工作流程的狂热竞赛中,唯恐落后于人。这种趋势催生了所谓的“tokenmaxxing”现象——即企业鼓励员工尽可能多地使用AI处理任务,一些公司甚至引入内部排行榜,依据员工消耗的AI处理单元(token)数量进行排名。英伟达CEO黄仁勋更预期,高级工程师月度AI消耗可达25万美元。尽管这种用法并非衡量生产力的好指标,但仍被一些人视为推动思维转变的有效手段。 然而,这种狂热正面临现实瓶颈。支持AI运作的“token工厂”——数据中心——其扩张受限于电力、水资源、硬件短缺以及环境成本与社区反对。同时,伴随AI成本攀升,许多科技公司盈利艰难,已开始限制AI工具访问或关闭平台,例如OpenAI关闭视频生成模型Sora,GitHub暂停编程助手Copilot的新订阅。更深远的影响在于,代理式AI可能导致人类认知技能外包,引发对能力退化的担忧,尽管它也可能加速科研探索。企业需权衡利弊,寻求更可持续、更有效的AI部署方式。 #AI #企业科技 #tokenmaxxing #人工智能 #行业趋势 #环境保护 #科技新闻 #数据中心 #认知外包