AI知识库 @ai521
344 subscribers
23.6K photos
42 videos
20 files
904 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
研究人员呼吁建立医疗AI超级智能测试框架

近日,多位学者在《自然》杂志发表观点文章,指出当前用于评估医疗人工智能的基准测试存在误导性且不充分,亟需建立一套严格、基于任务的多维度框架来定义和衡量医疗AI的“超级智能”。文章强调,现有评测过于简单或脱离临床实际,无法反映AI在复杂医疗场景中的真实能力。作者团队来自斯坦福大学、哈佛医学院、Google、OpenAI、Anthropic等多个顶尖机构,他们呼吁研究界应聚焦于可量化的任务指标,以确保医疗AI在辅助诊疗、数据解读等关键领域的可靠性和安全性。这一倡议有望推动相关行业标准和监管政策的制定。 #医疗AI #超级智能 #基准测试 #AI安全 #Nature #人工智能 #临床评估 #研究前沿
BlueVoyant AI 将安全防御引入微软Agent 365 和 Purview,加速Microsoft 365 E7 的AI 部署

BlueVoyant AI 宣布将其先进的网络安全防御能力集成至微软的 Agent 365 和 Purview 平台,旨在帮助企业在采用 Microsoft 365 E7 时,更安全地推进人工智能应用。通过这一整合,企业用户能够在微软生态内获得实时的威胁检测、自动化响应及合规管理支持,从而降低 AI 驱动的办公工具所面临的网络风险。此举不仅提升了 Microsoft 365 E7 的安全基线,也加速了企业向智能工作流转型的进程。 #BlueVoyant #AI #网络安全 #微软 #Microsoft365 #Agent365 #Purview #E7
优化器Adam默认参数并非万能

一位深度学习工程师在解决强化学习问题时,花费数周尝试各种架构调整均未成功,最终仅通过将Adam优化器的β₂从0.999降至0.95、β₁从0.9降至0.5便解决了问题。这一案例揭示了业界普遍存在的误区:盲目使用Adam或AdamW的默认参数(如学习率3e-4、β₁=0.9、β₂=0.999)并不可靠,尤其在非平稳或困难的优化场景中可能导致训练失败。文章从Adam的数学原理出发,指出默认参数是为通用任务设计的,但不同问题需要针对性调整。作者强调,理解优化器的工作机制比“照搬默认值”更重要,过于依赖默认参数将付出高昂代价。 #深度学习 #优化器 #Adam #超参数调整 #机器学习 #AI #强化学习 #技术博客
AI驱动的大规模商业邮件欺诈工具包浮出水面

安全研究人员发现两款此前未公开的AI构建网络钓鱼工具包,能够自动化完成商业邮件欺诈(BEC)的全链条攻击。这些工具包整合了设备代码钓鱼、令牌窃取、持久化入侵以及AI驱动的发票欺诈等多个环节,极大提高了攻击效率与规模。攻击者利用生成式AI技术自动生成逼真的钓鱼邮件和伪造发票,绕过传统安全检测。此类工具的出现意味着商业邮件欺诈正从人工操作向AI规模化转型,对企业财务安全和数据保护构成严峻挑战。专家建议组织加强多因素认证和异常行为监控。 #AI #网络安全 #钓鱼攻击 #商业邮件欺诈 #网络犯罪 #工具包 #BEC #技术威胁
我的本地语言模型拿了6/6分,但每题都答错了

一篇技术反思文章披露,作者花费六个月时间试图让一个1.2B参数的小型本地模型变得有用,却发现自己构建的评估系统存在致命缺陷。该模型在自建基准测试中六道题全部“通过”,但实际答案全是错的——评分器只检查输出是否为裸整数格式,从未验证答案的正确性。作者最初认为通过设计更好的推理框架能让小模型胜任多数任务,但模型在“12人中选择5人委员会”等问题上连续给出错误答案,却因格式正确而得分。随后作者改用更严格的MMLU-Pro基准测试,但优化过程进展缓慢且不稳定。文章指出,没有经过验证的测量工具,所有改进都是空中楼阁,警示AI评估不能只重形式而忽略内容。 #LLM #本地模型 #AI评估 #基准测试 #MMLUPro #人工智能 #技术反思 #模型测量
Dinjure:一个HTML文件实现“公牛与奶牛”猜数字游戏,带AI对手

Dinjure是一款基于逻辑推理的猜数字游戏,所有代码仅在一个HTML文件中实现。游戏规则简单:玩家需在8次猜测内破解一个4位不重复数字的密码,每次猜测后会得到“Dead”(数字与位置正确)和“Injured”(数字正确但位置错误)两种反馈。游戏提供每日挑战模式,全球玩家共享同一谜题,并设有排行榜和成就系统。此外,Dinjure还支持在线对战、对抗AI(名为Dinjure AI的逻辑引擎)以及本地双人模式。该游戏强调纯粹的逻辑推理,无需数学计算。 #HTML游戏 #猜数字 #AI对战 #网页游戏 #逻辑推理
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_8247614025
首个正式验证的3D CSG实现

该项目在Lean 4中实现了首个经过形式化验证的3D构造实体几何(CSG)网格相交操作。开发团队通过93行简洁的规范精确描述了结果网格的表面形态,并保证了实用上的良好性条件,从而避免了依赖可能含有错误的AI生成代码。人类审核者只需阅读这93行规范并运行验证,即可信任整个实现。此举旨在探索一种新范式:以极小规模的正式规范替代大规模AI代码,从而提升关键几何计算的可信度。该实现已开源,未来有望为CAD、计算机图形学等领域提供高可靠性的基础工具。 #形式化验证 #3D建模 #CSG #Lean4 #AI代码 #可靠软件 #软件工程 #开源
利用AI自动化处理越南语PDF转HTML

一名网页设计师在将56年前的越南语四音节成语PDF转为HTML时,因手动操作耗时过长而转向AI辅助。他先后尝试GPT-5.4和Claude Sonnet 4.6,前者因超限放弃,后者成功提取纯文本并生成干净的HTML代码,但缺少越南语变音符号。经过多次迭代,Claude Sonnet 4.6最终为约95%的越南语词汇正确补上变音符号,显著提升效率。作者虽对AI持保留态度,但承认其在自动化任务中的实用价值,最终保留了设计控制权。 #AI #自动化 #PDF转HTML #语言处理 #越南语 #ClaudeSonnet #GPT #网页设计
AI开发者可从布考斯基学到的创作哲学

作家查尔斯·布考斯基在诗中描述了创作瓶颈时的应对之道:不强迫自己继续产出糟糕文字,而是起身离开,去找妻子和猫。他相信这是暂时的,等待后一切会好起来。然而,当前借助AI工具的科技开发者们却陷入996和每日数千条PR的狂热。布考斯基还曾将不满意的诗稿直接丢入回收站,认为“拒绝自己总比被编辑拒绝好”。文章提醒,盲目追求更多产出不等于质量提升,开发者应当学习布考斯基的智慧:适当停顿、接受低效、倾听真实用户需求,而非被AI催生出的虚伪效率裹挟。 #AI开发者 #布考斯基 #创作瓶颈 #质量 #996 #开发者文化 #效率 #科技思考
平价手持风扇也能降温,专家称无需购买昂贵品牌

据外媒报道,面对炎炎夏日,不少消费者被网红种草价格高昂的手持风扇,如戴森HushJet Mini Cool售价99.99美元、鲨鱼ChillPill售价149.99美元。然而,有经验分享指出,中国品牌JisuLife推出的平价手持风扇仅需十几美元,足以应对潮湿的棒球赛、闷热的演唱会及出汗的徒步等场景。该品牌经过十年硬件打磨,在降温效果与便携性上不输高端产品,性价比更为突出。这一观点提醒消费者理性看待营销,根据实际需求选择合适产品,不必盲目追求高价。 #手持风扇 #消费理性 #性价比 #JisuLife #戴森 #夏季降温 #平价好物 #消费指南