AI知识库 @ai521
321 subscribers
21.9K photos
42 videos
19 files
839 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
香港电脑学会

据东网报道,香港电脑学会近日发出倡议,强调随着人工智能技术在各行各业广泛应用,用户应主动学习如何驾驭AI,以提高实际使用效能。学会指出,当前许多人仅停留在简单使用AI工具层面,未能充分发挥其潜力,需要通过系统培训掌握提示工程、模型调优等技巧。学会还建议企业与教育机构共同推进AI素养建设,帮助员工和学生适应智能化工作环境。这一呼吁旨在推动香港在人工智能时代的竞争力提升,确保技术红利惠及更多群体。 #香港电脑学会 #人工智能 #AI素养 #科技教育 #数字化转型 #香港科技
Constraint-Enhanced Physical Search through Correlation Matching 预印本发布

近日,一篇题为《Constraint-Enhanced Physical Search through Correlation Matching》的学术论文在arXiv预印本平台上线,作者为Song-Ju Kim博士。该研究聚焦于物理搜索领域中的约束优化问题,提出了一种基于相关性匹配的增强方法。传统物理搜索在面临复杂约束时效率较低,而该工作通过引入相关性匹配机制,能够在搜索过程中更有效地利用已知约束信息,从而提升搜索的准确性和速度。论文可能对物理实验设计、机器人路径规划、材料科学等需要高效搜索策略的领域具有潜在应用价值。目前该论文仅提供PDF版本,尚处于预印本阶段,未来或将在正式期刊发表。 #arXiv #物理搜索 #约束优化 #相关性匹配 #机器学习 #预印本 #研究论文
Endava 如何围绕 AI 代理重构软件交付

Endava 正通过引入 AI 代理、ChatGPT Enterprise 与 Codex 等工具,全面重塑软件交付流程。该公司旨在利用 AI 加速开发周期、自动化重复任务,并在企业内部培育 AI 原生文化。具体做法包括:将 AI 代理嵌入编码、测试与部署环节,借助 Codex 提升代码生成效率,同时利用 ChatGPT Enterprise 辅助需求分析与文档编写。这一转型不仅缩短了项目交付时间,还释放了开发者的创造力,使团队能更专注于高价值创新。Endava 表示,AI 并非替代人类,而是作为“超级协作者”增强工程师能力,最终推动企业级软件工程的效率与质量发生质变。 #Endava #AI代理 #软件交付 #ChatGPTEnterprise #Codex #自动化 #AI原生 #科技新闻
Google 在 AI 搜索中增加来源标注,允许网站选择退出

英国竞争与市场管理局(CMA)近日裁定,要求谷歌在 AI 搜索功能中为网站所有者提供选择退出机制,并添加更清晰的来源归属和链接。谷歌随即宣布,将测试新的 Search Console 设置,允许网站选择不将其内容用于 AI 概览和 AI 模式,同时保留在传统搜索结果中。CMA 还禁止谷歌处罚选择退出的站点,并强调出版商应对其内容的使用拥有议价权。谷歌表示该设置将先在英国小范围测试,随后全球推广。监管机构给予谷歌九个月时间全面合规。 #Google #AI搜索 #英国监管 #CMA #出版商 #科技新闻 #搜索控制台 #数据隐私
浙大与阿里联合提出Token经济学新范式,破解大模型Agent资源分配难题

浙江大学与阿里云等机构联合发布首篇《Token Economics for LLM Agents》综述,首次将计算机科学与经济学深度融合,提出“Token经济学”研究范式。该范式将Token重新定义为生产要素、交换媒介与记账单位,构建从单智能体到多智能体生态的完整经济分析框架。研究指出,随着大模型Agent加速落地,Token消耗指数级增长,传统“堆算力”方式已触及天花板。新框架从微观、中观、宏观及安全四个维度分析Agent资源分配,将安全风险内化为Token经济损耗,为下一代可扩展、可定价、可治理的Agentic AI系统奠定理论基础。 #Token经济学 #大模型Agent #浙江大学 #阿里云 #AI资源分配 #计算机科学 #经济学 #人工智能 #开源模型
Hscli 发布可脚本化 Help Scout CLI,支持终端、CI 与 AI 代理

一款名为 hscli 的开源命令行工具正式发布,专为 Help Scout 客服平台设计。该工具支持终端操作、CI 流水线以及 Claude Code、Codex 等 AI 代理,所有命令均输出 JSON 并返回明确的退出码。其设计强调自动化与安全性:OAuth 令牌仅存储在系统密钥链中,支持表格、JSON、YAML、CSV 等多种输出格式,并内置 jq 过滤功能。hscli 还提供全量账户备份能力,支持增量刷新、断点续传、删除检测及附件备份。用户可通过一条命令完成对话分类、批量状态更新、夜间备份及报表导出等任务,与 jq、xargs、cron 及 CI 运行器无缝集成。该工具已获 MIT 许可,与 Help Scout 官方无关联。 #HelpScout #CLI #开源 #自动化 #AI代理 #客服工具 #DevOps #备份 #JSON #CI
Knowledge Index of Noah's Ark 论文在 arXiv 发布

一篇题为《Knowledge Index of Noah's Ark》的学术论文于2026年6月3日在预印本平台 arXiv 上提交。该论文由 Sheng Jin 等27位作者共同完成,全文以PDF和HTML格式提供,并附有BibTeX引用信息。论文当前浏览上下文为计算机科学(cs)领域,并关联了NASA ADS、Google Scholar、Semantic Scholar等学术工具。arXiv平台还提供了相关论文推荐、代码链接、Hugging Face模型空间等资源。该研究可能涉及大规模知识索引或数据保存方法,但具体内容尚未公开。论文的发布为相关领域研究者提供了新的参考。 #arXiv #论文 #计算机科学 #知识索引 #诺亚方舟 #学术研究 #预印本
GPT-Rosalind 新增多项生物研究能力,助力生命科学突破

OpenAI 宣布为旗下生命科学专用模型 GPT-Rosalind 引入多项新功能,包括增强的生物学推理能力、药物化学专业知识、基因组学分析以及实验工作流支持。这些新功能旨在帮助研究人员更高效地处理复杂生物数据、设计实验方案并加速药物发现。GPT-Rosalind 在分子相互作用预测、蛋白质结构分析以及基因表达解读等任务上表现出色,有望推动精准医学和合成生物学领域的进展。OpenAI 表示,将持续优化模型在科学场景中的实用性与安全性。 #GPTRosalind #OpenAI #生命科学 #AI #药物研发 #基因组学 #蛋白质分析
Telegram必备的搜索引擎,极搜JISOU帮你精准找到,想要的群组、频道、视频、音乐

👉 t.me/jisou2?start=a_8247614025
公司利用Reddit操纵ChatGPT和Google AI搜索

据外媒报道,生物黑客子版块r/biohackers的版主近日宣布,将禁止发布关于肽类和激素替代疗法(HRT)的新帖子,原因是相关制造、营销和销售公司正秘密地在Reddit上大量发帖,试图让AI聊天机器人抓取这些内容。这些公司通过操纵AI抓取的底层素材(即Reddit热门社区),系统性地影响聊天机器人的回答。版主在帖子中指出,随着AI搜索引擎越来越多地从Reddit提取答案,企业正利用该平台进行“AI引擎优化”(AEO)。肽类和HRT话题在该子版块异常火爆,尤其是一些公司试图以标签外或灰色市场化合物形式推销产品,导致内容质量严重下降。此举反映了AI时代信息操纵的新趋势,即通过污染训练数据源来间接控制AI输出。 #Reddit #AI搜索 #信息操纵 #ChatGPT #GoogleAI #生物黑客 #内容质量 #SEO #AEO
AI Agent 的真实杠杆

作者分享了使用 AI agent 获得的实际杠杆——将杂乱语音笔记转化为草稿、代码变更、测试、PR、修复等流程自动化。但这种杠杆也有“诅咒”:经济学在奇怪的地方起作用,尤其对个人和小团队,但并非处处有效。token 费用可能快速增长,若缺乏系统构建,agent 容易成为产生未完成工作的昂贵方式。核心问题不是单个 agent 是否比人类快,而是人类能否同时并行指定、运行、审核和改进多个有边界的执行循环。George Hotz 警告 agent 输出会前置令人印象深刻的表面部分,而将艰苦的打磨工作留给人,产生难以被旧有质量指标检测的劣质产物。关键在于谁能在不降低自身系统质量的前提下吸收这种杠杆。有用的单位不是模型本身,而是整个系统:模型 × 工具 × 环境 × 评估器。不同任务需要不同模型/工具组合,且模型不是产品,工具和环境同样重要。 #AI #Agent #杠杆 #效率 #经济学 #软件工程 #技术评论 #自动化 #工作流
Vanta 发布 Trustcraft 方法论

Vanta 是一家为小企业提供安全合规解决方案的公司,近日分享了其 AI 产品构建理念“Trustcraft”。该公司强调,AI 功能不能只是“演示好看”,而必须真正帮助客户完成实际工作,如证明安全状态、履行合同承诺或修复控制项。Vanta 通过构建“信任图谱”(Trust Graph)整合客户合规数据,使 AI 在合规领域具备精准判断力,而非依赖大模型猜测。同时,Vanta 倾向于将合规智能嵌入客户已有的工具(如 IDE、CI 管道),而非要求用户切换上下文。与 Tagore 的合作案例显示,这种策略帮助客户在竞争市场中实现差异化。目前已有超过 16000 家公司使用 Vanta 持续证明其安全态势。 #Vanta #Trustcraft #AI #合规 #安全 #小企业 #信任图谱 #B2B #科技新闻
特朗普签署新AI行政令,扩大模型监管力度

美国前总统特朗普在废除此前AI行政令不到两周后,于周二签署了一项新命令,旨在促进创新与安全。该政策要求科技公司在发布前沿模型前30天自愿提交给政府审查,但未设立强制许可制度。同时,新设网络安全中心协调私营部门安全评估。外界认为,此令虽较此前版本有所弱化(此前要求提前90天提交),但仍标志着白宫在AI治理上从“放手”转向加强监管。此外,防务科技公司Anduril与Meta合作,为军方开发增强现实头盔,可通过眼神和语音指令控制无人机打击。SpaceX也计划以每股135美元进行IPO,筹资750亿美元。 #特朗普 #AI行政令 #人工智能 #科技政策 #无人机 #AR头盔 #SpaceX #IPO
VAMPS

来自arXiv的一篇论文介绍了VAMPS(Visual-Assisted Mathematical Problem Solving Benchmark),这是一个专门用于评估多模态大模型在视觉辅助数学推理能力上的新基准。该基准由Amirhossein Dabiriaghdam等八位研究者共同提出,旨在填补当前多模态模型在复杂数学问题中结合视觉信息进行推理的评估空白。VAMPS包含大量需要同时理解文本描述和图像信息的数学题目,覆盖几何、代数、概率等多个领域。研究团队通过该基准对现有主流多模态模型进行了测试,发现它们在视觉与数学推理的深度融合上仍存在显著不足,尤其在需要空间推理和图表解读的任务中表现欠佳。该基准的发布为未来多模态AI在教育和科研领域的应用提供了重要的评估工具和优化方向。 #VAMPS #多模态 #数学推理 #基准测试 #AI #arXiv #视觉辅助
数字学徒

一篇题为《数字学徒:人类指导下的自主AI开发框架》的学术论文在arXiv预印本平台发布。该论文由Travis Weber等人撰写,提出了一种名为“数字学徒”的新型框架,旨在让AI系统在人类明确指导下自主执行复杂任务。该框架强调人类与AI的协作关系,AI作为“学徒”学习人类意图并逐步提升自主性,同时保持人类对关键决策的控制权。论文探讨了该框架在软件开发、数据分析等领域的应用潜力,为未来人机协同的AI开发提供了新思路。 #AI #自主智能体 #人机协作 #arXiv #数字学徒 #人工智能框架
CHARM框架发布:精准检测与缓解Agentic RAG中的级联幻觉问题

一篇发表于arXiv的论文提出了名为CHARM的框架,用于检测和缓解代理式检索增强生成(Agentic RAG)中的级联幻觉现象。研究团队指出,在多步骤推理的Agentic RAG系统中,幻觉会沿推理链逐级累积,导致最终输出严重偏离事实。CHARM框架通过引入分层监测机制,在每一步推理中识别潜在幻觉信号,并利用回溯修正方法阻断错误传播。实验表明,该框架能显著降低级联幻觉的发生率,同时保持系统响应效率。这一工作为提升大语言模型在复杂任务中的可靠性提供了新思路。 #AI #大模型 #RAG #幻觉 #CHARM #arXiv #论文
元代理挑战

一项名为“元代理挑战”的研究在arXiv上发布,由Xinyu Lu等11位作者共同完成。该研究提出一个关键问题:现有的AI代理是否具备自主开发其他代理的能力?论文旨在评估当前智能体在无需人类干预的情况下,能否独立完成从设计到实现新代理的完整流程。这一挑战对于理解AI自主性、自我改进以及通用人工智能的发展具有重要意义。研究为代理能力的评测提供了新的基准,可能推动未来自主系统设计方向的思考。 #AI代理 #元代理挑战 #自主开发 #arXiv #人工智能研究
AICompanionBench 提出新基准,评估大语言模型作为 AI 伴侣的安全性

近期,一项名为 AICompanionBench 的研究提出了一种新的基准测试,旨在评估大语言模型(LLM)作为 AI 伴侣时的安全性。该研究由 Yanjing Ren 等学者完成,论文已提交至 arXiv。随着 AI 伴侣产品的普及,确保 LLM 在对话中不产生有害内容、不误导用户至关重要。AICompanionBench 通过设计多种安全场景,系统性地评测 LLM 作为“裁判”时对安全风险的识别与应对能力。这项研究为 AI 伴侣的安全评估提供了标准化工具,有助于推动更负责任的 AI 发展。 #AI伴侣 #安全 #大模型 #基准测试 #arXiv #LLM #人工智能 #安全评估 #AI伦理