LG CNS 推出 Agentic AI 驱动的 SAP ERP 测试自动化方案
LG CNS 于 25 日发布基于真实交易数据的 SAP ERP 测试自动化方案“PerfecTwin ERP Edition”。该方案内置 Agentic AI,可帮助企业将现有 ERP 系统迁移至 SAP S/4HANA,或在新系统上线前自动识别潜在缺陷与错误,提升系统稳定性与运营效率。Agentic AI 能自动生成测试场景、分析问题成因并生成报告,将原本耗时数天的场景设计压缩至数小时内完成。LG CNS 计划年内建立 AI Agent 协同运行的“Agent Orchestration”体系,推动形成覆盖测试生成、执行、分析及错误修复的全流程自主运行机制,并持续升级为自主型测试解决方案,以应对全球 SAP 云 ERP 转型需求。 #LG CNS #AgenticAI #SAP #ERP #测试自动化 #PerfecTwin #数字化转型 #AI
LG CNS 于 25 日发布基于真实交易数据的 SAP ERP 测试自动化方案“PerfecTwin ERP Edition”。该方案内置 Agentic AI,可帮助企业将现有 ERP 系统迁移至 SAP S/4HANA,或在新系统上线前自动识别潜在缺陷与错误,提升系统稳定性与运营效率。Agentic AI 能自动生成测试场景、分析问题成因并生成报告,将原本耗时数天的场景设计压缩至数小时内完成。LG CNS 计划年内建立 AI Agent 协同运行的“Agent Orchestration”体系,推动形成覆盖测试生成、执行、分析及错误修复的全流程自主运行机制,并持续升级为自主型测试解决方案,以应对全球 SAP 云 ERP 转型需求。 #LG CNS #AgenticAI #SAP #ERP #测试自动化 #PerfecTwin #数字化转型 #AI
MemoraX AI 完成数千万人民币种子+轮融资,核心记忆技术取得突破
深圳忆纪元科技有限公司(MemoraX AI)近日宣布完成数千万人民币种子+轮融资,由中金资本、达泰资本、华业天成联合领投,光源资本担任独家财务顾问。至此,公司累计融资超1亿元人民币。本轮资金将用于大模型记忆系统Agentic RL核心技术的深度迭代与规模化落地,推动内生记忆模块从技术验证迈向产品化和商业化。MemoraX AI专注于将记忆能力内化到模型的技术路径,在多项权威评测中表现突出:在LoCoMo-Refined评测中获82.65分,领先第二名30%;联合牛津大学构建的ScriptMem评测中正确率达60.3%,相比第二名提升40%;在Coding领域的SWE-context-bench评测中任务解决率达45%,提升50%。团队共有10篇论文入选国际机器学习顶会ICML 2026,并获中国电子学会自然科学一等奖。公司致力于引领大模型记忆技术从外挂范式迈向内生记忆时代,推动在知识管理、代码开发、智能客服等场景的应用。 #MemoraX AI #融资 #大模型 #记忆系统 #强化学习 #Agentic RL #人工智能 #科技新闻
深圳忆纪元科技有限公司(MemoraX AI)近日宣布完成数千万人民币种子+轮融资,由中金资本、达泰资本、华业天成联合领投,光源资本担任独家财务顾问。至此,公司累计融资超1亿元人民币。本轮资金将用于大模型记忆系统Agentic RL核心技术的深度迭代与规模化落地,推动内生记忆模块从技术验证迈向产品化和商业化。MemoraX AI专注于将记忆能力内化到模型的技术路径,在多项权威评测中表现突出:在LoCoMo-Refined评测中获82.65分,领先第二名30%;联合牛津大学构建的ScriptMem评测中正确率达60.3%,相比第二名提升40%;在Coding领域的SWE-context-bench评测中任务解决率达45%,提升50%。团队共有10篇论文入选国际机器学习顶会ICML 2026,并获中国电子学会自然科学一等奖。公司致力于引领大模型记忆技术从外挂范式迈向内生记忆时代,推动在知识管理、代码开发、智能客服等场景的应用。 #MemoraX AI #融资 #大模型 #记忆系统 #强化学习 #Agentic RL #人工智能 #科技新闻
TronBrowser
是一款基于 Ungoogled Chromium 构建的开源浏览器,主打隐私保护与 AI 原生体验。它彻底去除了谷歌的遥测、广告和赞助标签,同时保持对 Chrome 扩展的完整兼容。内置 AI 侧边栏支持用户自行接入 Anthropic、OpenAI、Google、DeepSeek 等多家大模型,或通过 Ollama、LM Studio 等运行本地模型。此外,TronBrowser 还提供了 agent 友好的命令行接口(`tron <url>`),方便自动化操作。该浏览器遵循 MIT 开源协议,核心功能完全免费,开发团队 Profullstack 同时提供可选的云管理服务。目前支持 macOS、Linux 及 Windows 平台。 #开源 #隐私保护 #AI浏览器 #UngoogledChromium #TronBrowser #大模型 #本地模型 #命令行
是一款基于 Ungoogled Chromium 构建的开源浏览器,主打隐私保护与 AI 原生体验。它彻底去除了谷歌的遥测、广告和赞助标签,同时保持对 Chrome 扩展的完整兼容。内置 AI 侧边栏支持用户自行接入 Anthropic、OpenAI、Google、DeepSeek 等多家大模型,或通过 Ollama、LM Studio 等运行本地模型。此外,TronBrowser 还提供了 agent 友好的命令行接口(`tron <url>`),方便自动化操作。该浏览器遵循 MIT 开源协议,核心功能完全免费,开发团队 Profullstack 同时提供可选的云管理服务。目前支持 macOS、Linux 及 Windows 平台。 #开源 #隐私保护 #AI浏览器 #UngoogledChromium #TronBrowser #大模型 #本地模型 #命令行
我与AI撰稿的解绑之路
作者Ian Johnson在Medium上分享了自己使用AI辅助写作的经历与反思。他坦承自己日常使用Claude Code等AI工具撰写文章,并认为善用工具无可厚非。然而,经过六个月的实践,他逐渐意识到AI虽能高效完成大纲、编辑和校验,但若完全由AI生成内容,最终成品更像是“填满提示词的结果”,而非自己的真实表达。他回溯了自己对AI从零信任开始,逐渐学会约束和引导AI的过程,强调“驾驭工程”的重要性。作者最后宣布,这是他最后一篇完全由AI撰写的文章,今后只将AI用于偶尔的编辑、分析和头脑风暴,核心写作将回归人类本身,以确保作品更真实、更具个人风格。 #AI写作 #技术反思 #人机协作 #人工智能 #写作工具 #技术实践 #创造力
作者Ian Johnson在Medium上分享了自己使用AI辅助写作的经历与反思。他坦承自己日常使用Claude Code等AI工具撰写文章,并认为善用工具无可厚非。然而,经过六个月的实践,他逐渐意识到AI虽能高效完成大纲、编辑和校验,但若完全由AI生成内容,最终成品更像是“填满提示词的结果”,而非自己的真实表达。他回溯了自己对AI从零信任开始,逐渐学会约束和引导AI的过程,强调“驾驭工程”的重要性。作者最后宣布,这是他最后一篇完全由AI撰写的文章,今后只将AI用于偶尔的编辑、分析和头脑风暴,核心写作将回归人类本身,以确保作品更真实、更具个人风格。 #AI写作 #技术反思 #人机协作 #人工智能 #写作工具 #技术实践 #创造力
Google 发布 Gemini 3.5 Flash,AI 可自主操控电脑
6月25日,谷歌正式发布 Gemini 3.5 Flash 模型,核心亮点是深度优化了“计算机操作”能力,让AI能直接接管电脑界面,自主完成复杂跨软件工作流。该模型可处理长链条任务,如从零构建系统、管理研究项目,运行速度大幅提升,显著减少人工干预。目前该技术已覆盖谷歌生态,Gemini 应用及搜索AI模式默认搭载,开发者可通过API调用。同时,谷歌强化了安全防护机制,针对高风险请求引入可控框架,必要时主动暂停并寻求人工确认,确保高效与安全。这一发布标志着AI从对话助手向“电脑管家”的进化,人机交互边界再次被拓宽。 #Google #Gemini #AI #人工智能 #大模型 #科技新闻 #计算机操作 #自动化 #安全防护
6月25日,谷歌正式发布 Gemini 3.5 Flash 模型,核心亮点是深度优化了“计算机操作”能力,让AI能直接接管电脑界面,自主完成复杂跨软件工作流。该模型可处理长链条任务,如从零构建系统、管理研究项目,运行速度大幅提升,显著减少人工干预。目前该技术已覆盖谷歌生态,Gemini 应用及搜索AI模式默认搭载,开发者可通过API调用。同时,谷歌强化了安全防护机制,针对高风险请求引入可控框架,必要时主动暂停并寻求人工确认,确保高效与安全。这一发布标志着AI从对话助手向“电脑管家”的进化,人机交互边界再次被拓宽。 #Google #Gemini #AI #人工智能 #大模型 #科技新闻 #计算机操作 #自动化 #安全防护
Artificial Analysis 发布语音到语音模型评测指数
Artificial Analysis 宣布推出全新的“语音到语音指数”,用于评估原生语音模型的质量。该指数综合三个核心维度:语音推理(Big Bench Audio)、对话动态(Full Duplex Bench)和智能体性能(τ-Voice),三个数据集权重相同。评测显示,OpenAI GPT-Realtime-2(High)以77.2%的指数得分领先,xAI Grok Voice Think Fast 1.0以75.7%紧随其后,GPT-Realtime-1.5(72.0%)和Google Gemini 3.1 Flash Live Preview(High)(69.5%)分列其后。在对话动态方面,GPT-Realtime-2(Minimal)以96.1%排名第一;智能体性能是差距最大的维度,Grok Voice Think Fast 1.0以52.1%领先,所有模型均低于53%;语音推理方面,Grok Voice Think Fast 1.0以97.1%居首。速度方面,Deepslate Opal首帧音频时间仅为0.44秒,GPT-Realtime-1.5为0.82秒;成本方面,Gemini 3.1 Flash Live Preview(Minimal)每小时输入音频成本最低,为1.50美元。 #AI #语音模型 #评测 #性能 #成本 #OpenAI #谷歌 #xAI
Artificial Analysis 宣布推出全新的“语音到语音指数”,用于评估原生语音模型的质量。该指数综合三个核心维度:语音推理(Big Bench Audio)、对话动态(Full Duplex Bench)和智能体性能(τ-Voice),三个数据集权重相同。评测显示,OpenAI GPT-Realtime-2(High)以77.2%的指数得分领先,xAI Grok Voice Think Fast 1.0以75.7%紧随其后,GPT-Realtime-1.5(72.0%)和Google Gemini 3.1 Flash Live Preview(High)(69.5%)分列其后。在对话动态方面,GPT-Realtime-2(Minimal)以96.1%排名第一;智能体性能是差距最大的维度,Grok Voice Think Fast 1.0以52.1%领先,所有模型均低于53%;语音推理方面,Grok Voice Think Fast 1.0以97.1%居首。速度方面,Deepslate Opal首帧音频时间仅为0.44秒,GPT-Realtime-1.5为0.82秒;成本方面,Gemini 3.1 Flash Live Preview(Minimal)每小时输入音频成本最低,为1.50美元。 #AI #语音模型 #评测 #性能 #成本 #OpenAI #谷歌 #xAI
IatroBench 研究揭示AI安全措施可能引发医源性伤害
一项名为 IatroBench 的预注册研究提供了系统性证据,表明某些人工智能安全措施可能产生医源性伤害。该研究由 David Gringras 主导,论文已提交至 arXiv 预印本平台。研究通过标准化基准测试,评估了多种常见 AI 安全策略在实际应用中的副作用,发现部分旨在提升模型安全性的方法反而可能导致模型性能下降、输出偏差增加或产生新的安全隐患。这一发现对当前 AI 安全领域的主流实践提出了重要警示,提示开发者在实施安全措施时需谨慎权衡其潜在负面影响。研究团队呼吁业界建立更全面的评估框架,以识别和缓解安全措施可能带来的意外后果。 #AI安全 #医源性伤害 #人工智能 #安全评估 #预注册研究
一项名为 IatroBench 的预注册研究提供了系统性证据,表明某些人工智能安全措施可能产生医源性伤害。该研究由 David Gringras 主导,论文已提交至 arXiv 预印本平台。研究通过标准化基准测试,评估了多种常见 AI 安全策略在实际应用中的副作用,发现部分旨在提升模型安全性的方法反而可能导致模型性能下降、输出偏差增加或产生新的安全隐患。这一发现对当前 AI 安全领域的主流实践提出了重要警示,提示开发者在实施安全措施时需谨慎权衡其潜在负面影响。研究团队呼吁业界建立更全面的评估框架,以识别和缓解安全措施可能带来的意外后果。 #AI安全 #医源性伤害 #人工智能 #安全评估 #预注册研究
AI新潮流“循环工程”仍需人类参与
近期,AI圈掀起“循环工程”(Loop Engineering)新浪潮,取代了去年的“提示工程”。专家声称,不应再手动编写提示词并检查每次回复,而应设计循环让AI代理自动执行多步骤任务。然而,这种自动化的背后是AI公司对token消耗的狂热推广——OpenAI、Anthropic等公司渴望用户为自动循环支付更多费用。批评者指出,这如同负债累累的公用事业公司建议用户整夜不关灯。开发者Addy Osmani在博客中强调,“循环改变了工作,但没有将你从中删除”,暗示自动化风险:非确定性AI模型可能产生错误,仍需人类监督。这场讨论提醒人们,无论技术如何演进,“人在循环中”的角色不可替代。 #AI #循环工程 #提示工程 #自动化 #人工智能 #技术新闻 #token消耗 #人在循环
近期,AI圈掀起“循环工程”(Loop Engineering)新浪潮,取代了去年的“提示工程”。专家声称,不应再手动编写提示词并检查每次回复,而应设计循环让AI代理自动执行多步骤任务。然而,这种自动化的背后是AI公司对token消耗的狂热推广——OpenAI、Anthropic等公司渴望用户为自动循环支付更多费用。批评者指出,这如同负债累累的公用事业公司建议用户整夜不关灯。开发者Addy Osmani在博客中强调,“循环改变了工作,但没有将你从中删除”,暗示自动化风险:非确定性AI模型可能产生错误,仍需人类监督。这场讨论提醒人们,无论技术如何演进,“人在循环中”的角色不可替代。 #AI #循环工程 #提示工程 #自动化 #人工智能 #技术新闻 #token消耗 #人在循环
93%的企业因AI导致基础设施事故,治理滞后成隐患
根据Spacelift发布的《2026年基础设施自动化状况报告》,一项针对406名IT决策者的调查显示,93%的组织报告了因AI引发的基础设施事故,但仅19%拥有必要的治理能力。报告指出存在“AI准备差距”,企业尚未准备好就急于采用AI,为此付出代价。事故后果包括返工AI生成的更改(37%)、安全配置错误进入生产环境(36%)、合规违规(36%)等。24%的组织被归类为“暴露”——使用AI但缺乏安全治理;32%为“碎片化”——使用不均衡;25%“超前”但控制不足;仅19%为“先驱”——有结构纪律。此外,82%的受访者表示25%-74%的代码由AI生成,导致安全漏洞增多、治理挑战加剧。尽管86%声称能治理AI,但仅30%有正式AI治理政策。 #AI #基础设施 #事故 #治理 #企业 #技术新闻 #Spacelift #调查 #风险 #自动化
根据Spacelift发布的《2026年基础设施自动化状况报告》,一项针对406名IT决策者的调查显示,93%的组织报告了因AI引发的基础设施事故,但仅19%拥有必要的治理能力。报告指出存在“AI准备差距”,企业尚未准备好就急于采用AI,为此付出代价。事故后果包括返工AI生成的更改(37%)、安全配置错误进入生产环境(36%)、合规违规(36%)等。24%的组织被归类为“暴露”——使用AI但缺乏安全治理;32%为“碎片化”——使用不均衡;25%“超前”但控制不足;仅19%为“先驱”——有结构纪律。此外,82%的受访者表示25%-74%的代码由AI生成,导致安全漏洞增多、治理挑战加剧。尽管86%声称能治理AI,但仅30%有正式AI治理政策。 #AI #基础设施 #事故 #治理 #企业 #技术新闻 #Spacelift #调查 #风险 #自动化