东京理科大学启用全自动实验室,机器人主导医学研究进程
东京理科大学在汤岛校区开设了机器人创新中心,这是一个完全无人值守的实验室,配备10个机器人,包括类人机器人Maholo LabDroid,旨在通过自动化应对研究机构面临的劳动力短缺和减少实验人为错误的挑战。这些机器人能执行精密任务,如定量试剂转移、温度控制设备操作及细胞培养等。大学计划到2040年将机器人数量增至约2000个,实现从假设生成到实验验证的全程自动化,以推动日本科研达到世界领先水平。该中心负责人强调,AI和机器人是实现这一目标的关键工具,而此前Maholo已在神户一家医院用于眼科临床研究。 #新闻 #科技 #AI #自动化 #机器人 #医疗研究 #日本 #大学 #实验室 #人工智能
东京理科大学在汤岛校区开设了机器人创新中心,这是一个完全无人值守的实验室,配备10个机器人,包括类人机器人Maholo LabDroid,旨在通过自动化应对研究机构面临的劳动力短缺和减少实验人为错误的挑战。这些机器人能执行精密任务,如定量试剂转移、温度控制设备操作及细胞培养等。大学计划到2040年将机器人数量增至约2000个,实现从假设生成到实验验证的全程自动化,以推动日本科研达到世界领先水平。该中心负责人强调,AI和机器人是实现这一目标的关键工具,而此前Maholo已在神户一家医院用于眼科临床研究。 #新闻 #科技 #AI #自动化 #机器人 #医疗研究 #日本 #大学 #实验室 #人工智能
五个AI智能体在浏览器中玩狼人杀,各持私有数据库
近日,一个技术演示项目展示了如何在浏览器中利用大型语言模型(LLM)智能体玩“狼人杀”游戏。其核心创新在于通过数据库架构而非应用代码来强制实施“信息不对称”。游戏中有五个AI智能体,每个都运行在自己的Web Worker中,并持有一个私有的DuckDB-WASM数据库实例。一个网关工作者作为信息枢纽,只有通过特定令牌验证才能跨智能体读取数据。这种设计确保了每个智能体的“知识”、“怀疑”和“意图”等数据严格隔离。 该系统支持两种模式:完全本地运行(利用WebGPU运行一个2B参数的Qwen模型,无需服务器推理)或通过API密钥调用Anthropic、OpenAI等云端模型。本地模式因模型体积限制仅在桌面端可用,但基于API的架构在手机端也能完整运行。游戏结束后,“X光”模式可让玩家查看每个智能体公开的发言与其内部私有的推理逻辑之间的差异,这正是该项目的展示重点。该项目为探索AI智能体的协作与竞争机制提供了一个有趣的实验平台。 #人工智能 #多智能体系统 #狼人杀 #DuckDB #WebGPU #AI游戏 #技术演示
近日,一个技术演示项目展示了如何在浏览器中利用大型语言模型(LLM)智能体玩“狼人杀”游戏。其核心创新在于通过数据库架构而非应用代码来强制实施“信息不对称”。游戏中有五个AI智能体,每个都运行在自己的Web Worker中,并持有一个私有的DuckDB-WASM数据库实例。一个网关工作者作为信息枢纽,只有通过特定令牌验证才能跨智能体读取数据。这种设计确保了每个智能体的“知识”、“怀疑”和“意图”等数据严格隔离。 该系统支持两种模式:完全本地运行(利用WebGPU运行一个2B参数的Qwen模型,无需服务器推理)或通过API密钥调用Anthropic、OpenAI等云端模型。本地模式因模型体积限制仅在桌面端可用,但基于API的架构在手机端也能完整运行。游戏结束后,“X光”模式可让玩家查看每个智能体公开的发言与其内部私有的推理逻辑之间的差异,这正是该项目的展示重点。该项目为探索AI智能体的协作与竞争机制提供了一个有趣的实验平台。 #人工智能 #多智能体系统 #狼人杀 #DuckDB #WebGPU #AI游戏 #技术演示
Hacker News用户热议大模型使用现状,GPT
在Hacker News近期的一篇讨论帖中,众多开发者分享了他们日常使用的大语言模型及选择理由。一名用户透露,其工作主力已从之前的Opus 4.6转向GPT-5.5,主要原因是后者输出更稳定、可预测且文字风格更佳,尽管Opus 4.7在代码质量上可能仍稍胜一筹。该用户同时提到,在个人项目中尝试了DeepSeek V4,对其超高的性价比和长达百万token的上下文窗口印象深刻,认为其非常适合处理长任务,尽管一次性生成答案的能力略有不足。 讨论反映了当前AI开发者工具选择的多样性与权衡:GPT系列在综合可用性上受青睐,Opus系列在特定领域如代码生成上保持优势,而DeepSeek等新兴模型则凭借成本与上下文长度优势迅速获得关注。许多用户也分享了配合使用重排序、嵌入模型等增强特定工作流的经验,表明大模型应用正走向更精细、组合化的阶段。 #HackerNews #大语言模型 #GPT5 #Opus #DeepSeek #AI开发 #程序员社区
在Hacker News近期的一篇讨论帖中,众多开发者分享了他们日常使用的大语言模型及选择理由。一名用户透露,其工作主力已从之前的Opus 4.6转向GPT-5.5,主要原因是后者输出更稳定、可预测且文字风格更佳,尽管Opus 4.7在代码质量上可能仍稍胜一筹。该用户同时提到,在个人项目中尝试了DeepSeek V4,对其超高的性价比和长达百万token的上下文窗口印象深刻,认为其非常适合处理长任务,尽管一次性生成答案的能力略有不足。 讨论反映了当前AI开发者工具选择的多样性与权衡:GPT系列在综合可用性上受青睐,Opus系列在特定领域如代码生成上保持优势,而DeepSeek等新兴模型则凭借成本与上下文长度优势迅速获得关注。许多用户也分享了配合使用重排序、嵌入模型等增强特定工作流的经验,表明大模型应用正走向更精细、组合化的阶段。 #HackerNews #大语言模型 #GPT5 #Opus #DeepSeek #AI开发 #程序员社区
Bitloops为AI编程代理构建代码库理解模型
专注于AI开发工具的Bitloops项目正式发布,旨在为AI编程代理、开发者和代码审查者提供一个本地化、带类型且可查询的代码库模型。该项目通过维护一个“共享的系统状态”,使AI代理无需在每次执行任务时都重新爬取、分析整个代码仓库,从而显著提升效率并减少重复推理。目前,Bitloops仍处于Alpha开发阶段,尚不适用于生产环境,用户可体验其核心功能。 该项目指出,当前大多数AI编程工具的根本瓶颈在于“状态”管理,而非代码生成本身。它们反复将代码库这一结构化系统通过非结构化的文本提示、嵌入向量等方式进行处理,导致代理陷入“检索-推理-行动-遗忘”的循环。Bitloops则试图通过构建持久化、可查询的本地模型,将其转变为“提取-持久化-分类-验证-刷新-行动”的新模式,为AI原生的软件工程基础设施提供一个知识可累积的基底。 #AI #编程 #代码库 #开发工具 #软件工程 #HackerNews #Bitloops
专注于AI开发工具的Bitloops项目正式发布,旨在为AI编程代理、开发者和代码审查者提供一个本地化、带类型且可查询的代码库模型。该项目通过维护一个“共享的系统状态”,使AI代理无需在每次执行任务时都重新爬取、分析整个代码仓库,从而显著提升效率并减少重复推理。目前,Bitloops仍处于Alpha开发阶段,尚不适用于生产环境,用户可体验其核心功能。 该项目指出,当前大多数AI编程工具的根本瓶颈在于“状态”管理,而非代码生成本身。它们反复将代码库这一结构化系统通过非结构化的文本提示、嵌入向量等方式进行处理,导致代理陷入“检索-推理-行动-遗忘”的循环。Bitloops则试图通过构建持久化、可查询的本地模型,将其转变为“提取-持久化-分类-验证-刷新-行动”的新模式,为AI原生的软件工程基础设施提供一个知识可累积的基底。 #AI #编程 #代码库 #开发工具 #软件工程 #HackerNews #Bitloops
AI智能体长期记忆工具TypedMemory发布
一款名为TypedMemory的开源工具正式发布,旨在为AI智能体提供持久、可演化且具备上下文感知能力的长期记忆与反思能力。该工具能够主动识别并记录智能体内部的矛盾信息与认知漂移,从而解决传统AI因记忆简单覆盖或冲突导致的“自我幻觉”问题,使其行为能随时间持续改进。 与单纯存储数据的向量数据库不同,TypedMemory将每一条记忆视为结构化对象,具备类型、置信度、来源和生命周期策略。它能通过内置的演化器自动处理记忆冲突、跟踪观点漂移、管理目标状态并进行非破坏性摘要,使记忆库成为一个动态的“活知识层”。开发者可通过清晰的API(如记忆、检索、反思)集成到智能体循环中。该项目采用零运行时依赖设计,提供了超越简单数据持久化的智能体记忆管理新范式。 #AI #智能体 #记忆技术 #开源 #开发者工具
一款名为TypedMemory的开源工具正式发布,旨在为AI智能体提供持久、可演化且具备上下文感知能力的长期记忆与反思能力。该工具能够主动识别并记录智能体内部的矛盾信息与认知漂移,从而解决传统AI因记忆简单覆盖或冲突导致的“自我幻觉”问题,使其行为能随时间持续改进。 与单纯存储数据的向量数据库不同,TypedMemory将每一条记忆视为结构化对象,具备类型、置信度、来源和生命周期策略。它能通过内置的演化器自动处理记忆冲突、跟踪观点漂移、管理目标状态并进行非破坏性摘要,使记忆库成为一个动态的“活知识层”。开发者可通过清晰的API(如记忆、检索、反思)集成到智能体循环中。该项目采用零运行时依赖设计,提供了超越简单数据持久化的智能体记忆管理新范式。 #AI #智能体 #记忆技术 #开源 #开发者工具
世界科学节深度探讨AI推理的真相与局限
近日,世界科学节发布了一段题为《AI推理的不舒适真相》的深度讨论视频,该视频于2026年5月15日首播,已吸引超过3.7万次观看。讨论中,专家们深入剖析了当前AI模型所谓"推理"能力的本质,指出其创造性输出主要源于对最终词元分布的统计采样和引入的随机性,这个过程在统计上可比拟马尔可夫链,而非真正的智能或创造性思维过程。观众反馈普遍认为,这场讨论是对AI领域过度炒作的一次冷静反思,清晰地揭示了模型在创造力上的盲区,并强调用户需通过自身能力引导模型,结合其跨领域知识来解决问题。此外,讨论触及通用人工智能(AGI)的前景,认为目前AGI仍是一个遥不可及的幻象,真正的突破可能有待未来技术的革新。 #AI #推理 #世界科学节 #科技新闻 #人工智能 #AGI #创造力 #科学讨论 #视频分享
近日,世界科学节发布了一段题为《AI推理的不舒适真相》的深度讨论视频,该视频于2026年5月15日首播,已吸引超过3.7万次观看。讨论中,专家们深入剖析了当前AI模型所谓"推理"能力的本质,指出其创造性输出主要源于对最终词元分布的统计采样和引入的随机性,这个过程在统计上可比拟马尔可夫链,而非真正的智能或创造性思维过程。观众反馈普遍认为,这场讨论是对AI领域过度炒作的一次冷静反思,清晰地揭示了模型在创造力上的盲区,并强调用户需通过自身能力引导模型,结合其跨领域知识来解决问题。此外,讨论触及通用人工智能(AGI)的前景,认为目前AGI仍是一个遥不可及的幻象,真正的突破可能有待未来技术的革新。 #AI #推理 #世界科学节 #科技新闻 #人工智能 #AGI #创造力 #科学讨论 #视频分享
AI生成代码潜藏技术债务危机,专家警告开发风险加剧
随着AI编程工具的快速普及,企业管理层对采用这些工具的热情高涨,但开发者的实际技能和培训却未能同步跟进。Lightrun公司副总裁Moshe Sambol指出,许多开发者仍在适应AI工具,而企业期望过高,导致工作压力增大。AI生成代码虽能快速产出,但往往缺乏上下文理解,容易积累技术债务。Sambol举例称,一名开发者使用AI助手构建Ansible自动化流程,初期运行顺利,随后突然故障,排查过程耗费大量精力。他强调,开发者需能解释代码并验证其与整体系统的兼容性,但AI系统未能弥补知识差距。这种趋势若持续,可能引发更多代码质量问题和系统故障风险,影响软件开发生态。 #AI #编程 #技术债务 #软件开发 #新闻 #科技 #开发者 #自动化 #Lightrun #风险管控
随着AI编程工具的快速普及,企业管理层对采用这些工具的热情高涨,但开发者的实际技能和培训却未能同步跟进。Lightrun公司副总裁Moshe Sambol指出,许多开发者仍在适应AI工具,而企业期望过高,导致工作压力增大。AI生成代码虽能快速产出,但往往缺乏上下文理解,容易积累技术债务。Sambol举例称,一名开发者使用AI助手构建Ansible自动化流程,初期运行顺利,随后突然故障,排查过程耗费大量精力。他强调,开发者需能解释代码并验证其与整体系统的兼容性,但AI系统未能弥补知识差距。这种趋势若持续,可能引发更多代码质量问题和系统故障风险,影响软件开发生态。 #AI #编程 #技术债务 #软件开发 #新闻 #科技 #开发者 #自动化 #Lightrun #风险管控
Anthropic被指承认AI无用,视频引发广泛讨论
近日,一段标题为“Anthropic just admitted AI is bullshit”的视频在网络上迅速传播,引发公众对人工智能实用性的热议。该视频由创作者Mo Bitar于2026年5月15日发布,声称AI公司Anthropic承认当前AI技术存在严重缺陷,甚至被批评为“无用”。视频上线后获得超过21万次观看和大量用户评论,观众们在讨论中将AI比作传统的咨询公司,质疑其是否过度炒作而缺乏实际价值。许多评论指出,AI技术承诺的突破往往未能兑现,反而催生了新的商业包装。这一事件反映了社会对AI热潮的日益反思,尽管技术不断进步,但其实际应用与宣传之间的差距仍引发广泛争议,促使行业重新评估AI的发展方向。 #Anthropic #AI #人工智能 #科技新闻 #视频热议 #质疑AI #技术反思 #商业炒作
近日,一段标题为“Anthropic just admitted AI is bullshit”的视频在网络上迅速传播,引发公众对人工智能实用性的热议。该视频由创作者Mo Bitar于2026年5月15日发布,声称AI公司Anthropic承认当前AI技术存在严重缺陷,甚至被批评为“无用”。视频上线后获得超过21万次观看和大量用户评论,观众们在讨论中将AI比作传统的咨询公司,质疑其是否过度炒作而缺乏实际价值。许多评论指出,AI技术承诺的突破往往未能兑现,反而催生了新的商业包装。这一事件反映了社会对AI热潮的日益反思,尽管技术不断进步,但其实际应用与宣传之间的差距仍引发广泛争议,促使行业重新评估AI的发展方向。 #Anthropic #AI #人工智能 #科技新闻 #视频热议 #质疑AI #技术反思 #商业炒作
Presight.ai在阿布扎比招聘全栈工程师
Presight.ai是一家上市的公司,在大数据分析和机器学习模型应用领域拥有多个国内外项目。为其中一个项目,公司正在阿布扎比招聘全栈工程师,职位为全职。该项目专注于通过GPU加速的机器学习模型服务,包括RAG和Agentic分析,来处理大型媒体和文本内容,以捕捉趋势、寻找答案,并深受企业欢迎。具体要求包括前端开发熟练使用TypeScript、React和Mobx,后端集成Elasticsearch作为主要数据存储,并结合多个ML服务。由于用户界面需要快速变化以保持市场主流,公司寻求多名能帮助推动UI发展的技术专家,并欢迎加入多元文化、志同道合的团队。 #招聘 #全栈工程师 #阿布扎比 # #大数据 #机器学习 #AI #科技新闻 #前端开发 #后端开发
Presight.ai是一家上市的公司,在大数据分析和机器学习模型应用领域拥有多个国内外项目。为其中一个项目,公司正在阿布扎比招聘全栈工程师,职位为全职。该项目专注于通过GPU加速的机器学习模型服务,包括RAG和Agentic分析,来处理大型媒体和文本内容,以捕捉趋势、寻找答案,并深受企业欢迎。具体要求包括前端开发熟练使用TypeScript、React和Mobx,后端集成Elasticsearch作为主要数据存储,并结合多个ML服务。由于用户界面需要快速变化以保持市场主流,公司寻求多名能帮助推动UI发展的技术专家,并欢迎加入多元文化、志同道合的团队。 #招聘 #全栈工程师 #阿布扎比 # #大数据 #机器学习 #AI #科技新闻 #前端开发 #后端开发
Codec开源方案:保持Token ID传输,大幅优化AI推理
Codec发布了一种面向AI推理的二进制传输方案。该方案的核心是,让数据在整个传输链路中始终保持原始的token ID格式,而非像传统方式那样在每一步都经历“反标记化为文本-JSON封装-传输-解析-重新标记化”的循环。这一创新避免了大量冗余的文本转换、编解码操作,从而显著节省CPU、内存消耗,并降低延迟。 据其测算,该技术可将网络传输数据量减少高达1700倍,在实际智能体流量中通常也能减少16倍。这不仅意味着全球范围内每年可节省超过4亿美元的云出口带宽与GPU成本,还能将移动设备上的AI响应速度提升最高10倍。更重要的是,通过大幅降低数据传输门槛,Codec有望让全球约50亿处于网络连接缓慢、昂贵或按流量计费环境中的用户,也能访问和使用AI服务。 #Codec #AI推理优化 #数据压缩 #移动互联网 #云计算成本 #开源技术
Codec发布了一种面向AI推理的二进制传输方案。该方案的核心是,让数据在整个传输链路中始终保持原始的token ID格式,而非像传统方式那样在每一步都经历“反标记化为文本-JSON封装-传输-解析-重新标记化”的循环。这一创新避免了大量冗余的文本转换、编解码操作,从而显著节省CPU、内存消耗,并降低延迟。 据其测算,该技术可将网络传输数据量减少高达1700倍,在实际智能体流量中通常也能减少16倍。这不仅意味着全球范围内每年可节省超过4亿美元的云出口带宽与GPU成本,还能将移动设备上的AI响应速度提升最高10倍。更重要的是,通过大幅降低数据传输门槛,Codec有望让全球约50亿处于网络连接缓慢、昂贵或按流量计费环境中的用户,也能访问和使用AI服务。 #Codec #AI推理优化 #数据压缩 #移动互联网 #云计算成本 #开源技术
从原始日志到可编程的EVM执行智能
传统区块链监控系统大多停留在孤立执行片段的捕获上,例如交易事件或流动性活动,这无法还原底层的完整系统状态。仅凭一次代币交换或转移记录,并不能回答如流动性是否崩溃、所有权是否转移、行为是否历史重现等关键问题。真正的执行智能需要跨越历史重现、运行时关系与行为连续性,对执行状态进行深度重构。 以BridgeXAPI为代表的新一代基础设施提出了“路由式执行智能”架构,其核心区别在于:传统监控是对孤立活动的被动反应,而执行智能是通过提交“作用域”,主动重构该作用域随时间推移的完整执行生命周期。系统会根据预设的路由配置(如轻量状态智能、风险智能、运行时取证等),自动执行对应的解析、状态重建、历史关联与置信度演化流程,最终输出结构化的情报。这标志着从简单的“代币监控”范式,向深入理解底层执行行为的可编程智能系统的根本性转变。 #区块链 #EVM #执行智能 #Web3基础设施 #BridgeXAPI #加密技术 #开发者工具
传统区块链监控系统大多停留在孤立执行片段的捕获上,例如交易事件或流动性活动,这无法还原底层的完整系统状态。仅凭一次代币交换或转移记录,并不能回答如流动性是否崩溃、所有权是否转移、行为是否历史重现等关键问题。真正的执行智能需要跨越历史重现、运行时关系与行为连续性,对执行状态进行深度重构。 以BridgeXAPI为代表的新一代基础设施提出了“路由式执行智能”架构,其核心区别在于:传统监控是对孤立活动的被动反应,而执行智能是通过提交“作用域”,主动重构该作用域随时间推移的完整执行生命周期。系统会根据预设的路由配置(如轻量状态智能、风险智能、运行时取证等),自动执行对应的解析、状态重建、历史关联与置信度演化流程,最终输出结构化的情报。这标志着从简单的“代币监控”范式,向深入理解底层执行行为的可编程智能系统的根本性转变。 #区块链 #EVM #执行智能 #Web3基础设施 #BridgeXAPI #加密技术 #开发者工具
本地AI即插即用
在本地运行人工智能时,硬件性能是上限,而软件优化决定了实际能达到的效率。作者近期聚焦软件层技巧,特别是针对Mixture-of-Experts(MoE)架构的优化,旨在使本地AI更加即插即用。MoE模型通过激活部分参数来提升推理速度,例如Qwen3.6-35B-A3B在仅有8GB显存的RTX 3070 Ti上,借助软件标志将冷专家层卸载到系统RAM,实现了33.5 tokens每秒的推理速度。这种优化让大型模型能在普通硬件上运行,降低了成本。然而,MoE模型存在一致性缺点,不同专家激活可能导致性能波动。作者的目标是探索硬件配置和软件工具的最佳组合,以实现高效、经济的本地AI推理,推动AI独立性的进程。 #AI #本地推理 #软件优化 #MoE #硬件 #科技新闻 #即插即用 #推理优化
在本地运行人工智能时,硬件性能是上限,而软件优化决定了实际能达到的效率。作者近期聚焦软件层技巧,特别是针对Mixture-of-Experts(MoE)架构的优化,旨在使本地AI更加即插即用。MoE模型通过激活部分参数来提升推理速度,例如Qwen3.6-35B-A3B在仅有8GB显存的RTX 3070 Ti上,借助软件标志将冷专家层卸载到系统RAM,实现了33.5 tokens每秒的推理速度。这种优化让大型模型能在普通硬件上运行,降低了成本。然而,MoE模型存在一致性缺点,不同专家激活可能导致性能波动。作者的目标是探索硬件配置和软件工具的最佳组合,以实现高效、经济的本地AI推理,推动AI独立性的进程。 #AI #本地推理 #软件优化 #MoE #硬件 #科技新闻 #即插即用 #推理优化
AI 代理 ARIA 升级因果图,强化推理与规划能力
在开发 AI 代理 ARIA 的过程中,从 Phase 01 到 Phase 02 的过渡并非预先计划,而是源于一次具体的工作失败。Phase 01 版本的 ARIA 依赖扁平记忆数据库,能够跨会话存储事实,如操作系统类型、数据库配置等,但无法理解事实间的因果关系。当尝试修复自定义模型提供者配置时,由于环境变量、数据库参数和连接测试之间存在依赖链,ARIA 无法推理问题根源,导致错误无法解决。这一事件凸显了纯检索系统与理解世界模型之间的关键区别:扁平列表只能回答事实是否存在,而因果图能支持反事实推理、预测和规划,从而处理复杂依赖。因此,Phase 02 引入了基于 NetworkX 的因果实体图,将事实作为节点,关系作为类型化边(如“导致”、“需要”),使 ARIA 能够深入理解交互影响,显著提升其多步行动规划能力。 #AI #因果图 #知识图谱 #大模型 #ARIA #RAG #人工智能 #科技进展
在开发 AI 代理 ARIA 的过程中,从 Phase 01 到 Phase 02 的过渡并非预先计划,而是源于一次具体的工作失败。Phase 01 版本的 ARIA 依赖扁平记忆数据库,能够跨会话存储事实,如操作系统类型、数据库配置等,但无法理解事实间的因果关系。当尝试修复自定义模型提供者配置时,由于环境变量、数据库参数和连接测试之间存在依赖链,ARIA 无法推理问题根源,导致错误无法解决。这一事件凸显了纯检索系统与理解世界模型之间的关键区别:扁平列表只能回答事实是否存在,而因果图能支持反事实推理、预测和规划,从而处理复杂依赖。因此,Phase 02 引入了基于 NetworkX 的因果实体图,将事实作为节点,关系作为类型化边(如“导致”、“需要”),使 ARIA 能够深入理解交互影响,显著提升其多步行动规划能力。 #AI #因果图 #知识图谱 #大模型 #ARIA #RAG #人工智能 #科技进展
数据证实AI影响岗位缩减,客服类职位首当其冲
美国劳工统计局最新数据显示,受人工智能影响的职业岗位正在经历显著缩减,其中客户服务代表职位在2024年5月至2025年5月间减少了约13万人,降幅达4.8%。该局在2024年报告中特别列出了18类“与人工智能相关的职业”,涵盖客服、销售及行政文秘等以桌面工作和人机交互为主的岗位。最新年度数据显示,这些相关职业的整体就业人数同比下降了0.2%,与同期美国整体就业增长0.8%的趋势形成鲜明对比。 分析指出,尽管医学秘书等少数子类别就业逆势增长,扭曲了整体下滑幅度,但排除这一类别后,其余受影响职业的就业率实际下降了1.6%。尽管有观点认为AI催生新经济将创造更优质岗位,但当前出现的新工作(如修正AI生成内容的质量监控员)并未带来普遍乐观预期,就业市场的结构性变化已初现端倪。 #AI就业 #劳动力市场 #科技冲击 #美国经济 #职业转型
美国劳工统计局最新数据显示,受人工智能影响的职业岗位正在经历显著缩减,其中客户服务代表职位在2024年5月至2025年5月间减少了约13万人,降幅达4.8%。该局在2024年报告中特别列出了18类“与人工智能相关的职业”,涵盖客服、销售及行政文秘等以桌面工作和人机交互为主的岗位。最新年度数据显示,这些相关职业的整体就业人数同比下降了0.2%,与同期美国整体就业增长0.8%的趋势形成鲜明对比。 分析指出,尽管医学秘书等少数子类别就业逆势增长,扭曲了整体下滑幅度,但排除这一类别后,其余受影响职业的就业率实际下降了1.6%。尽管有观点认为AI催生新经济将创造更优质岗位,但当前出现的新工作(如修正AI生成内容的质量监控员)并未带来普遍乐观预期,就业市场的结构性变化已初现端倪。 #AI就业 #劳动力市场 #科技冲击 #美国经济 #职业转型
无性恋者借助AI伴侣探索无性亲密关系
近年来,随着AI聊天机器人技术的进步,部分无性恋者开始利用此类平台建立亲密关系,以满足情感和浪漫需求,但不涉及性行为。无性恋者通常对性行为缺乏兴趣,但仍可能渴望浪漫连接。例如,一位化名Kor的35岁无性恋艺术家,去年每天花费8至10小时在SpicyChat平台上进行角色扮演,通过输入长文本构建复杂幻想,从中获得满足。研究显示,无性恋者约占全球人口的0.1%至1%,一些社区如MyBoyfriendIsAI讨论AI伴侣的可能性,认为AI本身默认无性。2025年无性意识周期间,Eva AI平台为无性恋谱系者提供免费服务,强调提供无性压力的亲密空间。一位匿名女性通过ChatGPT发展情感联系,帮助她重新连接性感面。然而,无性恋社区人士指出,这种行为极为边缘化,无性恋者同样能建立和维持人类关系,避免强化刻板印象。 #无性恋 #AI伴侣 #科技新闻 #情感关系 #社会文化 #人工智能 #亲密关系
近年来,随着AI聊天机器人技术的进步,部分无性恋者开始利用此类平台建立亲密关系,以满足情感和浪漫需求,但不涉及性行为。无性恋者通常对性行为缺乏兴趣,但仍可能渴望浪漫连接。例如,一位化名Kor的35岁无性恋艺术家,去年每天花费8至10小时在SpicyChat平台上进行角色扮演,通过输入长文本构建复杂幻想,从中获得满足。研究显示,无性恋者约占全球人口的0.1%至1%,一些社区如MyBoyfriendIsAI讨论AI伴侣的可能性,认为AI本身默认无性。2025年无性意识周期间,Eva AI平台为无性恋谱系者提供免费服务,强调提供无性压力的亲密空间。一位匿名女性通过ChatGPT发展情感联系,帮助她重新连接性感面。然而,无性恋社区人士指出,这种行为极为边缘化,无性恋者同样能建立和维持人类关系,避免强化刻板印象。 #无性恋 #AI伴侣 #科技新闻 #情感关系 #社会文化 #人工智能 #亲密关系
开盾发布AI编程智能体沙箱应用,保障开发安全与效率
为应对AI编程智能体在开发过程中可能带来的安全风险与环境管理难题,开源项目“开盾”正式发布。这款桌面应用的核心功能是为AI编程智能体提供安全隔离的运行环境。它能在本地或企业环境中,通过容器或微虚拟机技术为每个智能体会话创建独立沙箱,确保代码、工具和凭据安全,防止意外操作对主机系统造成损害。 开盾允许开发者统一管理工作空间,一次性配置好所需的模型、MCP服务器及工具,使得每次启动智能体时都能获得一致的环境。它支持同时运行多个不同的编程智能体(如Claude Code、OpenCode等),并提供单一界面进行监控。此外,该应用具备企业级连接能力,可将智能体与企业内部已有的工具、API和知识库相连接,使其更好地理解工作上下文。它还支持混合计算模式,自动将任务路由到本地或远程以平衡速度与算力。 #AI编程 #开发工具 #代码安全 #开源软件 #智能体开发 #沙箱技术 #企业软件 #效率工具
为应对AI编程智能体在开发过程中可能带来的安全风险与环境管理难题,开源项目“开盾”正式发布。这款桌面应用的核心功能是为AI编程智能体提供安全隔离的运行环境。它能在本地或企业环境中,通过容器或微虚拟机技术为每个智能体会话创建独立沙箱,确保代码、工具和凭据安全,防止意外操作对主机系统造成损害。 开盾允许开发者统一管理工作空间,一次性配置好所需的模型、MCP服务器及工具,使得每次启动智能体时都能获得一致的环境。它支持同时运行多个不同的编程智能体(如Claude Code、OpenCode等),并提供单一界面进行监控。此外,该应用具备企业级连接能力,可将智能体与企业内部已有的工具、API和知识库相连接,使其更好地理解工作上下文。它还支持混合计算模式,自动将任务路由到本地或远程以平衡速度与算力。 #AI编程 #开发工具 #代码安全 #开源软件 #智能体开发 #沙箱技术 #企业软件 #效率工具
专家认为AI不会加速流程优化,瓶颈在于需求理解而非编码
当前,众多企业在市场压力下大力推行流程优化,并对人工智能(AI)寄予了加速进程的厚望。然而,有专家通过重温《丰田之道》与《目标》等管理经典,并结合一个典型的软件项目甘特图进行分析,指出这种期望可能并不现实。该分析显示,软件开发阶段通常是整个项目周期中最耗时的环节。人们常误以为增加人手或引入AI就能直接缩短工期,却忽视了背后的根本原因:开发耗时并非源于编码速度,而是源于对模糊需求的澄清与理解过程。 例如,一个“销售完成后给用户发邮件”的需求,其具体含义、邮件内容、异常处理等细节都需要大量时间与业务专家反复沟通确认。AI生成代码工具并不能绕过这一对问题的深度理解阶段。因此,真正的优化焦点应在于完善前期需求定义,而非简单地将AI视为缩短开发时间的魔法棒。对AI能力的过度简化,可能导致组织忽视流程中真正需要改进的环节。 #人工智能 #流程优化 #软件开发 #企业管理 #科技观点
当前,众多企业在市场压力下大力推行流程优化,并对人工智能(AI)寄予了加速进程的厚望。然而,有专家通过重温《丰田之道》与《目标》等管理经典,并结合一个典型的软件项目甘特图进行分析,指出这种期望可能并不现实。该分析显示,软件开发阶段通常是整个项目周期中最耗时的环节。人们常误以为增加人手或引入AI就能直接缩短工期,却忽视了背后的根本原因:开发耗时并非源于编码速度,而是源于对模糊需求的澄清与理解过程。 例如,一个“销售完成后给用户发邮件”的需求,其具体含义、邮件内容、异常处理等细节都需要大量时间与业务专家反复沟通确认。AI生成代码工具并不能绕过这一对问题的深度理解阶段。因此,真正的优化焦点应在于完善前期需求定义,而非简单地将AI视为缩短开发时间的魔法棒。对AI能力的过度简化,可能导致组织忽视流程中真正需要改进的环节。 #人工智能 #流程优化 #软件开发 #企业管理 #科技观点
开发者构建缺失评估层,解决LLM幻觉检测难题
在大型语言模型评估中,许多团队依赖直觉判断输出质量,导致规模化时错误频发。一位开发者指出,传统方法无法有效识别自信但错误的响应,这些响应可能得分高于阈值却暗含幻觉。为此,他构建了一个缺失的评估层,将忠实度拆分为归因和特异性两个信号:高特异性结合低归因是幻觉的典型标志,单一评分无法捕捉。该系统作为决策引擎,集成在模型输出和用户交付之间,自动判断响应是否应提供、重试或重新生成。在实际测试中,模型针对“请具体详细”的提示虚构了1987年MIT相关细节,评估分数为0.525,略高于0.5的阈值,但开发者手动发现错误。这凸显了直觉评估的不可靠性。新系统已在RAG系统和多轮对话机器人中应用,通过代码和架构改进,提升输出准确性,防止误导性信息传播。 #LLM #AI评估 #大模型 #幻觉检测 #RAG系统 #科技新闻 #开发者工具 #自然语言处理
在大型语言模型评估中,许多团队依赖直觉判断输出质量,导致规模化时错误频发。一位开发者指出,传统方法无法有效识别自信但错误的响应,这些响应可能得分高于阈值却暗含幻觉。为此,他构建了一个缺失的评估层,将忠实度拆分为归因和特异性两个信号:高特异性结合低归因是幻觉的典型标志,单一评分无法捕捉。该系统作为决策引擎,集成在模型输出和用户交付之间,自动判断响应是否应提供、重试或重新生成。在实际测试中,模型针对“请具体详细”的提示虚构了1987年MIT相关细节,评估分数为0.525,略高于0.5的阈值,但开发者手动发现错误。这凸显了直觉评估的不可靠性。新系统已在RAG系统和多轮对话机器人中应用,通过代码和架构改进,提升输出准确性,防止误导性信息传播。 #LLM #AI评估 #大模型 #幻觉检测 #RAG系统 #科技新闻 #开发者工具 #自然语言处理