微软发布 Majorana 2 拓扑量子芯片,可靠性提升千倍
微软正式推出新一代拓扑量子芯片 Majorana 2。该芯片采用全新材料栈,量子比特可靠性比上一代提升1000倍,平均量子态寿命达20秒(部分可维持一分钟),运算速度达微秒级,尺寸仅为0.01毫米。借助专为加速科学进程而设计的智能代理AI,微软量子团队克服了可靠性、速度和规模等关键障碍,计划将可扩展量子计算机的商用目标提前至2029年,较原计划缩短一半时间。同时,微软宣布全面开放 Microsoft Discovery 平台,供科研机构部署AI代理团队进行自动化研究,并推出免费个人版应用程序。该技术有望解决全球健康、食品供应、能源等领域的棘手问题。 #微软 #量子计算 #Majorana2 #AI #科技突破 #芯片 #拓扑量子
微软正式推出新一代拓扑量子芯片 Majorana 2。该芯片采用全新材料栈,量子比特可靠性比上一代提升1000倍,平均量子态寿命达20秒(部分可维持一分钟),运算速度达微秒级,尺寸仅为0.01毫米。借助专为加速科学进程而设计的智能代理AI,微软量子团队克服了可靠性、速度和规模等关键障碍,计划将可扩展量子计算机的商用目标提前至2029年,较原计划缩短一半时间。同时,微软宣布全面开放 Microsoft Discovery 平台,供科研机构部署AI代理团队进行自动化研究,并推出免费个人版应用程序。该技术有望解决全球健康、食品供应、能源等领域的棘手问题。 #微软 #量子计算 #Majorana2 #AI #科技突破 #芯片 #拓扑量子
最新LLM工作流与现代工程价值观
作者分享了自己从手写代码到全面依赖编码代理的转变。目前主要使用Codex CLI配合GPT 5.5模型,编码代理能在几分钟内完成原本需要数周的工作,且代码质量与手写相当甚至更优。以Athena Crisis项目为例,代理自动修复了70个bug、实现新功能并编写测试,还优化了CI流程和Steam上传管道。作者强调,现代工程价值观依然重要:强所有权、品味、严格护栏与快速反馈、代码库上下文、掌控技术栈、选项价值等。尽管编码不再是瓶颈,但代码审查和上下文切换仍是挑战。 #LLM #编码代理 #AI编程 #工程价值观 #Codex #GPT5 #软件开发 #效率 #自动化
作者分享了自己从手写代码到全面依赖编码代理的转变。目前主要使用Codex CLI配合GPT 5.5模型,编码代理能在几分钟内完成原本需要数周的工作,且代码质量与手写相当甚至更优。以Athena Crisis项目为例,代理自动修复了70个bug、实现新功能并编写测试,还优化了CI流程和Steam上传管道。作者强调,现代工程价值观依然重要:强所有权、品味、严格护栏与快速反馈、代码库上下文、掌控技术栈、选项价值等。尽管编码不再是瓶颈,但代码审查和上下文切换仍是挑战。 #LLM #编码代理 #AI编程 #工程价值观 #Codex #GPT5 #软件开发 #效率 #自动化
Wanderwhim:为写作者与学习者打造的AI驱动思维工作空间
Wanderwhim 是一款专为作家、博主和终身学习者设计的AI工作空间,旨在帮助用户深度思考与整理知识。其核心功能包括:通过“收集”功能保存文章、引文、片段等素材;AI自动对保存内容进行聚类,形成主题地图;提供“探索”功能,AI推荐相关来源、尖锐问题和新连接。编辑器支持多种写作模式,如润色、深化、阐明、挑战等,帮助用户保持个人风格的同时提升表达。产品分为Starter、Pro、Studio三个付费层级,分别提供不同数量的主题、来源和AI积分,支持30天无理由退款。Wanderwhim强调无聊天机器人、无信息流、无噪音,专注于用户的兴趣与问题,为思想成长提供空间。 #AI写作 #知识管理 #思维工具 #创作者工具 #Wanderwhim
Wanderwhim 是一款专为作家、博主和终身学习者设计的AI工作空间,旨在帮助用户深度思考与整理知识。其核心功能包括:通过“收集”功能保存文章、引文、片段等素材;AI自动对保存内容进行聚类,形成主题地图;提供“探索”功能,AI推荐相关来源、尖锐问题和新连接。编辑器支持多种写作模式,如润色、深化、阐明、挑战等,帮助用户保持个人风格的同时提升表达。产品分为Starter、Pro、Studio三个付费层级,分别提供不同数量的主题、来源和AI积分,支持30天无理由退款。Wanderwhim强调无聊天机器人、无信息流、无噪音,专注于用户的兴趣与问题,为思想成长提供空间。 #AI写作 #知识管理 #思维工具 #创作者工具 #Wanderwhim
SFT与DPO结合提升AI代理工具调用准确性,亚马逊SageMaker AI助力模型微调
AI代理在执行复杂多步骤任务时,工具调用的准确性至关重要。错误调用工具或参数格式不当会导致任务延迟、错误率上升及用户体验下降。本文介绍如何结合监督微调(SFT)和直接偏好优化(DPO)来提升小语言模型的工具调用准确性。SFT通过高质量数据集训练模型识别工具特定语言和约束,DPO则利用“偏好”反馈(如“选这个而非那个”)直接优化模型输出,无需奖励函数。两者结合形成稳健框架,使模型能自主与外部应用交互。示例使用亚马逊SageMaker AI训练作业,支持按需高性能集群和自动资源释放,并提供了评估方法以对比基础模型与微调变体的准确性。 #AI代理 #工具调用 #监督微调 #直接偏好优化 #亚马逊SageMaker #小语言模型 #模型微调 #自动化
AI代理在执行复杂多步骤任务时,工具调用的准确性至关重要。错误调用工具或参数格式不当会导致任务延迟、错误率上升及用户体验下降。本文介绍如何结合监督微调(SFT)和直接偏好优化(DPO)来提升小语言模型的工具调用准确性。SFT通过高质量数据集训练模型识别工具特定语言和约束,DPO则利用“偏好”反馈(如“选这个而非那个”)直接优化模型输出,无需奖励函数。两者结合形成稳健框架,使模型能自主与外部应用交互。示例使用亚马逊SageMaker AI训练作业,支持按需高性能集群和自动资源释放,并提供了评估方法以对比基础模型与微调变体的准确性。 #AI代理 #工具调用 #监督微调 #直接偏好优化 #亚马逊SageMaker #小语言模型 #模型微调 #自动化
❤1
沃尔玛因需求过高限制员工使用AI工具
据彭博社报道,沃尔玛公司因员工对内部开发的AI助手Code Puppy需求过高,决定限制其使用。此前员工可无限量使用该工具,现在每人获得固定数量的“代币”。Code Puppy可协助处理电子表格、演示文稿等任务。沃尔玛表示希望员工以创造价值的方式使用AI,并提供相应指导。随着企业将AI融入工作流程,成本问题日益凸显,优步曾数月花完年度AI预算,微软也缩减了部分服务。尽管如此,从零售到金融行业的企业仍在推动员工日常使用AI。沃尔玛在供应链管理和购物体验等环节的AI应用领先同行。 #沃尔玛 #AI #人工智能 #CodePuppy #科技新闻 #企业应用 #成本控制 #零售业
据彭博社报道,沃尔玛公司因员工对内部开发的AI助手Code Puppy需求过高,决定限制其使用。此前员工可无限量使用该工具,现在每人获得固定数量的“代币”。Code Puppy可协助处理电子表格、演示文稿等任务。沃尔玛表示希望员工以创造价值的方式使用AI,并提供相应指导。随着企业将AI融入工作流程,成本问题日益凸显,优步曾数月花完年度AI预算,微软也缩减了部分服务。尽管如此,从零售到金融行业的企业仍在推动员工日常使用AI。沃尔玛在供应链管理和购物体验等环节的AI应用领先同行。 #沃尔玛 #AI #人工智能 #CodePuppy #科技新闻 #企业应用 #成本控制 #零售业
Meta 押注28岁创始人,一年打造出最强AI模型Muse Spark
一年前,扎克伯格任命年仅28岁的初创公司创始人亚历山德·王(Alexandr Wang)负责Meta的AI复兴,希望以局外人的紧迫感和雄心打破内部僵局。如今,这个价值1.5万亿美元的公司推出了其迄今为止最可信的AI模型Muse Spark。据现任及前员工透露,王在过去12个月内组建了高薪精英研究团队,重塑了Meta的AI运营架构,并跻身公司最具影响力的高管之列——他是除扎克伯格外唯一受邀参加白宫与硅谷巨头晚宴的Meta领导人。Muse Spark由王的秘密研究小组TBD Lab开发,被视为Meta在AI领域追赶OpenAI、谷歌和Anthropic的里程碑。尽管面临经验质疑和内部政治挑战,支持者认为后续模型有望进一步缩小差距。卡内基梅隆大学教授、Meta前AI研究副总裁萨拉胡特迪诺夫称赞该实验室在短期内取得的成就令人印象深刻。 #Meta #AI #AlexandrWang #MuseSpark #大模型 #科技新闻 #扎克伯格 #OpenAI
一年前,扎克伯格任命年仅28岁的初创公司创始人亚历山德·王(Alexandr Wang)负责Meta的AI复兴,希望以局外人的紧迫感和雄心打破内部僵局。如今,这个价值1.5万亿美元的公司推出了其迄今为止最可信的AI模型Muse Spark。据现任及前员工透露,王在过去12个月内组建了高薪精英研究团队,重塑了Meta的AI运营架构,并跻身公司最具影响力的高管之列——他是除扎克伯格外唯一受邀参加白宫与硅谷巨头晚宴的Meta领导人。Muse Spark由王的秘密研究小组TBD Lab开发,被视为Meta在AI领域追赶OpenAI、谷歌和Anthropic的里程碑。尽管面临经验质疑和内部政治挑战,支持者认为后续模型有望进一步缩小差距。卡内基梅隆大学教授、Meta前AI研究副总裁萨拉胡特迪诺夫称赞该实验室在短期内取得的成就令人印象深刻。 #Meta #AI #AlexandrWang #MuseSpark #大模型 #科技新闻 #扎克伯格 #OpenAI
Show HN: 本地运行Chrome扩展,阻止AI聊天中的凭证泄露
一款名为Redact的Chrome扩展应运而生,旨在防止用户在向ChatGPT、Claude、Gemini等AI聊天工具粘贴内容时,无意间泄露密码和敏感信息。该扩展完全在浏览器本地运行,通过内置的轻量级神经网络模型,在约150毫秒内检测粘贴内容中的凭证与个人隐私信息(PII)。用户可在弹出窗口中按数据类型设置“阻止”或“警告”模式,默认配置针对工程师优化。检测到敏感信息后,可选择发送脱敏版本、原始内容或直接取消发送。扩展仅对支持的聊天网站生效,不进行任何网络调用,所有操作均在本地完成,源码公开在GitHub,Chrome Web Store可免费下载。 #Chrome扩展 #网络安全 #AI #隐私保护 #凭证泄露 #本地检测 #开源 #ChatGPT
一款名为Redact的Chrome扩展应运而生,旨在防止用户在向ChatGPT、Claude、Gemini等AI聊天工具粘贴内容时,无意间泄露密码和敏感信息。该扩展完全在浏览器本地运行,通过内置的轻量级神经网络模型,在约150毫秒内检测粘贴内容中的凭证与个人隐私信息(PII)。用户可在弹出窗口中按数据类型设置“阻止”或“警告”模式,默认配置针对工程师优化。检测到敏感信息后,可选择发送脱敏版本、原始内容或直接取消发送。扩展仅对支持的聊天网站生效,不进行任何网络调用,所有操作均在本地完成,源码公开在GitHub,Chrome Web Store可免费下载。 #Chrome扩展 #网络安全 #AI #隐私保护 #凭证泄露 #本地检测 #开源 #ChatGPT
Knowable 开源 AI 导师上线 macOS,用摄像头“看”课本苏格拉底式引导学习
一款名为 Knowable 的开源个人 AI 导师工具正式面向 macOS 用户推出。该工具专为高中生设计,通过 Mac 内置摄像头或 iPhone 连续互通相机实时识别实体课本或笔记本内容,学生按下 opt+M 键语音提问,AI 助手 Milo 不仅能理解问题,还能结合当前摄像头画面给出苏格拉底式提示,而非直接提供答案。它支持 LaTeX 数学公式渲染和语音朗读,每月提供 1000 次免费对话。与传统 AI 辅导工具不同,Knowable 能真正“看见”学生正在看的页面,从而提供精准引导,帮助学生在不依赖答案的情况下自己找到解决方法,建立深入理解。该工具覆盖数学、科学、英语等所有高中科目,无需额外硬件,24/7 可用,旨在降低辅导成本并培养独立思考能力。 #AI #教育 #开源 #macOS #Knowable #智能导师 #苏格拉底式 #科技 #工具
一款名为 Knowable 的开源个人 AI 导师工具正式面向 macOS 用户推出。该工具专为高中生设计,通过 Mac 内置摄像头或 iPhone 连续互通相机实时识别实体课本或笔记本内容,学生按下 opt+M 键语音提问,AI 助手 Milo 不仅能理解问题,还能结合当前摄像头画面给出苏格拉底式提示,而非直接提供答案。它支持 LaTeX 数学公式渲染和语音朗读,每月提供 1000 次免费对话。与传统 AI 辅导工具不同,Knowable 能真正“看见”学生正在看的页面,从而提供精准引导,帮助学生在不依赖答案的情况下自己找到解决方法,建立深入理解。该工具覆盖数学、科学、英语等所有高中科目,无需额外硬件,24/7 可用,旨在降低辅导成本并培养独立思考能力。 #AI #教育 #开源 #macOS #Knowable #智能导师 #苏格拉底式 #科技 #工具
Opus 4.8 基准测试胜出:在Go与Rust代码任务中领先GPT
一项针对两个开源代码库(graphql-go-tools和sqlparser-rs)50个真实任务的基准测试显示,Anthropic的Opus 4.8模型在代码质量上全面领先于OpenAI GPT-5.5、Claude Opus 4.7及Composer 2.5。测试从测试通过、等价性、代码审查、工艺性和占用率五个维度进行评分。结果显示,Opus 4.8在Go和Rust两种语言上的工艺评分均居首位,且运行成本低于GPT-5.5高端版和Opus 4.7 xhigh,但在绝对价格上不如Composer 2.5便宜(后者价格低约6-7倍但工艺性较弱)。所有模型均能通过基本测试门槛,真正的差距体现在更高维度的代码质量上。该测试为开发者提供了具体的模型选择参考,表明Opus 4.8在成本效益方面具备显著优势,堪称新的“工艺领袖”。 #AI #机器学习 #代码生成 #模型基准 #Opus4.8 #GPT5.5 #Anthropic
一项针对两个开源代码库(graphql-go-tools和sqlparser-rs)50个真实任务的基准测试显示,Anthropic的Opus 4.8模型在代码质量上全面领先于OpenAI GPT-5.5、Claude Opus 4.7及Composer 2.5。测试从测试通过、等价性、代码审查、工艺性和占用率五个维度进行评分。结果显示,Opus 4.8在Go和Rust两种语言上的工艺评分均居首位,且运行成本低于GPT-5.5高端版和Opus 4.7 xhigh,但在绝对价格上不如Composer 2.5便宜(后者价格低约6-7倍但工艺性较弱)。所有模型均能通过基本测试门槛,真正的差距体现在更高维度的代码质量上。该测试为开发者提供了具体的模型选择参考,表明Opus 4.8在成本效益方面具备显著优势,堪称新的“工艺领袖”。 #AI #机器学习 #代码生成 #模型基准 #Opus4.8 #GPT5.5 #Anthropic
AI数据中心秘密建设引发居民强烈不满,透明度成最大担忧
著名环境活动家艾琳·布罗克维奇联合苏珊娜·布思比发起调查,发现全美各地AI数据中心正以“秘密”方式加速建设,引发社区广泛担忧。布罗克维奇称,接到大量居民投诉后,她在4月发起询问,一个月内收到3862份报告,地图标记覆盖49个州、共2716个点位。居民投诉集中在缺乏透明度,表现为“沉默、忽视、秘密”,很多项目通过幕后交易和非公开协议推进,社区会议成摆设。典型案例是Meta在路易斯安那州东北部建设的400万平方英尺AI园区“Hyperion”,其用电量将超过整个新奥尔良市,但当地居民直到挖掘开始才知情。居民担忧水质变差、电费上涨、动物生病和房产贬值。布罗克维奇直言:若AI数据中心果真造福社区,为何要秘密建造? #AI #数据中心 #透明度 #社区抗议 #环境影响 #能源消耗 #公众参与 #ErinBrockovich #科技基建 #隐私
著名环境活动家艾琳·布罗克维奇联合苏珊娜·布思比发起调查,发现全美各地AI数据中心正以“秘密”方式加速建设,引发社区广泛担忧。布罗克维奇称,接到大量居民投诉后,她在4月发起询问,一个月内收到3862份报告,地图标记覆盖49个州、共2716个点位。居民投诉集中在缺乏透明度,表现为“沉默、忽视、秘密”,很多项目通过幕后交易和非公开协议推进,社区会议成摆设。典型案例是Meta在路易斯安那州东北部建设的400万平方英尺AI园区“Hyperion”,其用电量将超过整个新奥尔良市,但当地居民直到挖掘开始才知情。居民担忧水质变差、电费上涨、动物生病和房产贬值。布罗克维奇直言:若AI数据中心果真造福社区,为何要秘密建造? #AI #数据中心 #透明度 #社区抗议 #环境影响 #能源消耗 #公众参与 #ErinBrockovich #科技基建 #隐私