七年四闯IPO,“溜溜梅”上市首日暴涨193%
6月15日,溜溜梅在港交所上市,首日股价暴涨193.71%,市值达100.88亿港元。其股票简称“LLM”恰好与“大语言模型”缩写相同,在AI概念股集体大涨的行情下被市场热炒。然而,专家指出其流通盘极小,存在游资炒作风险,高股价或难持续。溜溜梅历时七年四次冲击IPO,期间因多次对赌协议触发回购,红杉中国等明星机构清仓离场。上市前11天,公司在账上现金不足4000万元的情况下突击分红6730万元,创始人夫妇获超5300万元,而银行借款高达4.8亿元,财务健康状况引发质疑。近年公司收入增速放缓,毛利率持续下滑,基本面承压。 #溜溜梅 #IPO #港股 #AI概念股 #对赌协议 #零食 #股市炒作
6月15日,溜溜梅在港交所上市,首日股价暴涨193.71%,市值达100.88亿港元。其股票简称“LLM”恰好与“大语言模型”缩写相同,在AI概念股集体大涨的行情下被市场热炒。然而,专家指出其流通盘极小,存在游资炒作风险,高股价或难持续。溜溜梅历时七年四次冲击IPO,期间因多次对赌协议触发回购,红杉中国等明星机构清仓离场。上市前11天,公司在账上现金不足4000万元的情况下突击分红6730万元,创始人夫妇获超5300万元,而银行借款高达4.8亿元,财务健康状况引发质疑。近年公司收入增速放缓,毛利率持续下滑,基本面承压。 #溜溜梅 #IPO #港股 #AI概念股 #对赌协议 #零食 #股市炒作
AI无法取代的
许多人建议我部署更多AI代理进行冷呼叫、抓取新闻、自动化营销等,我完全认同AI和自动化工具的必要性。然而,AI永远无法取代的是我们的人际互动。我的社交网络是最重要的资产,信任和关系需要多年培养,不是靠社交吃喝,而是提供专业的服务。当我指导学生时,鼓励他们积极社交、保持活跃,并非追求朋友数量或社交媒体上的最多连接,而是与他人建立情感联系:在问题出现时挺身而出,在坏事发生时承担责任。拥有高质量的社交网络远比数量重要。AI能做很多事,但无法帮助我们建立牢固的关系。AI或许会夺走你的工作,但永远无法取代你给予社交网络的温暖与微笑。 #AI #人际关系 #信任 #情感连接 #社交网络 #职业发展 #人性价值
许多人建议我部署更多AI代理进行冷呼叫、抓取新闻、自动化营销等,我完全认同AI和自动化工具的必要性。然而,AI永远无法取代的是我们的人际互动。我的社交网络是最重要的资产,信任和关系需要多年培养,不是靠社交吃喝,而是提供专业的服务。当我指导学生时,鼓励他们积极社交、保持活跃,并非追求朋友数量或社交媒体上的最多连接,而是与他人建立情感联系:在问题出现时挺身而出,在坏事发生时承担责任。拥有高质量的社交网络远比数量重要。AI能做很多事,但无法帮助我们建立牢固的关系。AI或许会夺走你的工作,但永远无法取代你给予社交网络的温暖与微笑。 #AI #人际关系 #信任 #情感连接 #社交网络 #职业发展 #人性价值
This media is not supported in your browser
VIEW IN TELEGRAM
Cy:AI同事入驻Slack,端到端完成工作并汇报
一款名为Cy的AI同事正式推出,它嵌入在Slack中,能够端到端处理销售、营销、财务、招聘、运营和支持等实际工作。用户只需用自然语言在Slack中下达指令,如“催收逾期发票”或“生成每周复盘”,Cy即可自动登录现有工具(CRM、邮箱、账本等),完成整个流程并直接返回结果至对话线程,无需学习新工具或组建专门团队。例如,Cy可自动触达150人、更新CRM,或追讨逾期账款并记录已回收金额。其核心理念是让软件主动完成工作,而非仅仅提供辅助。Cy安装仅需60秒,免费试用,且每完成一项任务都会学习形成可复用的技能。 #AI #Slack #AI助手 #自动化 #效率工具 #科技新闻 #产品发布 #工作自动化
一款名为Cy的AI同事正式推出,它嵌入在Slack中,能够端到端处理销售、营销、财务、招聘、运营和支持等实际工作。用户只需用自然语言在Slack中下达指令,如“催收逾期发票”或“生成每周复盘”,Cy即可自动登录现有工具(CRM、邮箱、账本等),完成整个流程并直接返回结果至对话线程,无需学习新工具或组建专门团队。例如,Cy可自动触达150人、更新CRM,或追讨逾期账款并记录已回收金额。其核心理念是让软件主动完成工作,而非仅仅提供辅助。Cy安装仅需60秒,免费试用,且每完成一项任务都会学习形成可复用的技能。 #AI #Slack #AI助手 #自动化 #效率工具 #科技新闻 #产品发布 #工作自动化
Adam 发布开源 AI CAD 工具,推动机械设计代码化
来自 YC W25 孵化的初创公司 Adam 正式推出开源文本转 CAD 平台 CADAM。创始人 Zach 在 Hacker News 上介绍,该平台基于两大核心理念:AI 将成为机械设计的主要创作媒介,就像当前在软件开发中那样;最理想的 CAD 生成范式是将设计作为代码来生成(文本→代码→CAD)。CADAM 是一个 React 应用(基于 TanStack Start),后端采用 Supabase 处理身份验证、数据库和文件存储。这一开源项目旨在让机械设计师通过自然语言直接生成三维模型,降低传统 CAD 软件的使用门槛,加速产品设计流程。 #AI #CAD #开源 #机械设计 #YC #创业 #文本转CAD #人工智能
来自 YC W25 孵化的初创公司 Adam 正式推出开源文本转 CAD 平台 CADAM。创始人 Zach 在 Hacker News 上介绍,该平台基于两大核心理念:AI 将成为机械设计的主要创作媒介,就像当前在软件开发中那样;最理想的 CAD 生成范式是将设计作为代码来生成(文本→代码→CAD)。CADAM 是一个 React 应用(基于 TanStack Start),后端采用 Supabase 处理身份验证、数据库和文件存储。这一开源项目旨在让机械设计师通过自然语言直接生成三维模型,降低传统 CAD 软件的使用门槛,加速产品设计流程。 #AI #CAD #开源 #机械设计 #YC #创业 #文本转CAD #人工智能
LLM 基准测试的真相
通用 LLM 基准测试(如 MMLU、HumanEval)得分亮眼,但对于绝大多数用 AI 构建流程和产品的企业而言,这些数据毫无意义。真正关键的是你的系统在实际任务中的表现。作者指出,依赖用户投诉来发现模型退化会错过大量静默失败——用户得到错误答案却默默放弃,或支持工单仅捕捉到部分质量下降。推荐的做法是编写反映具体任务、数据和失败模式的评估(Evals)。评估方法分为三类:LLM 作裁判(快速但带有偏见)、人工评估(黄金标准但昂贵)、以及任务特定自动化检查(推荐:速度快、确定性强、与系统实际需求挂钩)。在更换模型或提示词之前,应先明确定义“糟糕输出”是什么,并用代码实现可编程的检查,例如验证 JSON 格式、确保引用有依据、检查响应长度等。只有针对自身工作负载的定制化评测,才能真实衡量模型的好坏。 #LLM #AI #基准测试 #Eval #企业应用 #模型评估 #质量保障 #自动化测试 #实际落地
通用 LLM 基准测试(如 MMLU、HumanEval)得分亮眼,但对于绝大多数用 AI 构建流程和产品的企业而言,这些数据毫无意义。真正关键的是你的系统在实际任务中的表现。作者指出,依赖用户投诉来发现模型退化会错过大量静默失败——用户得到错误答案却默默放弃,或支持工单仅捕捉到部分质量下降。推荐的做法是编写反映具体任务、数据和失败模式的评估(Evals)。评估方法分为三类:LLM 作裁判(快速但带有偏见)、人工评估(黄金标准但昂贵)、以及任务特定自动化检查(推荐:速度快、确定性强、与系统实际需求挂钩)。在更换模型或提示词之前,应先明确定义“糟糕输出”是什么,并用代码实现可编程的检查,例如验证 JSON 格式、确保引用有依据、检查响应长度等。只有针对自身工作负载的定制化评测,才能真实衡量模型的好坏。 #LLM #AI #基准测试 #Eval #企业应用 #模型评估 #质量保障 #自动化测试 #实际落地
AI时代正在把FP64硬件从科学计算领域抽走
科学高性能计算(HPC)依赖双精度浮点运算(FP64),例如计算流体力学需要高精度解析多尺度物理。然而,AI训练和推理仅需低精度(8位甚至4位),两者硬件需求相悖。芯片厂商追逐利润更丰厚的AI市场,倾向削减FP64核心,转而投入低精度计算单元。NVIDIA H100的FP64为34 TFLOP/s,B200约40 TFLOP/s,而Blackwell取消了专用FP64张量核心;AMD MI300X的FP81.7 TFLOP/s,后续MI355X降至78.6;Intel取消独立HPC GPU,Jaguar Shores未公布FP64指标;消费级芯片NVIDIA N1X甚至完全不提FP64。唯一的逆流是AMD MI430X,专为欧洲百亿亿次超算设计,FP64超过200 TFLOP/s,但仅此一款产品。长期看,科学计算正面临硬件精度支持的削弱。 #AI #高性能计算 #FP64 #芯片 #NVIDIA #AMD #Intel #HPC #科学计算
科学高性能计算(HPC)依赖双精度浮点运算(FP64),例如计算流体力学需要高精度解析多尺度物理。然而,AI训练和推理仅需低精度(8位甚至4位),两者硬件需求相悖。芯片厂商追逐利润更丰厚的AI市场,倾向削减FP64核心,转而投入低精度计算单元。NVIDIA H100的FP64为34 TFLOP/s,B200约40 TFLOP/s,而Blackwell取消了专用FP64张量核心;AMD MI300X的FP81.7 TFLOP/s,后续MI355X降至78.6;Intel取消独立HPC GPU,Jaguar Shores未公布FP64指标;消费级芯片NVIDIA N1X甚至完全不提FP64。唯一的逆流是AMD MI430X,专为欧洲百亿亿次超算设计,FP64超过200 TFLOP/s,但仅此一款产品。长期看,科学计算正面临硬件精度支持的削弱。 #AI #高性能计算 #FP64 #芯片 #NVIDIA #AMD #Intel #HPC #科学计算
Anthropic 高危 AI 模型因美国出口管制被迫下线
Anthropic 公司近日发布两款新型 AI 模型——Claude Fable 5 与 Mythos 5,后者具备发现软件漏洞并加以利用的双重能力,可能被恶意行为者滥用。美国政府随后依据出口管制指令,以“任何外国国民不得使用”为由要求下线。Anthropic 虽与白宫协商,但尚未达成恢复服务的协议。公司承认该模型是“双刃剑”,最初仅向特定工作组(Project Glasswing)开放 Mythos 5 预览版,并向公众推出经防护处理的 Fable 5。然而政府认为 Fable 5 的防护可被绕过,进而获取 Mythos 5 的全部能力,构成国家安全风险。网络安全专家指出,这一冲突只是暂时掩盖了更严峻的现实:其他公司甚至开源社区很快将推出类似能力的模型,Anthropic 并非孤例。OpenAI 也已开始私下发布网络安全模型。政策争论无法阻止技术趋势,社会必须为高危 AI 能力在未来6至24个月内广泛可用做好准备。 #AI #人工智能 #Anthropic #出口管制 #国家安全 #双重用途 #网络安全 #科技新闻 #Claude #Mythos
Anthropic 公司近日发布两款新型 AI 模型——Claude Fable 5 与 Mythos 5,后者具备发现软件漏洞并加以利用的双重能力,可能被恶意行为者滥用。美国政府随后依据出口管制指令,以“任何外国国民不得使用”为由要求下线。Anthropic 虽与白宫协商,但尚未达成恢复服务的协议。公司承认该模型是“双刃剑”,最初仅向特定工作组(Project Glasswing)开放 Mythos 5 预览版,并向公众推出经防护处理的 Fable 5。然而政府认为 Fable 5 的防护可被绕过,进而获取 Mythos 5 的全部能力,构成国家安全风险。网络安全专家指出,这一冲突只是暂时掩盖了更严峻的现实:其他公司甚至开源社区很快将推出类似能力的模型,Anthropic 并非孤例。OpenAI 也已开始私下发布网络安全模型。政策争论无法阻止技术趋势,社会必须为高危 AI 能力在未来6至24个月内广泛可用做好准备。 #AI #人工智能 #Anthropic #出口管制 #国家安全 #双重用途 #网络安全 #科技新闻 #Claude #Mythos
Rockstar宣布GTA V免费升级PS5和Xbox Series X
据Rockstar Games官方消息,在备受期待的《GTA VI》发售仅数月前,公司宣布将为玩家提供免费的《GTA V》次世代版本升级服务。从6月18日起,凡在PS4上拥有任意版本《GTA V》或在Xbox One上拥有数字版游戏的玩家,均可免费获取对应PS5或Xbox Series X/S版本,无需额外付费。此举被视为Rockstar在《GTA VI》发布前维持玩家热度的重要举措。此前的升级选项曾需要付费,本次免费升级政策适用于所有符合条件的玩家,但Xbox One实体版用户无法直接享受该优惠。 #GTA #Rockstar #免费升级 #游戏新闻 #PS5 #XboxSeriesX #GTAVI
据Rockstar Games官方消息,在备受期待的《GTA VI》发售仅数月前,公司宣布将为玩家提供免费的《GTA V》次世代版本升级服务。从6月18日起,凡在PS4上拥有任意版本《GTA V》或在Xbox One上拥有数字版游戏的玩家,均可免费获取对应PS5或Xbox Series X/S版本,无需额外付费。此举被视为Rockstar在《GTA VI》发布前维持玩家热度的重要举措。此前的升级选项曾需要付费,本次免费升级政策适用于所有符合条件的玩家,但Xbox One实体版用户无法直接享受该优惠。 #GTA #Rockstar #免费升级 #游戏新闻 #PS5 #XboxSeriesX #GTAVI
AI Native 人机协同重构内容安全新范式|AICon 上海
AICon 2026 上海站将于 6 月 26 日至 27 日举行,以“构建可信赖、可规模化、可商业化的 Agentic 操作系统”为核心命题,汇聚清华、复旦等高校教授及阿里、腾讯、快手等头部公司技术专家。快手商业化技术部风控大模型负责人宫兆汉将分享《商业安全大模型 BLM:AI Native 人机协同重构内容安全新范式》。该自研大模型具备图文视频跨模态统一理解与细粒度营销意图感知能力,构建“精细拒绝—AI 修复—自动过审”的生成式安全闭环,将拦截终点转化为内容修复起点。通过 Multi-Agent 协同架构实现审核、回扫、验真全链路智能化,并采用 HITL 设计将人工介入聚焦于高价值例外处理,形成持续自进化的增强型安全体系。大会还将深入探讨多智能体协调、记忆管理、工程化落地等议题,为 AGI 时代的智能化风控基础设施提供新思路。 #AICon #AI #人机协同 #内容安全 #大模型 #快手 #BLM #Agent #HITL #多模态
AICon 2026 上海站将于 6 月 26 日至 27 日举行,以“构建可信赖、可规模化、可商业化的 Agentic 操作系统”为核心命题,汇聚清华、复旦等高校教授及阿里、腾讯、快手等头部公司技术专家。快手商业化技术部风控大模型负责人宫兆汉将分享《商业安全大模型 BLM:AI Native 人机协同重构内容安全新范式》。该自研大模型具备图文视频跨模态统一理解与细粒度营销意图感知能力,构建“精细拒绝—AI 修复—自动过审”的生成式安全闭环,将拦截终点转化为内容修复起点。通过 Multi-Agent 协同架构实现审核、回扫、验真全链路智能化,并采用 HITL 设计将人工介入聚焦于高价值例外处理,形成持续自进化的增强型安全体系。大会还将深入探讨多智能体协调、记忆管理、工程化落地等议题,为 AGI 时代的智能化风控基础设施提供新思路。 #AICon #AI #人机协同 #内容安全 #大模型 #快手 #BLM #Agent #HITL #多模态
Testkube 举办 AI 调试测试失败网络研讨会
Testkube 宣布将于2026年6月18日举办一场主题为“使用AI进行测试失败分析”的网络研讨会。该会议由 CTO Ole Lensmar 主讲,旨在解决大规模测试中常见的瓶颈——分析测试失败原因。研讨将涵盖如何利用AI进行失败分类、根因分析及稳定性检测;AI代理所需的有效上下文(日志、指标、工件、源代码及MCP服务器集成);处理大规模测试数据时成本、精度与隐私的权衡;以及从基础失败分类到自主修复的扩展策略。此外还将进行Testkube原生AI功能的现场演示。 #AI #测试 #调试 #Testkube #自动化 #软件测试 #网络研讨会
Testkube 宣布将于2026年6月18日举办一场主题为“使用AI进行测试失败分析”的网络研讨会。该会议由 CTO Ole Lensmar 主讲,旨在解决大规模测试中常见的瓶颈——分析测试失败原因。研讨将涵盖如何利用AI进行失败分类、根因分析及稳定性检测;AI代理所需的有效上下文(日志、指标、工件、源代码及MCP服务器集成);处理大规模测试数据时成本、精度与隐私的权衡;以及从基础失败分类到自主修复的扩展策略。此外还将进行Testkube原生AI功能的现场演示。 #AI #测试 #调试 #Testkube #自动化 #软件测试 #网络研讨会
客户流失模型的阈值选择,本质是一场定价决策
当流失模型预测某客户离开概率为0.4,而你的代码以0.5为阈值判定其留下时,你已做出了一个定价决策:你认为向本可留下的客户发送挽留offer的成本,恰好等于失去一个真正要离开的客户的代价。然而,对于IBM Telco数据集(Kaggle上最常被使用的流失数据集),这一默认阈值会导致成本估算偏差高达13倍。作者整理了36个公开分析报告,发现约九成只报告准确率或F1分数,仅一成多报告利润曲线,无一使用生存分析计算客户生命周期价值。按照标准20%测试集分割,每个客户的潜在损失约为86美元;若将比例放大至10万订阅用户规模,可挽回成本高达860万美元。文章指出,阈值决策依赖于生命周期价值(LTV),而生存分析是准确计算LTV的关键。通过公开的2026年B2C SaaS基准数据,作者演示了如何利用平均每用户收入、毛利率和获客成本计算分类错误的真实成本,并证明在SMOTE平衡数据上训练时,教科书式的贝叶斯最优阈值公式不如暴力搜索有效。 #客户流失 #机器学习 #定价决策 #数据科学 #SaaS #生存分析 #成本优化 #AI商业应用 #客户生命周期价值
当流失模型预测某客户离开概率为0.4,而你的代码以0.5为阈值判定其留下时,你已做出了一个定价决策:你认为向本可留下的客户发送挽留offer的成本,恰好等于失去一个真正要离开的客户的代价。然而,对于IBM Telco数据集(Kaggle上最常被使用的流失数据集),这一默认阈值会导致成本估算偏差高达13倍。作者整理了36个公开分析报告,发现约九成只报告准确率或F1分数,仅一成多报告利润曲线,无一使用生存分析计算客户生命周期价值。按照标准20%测试集分割,每个客户的潜在损失约为86美元;若将比例放大至10万订阅用户规模,可挽回成本高达860万美元。文章指出,阈值决策依赖于生命周期价值(LTV),而生存分析是准确计算LTV的关键。通过公开的2026年B2C SaaS基准数据,作者演示了如何利用平均每用户收入、毛利率和获客成本计算分类错误的真实成本,并证明在SMOTE平衡数据上训练时,教科书式的贝叶斯最优阈值公式不如暴力搜索有效。 #客户流失 #机器学习 #定价决策 #数据科学 #SaaS #生存分析 #成本优化 #AI商业应用 #客户生命周期价值