This media is not supported in your browser
VIEW IN TELEGRAM
Atuin AI 服务器正式开源,支持自托管与本地模型部署
Atuin AI 是一款运行在终端中的快速智能代理,能够即时启动并提供多种工具辅助终端操作。为了满足用户对数据隐私的更高要求,团队宣布将 Atuin AI 服务器代码开源,允许用户自托管。该项目基于与生产环境相同的核心库,兼容任何 OpenAI 风格的聊天补全新 API,可接入 Ollama、vLLM、LM Studio 等本地模型,也支持 OpenRouter 等在线服务。用户可通过 Docker 或本地运行快速部署,并配置服务器端工具(如网络搜索和内容抓取)。Atuin AI 继续为所有用户提供免费使用额度,且不存储对话记录。这一举措在保持功能的同时,赋予用户更强的数据控制权。 #AtuinAI #开源 #终端代理 #自托管 #隐私保护 #AI #Ollama #Docker #技术新闻
Atuin AI 是一款运行在终端中的快速智能代理,能够即时启动并提供多种工具辅助终端操作。为了满足用户对数据隐私的更高要求,团队宣布将 Atuin AI 服务器代码开源,允许用户自托管。该项目基于与生产环境相同的核心库,兼容任何 OpenAI 风格的聊天补全新 API,可接入 Ollama、vLLM、LM Studio 等本地模型,也支持 OpenRouter 等在线服务。用户可通过 Docker 或本地运行快速部署,并配置服务器端工具(如网络搜索和内容抓取)。Atuin AI 继续为所有用户提供免费使用额度,且不存储对话记录。这一举措在保持功能的同时,赋予用户更强的数据控制权。 #AtuinAI #开源 #终端代理 #自托管 #隐私保护 #AI #Ollama #Docker #技术新闻
AI提示词鲁棒性平均仅31分,多数提示词无法应对异常输入
一项针对1018个真实AI提示词的评估显示,提示词的平均得分为54分(满分100),但鲁棒性维度平均仅31分。评估从清晰度、具体性、结构性和鲁棒性四个维度评分,其中鲁棒性在95.7%的提示词中为最弱项。83.6%的提示词鲁棒性低于50分,说明大多数人只针对理想输入编写提示词,而忽略了空消息、垃圾输入、其他语言或恶意破坏等真实场景。研究还发现,仅10.5%的提示词达到75分以上,意味着大多数提示词在重复使用时不可靠。改善鲁棒性的有效方法包括:指定输出格式(如编号列表、JSON)、告诉模型不要做什么、赋予角色视角、以及提供示例(94.8%的提示词缺少示例)。内容创作和教育领域占提示词的58%,且大部分为系统提示词,鲁棒性不足的影响会被放大。 #AI提示词 #鲁棒性 #大模型 #Prompt工程 #评估 #机器学习 #自然语言处理 #研究 #技术 #AI应用
一项针对1018个真实AI提示词的评估显示,提示词的平均得分为54分(满分100),但鲁棒性维度平均仅31分。评估从清晰度、具体性、结构性和鲁棒性四个维度评分,其中鲁棒性在95.7%的提示词中为最弱项。83.6%的提示词鲁棒性低于50分,说明大多数人只针对理想输入编写提示词,而忽略了空消息、垃圾输入、其他语言或恶意破坏等真实场景。研究还发现,仅10.5%的提示词达到75分以上,意味着大多数提示词在重复使用时不可靠。改善鲁棒性的有效方法包括:指定输出格式(如编号列表、JSON)、告诉模型不要做什么、赋予角色视角、以及提供示例(94.8%的提示词缺少示例)。内容创作和教育领域占提示词的58%,且大部分为系统提示词,鲁棒性不足的影响会被放大。 #AI提示词 #鲁棒性 #大模型 #Prompt工程 #评估 #机器学习 #自然语言处理 #研究 #技术 #AI应用
OpenAI 模型证明 50 年未解数学猜想,引发行业危机
OpenAI 近日宣布,其最新模型 GPT-5.6 Sol 独立证明了一个悬而未决超过 50 年的数学难题——Cycle Double Cover 猜想。尽管该证明尚未经过同行评审,但已有专家初步审查未发现明显错误。这一突破距离该团队上一次在著名数学猜想上取得进展不到两个月。数学家们正面临与软件工程、咨询、金融等领域同行相似的生存危机:是否会被 AI 取代。文章认为,自动化数学研究将极大加速科技与工程进步,但人类数学家直觉与自由探索的“自由创意”依然不可或缺。该事件再次引发关于 AI 能否替代整个学科而非单一职业的深层讨论。 #AI #数学 #OpenAI #GPT5 #数学猜想 #科技新闻 #自动化 #学术突破
OpenAI 近日宣布,其最新模型 GPT-5.6 Sol 独立证明了一个悬而未决超过 50 年的数学难题——Cycle Double Cover 猜想。尽管该证明尚未经过同行评审,但已有专家初步审查未发现明显错误。这一突破距离该团队上一次在著名数学猜想上取得进展不到两个月。数学家们正面临与软件工程、咨询、金融等领域同行相似的生存危机:是否会被 AI 取代。文章认为,自动化数学研究将极大加速科技与工程进步,但人类数学家直觉与自由探索的“自由创意”依然不可或缺。该事件再次引发关于 AI 能否替代整个学科而非单一职业的深层讨论。 #AI #数学 #OpenAI #GPT5 #数学猜想 #科技新闻 #自动化 #学术突破
Bonsai 27B 发布:首个可在手机上运行的 27B 参数大模型
今日,Bonsai 团队宣布推出 Bonsai 27B,这是基于 Qwen3.6 27B 的多模态旗舰模型,也是首个能在手机上运行的 27B 量级大模型。该模型采用低比特量化技术,提供两种变体:三元版(1.71 有效位/权重,5.9GB)和 1 位版(1.125 有效位/权重,3.9GB),后者可装入 iPhone 17 Pro 内存。模型在语言网络全流程(嵌入、注意力、MLP、LM head)中均使用低比特表示,无精度逃逸,并支持全 262K 上下文和推测解码加速。在 15 项基准测试(涵盖知识、推理、数学、代码、工具调用、视觉等)中,三元版保留全精度基线 95% 的性能,1 位版保留 90%,其中数学和代码能力几乎无损,工具调用仅略降数个百分点。相比之下,传统低比特方案需占用 2.5 倍内存且得分更低。Bonsai 27B 已完全开源,采用 Apache 2.0 许可,标志着大模型向终端设备迈出关键一步。 #Bonsai #27B #1bit #大模型 #手机 #AI #开源 #多模态 #低比特 #代理
今日,Bonsai 团队宣布推出 Bonsai 27B,这是基于 Qwen3.6 27B 的多模态旗舰模型,也是首个能在手机上运行的 27B 量级大模型。该模型采用低比特量化技术,提供两种变体:三元版(1.71 有效位/权重,5.9GB)和 1 位版(1.125 有效位/权重,3.9GB),后者可装入 iPhone 17 Pro 内存。模型在语言网络全流程(嵌入、注意力、MLP、LM head)中均使用低比特表示,无精度逃逸,并支持全 262K 上下文和推测解码加速。在 15 项基准测试(涵盖知识、推理、数学、代码、工具调用、视觉等)中,三元版保留全精度基线 95% 的性能,1 位版保留 90%,其中数学和代码能力几乎无损,工具调用仅略降数个百分点。相比之下,传统低比特方案需占用 2.5 倍内存且得分更低。Bonsai 27B 已完全开源,采用 Apache 2.0 许可,标志着大模型向终端设备迈出关键一步。 #Bonsai #27B #1bit #大模型 #手机 #AI #开源 #多模态 #低比特 #代理
Anthropic 秘密启动“巴拿马计划”
据《华盛顿邮报》2026年1月调查,AI公司Anthropic(Claude聊天机器人开发商)自2024年初启动代号“巴拿马计划”的秘密行动:大量购买纸质图书,机械切除书脊后高速扫描,随后将纸张送入回收,不留实体存档。该计划因作者提起的集体版权诉讼而曝光,法庭文件显示扫描文本被用于训练Claude背后的大语言模型。2025年6月,美国联邦法官裁定购买并破坏性扫描纸质书用于训练属于“合理使用”,但问题在于该公司同时从LibGen等盗版图书馆下载了数百万册图书。2025年9月,Anthropic为此支付15亿美元和解金,成为美国版权法史上最大公开赔偿。这一事件表明,AI行业对高质量文本的渴求已从数字世界蔓延至实体图书,巨头不惜先行支付版权风险,以获取稀缺训练数据。欧洲也出现类似批量购书现象,推测与德语文学训练需求有关。 #Anthropic #巴拿马计划 #AI训练 #版权诉讼 #合理使用 #图书扫描 #数据饥渴 #赔偿协议
据《华盛顿邮报》2026年1月调查,AI公司Anthropic(Claude聊天机器人开发商)自2024年初启动代号“巴拿马计划”的秘密行动:大量购买纸质图书,机械切除书脊后高速扫描,随后将纸张送入回收,不留实体存档。该计划因作者提起的集体版权诉讼而曝光,法庭文件显示扫描文本被用于训练Claude背后的大语言模型。2025年6月,美国联邦法官裁定购买并破坏性扫描纸质书用于训练属于“合理使用”,但问题在于该公司同时从LibGen等盗版图书馆下载了数百万册图书。2025年9月,Anthropic为此支付15亿美元和解金,成为美国版权法史上最大公开赔偿。这一事件表明,AI行业对高质量文本的渴求已从数字世界蔓延至实体图书,巨头不惜先行支付版权风险,以获取稀缺训练数据。欧洲也出现类似批量购书现象,推测与德语文学训练需求有关。 #Anthropic #巴拿马计划 #AI训练 #版权诉讼 #合理使用 #图书扫描 #数据饥渴 #赔偿协议
AI 让游戏创意克隆变得轻而易举
独立游戏开发者 Freya Holmér 在社交媒体上发布了一段旋转版俄罗斯方块的创意原型视频,不到几天内便出现了至少四款由 AI 工具“vibe coding”生成的克隆版本。克隆者无需编程或设计经验,只需通过对话式输入指令,AI 即可生成代码和界面。尽管克隆版本缺乏原版的精细动画和设计意图,但克隆者声称其行为不存在道德问题。Holmér 表示,AI 大幅降低了抄袭门槛,令她不敢再分享创意,担心被他人迅速完成并商业化。《Papers, Please》开发者 Lucas Pope 也表达了类似担忧,认为 AI 正在导致技能和知识的贬值。 #AI #游戏开发 #抄袭 #创意保护 #VibeCoding #俄罗斯方块 #科技伦理 #独立游戏
独立游戏开发者 Freya Holmér 在社交媒体上发布了一段旋转版俄罗斯方块的创意原型视频,不到几天内便出现了至少四款由 AI 工具“vibe coding”生成的克隆版本。克隆者无需编程或设计经验,只需通过对话式输入指令,AI 即可生成代码和界面。尽管克隆版本缺乏原版的精细动画和设计意图,但克隆者声称其行为不存在道德问题。Holmér 表示,AI 大幅降低了抄袭门槛,令她不敢再分享创意,担心被他人迅速完成并商业化。《Papers, Please》开发者 Lucas Pope 也表达了类似担忧,认为 AI 正在导致技能和知识的贬值。 #AI #游戏开发 #抄袭 #创意保护 #VibeCoding #俄罗斯方块 #科技伦理 #独立游戏