谷歌为美国用户免费开放Gemini个性化AI图像功能
谷歌宣布扩大其Gemini应用中的个性化AI图像功能覆盖范围。自周一起,符合条件的美国用户可免费使用名为Nano Banana的AI图像生成工具。该功能允许用户通过自然语言描述,由AI生成定制化的图像内容,进一步丰富了Gemini的创意应用场景。此举旨在提升用户体验,并推动AI技术在图像生成领域的普及。 #谷歌 #Gemini #AI图像 #NanoBanana #科技新闻
谷歌宣布扩大其Gemini应用中的个性化AI图像功能覆盖范围。自周一起,符合条件的美国用户可免费使用名为Nano Banana的AI图像生成工具。该功能允许用户通过自然语言描述,由AI生成定制化的图像内容,进一步丰富了Gemini的创意应用场景。此举旨在提升用户体验,并推动AI技术在图像生成领域的普及。 #谷歌 #Gemini #AI图像 #NanoBanana #科技新闻
Codex exec命令
Codex exec是一个可被其他编码代理调用的子命令,用于执行特定任务并返回最终结果。与直接启动Codex不同,该命令会创建一个全新的、无前序上下文的子代理,非常适合代码审查场景。作者通常让Claude Code驱动代码实现,同时使用Codex exec进行审查,认为前者无法与后者的审查能力相比。通过简单的命令如 `codex exec "审查PR内容,按严重级别分类bug,并判断是否完成原始任务"`,即可获得一个强大的审查代理。这一用法能显著提升代码质量、减少bug,建议在合并代码前反复修复并重新请求审查直至通过。 #AI编程 #代码审查 #Codex #ClaudeCode #开发工具 #效率提升 #子代理 #编程最佳实践
Codex exec是一个可被其他编码代理调用的子命令,用于执行特定任务并返回最终结果。与直接启动Codex不同,该命令会创建一个全新的、无前序上下文的子代理,非常适合代码审查场景。作者通常让Claude Code驱动代码实现,同时使用Codex exec进行审查,认为前者无法与后者的审查能力相比。通过简单的命令如 `codex exec "审查PR内容,按严重级别分类bug,并判断是否完成原始任务"`,即可获得一个强大的审查代理。这一用法能显著提升代码质量、减少bug,建议在合并代码前反复修复并重新请求审查直至通过。 #AI编程 #代码审查 #Codex #ClaudeCode #开发工具 #效率提升 #子代理 #编程最佳实践
TraceAIO 开源发布
TraceAIO 是一款开源工具,旨在帮助企业监控其品牌在 ChatGPT、Perplexity、Google Gemini 等主流大语言模型中的提及情况。它通过真实浏览器会话模拟用户查询,获取模型实际输出,而非简化版的 API 近似结果。该工具支持浏览器端(如 ChatGPT、Perplexity)和 API 端(如 OpenAI、Anthropic)两种数据获取方式,并自动分析品牌提及、竞争对手出现频次及引用的来源网站。用户可创建和复用品牌中立的行业相关问题,定期运行分析,追踪可见性变化。此外,TraceAIO 提供实时演示、Webhook 集成及 MCP 服务,方便用户将数据接入现有工作流。该项目在 GitHub 上开源,旨在填补企业在大模型时代品牌监测的空白。 #开源 #LLM #品牌监测 #AI搜索 #TraceAIO #GPT #ChatGPT #Perplexity #Gemini #开发者工具
TraceAIO 是一款开源工具,旨在帮助企业监控其品牌在 ChatGPT、Perplexity、Google Gemini 等主流大语言模型中的提及情况。它通过真实浏览器会话模拟用户查询,获取模型实际输出,而非简化版的 API 近似结果。该工具支持浏览器端(如 ChatGPT、Perplexity)和 API 端(如 OpenAI、Anthropic)两种数据获取方式,并自动分析品牌提及、竞争对手出现频次及引用的来源网站。用户可创建和复用品牌中立的行业相关问题,定期运行分析,追踪可见性变化。此外,TraceAIO 提供实时演示、Webhook 集成及 MCP 服务,方便用户将数据接入现有工作流。该项目在 GitHub 上开源,旨在填补企业在大模型时代品牌监测的空白。 #开源 #LLM #品牌监测 #AI搜索 #TraceAIO #GPT #ChatGPT #Perplexity #Gemini #开发者工具
AI与人类
长期以来,关于AI与人类对比的讨论总是陷入误区。人们习惯于拿人类的智慧、创造力、同理心等特质与AI的能力进行比较,但这种比较本身就存在根本问题。这种思维框架默认将人性缩减为一系列可量化的能力清单,仿佛每一次AI获得新能力,人类就失去一分优势。任何试图将人类体验纳入二元对立框架的做法,都在测量开始之前就已扭曲了被测量对象的本质。 人类意识、认知和学习仍是科学与哲学中最深奥的未解之谜,而AI同样充满未知。我们比较的是两个尚未完全理解的未知领域,却自信地宣布赢家。历史反复证明,每一次重大技术革新都伴随着"人类将被削弱"的恐惧,但最终新技术只是成为人类表达的新媒介,而非替代品。 #AI #人工智能 #人类与技术 #技术哲学 #数字时代
长期以来,关于AI与人类对比的讨论总是陷入误区。人们习惯于拿人类的智慧、创造力、同理心等特质与AI的能力进行比较,但这种比较本身就存在根本问题。这种思维框架默认将人性缩减为一系列可量化的能力清单,仿佛每一次AI获得新能力,人类就失去一分优势。任何试图将人类体验纳入二元对立框架的做法,都在测量开始之前就已扭曲了被测量对象的本质。 人类意识、认知和学习仍是科学与哲学中最深奥的未解之谜,而AI同样充满未知。我们比较的是两个尚未完全理解的未知领域,却自信地宣布赢家。历史反复证明,每一次重大技术革新都伴随着"人类将被削弱"的恐惧,但最终新技术只是成为人类表达的新媒介,而非替代品。 #AI #人工智能 #人类与技术 #技术哲学 #数字时代
Show HN 发布 CiteReady 工具,检测网站是否被 AI 搜索引擎引用
一款名为 CiteReady 的新工具正式上线,旨在帮助网站管理员检查其网站是否能被 ChatGPT、Perplexity 等 AI 搜索引擎有效抓取和引用。随着 AI 助手直接回答用户问题,未被AI抓取的网站将损失流量。该工具通过分析 AI 爬虫访问权限、结构化数据、内容可引用性和技术基础四项指标,为网站提供优化建议。用户每天可进行 3 次免费审计,无需注册,约 10 秒内出结果。Pro 版月费 2.99 欧元,支持每周自动重新审计、最多 5 个网站的得分历史和全 API 套餐。这一工具的出现反映了生成式引擎优化(GEO)的新趋势,即优化内容使其易于被 AI 系统理解和引用。 #AI #搜索引擎 #网站优化 #GEO #科技工具 #网页爬虫 #结构化数据
一款名为 CiteReady 的新工具正式上线,旨在帮助网站管理员检查其网站是否能被 ChatGPT、Perplexity 等 AI 搜索引擎有效抓取和引用。随着 AI 助手直接回答用户问题,未被AI抓取的网站将损失流量。该工具通过分析 AI 爬虫访问权限、结构化数据、内容可引用性和技术基础四项指标,为网站提供优化建议。用户每天可进行 3 次免费审计,无需注册,约 10 秒内出结果。Pro 版月费 2.99 欧元,支持每周自动重新审计、最多 5 个网站的得分历史和全 API 套餐。这一工具的出现反映了生成式引擎优化(GEO)的新趋势,即优化内容使其易于被 AI 系统理解和引用。 #AI #搜索引擎 #网站优化 #GEO #科技工具 #网页爬虫 #结构化数据
EDDI:开源主权AI编排平台,荣获OpenSSF最高安全认证并成为联合国合作伙伴
开源生产级AI平台EDDI现已迭代至v6.1.2版本,专为企业级多智能体系统的受控部署而设计。该平台采用配置驱动、自主托管模式,内置可视化管理界面、65个MCP工具及企业级安全机制,旨在解决企业AI编排中的碎片化难题。团队无需再经历从可视化原型到生产系统的重复开发,或被迫将非确定性AI代理强行植入BPMN工作流。EDDI通过JSON配置实现代理逻辑、流水线和工具定义,支持即时迭代而无需重新部署。平台已获得联合国工业发展组织(UNIDO)的"全球南方工业AI可信伙伴"认证,同时通过Linux基金会OpenSSF最高安全等级Gold认证、IBM红帽容器认证,并拥有9600+测试用例与零失败的CI/CD体系。其核心技术基于Quarkus云原生框架、LangChain4j多供应商LLM支持及CQRS遥测账本,确保每个管道步骤具备不可变审计痕迹。 #EDDI #AI编排 #开源企业平台 #OpenSSF #UNIDO #主权AI #多智能体系统 #配置驱动
开源生产级AI平台EDDI现已迭代至v6.1.2版本,专为企业级多智能体系统的受控部署而设计。该平台采用配置驱动、自主托管模式,内置可视化管理界面、65个MCP工具及企业级安全机制,旨在解决企业AI编排中的碎片化难题。团队无需再经历从可视化原型到生产系统的重复开发,或被迫将非确定性AI代理强行植入BPMN工作流。EDDI通过JSON配置实现代理逻辑、流水线和工具定义,支持即时迭代而无需重新部署。平台已获得联合国工业发展组织(UNIDO)的"全球南方工业AI可信伙伴"认证,同时通过Linux基金会OpenSSF最高安全等级Gold认证、IBM红帽容器认证,并拥有9600+测试用例与零失败的CI/CD体系。其核心技术基于Quarkus云原生框架、LangChain4j多供应商LLM支持及CQRS遥测账本,确保每个管道步骤具备不可变审计痕迹。 #EDDI #AI编排 #开源企业平台 #OpenSSF #UNIDO #主权AI #多智能体系统 #配置驱动
AI Agent 真实任务完成率仅三成,可靠性复合衰减成瓶颈
最新基准测试显示,当前最强 AI Agent 在真实多步骤办公任务中完全自主完成率仅约30%。谷歌 Gemini 2.5 Pro 在卡内基梅隆大学 TheAgentCompany 测试中得分为30.3%,即使放宽部分完成标准也仅升至39%。Salesforce 自建基准 CRMArena-Pro 同样揭示:单步任务成功率58%,但一旦涉及多轮对话交互,成功率骤降至35%。更严峻的是,Sierra 的 tau-bench 测试表明,虽然 Agent 平均单次任务正确率达61%,但连续8次正确率跌至25%以下。根本原因在于可靠性随步骤数指数衰减——即便每步95%可靠,20步任务整体成功率仅约36%。当前 Agent 仅在狭窄、短时、受监督的任务中真正可用,开放式的多步骤自动化仍不可靠。 #AI #Agent #人工智能 #可靠性 #基准测试 #自动化 #科技
最新基准测试显示,当前最强 AI Agent 在真实多步骤办公任务中完全自主完成率仅约30%。谷歌 Gemini 2.5 Pro 在卡内基梅隆大学 TheAgentCompany 测试中得分为30.3%,即使放宽部分完成标准也仅升至39%。Salesforce 自建基准 CRMArena-Pro 同样揭示:单步任务成功率58%,但一旦涉及多轮对话交互,成功率骤降至35%。更严峻的是,Sierra 的 tau-bench 测试表明,虽然 Agent 平均单次任务正确率达61%,但连续8次正确率跌至25%以下。根本原因在于可靠性随步骤数指数衰减——即便每步95%可靠,20步任务整体成功率仅约36%。当前 Agent 仅在狭窄、短时、受监督的任务中真正可用,开放式的多步骤自动化仍不可靠。 #AI #Agent #人工智能 #可靠性 #基准测试 #自动化 #科技
AI驱动新游戏数量激增,但大型开发商仍占据主导
英国《金融时报》报道,尽管人工智能(AI)大幅提升了游戏开发效率,但行业数据显示,大型游戏开发商仍在市场中占据主导地位。前法国移动游戏独角兽Voodoo高管斯坦尼斯拉斯·马尔尚指出,AI将一款手机游戏从设计到上市的时间从14天缩短至10天,但AI仍无法复制关键的“游戏感觉”。与此同时,AI——尤其是“氛围编码”的兴起——导致新游戏数量井喷:研究公司ATTN Economy数据显示,截至今年5月的六个月内,全球共发布18.1万款游戏,iOS和Android平台分别同比增长118%和73%。然而,行业裁员也在加剧,微软Xbox及旗下King部门近期均有裁员。游戏开发者大会(GDC)报告显示,52%的游戏专业人士认为生成式AI对行业不利,这一比例较2025年的30%大幅上升,其中视觉艺术和技术美术岗位的反对情绪最为强烈。尽管AI在非玩家角色(NPC)对话等场景中展现出潜力,但“游戏感觉”的缺失和成本压力使得大型开发商更易利用AI的优势,而独立开发者面临更严峻的生存挑战。 #AI #游戏产业 #大型开发商 #行业裁员 #游戏感觉 #生成式AI #科技新闻
英国《金融时报》报道,尽管人工智能(AI)大幅提升了游戏开发效率,但行业数据显示,大型游戏开发商仍在市场中占据主导地位。前法国移动游戏独角兽Voodoo高管斯坦尼斯拉斯·马尔尚指出,AI将一款手机游戏从设计到上市的时间从14天缩短至10天,但AI仍无法复制关键的“游戏感觉”。与此同时,AI——尤其是“氛围编码”的兴起——导致新游戏数量井喷:研究公司ATTN Economy数据显示,截至今年5月的六个月内,全球共发布18.1万款游戏,iOS和Android平台分别同比增长118%和73%。然而,行业裁员也在加剧,微软Xbox及旗下King部门近期均有裁员。游戏开发者大会(GDC)报告显示,52%的游戏专业人士认为生成式AI对行业不利,这一比例较2025年的30%大幅上升,其中视觉艺术和技术美术岗位的反对情绪最为强烈。尽管AI在非玩家角色(NPC)对话等场景中展现出潜力,但“游戏感觉”的缺失和成本压力使得大型开发商更易利用AI的优势,而独立开发者面临更严峻的生存挑战。 #AI #游戏产业 #大型开发商 #行业裁员 #游戏感觉 #生成式AI #科技新闻
数据科学行为面试
许多数据科学家误以为行为面试只是走形式,技术过硬就能胜出。但现实是,一位技术精湛的候选人曾因无法清晰阐述工作价值而输给沟通能力更强的对手。数据科学行为面试与其他领域不同:公司不仅考察你的专业能力,更看重你是否能将技术工作转化为商业价值、能否与非技术利益相关者协作、以及在数据不完美时做出决策。常见错误是面试者大谈交叉验证、超参数调优等细节,而面试官只想听业务故事。正确做法是用简洁语言描述项目背景、你解决的问题及量化业务影响,例如“我构建的预测模型将超支成本降低了X%”。提前搜索目标公司的面试题(如Glassdoor、Reddit),针对岗位类型(数据科学家、工程师、分析师)练习讲故事。 #数据科学 #行为面试 #求职技巧 #沟通能力 #技术转商业 #面试准备 #数据分析 #职场攻略
许多数据科学家误以为行为面试只是走形式,技术过硬就能胜出。但现实是,一位技术精湛的候选人曾因无法清晰阐述工作价值而输给沟通能力更强的对手。数据科学行为面试与其他领域不同:公司不仅考察你的专业能力,更看重你是否能将技术工作转化为商业价值、能否与非技术利益相关者协作、以及在数据不完美时做出决策。常见错误是面试者大谈交叉验证、超参数调优等细节,而面试官只想听业务故事。正确做法是用简洁语言描述项目背景、你解决的问题及量化业务影响,例如“我构建的预测模型将超支成本降低了X%”。提前搜索目标公司的面试题(如Glassdoor、Reddit),针对岗位类型(数据科学家、工程师、分析师)练习讲故事。 #数据科学 #行为面试 #求职技巧 #沟通能力 #技术转商业 #面试准备 #数据分析 #职场攻略