AI知识库 @ai521
367 subscribers
24.3K photos
45 videos
20 files
927 links
@ai521 专注分享最实用的AI内容

🤖 AI教程(新手到进阶)
🧠 AI知识科普(大模型 / 提示词 / 自动化)
📰 AI资讯更新(每日最新AI动态)
📚 AI实战技巧(写作 / 绘画 / 编程 / 赚钱)
🔧 最新AI工具推荐

每天更新AI干货
长期做一个真正有价值的AI频道
Download Telegram
apers Toggle Connected Papers ( What is Connected Papers? ) Litmaps Toggle Litmaps ( What is Litmaps? ) Toggle scite Smart Citations ( What are Smart Citations? ) Code, Data, Media Code, Data and Media Associated with this Article alphaXiv Toggle alphaXiv ( What is alphaXiv? ) Links to Code Toggle CatalyzeX Code Finder for Papers ( What is CatalyzeX? ) DagsHub Toggle DagsHub ( What is DagsHub? ) GotitPub Toggle ( What is GotitPub? ) Huggingface Toggle Hugging Face ( What is Huggingface? ) ScienceCast Toggle ScienceCast ( What is ScienceCast? ) Demos Demos Replicate Toggle Replicate ( What is Replicate? ) Spaces Toggle Hugging Face Spaces ( What is Spaces? ) Spaces Toggle ( What is ? ) Related Papers Recommenders and Search Tools Link to Influence Flower Influence Flower ( What are Influence Flowers? ) Core recommender toggle CORE Recommender ( What is CORE? ) Author Venue Institution Topic About arXivLabs arXivLabs: experimental projects with community collaborators arXivLabs is a framework that allows collaborators to develop and share new arXiv features directly on our website. Both individuals and organizations that work with arXivLabs have embraced and accepted our values of openness, community, excellence, and user data privacy. arXiv is committed to these values and only works with partners that adhere to them. Have an idea for a project that will add value for arXiv's community? Learn more about arXivLabs .
AgentLens:基于生产评估的编码智能体轨迹审查方法被提出

近日,一篇题为《AgentLens: Production-Assessed Trajectory Reviews for Coding Agent Evaluation》的论文在arXiv预印本平台发布。该论文由Andrey Podivilov等七位作者共同完成,提出了一种名为AgentLens的编码智能体评估新方法。与传统基准测试不同,AgentLens利用智能体在真实生产环境中的任务执行轨迹进行审查与评估,旨在更客观、准确地衡量编码智能体的实际能力。该方法有望为智能体的研发与部署提供更有效的反馈,推动编码智能体评估的标准化。目前论文已开放PDF全文下载。 #AgentLens #编码智能体 #评估方法 #生产评估 #轨迹审查 #arXiv #AI #大模型
学术“人性化”工具消除AI写作痕迹引担忧

一款名为Humanizer的学术工具于6月20日发布,旨在个性化修改由AI生成的研究论文语气,抹去明显的机器写作痕迹。该工具由明尼苏达大学研究员Jie Ding开发,专为论文和基金申请书设计,核心原则是“在不随意化文风的前提下消除AI特有印记”。支持者认为它能帮助非母语学者提高写作效率,但批评者担忧这会诱使更多研究者违规使用AI且不披露,损害学术诚信。AI检测平台Pangram的CEO表示该工具并不高级,大部分处理过的文本仍能被其平台捕获,并表示正开发专门针对性的升级版本。开发者Ding强调工具仅是编辑辅助,不解除使用者披露AI协助的义务,并已修改说明以避免误导。这一争议凸显出AI辅助学术写作与规范之间的紧张关系。 #AI #学术写作 #人性化工具 #人工智能 #学术诚信 #科技争议 #大模型
世界杯AI预测对决

由联想与中国移动咪咕联合发起的“世界杯人机预测对决”项目,对12款国产大模型进行了评测。在全部92场比赛中,机器整体预测准确率达64%,高于人类的53.8%。中国移动“九天”框架以64次预测正确居首,联想“天禧AI”和阿里“通义千问”并列第二。然而,当比赛爆出冷门时,算法便暴露了局限:西班牙对阵佛得角的比赛,多数模型预测西班牙胜,结果却是0-0闷平;佛得角随后逼平乌拉圭和沙特,以不败战绩出线,四款模型未能预见这一“童话”。DeepSeek、Kimi等也曾错误预测荷兰、德国晋级,而两队均在32强出局。专家指出,高准确率不代表机器真正理解足球,这一测试更像一场公开的算法压力考试。 #AI #世界杯 #大模型 #预测 #人工智能 #足球 #联想 #中国移动 #机器学习 #比赛分析
Grok 4.5 低价代理式AI来袭,挑战OpenAI与Anthropic

xAI(SpaceXAI)于7月9日发布Grok 4.5,定位为低成本、面向编码和代理式工作负载的AI模型。该模型定价每百万输入Token 2美元、输出Token 6美元,显著低于Anthropic和OpenAI的高端产品。此前xAI以600亿美元收购AI编码工具Cursor,获取了大量开发者工作流数据与分发渠道。据xAI称,Grok 4.5性能大致与Claude Opus 4.7相当,响应速度更快;Artificial Analysis的代理式知识工作指数将其排在第四位,且每任务成本比前三名低近90%。该模型瞄准在工程团队中大规模运行AI代理的企业,尤其在多仓库代码分析和调试场景下,低成本优势可能弥补轻微的性能差距。来自Tesla和SpaceX工程师的早期反馈显示,Grok 4.5在处理大型代码库时具有实用价值。尽管早期Grok模型曾因反犹输出和安全问题引发争议,且多位联合创始人离职,xAI仍押注成本与速度将成为企业级编码代理的关键决胜点,其闭环生态(算力、数据、内部需求)构成独特优势。 #Grok4.5 #xAI #代理式AI #编码AI #低成本AI #AI模型 #科技新闻
Facebook 对 AI 极右翼影响活动坐视不理,问题曝光已一月未作处理

一项调查发现,Facebook 上存在大量由人工智能生成的极右翼政治视频,内容涉及英国移民、农业等敏感议题,累计观看量达数百万。经专业机构鉴定,这些视频有97%的几率系 AI 生成,其制作方远在5000英里之外。专家指出,这很可能是一场利用 AI 操纵英国舆论的外国影响力行动。尽管一个月前相关证据已被提交,Facebook 至今未对账号采取任何措施,也未标注视频为虚假内容。研究人员警告,此类 AI 生成内容极易传播且难以即时辨别,反复暴露可能削弱公众对机构、媒体和选举的信任,为外部势力介入内政提供可乘之机。 #Facebook #AI #虚假信息 #极右翼 #影响活动 #英国 #合成媒体 #社交媒体 #技术监管
OtterSec设立10万美元基金应对AI对CTF竞赛的冲击

网络安全公司OtterSec宣布投入10万美元成立“Save CTFs Fund”,旨在应对人工智能对CTF(夺旗赛)竞赛的冲击。随着AI模型快速发展,传统Jeopardy计分模式逐渐失效,许多精心设计的挑战被AI在短时间内破解,导致竞赛变成“付费赢”的局面。OtterSec认为这一困境可解,将更谨慎地赞助传统CTF,转而支持新的竞赛格式,确保排行榜仍具意义。基金将鼓励创新,保持CTF的教育价值与竞争性,帮助新玩家成长,避免被AI完全主导。 #CTF #AI #OtterSec #网络安全 #竞赛 #基金 #Jeopardy #新技术
Databricks 2026数据与AI峰会开幕,全球逾3万人齐聚旧金山

Databricks于近日在旧金山举办其年度Data + AI Summit,这是该司迄今最大规模的数据与人工智能盛会,吸引来自160多个国家的超过3万名参与者。峰会首日主题演讲公布了多项新产品与功能,旨在简化数据处理并加速AI应用落地。作为Databricks MVP,作者提前一周知悉新特性并签署保密协议,在峰会当天与官方同步发布。现场组织专业、氛围热烈,展示了数据工程与AI领域的最新趋势。此次峰会进一步巩固了Databricks在数据与AI平台领域的领导地位,也为全球从业者提供了重要的交流与学习机会。 #Databricks #DataAISummit #AI #大数据 #数据工程 #旧金山 #MVP #科技峰会 #人工智能