Forwarded from AI 托我给您带个话
新的代码语言模型 phi-1 的作者表示,只需要教科书就足以训练代码语言模型。
该模型有 13 亿个参数,使用了从网上和人工合成的「教科书质量」数据进行训练。
尽管规模较小,phi-1 在 HumanEval 和 MBPP 上的准确率很高,并展现出惊人的新特性。
评论中讨论了数据质量的重要性、使用合成数据的优势以及模型性能的局限性。
一些评论者还讨论了 AI 领域中模因和简化要求的普遍存在。
🔗 https://arxiv.org/abs/2306.11644
💬 https://news.ycombinator.com/item?id=36413768
该模型有 13 亿个参数,使用了从网上和人工合成的「教科书质量」数据进行训练。
尽管规模较小,phi-1 在 HumanEval 和 MBPP 上的准确率很高,并展现出惊人的新特性。
评论中讨论了数据质量的重要性、使用合成数据的优势以及模型性能的局限性。
一些评论者还讨论了 AI 领域中模因和简化要求的普遍存在。
🔗 https://arxiv.org/abs/2306.11644
💬 https://news.ycombinator.com/item?id=36413768
Forwarded from AI 托我给您带个话
这篇文章讨论了一个名为 ChatGPT 的自然语言处理工具,它可以根据提供的文本进行摘要。
有人认为它可以用于写自助书籍,但也有人认为它可能会出现错误。
一些评论者提出了一些解决方案,例如将书籍转换为嵌入式向量并存储在数据库中,以便 ChatGPT 可以从中生成文本。
但也有人认为这种方法可能会导致信息失真,因为 ChatGPT 只是一种语言模型,而不是真正的阅读器。
一些评论者认为这种方法不是真正的阅读,而是记忆工具。
#ai #languagemodel
🔗 https://redd.it/14elgw9
有人认为它可以用于写自助书籍,但也有人认为它可能会出现错误。
一些评论者提出了一些解决方案,例如将书籍转换为嵌入式向量并存储在数据库中,以便 ChatGPT 可以从中生成文本。
但也有人认为这种方法可能会导致信息失真,因为 ChatGPT 只是一种语言模型,而不是真正的阅读器。
一些评论者认为这种方法不是真正的阅读,而是记忆工具。
#ai #languagemodel
🔗 https://redd.it/14elgw9
Reddit
[deleted by user] : r/ChatGPT
3.6K votes, 660 comments. 8.4M subscribers in the ChatGPT community. Subreddit to discuss ChatGPT and AI. Not affiliated with OpenAI. Thanks, Nat!
产生影响力有很多方式。比如,
• 施展社交能力,混人际关系;
• 组织会议,拉团队或个人讨论;
• 展现技术实力,请别人 code review;
• Slack 中就某些问题公开发表自己的想法。
只要场合适当,这些方式都是有价值的,但我最常用的方式是另一种:写长文(long-form writing)。
https://arthurchiao.github.io/blog/writing-is-magic-zh/
• 施展社交能力,混人际关系;
• 组织会议,拉团队或个人讨论;
• 展现技术实力,请别人 code review;
• Slack 中就某些问题公开发表自己的想法。
只要场合适当,这些方式都是有价值的,但我最常用的方式是另一种:写长文(long-form writing)。
https://arthurchiao.github.io/blog/writing-is-magic-zh/