支持中文,性能超GPT-4!笑脸排名第一的纯代码模型
生成式AI代码开发平台Phind在官网发布了最新V7版本,性能方面超越GPT-4,运行效率提升了5倍,并且支持中文和16K超长上下文。
据悉,Phind V7是基于Phind的开源代码模型CodeLlama-34B V2,以及700亿个高质量代码和推理问题进行了额外精调。
CodeLlama-34B V2在huggingface(笑脸)的代码大模型排行榜中位居第一名,这也是首个击败GPT-4的开源代码项目。
无需注册,免费在线测试地址:https://www.phind.com/
开源地址:https://huggingface.co/Phind/Phind-CodeLlama-34B-v2
Phind V7专业代码开发平台
Phind V7在HumanEval上的测试分数达到74.7%,成功超越了GPT-4在今年3月份的官方技术报告中公布的67%的成绩。
但Phind发现,HumanEval的评分并不能准确地反映出大模型的实用性。
Phind将多个版本部署到自家服务平台后,收集到了大量反馈信息,发现其模型在大多数真实问题上的表现与GPT-4相当甚至更好。
许多在其Discord社区的用户已经开始只使用Phind的产品,尽管他们也订阅了GPT-4。
除了性能超强之外,运行速度是Phind V7的一大技术亮点,通过在NVIDIA的新型TensorRT-LLM库上运行模型,Phind成功实现了比GPT-4快5倍的运行速度,达到每秒处理100tokens。
另一个优点是Phind支持多达16k tokens的上下文。目前,Phind允许用户输入最多12k tokens,剩余的4k tokens用于网络结果。
Phind V7精通Python、C/C 、TypeScript、Java等主流编程语言,使用界面也简单直观,直接输入你的编程问题就能返回代码。
例如,我们直接输入中文提示:用python写一个吃豆游戏的代码。
Phind返回的注释也都是中文,如果点击三角按钮可以直接在replit中运行非常方便。
支持多轮深度对话,继续发问,游戏中的吃豆人和豆子是如何运动的?
Phind在对文本回答时,会标注引用的原出处,用户点击网站可以直接跳转。
CodeLlama-34B V2
CodeLlama-34B V2代码模型使用了80,000个高质量编程问题和解决方案的专有数据集进行微调。这个数据集的技术特点在于,采用的是指令-答案对的格式,而非常见的代码补全示例,使得在结构上与HumanEval有明显的区别。
此外,Phind还将 OpenAI 的去污方法应用在数据集中,以确保结果准确有效并且没有发现受污染的示例。
方法是:1)对于每个评估示例,随机抽取了三个50个字符的子字符串,如果少于50个字符,则使用整个示例。
2)如果任何采样的子字符串是已处理的训练示例的子字符串,则识别为匹配。
在训练过程中,Phind使用了DeepSpeed ZeRO3和Flash Attention2技术,并使用了32个A100-80GB的GPU,仅在三小时内就完成了序列长度为4096的模型训练。
经常编程的小伙伴们可以试试该模型,生成、审核、注释、改错样样精通,是降本增效的利器。
发布几小时,微软秒删媲美GPT-4开源大模型!竟因忘记投毒测试
【新智元导读】前段时间,微软公布并开源了最新一代大模型WizardLM-2,号称性能堪比GPT-4。不过,还未上线一天,模型权重和公告全被删除了,原因竟是......上周,微软空降了一个堪称GPT-4级别的开源模型WizardLM-2。却没想到发布几小时之后,立马被删除了。站长网2024-04-24 18:10:020001Waymo推出多智能体运动预测方法MotionLM
研究人员推出了一种名为MotionLM的新方法,用于预测道路上各种交通参与者的未来行为,这对于自动驾驶车辆的安全规划至关重要。MotionLM的主要思想是将多个道路参与者的行动预测任务视为一项语言建模工作,将预测任务视为创建语言短语的过程,其中语言是道路参与者的行动。站长网2023-10-10 17:20:070000突发!谷歌 Python 团队全体被裁,Flutter 团队也“在劫难逃”
谷歌的好消息和坏消息,来得都很突然。本周五,谷歌母公司Alphabet公布了第1季度财报:营收为805.39亿美元,较上年同期的697.87亿美元增长15%,创2022年初以来最快增速——同样是发布财报,Meta股价暴跌15%,谷歌却由此正式跻身进入“2万亿俱乐部”!站长网2024-04-28 22:18:290000到2030年的5个人工智能发展的相关预测
划重点:🔮Nvidia市值将明显下降,Intel将明显上升。🔮到2030年,我们将与多种人工智能进行日常互动,如同今天与他人自然互动一样。🔮到2030年,将有超过十万个类人机器人在现实世界中部署。2030年,人工智能领域将会有怎样的变化?RadicalVentures的风险投资家RobToews。发布了关于2030年的5个人工智能预测。站长网2024-03-11 15:47:120000Meta新大语言模型LLama 3将在英特尔和高通硬件上运行
划重点:⭐Meta发布了最新的大型语言模型LLama3,以实现更安全、更准确的生成式人工智能体验。⭐英特尔和高通迅速将LLama3移植到硬件平台上。⭐Llama3采用了128-Ktoken词汇表进行高效编码,并在8B和70B模型中使用了分组查询注意力。站长网2024-04-26 12:14:200001