【微软发布1.3B参数量小模型,效果优于7B参数Llama2】
9月11日,微软发布开源模型phi-1.5,在只支持代码的1.0版本之上加入了一般场景对话。该模型的参数量只有1.3B,但效果已经超过了拥有7B参数的Llama2。phi团队一致认为,数据的质量远比数量更重要。所以与一众卷参数量的模型相比,phi-1.5不仅参数量不到Llama2的五分之一,训练时所用的token更是少了一个数量级,只用了3千亿的训练数据。但phi-1.5在AGIEval、 LM-Eval等多个Benchmark上都取得了比Llama2还要优异的成绩。
【英伟达 GH200 超级芯片首次亮相 MLPerf v3.1,性能跃升 17%】
9月11日,推出不到两个月的英伟达GH200 Grace Hopper超级芯片首次亮相MLPerf行业基准测试。在此次测试中,具有更高的内存带宽和更大的内存容量的GH200与H100 GPU相比,性能高出17%。此次MLPerf Inference v3.1基准测试是继4月发布3.0版本之后的又一次更新,这次更新包含了两个方面:引入基于60亿参数大语言模型GPT-J的推理基准测试(AI模型的大小通常根据它有多少参数来衡量)和改进的推荐模型。
【Meta计划对标GPT-4训练下一代大模型】
9月11日消息,Meta购入大量英伟达H100芯片,并积极扩建数据中心,减少对微软Azure云平台的依赖,以创建一款更为强大、复杂的聊天机器人。Meta 将 GPT-4 作为其下一个 AI 模型的标准,并计划在2024年开始训练,旨在模仿人类的表情和感情,提供更加逼真的交互体验。根据此前泄露的消息,Instagram正在测试一个具有30种性格的聊天机器人,可能与公司即将推出的未公布的人工智能“角色”相关联。
【研究发现ChatGPT可在七分钟内完成软件开发,平均成本不足1美元】
9月12日消息,来自布朗大学和多所中国大学的研究团队进行了一个实验,探究是否可以用 ChatGPT 的 3.5 版本的语言模型来驱动的人工智能机器人,在没有事先训练的情况下完成软件开发过程。研究者创建了一个假想的软件开发公司,名为 ChatDev。研究表明,这个由人工智能驱动的公司平均可以在不到七分钟内以不到一美元的成本完成整个软件开发过程,同时通过其“记忆”和“自我反思”的能力识别和解决“潜在漏洞”。
【国内外高校联合开源强化学习策略,让机器狗能跑酷】
9月12日消息,来自上海期智研究院、斯坦福大学、上海科技大学、卡内基梅隆大学和清华大学的研究者联合开展了一个项目,旨在通过开源强化学习策略让机器狗掌握多样化的通用技能,以迅速应对各种场景和障碍。该项目基于一种新的开源系统,可以学习基于视觉的端到端跑酷策略,无需依赖任何参考动作数据。这种强化学习方法能够让机器狗学会攀爬高障碍、跳过大间隙、在低障碍下爬行、挤过狭小缝隙和跑步等技能,并将这些技能整合成一个基于视觉的跑酷策略,可以直接部署到四足机器人上。
【用户反映llama2.mojo实现比llama2.c快20%的效果】
9月12日消息,一名Mojo社区成员将Python程序llama2.py移植到Mojo上,实现了比原版llama.c快20%的效果,显示了Mojo在硬件级优化方面的巨大潜力。Mojo是一种新的面向AI开发人员的编程语言,其目标是将Python的易用性与系统编程功能结合,实现高性能计算。Mojo可以无缝集成Python代码和库,同时提供与C++和CUDA相匹配的性能。Mojo的发明者Chris Lattner表示,他创立的公司Modular新获得的1亿美元融资将用于推动Mojo的进一步发展和产品扩展。
【腾讯健康公布医疗大模型,并发布AI医疗产品矩阵】
9月12日消息,据腾讯健康官方公众号报道,腾讯健康在日前公布了旗下医疗大模型,并发布“智能问答、家庭医生助手、数智医疗影像平台等多场景 AI 产品矩阵”,以及药物发现平台“云深”(iDrug)。这一医疗大模型基于腾讯混元大模型,适用于文案生成、智能问答、病历结构化和检索、影像报告和辅助诊断等场景,可嵌入医疗环节全流程;同时,在 AI 驱动药物发现方面,腾讯宣称,旗下 “云深”(iDrug)平台已同时具备了小分子药物与大分子药物的加速发现能力。
【Adobe Firefly 生成式 AI 模型全面开放商用】
9月13日消息,Adobe宣布,经过几个月的测试,Firefly生成式AI模型已正式上线,可在Adobe Creative Cloud、Adobe Express和Adobe Experience Cloud等多个应用中使用。此外,Adobe还推出了一个独立的Firefly网页应用,让用户在不使用特定的Adobe Creative Suite应用的情况下,也可以体验生成式AI的功能。
【Stability AI 发布文本生成音频产品Stable Audio】
9月14日消息,Stability AI 公司近日推出 Stable Audio,可基于用户输入的文本内容,自动生成多种类型和风格的音频内容,包括音乐、语音、环境声、特效等。Stability AI 宣称,Stable Audio 模型可以在一秒内渲染出 95 秒的立体声音频,并且只需要一个 NVIDIA A100 GPU。
【谷歌被曝小范围测试Gemini,比训练GPT-4算力大5倍】
9月15日消息,据三位直接知情人士透露,谷歌已经允许一小部分公司使用 Gemini 软件的早期版本,意味着谷歌即将将其纳入消费者服务,并通过公司的云计算服务出售给企业;同时,Gemini 已开始在新的 TPUv5 Pod上进行训练,算力高达~1e26 FLOPS,比训练 GPT-4的算力还要大5倍;另外,Gemini 的训练数据库为Youtube上 93.6亿分钟的视频字幕,总数据集大小约为GPT-4的两倍。
【微软开源EvoDiff,用AI生成蛋白质框架】
9月15日消息,微软开源了一个蛋白质生成框架EvoDiff。该框架使用AI技术,能够在没有目标蛋白质结构信息的情况下,生成生成高保真、多样化的蛋白质序列。EvoDiff的核心是一个拥有6.4亿参数的模型,该模型通过使用来自不同物种和功能类别蛋白质的数据进行训练,使模型具备生成高质量蛋白质序列的能力。创新之处在于,它不再依赖蛋白质结构信息,而是基于蛋白质序列来生成蛋白质。
【百度希壤与高通达成战略合作,拟打造元宇宙基础设施平台】
9月15日消息,近期,北京百度网讯科技有限公司与高通无线通信技术(中国)有限公司在北京签署非约束性战略合作谅解备忘录,将在XR领域展开全面战略合作。通过此次战略合作的宣布,双方期望在未来开展深度的技术、市场与生态合作,其中包括双方将在XR技术、生成式AI、数字人、产业上下游协同等方面,围绕元宇宙+生态+行业应用共同打造新一代元宇宙基础设施平台。
发布于 江苏
