【投入】2024年字节跳动AI投入达800亿元,接近BAT三家总和

来源:爱集微 #字节跳动#
2.4w

1.OpenAI被曝开发GPT-5陷入困境,正考虑打造自研人形机器人

2.国产开源模型DeepSeek-V3逼近行业顶尖并火到海外

3.2024年字节跳动AI投入达800亿元,接近BAT三家总和


1.OpenAI被曝开发GPT-5陷入困境,正考虑打造自研人形机器人

在计划重组公司结构同时,OpenAI也面临着产品技术开发的挑战。

据外媒近日报道,OpenAI内部代号为“猎户座”(Orion)的GPT-5项目的开发已持续超过18个月,目前面临严峻挑战。按原计划,该项目应在2024年年中完成,但现在进度严重滞后。

更早些时候,由于GPT-5可能不像以前的模型那样代表着巨大的飞跃,OpenAI正在寻求新的战略。据报道,OpenAI已经完成了至少两次大型训练运行,最初的训练运行比预期的要慢,这暗示着更大规模的运行既费时又费钱。虽然GPT-5的性能比前代产品更好,但它的进步还不足以证明维持模型运行的成本合理。

不过,OpenAI也在寻求拓展新的领域。

据知情人士对媒体称,OpenAI正考虑打造自己的人形机器人。在过去一年里,OpenAI多次暗示对机器人项目重燃热情。OpenAI投资了开发机器人硬件和软件的初创公司,如Figure和Physical Intelligence,并重启了四年前解散的内部机器人软件团队。最近,OpenAI还在考虑开发一种人形机器人,但关于这一潜在项目的细节仍然很少。


2.国产开源模型DeepSeek-V3逼近行业顶尖并火到海外

近日,AI公司深度求索(DeepSeek)正式上线全新系列模型DeepSeek-V3首个版本并同步开源。官方数据显示,该模型在多项评测集上超越了阿里Qwen2.5-72B、Meta的Llama-3.1-405B等其他头部开源模型,并逼近GPT-4o、Claude-3.5-Sonnet等顶尖闭源模型,甚至不分伯仲。

据官方技术论文披露,DeepSeek-V3是一个具有6710亿总参数的MoE(混合专家)模型,在14.8万亿token上进行了预训练。v3模型的总训练成本为557.6万美元,GPT-4o等模型的训练成本约为1亿美元。DeepSeek-V3定价为每百万输入tokens 0.5元(缓存命中)/2元(缓存未命中),每百万输出tokens 8元,并享有45天的优惠价格体验期。

显然,高性价比是DeepSeek大模型的关键特色之一。今年5月,DeepSeek发布的V2开源模型,将推理成本降到每百万token仅1元人民币,随后字节跳动、腾讯、百度、阿里等大厂纷纷降价,大模型价格战由此一触即发。

在DeepSeek-V3上线后,海外社交媒体平台X迅速对其“刷屏”,其中的焦点在于这一模型能力对标头部模型,但训练的预算却非常低,“2048个GPU、2个月、近600万美元”,而GPT-4o等模型除了训练成本约为1亿美元,还需至少在万个GPU量级的计算集群上训练。


3.2024年字节跳动AI投入达800亿元,接近BAT三家总和

浙商证券近日发布报告指出,字节跳动在AI上加大流量投放、扩大资本开支、大力扩张团队,研发投入显著领先同行。

在资金上,字节跳动在AI上投入巨大,2024年资本开支达到800亿元,接近百度、阿里、腾讯三家的总和(约1000亿元)。2025年,字节跳动资本开支有望达到1600亿元,旨在打造自主可控的大规模数据中心集群,其中约900亿元将用于 AI 算力的采购,700亿元用于IDC基建以及网络设备。

在推广力度方面,字节跳动在推广其 AI 产品上采取了大力度的广告投放。

例如豆包智能助手在2024年4月至5月的广告投放金额接近1800万元,6月上旬更是飙升至1.24亿元。同时,字节跳动利用抖音等平台的内部流量优势,为 AI 产品引流。此外,在许多大模型付费的环境下,豆包大模型在保障性能前提下免费向公众开放,有助于快速提升用户数量,起到了扩大市占率以及获取庞大训练语料的作用。


责编: 爱集微
来源:爱集微 #字节跳动#
THE END

*此内容为集微网原创,著作权归集微网所有,爱集微,爱原创

关闭
加载

PDF 加载中...