数据世界
产业资讯 宏观经济 企业动态 人物动态 科技数码 数据洞察 AI前沿 行业峰会 热点资讯

豆包视觉理解模型正式发布,比行业价格便宜85%

2024-12-19来源:互联网编辑:芳华

继大语言模型价格以厘计算之后,视觉理解模型也宣告进入“厘时代”。

在12月18日举办的火山引擎 Force 大会上,字节跳动正式发布豆包视觉理解模型,为企业提供极具性价比的多模态大模型能力。豆包视觉理解模型千tokens输入价格仅为3厘,一元钱就可处理284张720P的图片,比行业价格便宜85%,以更低成本推动AI技术普惠和应用发展。

豆包大模型全面升级

研究显示,人类接受的信息超过80%来自视觉。视觉理解将极大地拓展大模型的能力边界,同时也会降低人们与大模型交互的门槛,为大模型解锁更丰富的应用场景。

据火山引擎总裁谭待介绍,豆包视觉理解模型不仅能精准识别视觉内容,还具备出色的理解和推理能力,可根据图像信息进行复杂的逻辑计算,完成分析图表、处理代码、解答学科问题等任务。此外,该模型有着细腻的视觉描述和创作能力。

图:火山引擎总裁谭待

此前,豆包视觉理解模型已经接入豆包App和PC端产品。豆包战略研究负责人周昊表示:“豆包一直在努力,让用户的输入更快更方便”。为此,豆包产品非常注重多模态的输入和打磨,包括语音、视觉等能力,这些模型都已通过火山引擎开放给企业客户。

会上,豆包3D生成模型也首次亮相。该模型与火山引擎数字孪生平台veOmniverse结合使用,可以高效完成智能训练、数据合成和数字资产制作,成为一套支持 AIGC 创作的物理世界仿真模拟器。

豆包大模型多款产品也迎来重要更新:豆包通用模型pro已全面对齐GPT-4o,使用价格仅为后者的1/8;音乐模型从生成60秒的简单结构,升级到生成3分钟的完整作品;文生图模型2.1版本,更是在业界首次实现精准生成汉字和一句话P图的产品化能力,该模型已接入即梦AI和豆包App。

即梦Dreamina张楠认为,生成式AI技术可以把每个人脑子里的奇思妙想快速视觉化,“像做梦一样”。即梦希望成为“想象力世界”的相机,记录每个人的奇思妙想,帮助每个有想法的人轻松表达、自由创作。

图:即梦Dreamina 张楠

大会正式宣告,2025年春季将推出具备更长视频生成能力的豆包视频生成模型1.5版,豆包端到端实时语音模型也将很快上线,从而解锁多角色演绎、方言转换等新能力。谭待表示,豆包大模型虽然发布较晚,但一直在快速迭代进化,目前已成为国内最全面、技术最领先的大模型之一。

大模型应用加速落地

数据显示,截至12月中旬,豆包通用模型的日均tokens使用量已超过4万亿,较七个月前首次发布时增长了33倍。大模型应用正在向各行各业加速渗透。

据悉,豆包大模型已经与八成主流汽车品牌合作,并接入到多家手机、PC等智能终端,覆盖终端设备约3亿台,来自智能终端的豆包大模型调用量在半年时间内增长100倍。

与企业生产力相关的场景,豆包大模型也获得了众多企业客户青睐:最近3个月,豆包大模型在信息处理场景的调用量增长了39倍,客服与销售场景增长16倍,硬件终端场景增长13倍,AI工具场景增长9倍,学习教育等场景也有大幅增长。

谭待认为,豆包大模型市场份额的爆发,得益于火山引擎“更强模型、更低成本、更易落地”的发展理念,让AI成为每一家企业都能用得起、用得好的普惠科技。

在公布豆包视觉理解模型超低定价的同时,火山引擎升级了火山方舟、扣子和 HiAgent 三款平台产品,帮助企业构建好自身的 AI 能力中心,高效开发 AI 应用。其中,火山方舟发布了大模型记忆方案,并推出 prefix cache 和 session cache API,降低延迟和成本。火山方舟还带来全域 AI 搜索,具备场景化搜索推荐一体化、企业私域信息整合等服务。

云原生是过去十年最重要的计算范式,大模型时代则推动着云计算的变革。火山引擎认为,下一个十年,计算范式应该从云原生进入到AI云原生的新时代。

基于AI云原生的理念,火山引擎推出了新一代计算、网络、存储和和安全产品。在计算层面,火山引擎GPU实例,通过vRDMA网络,支持大规模并行计算和P/D分离推理架构,显著提升训练和推理效率,降低成本;存储上,新推出的EIC弹性极速缓存,能够实现GPU直连,使大模型推理时延降低至1/50、成本降低20%;在安全层面,火山将推出PCC私密云服务,构建大模型的可信应用体系。基于PCC,企业能够实现用户数据在云上推理的端到端加密,而且性能很好,推理时延比明文模式的差异在5%以内。

谭待说:“今年是大模型高速发展的一年。当你看到一列高速行驶的列车,最重要的事就是确保自己要登上这趟列车。通过AI云原生和豆包大模型家族,火山引擎希望帮助企业做好AI创新,驶向更美好的未来。”

iPhone17系列销售势头猛 本周国内激活量或冲破1000万台大关
【CNMO科技消息】11月14日,据数码博主爆料称,iPhone17系列国内激活量将于本周突破1000万台。截至11月2日,该系列在国内的激活数量已突破825万台,其中iPhone 17 Pro Max约3…

2025-11-14

95后「AI天才少女」罗福莉加入小米,AI圈人才争夺再掀热潮
DeepSeek员工、有天才名号、小米雷军出千万年薪挖角,这几个因素叠合起来,让不怎么关注 AI 的网友都知道了这位 95 后技术大牛。暂且不说这“千万年薪”是不是真消息,能让雷军出动请人, 相信大家都能从…

2025-11-13

原DeepSeek核心成员罗福莉加盟小米MiMo团队
近日,一则科技圈的重磅消息引发广泛关注:曾参与DeepSeek-V2大模型研发的“天才少女”罗福莉,正式宣布加入小米Xiaomi MiMo团队,并表示将“全力奔赴心中的AGI(通用人工智能)”。这一消息不仅证实了此前关于她跳槽小米的传闻,更透露出小米在AGI领域的战略布局。

2025-11-13

双11手机市场:苹果销量领跑,小米成国产手机销量佼佼者
【太平洋科技】11 月 12 日消息,本年度的双 11 正式收官,各大电商平台的品类销售排名也随之揭晓。据京东官方数据,在全部品牌销量累计榜中,苹果、小米、vivo 占据前三席位。在全部品牌销售额累计榜…

2025-11-12

中国折叠屏手机市场回暖,2025年全球出货量或达5470万台引关注
基于前三季度的良好表现,IDC预计2025年中国折叠屏手机市场出货量将接近千万台,延续此前持续增长的趋势。 机构指出,折叠屏手机正成为智能手机市场的全新增长极,2025年全球出货量预计达5470万台,中国市…

2025-11-12

联想双十一成绩亮眼:89亿销售额揽19冠 平板与多品类齐发力
不仅一举夺得笔记本电脑总榜自营销量冠军与POP销售额冠军,更在细分品类中实现了多维度领跑。旗下的ThinkPad与ThinkBook分别拿下POP销售额冠军与自营高端销售额冠军;游戏本方面,联想更是包揽了自营…

2025-11-12

2025年Q3中国折叠屏手机回暖:出货量增17.8\% 体验升级或成高端市场关键赛道
【环球网科技综合报道】11月11日消息,根据IDC最新手机季度跟踪报告显示,2025年第三季度,中国折叠屏手机市场迎来显著回暖,该季度出货量达到263万台,同比增长17.8%。市场动能的恢复,一方面得益于手机…

2025-11-11

取消实体卡槽换来长续航!纯eSIM版iPhone17 Pro多场景续航表现亮眼
在美国、加拿大、日本等特定市场销售的纯 eSIM 版本,由于取消了实体 SIM卡槽,获得了更大的电池空间,续航表现明显优于实体卡槽版本。在综合活跃使用测试中,eSIM 版续航达 16 小时 12 分钟,比实…

2025-11-11

荣耀400系列发货量破600万创佳绩 荣耀500系列新设计蓄势待发
在海外首发时,销量就达到前代产品的2-3倍。在中国市场上,荣耀400系列首销日销量同比荣耀300系列增长195%,同比荣耀200系列增长138%,打破近三年荣耀手机首销日销量纪录。6月30日,该系列全球累计激…

2025-11-11