传媒教育网

 找回密码
 实名注册

QQ登录

只需一步,快速开始

搜索
做个试验
查看: 532|回复: 0
打印 上一主题 下一主题

GPT-4「变懒」bug被修复,价格暴降80%!OpenAI连更5款新模型,性能狂飙

[复制链接]
跳转到指定楼层
楼主
发表于 2024-1-26 21:52:32 | 只看该作者 回帖奖励 |倒序浏览 |阅读模式
【案例】
% H( c+ n) G+ C3 _% L" b6 J/ N: s" B2 |5 m& x
GPT-4「变懒」bug被修复,价格暴降80%!OpenAI连更5款新模型,性能狂飙
新智元   2024-01-26 12:18 发表于北京


& n' ^: J8 V! ]. |8 l) K
新智元报道  
编辑:编辑部

# w) Z% L3 B7 V# C! g% _
【新智元导读】昨夜,OpenAI一口气连更5款新模型。GPT-4 Turbo变懒问题修复,代码生成能力史诗级加强。另外,多款模型价格大幅暴降。+ K2 t( j1 e& N/ _8 e8 ?/ O" u

, T5 C' P- w% R/ ?5 a' }
' D% j3 d( n- K+ i- M" _& }3 G8 G( |& H
  GPT-4又双叒叕变强了!
: |3 |) Q4 W3 v' m7 n

9 H9 A: O; }- o; i  今天,OpenAI正式发布了更新版的GPT-4 Turbo——gpt-4-0125-preview
% m4 z" W  i) }1 i$ E

$ d* v1 c/ E% {  不仅大幅改善了模型「偷懒」的情况,而且还极大地提升了代码生成的能力。
. y2 M; ]# O& @* i" C. [8 _+ w  ?% }1 J# D8 W: P- a/ |
0 n6 S' R5 q& L

! b& B& Y+ Z! K" R1 O
  与此同时,OpenAI还发布了一系列模型和API更新,总体来说就是「更强的性能,更低的价格」。
2 Q% s* D0 l. V. I& O& `
, A# \9 ]' y6 b  g, \* {1 \
  - GPT-3.5 Turbo更新——gpt-3.5-turbo-0125。输入价格大降50%,输出价格下降25%。性能上也有升级。0 A. e) t( n$ _2 F4 L& [( L8 O
6 ^+ Q$ H4 K! J" n
  - 「迄今为止最强」的审核模型text-moderation-007,帮助开发者有效地识别有害文本。' x" }1 A4 l7 S, J, Y. {

$ C$ Z/ p. K& v. I. a& y1 v  两个新一代embedding模型:
2 z$ {& s0 w: N. H9 I' `
- d( w& y% R$ p, ]
  - text-embedding-3-small,体积更小效率更高,价格直接砍到了原模型20%!支持512维和1536维两种大小。
4 q/ {8 M# c1 D( f. B& I4 ?; O  - text-embedding-3-large,性能相比之前模型大幅提升,高达3072维的嵌入向量,价格是小模型的6.5倍。
3 G2 z9 v: r; Y4 ?, k  最后,OpenAI还强调称,用户通过API传送的数据,都不会被用于训练新的模型。5 v( |( @. i% R( U8 x
9 a/ U, |, S( _4 y

# q- h2 O& A5 F5 E  ~: O3 q
6 U5 T5 c7 u7 d2 ^- n1 U( s
  GPT-4更强了,变懒bug修复
  自从去年11月份开发者大会发布GPT-4-Turbo以来,超过70%的GPT-4 API用户已经转用了GPT-4-Turbo预览版,从而能够享受最新的知识戒指日期、更大的128k上下文窗口和更低的价格。# c" [7 @, n' l. o" O& r

, k+ W- s1 b' h, D/ k  最新更新的GPT-4-Turbo 预览模型——gpt-4-0125-preview在执行任务(如代码生成)方面比之前的预览版要更强,能够减少模型有可能出现的「偷懒」现象。
8 D8 L: n5 K# k* b/ ]( N( C- ?
: f# K' E3 O1 ]3 p
  新模型还修复了一个影响非英文UTF-8生成的漏洞。- s: m/ [0 W9 X5 [
  对于那些希望自动升级到最新GPT-4-Turbo预览版的用户,OpenAI还推出了一个新的模型名别名gpt-4-turbo-preview,它将始终指向最新的GPT-4-Turbo预览版模型。  q0 k! b& E  C- S) ~% Z" D7 M

$ v1 R% o5 b  G! K6 Y, X; Z# Z  在未来几个月内,OpenAI还会推出具备视觉功能的GPT-4-Turbo正式版。
5 Q9 k) K( @; V7 x
: @' c( `1 m' Y6 y5 s0 T; Z# `

  ^! l7 ^: `$ Q5 _1 M2 `; s
  GPT-3.5-Turbo喜迎「降价增效」
  下周,OpenAI即将推出新版的GPT-3.5-Turbo,型号为gpt-3.5-turbo-0125。
7 g7 f# Z: Q' G
: d4 a. e& l+ U& \
  在过去的一年里,OpenAI已经第三次下调GPT-3.5-Turbo的价格。
6 g4 R$ {2 ]! [1 J+ r4 f3 H

) c% s4 X! W# D, R) i4 _% n  新模型的输入价格下降了50%,现为0.0005美元/1k token;输出价格下降了 25%,现为0.0015美元/1k token。
6 l+ o& Y' k% I$ P* \1 _  此外,模型还进行了多项改进,比如提高了按要求格式响应的准确性,并修复了一个导致非英文语言函数调用出现文本编码问题的漏洞。
1 N: T. P7 f# {: T3 ?- R& |

3 y- @5 P9 h3 A  在API中使用固定gpt-3.5-turbo模型名称的用户,将在这款新模型推出两周后,自动从gpt-3.5-turbo-0613升级至gpt-3.5-turbo-0125版本。' {0 g" k( O7 S9 j; a6 F
, W0 i- k: N9 m) [

: n  M! m% V: K7 w& U, o
  全新嵌入模型2连发:性能大涨价格狂降
  OpenAI推出了两款新的嵌入模型:体积更小、效率更高的text-embedding-3-small模型,以及更大、性能更强的text-embedding-3-large模型。* I- e  z* P2 K0 l

0 V9 v' M0 x" M* H' b1 z/ c2 q# j
' W( N7 A& J4 R1 Y
% w7 p7 I) Q, {- S7 e4 t1 f! ?
  所谓嵌入(Embedding),就是将内容(如文字或代码)中的概念转化为一串数字序列。
! C. ]5 O" ]4 c" f6 \6 r3 f  P- f  通过这种方式,机器学习模型和其他算法可以轻松理解不同内容之间的关系,执行聚类、检索等操作。
: c0 t1 T. R, A7 n# W% |! f, k

' A9 g' c% R7 ~  嵌入技术为 ChatGPT 和 Assistants API 中的知识检索功能,以及许多检索增强生成([color=var(--weui-LINK)][url=]RAG[/url])开发工具提供了强大动力。3 {1 q' r0 c% k
  「小」文本嵌入模型:text-embedding-3-smalltext-embedding-3-small是OpenAI的新型高效嵌入模型,与2022年12月推出的前代产品text-embedding-ada-002相比,性能有了大幅提升。! l* q: N  b# E4 G
% q2 t2 {4 L' B

7 o5 w2 L3 n6 I. p( F# n  - 性能更强" {. a1 p6 T/ N  ^4 ~9 f
& Q" z% C! H2 D
  在多语言检索(MIRACL)的常用基准测试中,text-embedding-3-small的平均得分从31.4%提高到44.0%,在英语任务(MTEB)的常用基准测试中,平均得分从61.0%提高到 62.3%。
2 p" V4 F4 x6 R' p6 W4 b( e4 Y# l( a% o$ J% f7 i) e
: Q" [5 C# L4 d
  - 价格实惠) ?) V  k% m% t$ @, {( M

0 |2 w& a1 G" P3 i# B  {5 _  text-embedding-3-small远比OpenAI之前的text-embedding-ada-002模型效率高,因此价格也大幅降低了5倍,从每千token的0.0001美元降至0.00002美元。1 V2 C. B) H' I: E+ g' t
+ G! @& x$ \% d2 K
  OpenAI不会停用text-embedding-ada-002,尽管OpenAI更推荐用户使用新模型,客户仍可选择继续使用上一代产品。
# m1 y7 E) Z9 F0 [; H1 U4 \
2 A: v) j8 _! x

0 `4 E. B! T( f8 m/ Z" L- D2 _「大」文本嵌入模型:text-embedding-3-large. u# Z) \  L# {& B4 d, I, E
. w; D! a8 Z1 k& x
  text-embedding-3-large是OpenAI的新一代大型嵌入模型,能够生成高达3072维的嵌入向量。6 ]  E% x3 E# j$ {
  text-embedding-3-large是OpenAI目前性能最强的模型——% ?1 @3 t3 f: G9 j
' Z" v- f- F$ r+ {0 ^0 C# n
  与text-embedding-ada-002相比,它在MIRACL上的平均得分从31.4%提升至54.9%,在MTEB上的平均得分从61.0%提升至 64.6%。( F; z8 Y# }& B3 ~! n2 ~) X

5 e3 e9 k' ~, G+ A* V; M9 e) ?/ B1 b0 z; o9 S% [( {) n

# p5 T& P3 |: U0 g  R  text-embedding-3-large的价格定为0.00013美元/1k token。
0 B0 K% A/ d3 ^% k: m
6 _1 ^8 h( p; j" h, Z8 m7 \
; O" t- g3 H: Q
' q8 B6 e+ m1 O+ f8 p9 b6 |5 G( w
3 \5 z; X1 O( Q
  灵活调整嵌入向量( B: g9 i) c0 {+ C# E' f
- l5 c+ [! X$ _1 `9 m1 A
  相比于小型嵌入,大型嵌入的存储和检索,如放置于向量存储库中,往往需要更高的成本,也消耗更多的计算资源、内存和存储空间。
' u* q  a, k. d9 C! f* k

. V% M& k# M1 N5 b9 c9 m  ?9 {  P7 b  OpenAI的两款新嵌入模型均采用了一种特殊的训练技术,使得开发者可以在嵌入的使用成本和性能之间做出权衡。' F2 `+ }. E+ t, k
  具体来说,开发者可以通过设定dimensions API参数来有效缩短嵌入向量的长度(也就是去掉数列末端的一些数字),而这样做不会影响嵌入向量代表概念的核心特性。# X' @+ ]& ]  L! h* P8 P& b
( m, U7 K( p5 r2 o# t
  例如,在MTEB基准测试中,即使将text-embedding-3-large嵌入向量的长度缩减到 256,它的性能仍然超过了长度为1536的未经缩减的text-embedding-ada-002嵌入向量。# i( E+ v% o* f7 |/ R; }/ G5 [
  这种做法极大地增加了使用上的灵活性。
8 C4 Q8 c- P. J4 y. P) C

& |+ P, u: y% w* y& i3 B  比如说,当开发者需要使用一个只支持最大1024维度嵌入向量的向量数据存储时,可以选择OpenAI性能最佳的嵌入模型text-embedding-3-large,并通过设置dimensions API参数为1024,从而将原本3072维的嵌入向量缩减下来,以较小的向量尺寸为代价换取了准确度。4 F/ w) K2 L. Q
7 J0 Y$ ~7 ^; v6 J) v9 Y! F

" q3 _/ e% ~: h$ |
- p7 \$ t' `( z) I$ b, N0 T1 u! X
  迄今最强的内容审核模型
  OpenAI提供的免费内容审核API可以帮助开发者识别可能有害的文本。
& o  W% U, Q/ N

. s" k) x& B  r  作为OpenAI持续安全工作的一部分,OpenAI发布了迄今为止最强大的内容审核模型text-moderation-007。
8 \8 l" [8 X: @

- f3 {: z6 c( Q6 m. f  此前的text-moderation-latest和text-moderation-stable,也将重新指向这个新模型。
5 a/ v2 s  L& W3 i1 l7 ?) O8 L5 h3 U8 ]9 j

* y7 h, C0 \' t5 `4 k; x
API后台更新,更好的API密钥管理
  OpenAI正在推出两项重要的平台升级,旨在为开发者提供对他们的API使用情况更清晰的洞察,并加强对API密钥的管理。
. P' O+ m5 y! G( b7 M
9 ^. L2 r5 e; J
  首先,开发者可以直接在API密钥页面设置不同的密钥权限。9 @  l% s. a! g2 Q9 A

3 K+ k1 i. W  v- G  举个例子,用户可以为一个密钥配置只读权限,以便用于内部的跟踪数据面板,或者设置为仅限访问某些特定的接口。6 Q# `: a' ?: U  P
  其次,一旦开启了密钥使用跟踪功能,使用仪表盘和数据导出功能就能够提供基于每个API 密钥的详细使用指标。这样一来,只需为不同的功能、团队、产品或项目分配独立的 API 密钥,就可以轻松地监控到各自的使用情况。
6 d/ c  _7 P7 s/ q
! f+ o; w& d% B
  在接下来的几个月里,OpenAI计划为开发者提供更多便利,让他们能够更好地监控 API 使用情况并管理 API 密钥,这一点对于大型组织来说尤其重要。
' n6 f/ S2 x1 D8 T, b; Z0 N$ U/ o

4 ~. K% V8 L$ R3 y8 |5 @
) Q$ A" {. f; [: N5 _& a

) R! R: G8 i$ ?4 j7 \
来源:新智元(公众号)
+ C' |5 t  Q: D链接:https://mp.weixin.qq.com/s/6deJkhCniZPCMdZdy1T2Yg3 c2 n( o! A) E, M' }; m2 p' h$ U
编辑:李梦瑶4 g" P& T" R3 \' F
. w/ _- @0 N' z, M8 G, s( ?
4 T. ~  g; z0 ?) s1 D' K) j
4 K; Y3 o( m  g2 C
分享到:  QQ好友和群QQ好友和群 QQ空间QQ空间 腾讯微博腾讯微博 腾讯朋友腾讯朋友
收藏收藏 支持支持 反对反对

发表回复

您需要登录后才可以回帖 登录 | 实名注册

本版积分规则

掌上论坛|小黑屋|传媒教育网 ( 蜀ICP备16019560号-1

Copyright 2013 小马版权所有 All Rights Reserved.

Powered by Discuz! X3.2

© 2016-2022 Comsenz Inc.

快速回复 返回顶部 返回列表