【案例】0 |) R/ k8 f+ u, t3 ]0 u
/ ^4 j( X) y% C4 r; kGPT-4「变懒」bug被修复,价格暴降80%!OpenAI连更5款新模型,性能狂飙 新智元 2024-01-26 12:18 发表于北京
- U2 ^2 L* j- z新智元报道 编辑:编辑部
% U' g- Q- F; Z$ s" V% W 【新智元导读】昨夜,OpenAI一口气连更5款新模型。GPT-4 Turbo变懒问题修复,代码生成能力史诗级加强。另外,多款模型价格大幅暴降。
$ _9 M6 J' W# b, d& t( ]
" g; f I& {; W% f S
9 a1 V2 b4 }) p4 R: T% l1 s1 ? k GPT-4又双叒叕变强了!' V9 m0 R2 B. k
8 J- Y5 {$ ]$ D1 C 今天,OpenAI正式发布了更新版的GPT-4 Turbo——gpt-4-0125-preview。
1 H# L0 w6 z# p3 i! k" O0 Q2 S% _& ~/ Q$ b+ C/ N
不仅大幅改善了模型「偷懒」的情况,而且还极大地提升了代码生成的能力。
2 }9 n2 A1 R) G
+ y _. O/ K, M+ @7 d, K: H! z* N$ d9 x. q
0 ]' }8 v0 ?1 z% [- R0 X8 d1 H
与此同时,OpenAI还发布了一系列模型和API更新,总体来说就是「更强的性能,更低的价格」。, C) }7 T$ v& Y0 B! V# f
1 \, r5 ^& R, R9 g5 R8 o0 C! f0 O- f' K3 Y
- GPT-3.5 Turbo更新——gpt-3.5-turbo-0125。输入价格大降50%,输出价格下降25%。性能上也有升级。. w" F4 z: z4 i9 q% h3 `! [
+ L4 X- [# R; d$ l* i
- 「迄今为止最强」的审核模型text-moderation-007,帮助开发者有效地识别有害文本。
( ]- m& Y* e; m: y: @! z% \% r. C$ v6 c6 C+ J: s0 S
两个新一代embedding模型:1 F6 v" _) Q/ l6 }9 s6 s
7 Y. D- d) N3 [. `/ V
- text-embedding-3-small,体积更小效率更高,价格直接砍到了原模型20%!支持512维和1536维两种大小。
3 u" E, f e5 [# F) I - text-embedding-3-large,性能相比之前模型大幅提升,高达3072维的嵌入向量,价格是小模型的6.5倍。. r6 J3 [4 G' `: m
最后,OpenAI还强调称,用户通过API传送的数据,都不会被用于训练新的模型。
3 k, K/ n% V) ]0 ]' Y' \3 E9 b
% P/ O' e# H) x' c# i+ X+ i" s6 V' Z$ ^( U2 D: b+ J
5 J8 S: s* _ P; a( [ GPT-4更强了,变懒bug修复 自从去年11月份开发者大会发布GPT-4-Turbo以来,超过70%的GPT-4 API用户已经转用了GPT-4-Turbo预览版,从而能够享受最新的知识戒指日期、更大的128k上下文窗口和更低的价格。
w8 `8 X: Y+ q8 p- u( c1 T7 L0 f4 i& \! e/ k0 o
最新更新的GPT-4-Turbo 预览模型——gpt-4-0125-preview在执行任务(如代码生成)方面比之前的预览版要更强,能够减少模型有可能出现的「偷懒」现象。
6 a( f# Z" b: R0 m, i: O) W9 { |, w- h# @, R: T+ U
新模型还修复了一个影响非英文UTF-8生成的漏洞。/ A5 V7 t: E5 o% o& \
对于那些希望自动升级到最新GPT-4-Turbo预览版的用户,OpenAI还推出了一个新的模型名别名gpt-4-turbo-preview,它将始终指向最新的GPT-4-Turbo预览版模型。7 A/ Q4 E% w' p; U8 V1 J
1 K) p% [6 m' i& J2 I4 m: W! ~ 在未来几个月内,OpenAI还会推出具备视觉功能的GPT-4-Turbo正式版。& K7 O0 v4 l8 M- B9 m
' q, j' F6 [3 k! x; g j- Y& ^! F9 D( U. m: }: ?
GPT-3.5-Turbo喜迎「降价增效」 下周,OpenAI即将推出新版的GPT-3.5-Turbo,型号为gpt-3.5-turbo-0125。
# r M5 x) `; }3 G' J6 {. S
5 V1 V) H4 a( R; @5 e5 a 在过去的一年里,OpenAI已经第三次下调GPT-3.5-Turbo的价格。
# ^- e' r( N0 V8 H7 b& N% P
; T! n; ]( b& G# f. B 新模型的输入价格下降了50%,现为0.0005美元/1k token;输出价格下降了 25%,现为0.0015美元/1k token。
7 g% e4 z; b1 v: h. N0 o7 Q( I) a 此外,模型还进行了多项改进,比如提高了按要求格式响应的准确性,并修复了一个导致非英文语言函数调用出现文本编码问题的漏洞。: s" S' |% l3 Z4 |
7 C% J5 w$ N: a. g 在API中使用固定gpt-3.5-turbo模型名称的用户,将在这款新模型推出两周后,自动从gpt-3.5-turbo-0613升级至gpt-3.5-turbo-0125版本。
, x- G* C6 I8 B& N5 A0 L
4 n! b4 c3 \# j: E# F; V0 B! E' p! Q! l1 B" y% j! F
全新嵌入模型2连发:性能大涨价格狂降 OpenAI推出了两款新的嵌入模型:体积更小、效率更高的text-embedding-3-small模型,以及更大、性能更强的text-embedding-3-large模型。
8 e9 j( ~7 p! M; y, [0 B9 a% [& y$ ^' d9 W( v
# E. L7 C- ?! R% f% t A0 I( n- N8 |5 O2 `
所谓嵌入(Embedding),就是将内容(如文字或代码)中的概念转化为一串数字序列。3 k" L% V& x* e5 L* \; {7 @' x
通过这种方式,机器学习模型和其他算法可以轻松理解不同内容之间的关系,执行聚类、检索等操作。
' W; m3 w8 g: s) O# X8 t: ?$ u
6 W6 S4 ] V" {; b3 a6 @9 J1 ]4 P 嵌入技术为 ChatGPT 和 Assistants API 中的知识检索功能,以及许多检索增强生成([color=var(--weui-LINK)][url=]RAG[/url])开发工具提供了强大动力。. z- W' P' d1 C5 N6 G( n; x
「小」文本嵌入模型:text-embedding-3-smalltext-embedding-3-small是OpenAI的新型高效嵌入模型,与2022年12月推出的前代产品text-embedding-ada-002相比,性能有了大幅提升。. H" n) ~: `0 d) |; ?# w5 w9 K! X
' J7 M, Y% |1 M2 S9 P2 R& ~% Z! F" r" B: B1 j7 w3 o7 a0 _
- 性能更强
0 w8 k. Y' }5 `. r1 _
( s5 X# [& z% e# ^1 u2 h% n* m 在多语言检索(MIRACL)的常用基准测试中,text-embedding-3-small的平均得分从31.4%提高到44.0%,在英语任务(MTEB)的常用基准测试中,平均得分从61.0%提高到 62.3%。4 f" [- J. x+ `; J7 d! f
- ~; U7 a8 m2 i% z/ a& @" ^ m$ A) v0 g5 K( s! W
- 价格实惠2 C% \/ R1 @6 F
' {" ^1 b5 y- Z2 j( \9 B text-embedding-3-small远比OpenAI之前的text-embedding-ada-002模型效率高,因此价格也大幅降低了5倍,从每千token的0.0001美元降至0.00002美元。4 h8 ^$ e! a+ g/ C& Q0 g2 |
) R- G5 V: ]" m* v0 U% i
OpenAI不会停用text-embedding-ada-002,尽管OpenAI更推荐用户使用新模型,客户仍可选择继续使用上一代产品。. u; r8 {" I2 Y
5 L0 V, Y' v4 i5 @ ?( f+ [: B9 n/ L6 Q$ c/ ] K
「大」文本嵌入模型:text-embedding-3-large
1 [( n( v2 P2 q" U/ a: M' J( b
& l, G1 M! p. b: q text-embedding-3-large是OpenAI的新一代大型嵌入模型,能够生成高达3072维的嵌入向量。
9 K! g2 Q1 {" o. V. @& j w Y! F5 R text-embedding-3-large是OpenAI目前性能最强的模型——5 h$ _' r/ {; ^
$ ?2 e: p7 Z2 q( M: N
与text-embedding-ada-002相比,它在MIRACL上的平均得分从31.4%提升至54.9%,在MTEB上的平均得分从61.0%提升至 64.6%。8 U/ o& t4 {& E0 W1 d
( v& n7 R# ~) B) N. w+ _3 Y
6 p$ J3 a, g _0 I/ i) S) X, V5 x7 U
7 {4 N( p% E5 W+ ^5 v
text-embedding-3-large的价格定为0.00013美元/1k token。
; I- K# j9 C. Z# n! {5 K6 p( }! Q/ q' o( f
# V( J1 W# n7 D& A
! R- `: \: [; d6 [4 l) p0 b
& h, j( i) Z1 y5 F. Y) ^' A7 x# q 灵活调整嵌入向量
" l% A. F2 t& O+ S, k: h
* i4 T' X: V7 C7 ]" z* H0 G 相比于小型嵌入,大型嵌入的存储和检索,如放置于向量存储库中,往往需要更高的成本,也消耗更多的计算资源、内存和存储空间。
+ q+ i' m7 o2 D+ s, ]5 F* f% d- C" Y! Q+ B! V& p' `- W* V
OpenAI的两款新嵌入模型均采用了一种特殊的训练技术,使得开发者可以在嵌入的使用成本和性能之间做出权衡。
+ ]: K5 \& a- R) v0 x' {4 d 具体来说,开发者可以通过设定dimensions API参数来有效缩短嵌入向量的长度(也就是去掉数列末端的一些数字),而这样做不会影响嵌入向量代表概念的核心特性。" U3 M8 O ^* I3 t
4 F/ R0 o1 }7 j# v
例如,在MTEB基准测试中,即使将text-embedding-3-large嵌入向量的长度缩减到 256,它的性能仍然超过了长度为1536的未经缩减的text-embedding-ada-002嵌入向量。
8 w' L# J& K5 E, I/ [; j- S 这种做法极大地增加了使用上的灵活性。
, C! Q, R+ p, Y' A' M h! t' \4 [: ^
% v- e% R/ a3 P 比如说,当开发者需要使用一个只支持最大1024维度嵌入向量的向量数据存储时,可以选择OpenAI性能最佳的嵌入模型text-embedding-3-large,并通过设置dimensions API参数为1024,从而将原本3072维的嵌入向量缩减下来,以较小的向量尺寸为代价换取了准确度。
- W- w" `; F; j+ s# l& T5 x
. @; p6 h' M; X. }1 ^
. A4 c# C/ ^- h& p5 y
( P) r$ N3 ]6 b2 {- W+ e 迄今最强的内容审核模型 OpenAI提供的免费内容审核API可以帮助开发者识别可能有害的文本。
8 L9 K2 ^4 h% x( p$ r0 F" D K2 \) ] b; Z2 M9 i
作为OpenAI持续安全工作的一部分,OpenAI发布了迄今为止最强大的内容审核模型text-moderation-007。
: a; i2 H% n, N
1 A- D+ e5 {+ R4 B 此前的text-moderation-latest和text-moderation-stable,也将重新指向这个新模型。2 R! `* p$ V, B- o# E8 h4 f" Q
5 C# k. \: L5 Z) V o5 `* }
; H* d* I2 d' ? API后台更新,更好的API密钥管理 OpenAI正在推出两项重要的平台升级,旨在为开发者提供对他们的API使用情况更清晰的洞察,并加强对API密钥的管理。/ [: C+ A% d+ s, K+ v2 d$ ?; _
. O" Q9 r3 l9 |; J: _
首先,开发者可以直接在API密钥页面设置不同的密钥权限。
: M- t8 r! `5 a% a
2 c! C1 g [: j a' }1 y# u% { 举个例子,用户可以为一个密钥配置只读权限,以便用于内部的跟踪数据面板,或者设置为仅限访问某些特定的接口。
$ x9 @3 o% g F8 s% U 其次,一旦开启了密钥使用跟踪功能,使用仪表盘和数据导出功能就能够提供基于每个API 密钥的详细使用指标。这样一来,只需为不同的功能、团队、产品或项目分配独立的 API 密钥,就可以轻松地监控到各自的使用情况。" T. j6 c1 b* Z4 _5 }9 D# z& u
, Z: a" x# S2 r
在接下来的几个月里,OpenAI计划为开发者提供更多便利,让他们能够更好地监控 API 使用情况并管理 API 密钥,这一点对于大型组织来说尤其重要。
+ _ y) C1 P8 G, t& z! q4 Y$ M! F9 O9 t |3 t
- Y- I) Y' e( _2 W9 V
! V, E- f2 Z. z% ~; S
: X; H F" i! c1 R! B
) ^4 y$ B4 A `
, | B) c2 }5 x! F: o: }
, I$ {9 C. n2 w, w1 a" { |