Google llança Gemini 3.1 Flash-Lite i OpenAI actualitza ChatGPT amb GPT-5.3 Instant. Per què els models d'IA barats són la notícia que importa a les PIMEs.
El 3 de març, Google i OpenAI van moure fitxa el mateix dia. Google va presentar Gemini 3.1 Flash-Lite i OpenAI va llançar GPT-5.3 Instant. Cap dels dos és el model més potent del seu catàleg. I justament per això em semblen la notícia del mes.
Què han tret exactament
Gemini 3.1 Flash-Lite és el model més ràpid i barat de la família Gemini: 0,25 dòlars per milió de tokens d'entrada i 1,50 per milió de sortida. Segons Google, genera respostes un 45% més de pressa que la generació anterior i triga 2,5 vegades menys a començar a respondre. De moment és en proves a Vertex AI i a Google AI Studio, i admet entrades de fins a un milió de tokens.
GPT-5.3 Instant és una altra cosa: l'actualització del model de cada dia de ChatGPT, el que fa servir la immensa majoria de gent sense saber-ne el nom. Menys respostes esquives, to més natural, més precisió en les dades i millors respostes quan busca a la web. Res d'espectacular. Tot útil.
La cursa que no surt als titulars
Els titulars sempre se'ls emporten els models gegants: qui raona millor, qui guanya el benchmark de torn. Però quan automatitzes un procés real d'un negoci real, la pregunta no és quin model és més llest. És quin model és prou bo, va ràpid i costa cèntims.
Llegir albarans, classificar correus, resumir trucades, extreure dades d'un PDF. Per a res d'això no cal el model que resol problemes d'olimpíada matemàtica. Cal un model constant, ràpid i barat. A 0,25 dòlars per milió de tokens, passar per la IA tota la paperassa d'un mes d'una PIME costa menys que un cafè.
I no és només el preu. Que el model trigui 2,5 vegades menys a començar a respondre vol dir que el pots posar dins d'un procés sense que ningú s'esperi: el client ni nota que darrere hi ha una IA treballant.
El que veig des del taller
A Moblio faig servir aquesta gamma de models cada dia: el fuster grava la primera visita amb el client, i la IA converteix la transcripció en una fitxa estructurada amb peces, mides i materials. No necessito el model més llest del món. Necessito que sigui ràpid, que no falli i que no em mengi el marge.
Aquesta és la clau de qualsevol SaaS amb quota continguda, i de qualsevol negoci que vulgui IA als seus processos: que els números surtin cada mes, no només a la demo.
Torna a fer els números
Si fa un any vas descartar automatitzar alguna cosa perquè la IA anava lenta o sortia cara, revisa-ho. Aquests preus canvien cada trimestre, i sempre a la baixa. El que era inviable el 2024 avui és trivial.
Si no saps per on començar, l'avaluació de processos que ofereixo és gratuïta i serveix exactament per a això: trobar quines feines repetitives del teu negoci ja es poden automatitzar amb els preus d'avui.
La cursa dels models gegants és espectacular. La dels models barats és la que et pot estalviar hores cada setmana.
← Tots els articles del blog · Qui sóc · IA per a empreses a Lleida i Catalunya
