GPT-5.6 és més ràpid. Llavors, per què encara esperem?

  • Jordi Torras
  • Blog

El 9 de juliol, OpenAI va fer dos anuncis que van captar cap a on es dirigeix el treball amb IA.

GPT-5.6 es va fer generalment disponible a ChatGPT, Codex i l’API. Al mateix temps, la nova aplicació d’escriptori de ChatGPT va reunir Chat, Work i Codex en una sola aplicació.

Una sola família de models. Un sol espai de treball. Agents més capaços. Execució més ràpida.

I tot i així, encara esperem.

Això no és necessàriament una contradicció. Pot ser la característica definidora de la pròxima fase del treball del coneixement.

Com més ràpida és la IA, més feina li deleguem

Durant molt de temps, utilitzar la IA significava fer una pregunta i esperar uns segons per obtenir una resposta. La latència era fàcil d’entendre. Entraves un prompt, veies aparèixer els tokens i continuaves quan la resposta acabava.

Els agents de programació van canviar aquesta relació.

Ara demanem a la IA que inspeccioni repositoris, cerqui documentació, editi múltiples fitxers, executi ordres, diagnostiqui errors, operi aplicacions, creï artefactes, provi la seva feina i revisi el resultat. Una tasca seriosa pot implicar desenes de crides a eines i diverses rondes de verificació abans que torni res útil.

El model pot ser més ràpid, però l’encàrrec és molt més gran.

Codex ja oferia un mode ràpid que proporcionava fins a 1,5 vegades més velocitat de tokens amb GPT-5.4. GPT-5.6 va més enllà aconseguint més feina amb menys tokens i afegint configuracions per a tasques més difícils. max dona al model més temps per explorar, comprovar i revisar. ultra coordina múltiples agents en fluxos de treball paral·lels.

Aquestes millores redueixen el temps necessari per a una tasca comparable. Però rarament mantenim la tasca comparable. Quan la capacitat creix, l’ambició creix amb ella.

Deixem de demanar una funció i comencem a demanar una funcionalitat. Deixem de demanar un resum i comencem a demanar una recomanació investigada. Deixem de demanar una fórmula d’Excel i comencem a demanar un model operatiu complet.

Una IA més ràpida no elimina l’espera. Fa que delegar tasques més grans sigui pràctic.

L’espera ha pujat de nivell

Hi ha diversos tipus de latència en un flux de treball amb IA.

Hi ha la latència del model: el temps necessari per produir el següent token.

Hi ha la latència de l’eina: el temps necessari per cercar, navegar, consultar un sistema, executar una prova, renderitzar un document o operar una aplicació.

Hi ha la latència del flux de treball: el temps necessari per planificar, executar, inspeccionar el resultat, descobrir un problema, provar un altre enfocament i verificar que la feina està realment acabada.

La inferència més ràpida ataca el primer tipus. Millors eines redueixen parts del segon. Però a mesura que els agents assumeixen la responsabilitat de resultats més complets, la latència del flux de treball es fa més visible.

Aquesta és una bona latència quan substitueix feina que d’altra manera hauríem de fer nosaltres mateixos. Esperar cinc minuts perquè un agent implementi i provi alguna cosa és molt diferent d’estar cinc minuts sense fer res.

El problema és que pot semblar el mateix si ens quedem mirant l’indicador de progrés.

Una aplicació, dos ritmes de treball

La nova aplicació d’escriptori de ChatGPT fa explícit aquest canvi.

El xat és conversacional. Funciona al ritme de preguntes i respostes.

Work i Codex són més agents. Treballen al ritme de delegació, progrés, intervenció i finalització.

Posar aquests modes dins d’una sola aplicació elimina fronteres de producte, però no elimina la diferència entre treball sincrònic i asincrònic. De fet, fa que aquesta diferència sigui més important.

Hem d’aprendre quan quedar-nos a la conversa i quan deixar l’agent sol.

L’instint de mirar és comprensible. Volem saber si l’agent ens ha entès, si està avançant i si es perdrà pel camí equivocat. Per a tasques poc especificades o d’alt risc, la supervisió propera és sensata.

Però consultar constantment un agent capaç anul·la part del motiu de delegar la feina. Manté la nostra atenció lligada a una tasca que ja no estem executant.

La millor interfície no és una animació de progrés més hipnòtica. És una notificació fiable en el moment que es necessita el nostre judici.

Millora la pròxima entrega

La primera cosa útil a fer mentre un agent treballa és millorar el context per al que vindrà després.

Això pot voler dir recollir un exemple que falta, trobar el document rellevant, escriure criteris d’acceptació, registrar un cas límit o aclarir el motiu empresarial darrere de la tasca.

No es tracta d’interrompre l’execució actual amb una allau d’afegits a mig fer. Es tracta de preparar un prompt més fort per a la següent ronda.

Els agents funcionen millor quan reben context concret: l’objectiu, restriccions, material font, exemples, definició de fet i les decisions que poden prendre. El temps d’espera és una bona oportunitat per convertir coneixement implícit en instruccions explícites.

La pròxima entrega esdevé així més curta, clara i valuosa.

Pensa estratègicament i deixa que les notificacions facin la seva feina

L’execució ens porta naturalment cap als detalls. Un interval d’espera crea una petita obertura per pujar un nivell.

Pregunta’t què hauria de passar després que acabi la tasca actual.

Cal revisar la sortida? Qui l’hauria de rebre? Quines proves la farien fiable? És una tasca puntual o la primera versió d’un flux de treball repetible? Quina part hauria de seguir sent una decisió humana? Què s’hauria de mesurar la pròxima vegada?

Aquí és on també importen les notificacions de la IA.

Una bona notificació no és només una comoditat. És una eina de gestió de l’atenció. Permet a l’agent apropiar-se de l’interval d’execució i dona permís a la persona per deixar de comprovar.

La notificació ideal és específica: la tasca està acabada, cal prendre una decisió, cal una aprovació o el flux de treball està bloquejat. Tot el demés pot quedar en silenci.

Fes que els canvis de context siguin més barats

“Millora la teva capacitat de fer multitasking” probablement no és la lliçó correcta.

El canvi de context humà és costós. Deixar una tasca exigent, entrar en una altra i reconstruir la primera pot consumir més energia que l’interval d’espera estalviat.

L’habilitat útil és fer que els canvis de context siguin més barats.

Abans d’allunyar-te d’una tasca activa d’un agent, deixa’t un petit punt de control:

  • Què està fent l’agent?
  • Quin resultat estic esperant?
  • Què inspeccionaré o decidiré quan torni?

Normalment, tres línies són suficients. Quan arriba la notificació, no cal reconstruir tot l’estat mental de memòria.

També ajuda ajustar la segona activitat a l’espera probable. Si l’agent necessita trenta segons, recull context o escriu una nota. Si necessita diversos minuts, revisa un altre resultat o esbossa una idea. Si està executant un flux llarg, passa a una tasca independent substancial.

No totes les pauses són prou llargues per a treball profund.

Utilitza l’interval de manera creativa

El treball dels agents sovint crea fragments estranys de temps: massa llargs per quedar-se mirant la pantalla, massa curts per començar alguna cosa intimidant.

Aquests fragments són sorprenentment bons per a la creativitat.

Captura un títol. Escriu un paràgraf inicial. Esbossa un argument. Fes una llista de preguntes que has estat evitant. Anota una observació del treball que acabes de delegar.

La clau és tenir a mà algunes tasques creatives de baixa fricció. Una pàgina en blanc pot ser difícil; una llista d’idees inacabades és fàcil d’afegir-hi.

Aquest article va començar exactament així. Codex estava treballant en un flux complex, i en comptes de mirar com treballava, vaig començar a pensar en què hauríem de fer mentre esperem la IA.

L’interval d’espera es va convertir en el tema.

De vegades, el millor ús de l’espera no és més feina

Hi ha un risc en convertir cada segon lliure en un altre sistema de productivitat.

Si un agent ens retorna cinc minuts, no sempre cal omplir aquests cinc minuts amb un segon agent, una altra pestanya del navegador i una nova cua de tasques.

Fes un cafè. Beu aigua. Estira’t. Aparta la mirada de la pantalla. Camina a una altra habitació. Deixa que una idea reposi sense forçar-la a existir immediatament.

La IA pot augmentar la quantitat de feina en moviment. Això fa que la recuperació sigui més important, no menys.

Un reset físic també és una de les fronteres de context més barates disponibles. Tornar després d’una petita pausa pot facilitar revisar la sortida de l’agent com a editor i no com algú encara emocionalment lligat al prompt original.

La nova habilitat de productivitat és l’orquestració

Chat, Work i Codex han convergit en una sola aplicació. La nostra atenció, no.

A mesura que la IA és capaç de gestionar fluxos de treball més llargs, el paper humà es desplaça de l’execució contínua cap a l’orquestració: definir resultats, aportar context, decidir què pot executar-se de manera independent, respondre a excepcions, revisar proves i triar què mereix atenció a continuació.

Això no vol dir que les persones esdevinguin supervisors passius. La qualitat de la feina encara depèn del judici. Però el judici s’ha d’aplicar en els moments en què canvia el resultat, no gastant-lo mirant cada pas intermedi.

GPT-5.6 és més ràpid. Codex pot executar diversos fluxos de treball en paral·lel. Les eines d’escriptori s’estan convertint en un entorn continu.

Encara esperarem, perquè la feina que demanem a la IA continuarà expandint-se.

La pregunta és si aquesta espera es viu com a temps mort o esdevé una part deliberada del flux de treball.

Mentre l’agent treballa, millora la pròxima entrega. Pensa estratègicament. Confia en la notificació. Deixa’t un punt de control. Escriu alguna cosa. O fes un cafè i estira’t.

Les màquines cada cop són millors aprofitant el càlcul.

Nosaltres hauríem de ser millors aprofitant l’interval.

Fes que l'IA treballi per a tu

Empodera la teva visió amb la nostra experiència. Jo i el meu equip estem especialitzats en convertir conceptes en realitat, oferint solucions a mida que redefineixen el que és possible. Desbloquegem el ple potencial de l'IA. Efectivament.

Contacta'ns