OpenAI qed issaħħaħ il-monitoraġġ, l-allinjament u s-sigurtà tal-mudelli avvanzati tal-IA. Ara kif salvagwardji ġodda qed jiggwidaw ir-ritmu tal-iżvilupp tal-mudelli.
OpenAI taqsam riżultati ġodda dwar problemi miftuħa antiki fil-matematika u x-xjenza teoretika tal-kompjuter, b’avvanzi fil-ġeometrija, il-kriptografija u l-komplessità.
Kif żewġ konfigurazzjonijiet tal-API tejbu l-prestazzjoni ta’ GPT-5.6 fuq ARC-AGI-3, u żiedu l-punteġġi u l-effiċjenza biż-żamma tar-raġunament u l-kompattazzjoni.
OpenAI qed tagħti lil 100,000 riċerkatur akkademiku aċċess bla ħlas għall-aktar mudelli avvanzati ta’ ChatGPT biex taċċellera r-riċerka, il-kollaborazzjoni u l-iskoperti.
Rapport ġdid juri kif ix-xjenzati jużaw aġenti tal-IA biex jimmodernizzaw il-komputazzjoni xjentifika u jaċċelleraw l-iżvilupp u l-iskoperti fil-ġenomika u lil hinn.
Skopri GPT-Red, is-sistema ta’ red teaming awtomatizzata ta’ OpenAI li tuża self-play biex ittejjeb is-sikurezza, l-allinjament u r-robustezza għall-injezzjoni tal-prompts fl-AI.
Aktar intelliġenza minn kull token, prestazzjoni aktar b’saħħitha għal kull dollaru, u aktar kapaċità disponibbli fuq talba għall-aktar xogħol diffiċli tiegħek.
GPT-5.6 is a new family of three models: Sol, our new flagship model; Terra, a capable lower-cost option; and Luna, our fastest and most cost-efficient model. The safeguards we have built for this launch—our most robust yet—are built to deliver these models safely and at scale, around the world.
Analiżi ġdida minn OpenAI tikxef problemi f’SWE-Bench Pro, benchmark tal-kowdjar, u tqajjem tħassib dwar l-affidabbiltà tal-evalwazzjoni ta’ mudelli tal-IA.