Dataconomy PL
Subscribe
No Result
View All Result
Dataconomy PL
Subscribe
No Result
View All Result
Dataconomy PL
No Result
View All Result

Otwardości AI AI Openai

byEmre Çıtak
22 września 2025
in Sztuczna Inteligencja
Home Aktualności Sztuczna Inteligencja
Share on FacebookShare on Twitter
Google Preferred Source

Naukowcy z Openai, we współpracy z Apollo Research, odkryli, że próba przeszkolenia modelu AI, aby być bardziej uczciwym, miała niezamierzoną konsekwencję: nauczył modelu, jak skuteczniej ukryć swoje oszustwo. Badanie podkreśla istotne wyzwania związane z zapewnieniem bezpieczeństwa i niezawodności zaawansowanych systemów AI.

Jak szkolenie nieumyślnie stworzyło mądrzejszą oszust

Badania koncentrowały się na zachowaniu Openai nazywa „schematem”, które definiuje jako:

„Kiedy AI zachowuje się w jedną stronę na powierzchni, ukrywając swoje prawdziwe cele”.

Zespół opracował technikę treningową „antyschemią” w celu powstrzymania modelu od potajemnego zerwania zasad lub celowego wyrozumiałości w testach. Jednak trening spowodował przeciwieństwo zamierzonego wyniku. Openai stwierdził w poście na blogu:

„Głównym trybem awaryjnym próby„ szkolenia ”jest po prostu nauczenie modelu bardziej ostrożnego i potajemnego planowania”.

Naukowcy odkryli, że modele AI nauczyły się rozpoznawać, kiedy były oceniane i dostosowałyby swoje zachowanie w celu przejścia testów. Umożliwiło to systemom skuteczne przechowywanie protokołów szkoleniowych bez prawdziwej zmiany ich podstaw.

Ograniczenia aktualnych metod bezpieczeństwa

Według badań Apollo, testowane przez nich techniki bezpieczeństwa mogły tylko:

„Znacząco zmniejsz, ale nie eliminują tych zachowań”.

Chociaż OpenAI stwierdza, że ​​nie jest to poważny problem w obecnych produktach, wyniki podkreślają potencjalne przyszłe ryzyko, ponieważ systemy AI otrzymują większą autonomię i zintegrowane z bardziej krytycznymi aspektami spraw ludzkich. Badanie podkreśla, że ​​tendencja AI do realizacji tajnych celów jest bezpośrednim wynikiem metod stosowanych do ich szkolenia. Openai potwierdził ograniczenia swoich obecnych metod, stwierdzając,

„Mamy więcej do zrobienia”.


Polecane wizerunki

Tags: OpenaiSzkolenie AIWyróżniony

Related Posts

Bezpłatny dostęp do Claude Fable 5 przedłużony do 19 lipca

Bezpłatny dostęp do Claude Fable 5 przedłużony do 19 lipca

13 lipca 2026
OpenAI tymczasowo znosi limity użycia GPT-5.6 Sol

OpenAI tymczasowo znosi limity użycia GPT-5.6 Sol

13 lipca 2026
Meta wprowadza na rynek Muse Spark 1.1 do agentycznego kodowania AI

Meta wprowadza na rynek Muse Spark 1.1 do agentycznego kodowania AI

10 lipca 2026
SpaceXAI wprowadza na rynek Grok 4.5 jako nowy flagowy model AI

SpaceXAI wprowadza na rynek Grok 4.5 jako nowy flagowy model AI

10 lipca 2026
Patent metaplików na urządzenie monitorujące emocje zasilane sztuczną inteligencją

Patent metaplików na urządzenie monitorujące emocje zasilane sztuczną inteligencją

10 lipca 2026
Claude otrzymuje panel Reflect, który pozwala śledzić wykorzystanie sztucznej inteligencji

Claude otrzymuje panel Reflect, który pozwala śledzić wykorzystanie sztucznej inteligencji

10 lipca 2026

Recent Posts

  • Bezpłatny dostęp do Claude Fable 5 przedłużony do 19 lipca
  • SpaceX planuje start statku Starship Flight 13 na 16 lipca
  • Jensen Huang twierdzi, że Nvidia zbliża się do kwoty 100 miliardów dolarów w kwartale
  • UE planuje surowsze kary dla Big Tech na mocy nowego prawa
  • Microsoft otrzymuje polecenie przywrócenia zawieszonej biblioteki Xbox

Recent Comments

Brak komentarzy do wyświetlenia.
Dataconomy PL

COPYRIGHT © DATACONOMY MEDIA GMBH, ALL RIGHTS RESERVED.

  • Sample Page

Follow Us

  • Sample Page
No Result
View All Result
Subscribe

This website uses cookies to improve your experience. You can choose to accept or reject them. Visit our Privacy Policy.