ಮುಖ್ಯ ವಿಷಯಕ್ಕೆ ನೇರವಾಗಿ ಹೋಗಿ
OpenAI
ಲೋಡ್ ಆಗುತ್ತಿದೆ…

ಇಂದು ನಾವು ಈವರೆಗೆ ವ್ಯಾಪಕವಾಗಿ ನಿಯೋಜಿಸಿರುವ ಅತ್ಯಂತ ಸಮರ್ಥ ಮಾಡೆಲ್ GPT‑6 Astra ವನ್ನು ಬಿಡುಗಡೆ ಮಾಡುತ್ತಿದ್ದೇವೆ. Astra ನಮ್ಮ ಪ್ರಿಪೇರ್ಡ್‌ನೆಸ್ ಫ್ರೇಮ್‌ವರ್ಕ್ ಅಡಿಯಲ್ಲಿ ಸೈಬರ್ ಭದ್ರತಾ ಸಾಮರ್ಥ್ಯದ ಗಂಭೀರ ಮಟ್ಟವನ್ನು ತಲುಪಿದ ನಮ್ಮ ಮೊದಲ ಮಾಡೆಲ್ ಆಗಿದೆ.

ಈ ಬಿಡುಗಡೆಯ ಸುರಕ್ಷತೆಯ ಕುರಿತು ತಿಳಿಯಬೇಕಾದ ಪ್ರಮುಖ ಅಂಶಗಳು ಹೀಗಿವೆ:

  1. ಸೈಬರ್ ಸಾಮರ್ಥ್ಯಗಳಲ್ಲಿ GPT‑6 Astra ಮಹತ್ವದ ಪ್ರಗತಿಯಾಗಿದ್ದು, ನಮ್ಮ ಗಂಭೀರ ಮಿತಿಯನ್ನು ತಲುಪಿದೆ. ಅಂದರೆ, ಸೂಕ್ತ ಸಾಧನಗಳು ಮತ್ತು ಪ್ರವೇಶ ಲಭ್ಯವಿದ್ದರೆ, ಪ್ರತಿಯೊಂದು ಹಂತದಲ್ಲೂ ವ್ಯಕ್ತಿಯ ಮಾರ್ಗದರ್ಶನವಿಲ್ಲದೆಯೇ GPT‑6 ಅಸ್ಟ್ರಾ ಈ ಹಿಂದೆ ತಿಳಿದಿರದ ಭದ್ರತಾ ದೋಷಗಳನ್ನು ಪತ್ತೆಹಚ್ಚಬಹುದು ಮತ್ತು ಉತ್ತಮವಾಗಿ ರಕ್ಷಿಸಲಾದ ಅನೇಕ ಸಿಸ್ಟಮ್‌ಗಳಲ್ಲಿ ಅವುಗಳನ್ನು ಬಳಸಿಕೊಳ್ಳಲು ಹೊಸ ವಿಧಾನಗಳನ್ನು ರೂಪಿಸಬಹುದು. ಆದ್ದರಿಂದ, ದುರುಪಯೋಗ ಅಥವಾ ಹೊಂದಾಣಿಕೆಯ ಕೊರತೆಯಿಂದ ಮಾಡೆಲ್ ಹಾನಿಕಾರಕ ಸೈಬರ್ ಕ್ರಮಗಳನ್ನು ಕೈಗೊಳ್ಳದಂತೆ ನಮ್ಮ ರಕ್ಷಣೆಗಳನ್ನು ಗಣನೀಯವಾಗಿ ಬಲಪಡಿಸಿದ್ದೇವೆ. ಅಸ್ಟ್ರಾ ಮತ್ತು ಅಂತಹುದೇ ಮಾಡೆಲ್‌ಗಳ ಆಂತರಿಕ ಅಭಿವೃದ್ಧಿ ಹಾಗೂ ನಿಯೋಜನೆಯನ್ನು ಸುರಕ್ಷಿತಗೊಳಿಸಲೂ ಕ್ರಮ ಕೈಗೊಂಡಿದ್ದೇವೆ. ಇವುಗಳಲ್ಲಿ ಹೆಚ್ಚು ಕಟ್ಟುನಿಟ್ಟಿನ ಪ್ರತ್ಯೇಕತೆ, ಪರಿಶೀಲನಾ ಬಿಂದುಗಳ ಗೂಢಲಿಪೀಕರಣ, ಚೈನ್-ಆಫ್-ಥಾಟ್ (CoT) ಸೇರಿದಂತೆ ಸಂಪೂರ್ಣ ಕ್ರಮಪಥಗಳ ಸಾರ್ವತ್ರಿಕ ಮೇಲ್ವಿಚಾರಣೆ ಮತ್ತು ಆಂತರಿಕ ಬಳಕೆಗೆ ಮುನ್ನ ತಡೆಯುವ ಹೊಂದಾಣಿಕೆ ಮೌಲ್ಯಮಾಪನ ಪ್ರಕ್ರಿಯೆ ಸೇರಿವೆ.
  2. GPT‑6 Astra ತನ್ನ ಹಿಂದಿನ ಆವೃತ್ತಿಗಳಿಗಿಂತ ಗಣನೀಯವಾಗಿ ಹೆಚ್ಚು ದೃಢವಾಗಿದೆ. ಹೊಸ ದೃಢತಾ ಸುರಕ್ಷತಾ ತರಬೇತಿ ತಂತ್ರಗಳನ್ನು ಅಳವಡಿಸಿಕೊಂಡಿರುವ GPT‑6 ಅಸ್ಟ್ರಾ, ದೀರ್ಘ ಕ್ರಮಪಥಗಳಲ್ಲಿಯೂ GPT‑5.6 Sol ಗಿಂತ ಜೈಲ್‌ಬ್ರೇಕ್‌ಗಳಿಗೆ ಗಣನೀಯವಾಗಿ ಹೆಚ್ಚು ಪ್ರತಿರೋಧ ಹೊಂದಿದೆ. ಆಫ್‌ಲೈನ್ ಪರೀಕ್ಷೆಗಳು ಮತ್ತು ಕಠಿಣ ಆಂತರಿಕ ಹಾಗೂ ಬಾಹ್ಯ ಜೈಲ್‌ಬ್ರೇಕ್ ಪರೀಕ್ಷೆ ಮತ್ತು ಪರಿಹಾರ ಕಾರ್ಯಕ್ರಮದಿಂದ ನಮಗೆ ಇದು ತಿಳಿದಿದೆ. ಹೆಚ್ಚಿನ ಅಪಾಯ ಹೊಂದಿರಬಹುದೆಂದು ಗುರುತಿಸಲಾದ ಬಳಕೆದಾರರಿಗಾಗಿ, ಮಾಡೆಲ್‌ನ ನಿರಾಕರಣೆಯ ಮಿತಿಯನ್ನು ಹೆಚ್ಚು ಎಚ್ಚರಿಕೆಯದಾಗಿಸಲು ಮತ್ತು ದ್ವಿಬಳಕೆಯ ಅಪಾಯಗಳ ವಿಶಾಲ ವ್ಯಾಪ್ತಿಯನ್ನು ಒಳಗೊಳ್ಳುವಂತೆ ಹೊಂದಿಸುವ ಸಾಮರ್ಥ್ಯವನ್ನೂ ತರಬೇತಿಗೊಳಿಸಿದ್ದೇವೆ. ಹಿಂದಿನ ಪರೀಕ್ಷಾ ಅವಧಿಗಳಲ್ಲಿ ಪತ್ತೆಯಾದ ಜೈಲ್‌ಬ್ರೇಕ್‌ಗಳ ವಿರುದ್ಧ Astra ದೃಢವಾಗಿರುವುದನ್ನು ಖಚಿತಪಡಿಸಿಕೊಳ್ಳಲು ನಾವು ಹಿಂಜರಿತ ಪರೀಕ್ಷೆಯನ್ನು ಬಳಸುತ್ತೇವೆ. ನಮ್ಮ ಸುಧಾರಣೆಗಳನ್ನು ದೃಢೀಕರಿಸಲು ಇತ್ತೀಚಿನ ಆಂತರಿಕ ರೆಡ್ ಟೀಮಿಂಗ್ ದಾಳಿಕೋರರೊಂದಿಗೆ ಹೊಸ ಸುತ್ತಿನ ಸ್ವಯಂಚಾಲಿತ ರೆಡ್ ಟೀಮಿಂಗ್ ನಡೆಸಿದ್ದೇವೆ.
  3. GPT‑6 Astra, GPT‑5.6 Sol ಗಿಂತ ಉತ್ತಮವಾಗಿ ಹೊಂದಾಣಿಕೆಗೊಂಡಿದೆ. ಮಾಡೆಲ್ ಹೊಂದಾಣಿಕೆಯಲ್ಲಿ Astra ಮಹತ್ವದ ಮುನ್ನಡೆಯಾಗಿದ್ದು, ನಮ್ಮ ಪ್ರೀ-ಟ್ರೈನಿಂಗ್ ದತ್ತಾಂಶದ ಸಂಯೋಜನೆಯಿಂದ ರೀಇನ್‌ಫೋರ್ಸ್‌ಮೆಂಟ್ ಲರ್ನಿಂಗ್ ಸಮಯದ ಶ್ರೇಣೀಕರಣದವರೆಗಿನ ಸುಧಾರಣೆಗಳನ್ನು ಒಳಗೊಂಡಿದೆ. ನಾವು ಹೊಸ ಹೊಂದಾಣಿಕೆ ಮೌಲ್ಯಮಾಪನಗಳ ಸಮೂಹವನ್ನು(ಹೊಸ ಕಿಟಕಿಯಲ್ಲಿ ತೆರೆಯುತ್ತದೆ) ವರದಿ ಮಾಡಿದ್ದೇವೆ. ಸುರಕ್ಷತೆ ಮತ್ತು ಭದ್ರತಾ ಮಿತಿಗಳನ್ನು ಗೌರವಿಸುವುದರಲ್ಲೂ, ಅಧಿಕೃತ ಕಾರ್ಯವ್ಯಾಪ್ತಿಯೊಳಗೆ ಉಳಿಯುವುದರಲ್ಲೂ GPT‑6 ಅಸ್ಟ್ರಾ ಹೆಚ್ಚು ಸಮರ್ಥವಾಗಿದೆ ಎಂದು ಕಂಡುಕೊಂಡಿದ್ದೇವೆ. 54,000ಕ್ಕೂ ಹೆಚ್ಚು ಆಂತರಿಕ Codex ಟಾಸ್ಕ್‌ಗಳನ್ನು(ಹೊಸ ಕಿಟಕಿಯಲ್ಲಿ ತೆರೆಯುತ್ತದೆ) ಬಳಸಿದ ಅನುಕರಣೆಯಲ್ಲಿ, ಹೆಚ್ಚಿನ ತೀವ್ರತೆಯ ಹೊಂದಾಣಿಕೆಯಿಲ್ಲದ ವರ್ತನೆಗಾಗಿ Astra ಪಡೆದ ಗುರುತುಗಳ ಸಂಖ್ಯೆ Sol ಪಡೆದದ್ದಕ್ಕಿಂತ ಸರಿಸುಮಾರು ಅರ್ಧದಷ್ಟಿತ್ತು.
  4. ಹೊಂದಾಣಿಕೆಯ ಕೊರತೆಯ ಮೇಲ್ವಿಚಾರಣೆಯನ್ನು ನಾವು ವ್ಯಾಪಕವಾಗಿ ನಿಯೋಜಿಸುತ್ತಿದ್ದೇವೆ. ನಮ್ಮ ಮಾಡೆಲ್‌ಗಳ ಸಂಭಾವ್ಯ ಹೊಂದಾಣಿಕೆಯಿಲ್ಲದ ವರ್ತನೆಯನ್ನು ತಡೆಯಲು ಮಾಡೆಲ್ ಹೊಂದಾಣಿಕೆಯೇ ಮುಖ್ಯ ಸಾಧನವೆಂದು ನಾವು ಪರಿಗಣಿಸುತ್ತೇವೆ. ಆದಾಗ್ಯೂ, ಮೇಲ್ವಿಚಾರಣೆಯು ಅತ್ಯಾಧುನಿಕ ಮಾಡೆಲ್‌ನ ವರ್ತನೆಯ ಕುರಿತು ವ್ಯಾಪಕ ಒಳನೋಟ ನೀಡುತ್ತದೆ ಮತ್ತು ಹೊಂದಾಣಿಕೆ ಹಾಗೂ ಸುರಕ್ಷತೆಯನ್ನು ಮತ್ತಷ್ಟು ಸುಧಾರಿಸುವ ಅವಕಾಶಗಳನ್ನು ಬೆಳಕಿಗೆ ತರುತ್ತದೆ. ಜೊತೆಗೆ, ಪತ್ತೆಯಾದ ಹೊಂದಾಣಿಕೆಯಿಲ್ಲದ ವರ್ತನೆಯ ವಿರುದ್ಧ ಮೇಲ್ವಿಚಾರಣೆಯು ಹೆಚ್ಚುವರಿ ರಕ್ಷಣಾ ಪದರವಾಗಿಯೂ ಕಾರ್ಯನಿರ್ವಹಿಸುತ್ತದೆ. ಈ ಕಾರಣಗಳಿಂದಾಗಿ, ಗಣನೀಯ ಗಣನಾ ವೆಚ್ಚದ ಹೊರತಾಗಿಯೂ ಅಸ್ಟ್ರಾದ ಬಾಹ್ಯ ನಿಯೋಜನೆಯಲ್ಲಿ ಸಾಧನಗಳನ್ನು ಬಳಸುವ ಎಲ್ಲ ಅನುಮಾನ ಪ್ರಕ್ರಿಯೆಗಳಿಗೆ ಹೊಂದಾಣಿಕೆಯ ಕೊರತೆಯ ಮೇಲ್ವಿಚಾರಣೆಯನ್ನು ಸೇರಿಸಿದ್ದೇವೆ. ಈ ವ್ಯವಸ್ಥೆಯು ನಮ್ಮ ಆಂತರಿಕ ವ್ಯವಸ್ಥೆಗೆ ಸಮಾನವಾಗಿದೆ.
  5. GPT‑5.6 Solಗೆ ಹೋಲಿಸಿದರೆ GPT‑6 Astraದ ಮೇಲ್ವಿಚಾರಣಾಸಾಧ್ಯತೆ ಕಡಿಮೆಯಾಗಿದೆ. GPT‑6 ಅಸ್ಟ್ರಾದ ಮೇಲ್ವಿಚಾರಣಾಸಾಧ್ಯತೆ(ಹೊಸ ಕಿಟಕಿಯಲ್ಲಿ ತೆರೆಯುತ್ತದೆ) ಮತ್ತು ನಿಯಂತ್ರಣಸಾಧ್ಯತೆಯ(ಹೊಸ ಕಿಟಕಿಯಲ್ಲಿ ತೆರೆಯುತ್ತದೆ) ಕುರಿತು ನಾವು ಮಹತ್ವದ ತನಿಖೆಗಳನ್ನು ನಡೆಸಿದ್ದೇವೆ. GPT‑5.6 Solಗಿಂತ GPT‑6 Astra ತನ್ನದೇ CoT ಅನ್ನು ನಿಯಂತ್ರಿಸುವಲ್ಲಿ ಹೆಚ್ಚು ಸಮರ್ಥವಾಗಿದ್ದು, ತನ್ನ CoTಯಲ್ಲಿ ಅಪರಾಧ ಸೂಚಕ ಮಾಹಿತಿಯನ್ನು ಸೇರಿಸುವ ಸಾಧ್ಯತೆ ಕಡಿಮೆ ಎಂದು ಕಂಡುಕೊಂಡಿದ್ದೇವೆ. ಪ್ರತಿಕೂಲ ಸನ್ನಿವೇಶಗಳಲ್ಲಿ, ಅಂದರೆ ನಮ್ಮ ಮೇಲ್ವಿಚಾರಕರಿಂದ ತಪ್ಪಿಸಿಕೊಳ್ಳಲು ಮಾಡೆಲ್ ಅನ್ನು ಪ್ರೇರೇಪಿಸಿದಾಗ, ಮೌಲ್ಯಮಾಪನಗಳಲ್ಲಿ ಉದ್ದೇಶಪೂರ್ವಕವಾಗಿ ಕಳಪೆ ಪ್ರದರ್ಶನ ನೀಡುವಾಗ (ಸ್ಯಾಂಡ್‌ಬ್ಯಾಗಿಂಗ್) ಮಾಡೆಲ್ ಪತ್ತೆಯಾಗದೆ ಉಳಿಯಬಲ್ಲದು. ಅಲ್ಲದೆ, ಕೆಲವು ವಿಧ್ವಂಸಕ ಕಾರ್ಯಗಳನ್ನು(ಹೊಸ ಕಿಟಕಿಯಲ್ಲಿ ತೆರೆಯುತ್ತದೆ) ಮಾಡಲು ಸೂಚಿಸಿದಾಗ ಅದು ಕೆಲವೊಮ್ಮೆ ನಮ್ಮ ಆಂತರಿಕ ಮೇಲ್ವಿಚಾರಕರಿಂದ ತಪ್ಪಿಸಿಕೊಳ್ಳಬಲ್ಲದು. ಗುಪ್ತಲಿಪಿಯ CoT ರೀಜನಿಂಗ್‌ಗೆ, ಉದಾಹರಣೆಗೆ ಸಾಮಾನ್ಯವಾಗಿ ಕಾಣುವ ಮತ್ತು ಸಂಬಂಧವಿಲ್ಲದ ಪಠ್ಯದಲ್ಲಿ ಗುಪ್ತ ರೀಜನಿಂಗ್ ಅನ್ನು ಮರೆಮಾಡುವುದಕ್ಕೆ, ಯಾವುದೇ ಪುರಾವೆ ಕಂಡುಬಂದಿಲ್ಲ. ಹೀಗಾಗಿ ತಪ್ಪಿಸಿಕೊಳ್ಳುವ ಅಪಾಯವು ಬಹುಮಟ್ಟಿಗೆ ಕಡಿಮೆ ರೀಜನಿಂಗ್ ಅಗತ್ಯವಿರುವ ಕಾರ್ಯಗಳಿಗೆ ಸೀಮಿತವಾಗಿರಬಹುದು.
    • ಪ್ರತಿಕೂಲ ಪರಿಸ್ಥಿತಿಗಳಲ್ಲಿ Astra ವರ್ಗದ ಮಾಡೆಲ್‌ಗಳು ನಮ್ಮ CoT ಮಾನಿಟರ್ಸ್‌ನಿಂದ ತಪ್ಪಿಸಿಕೊಳ್ಳಬಹುದು ಎಂಬುದನ್ನು ಈ ಫಲಿತಾಂಶಗಳು ಸೂಚಿಸುತ್ತವೆ. ಸದ್ಯಕ್ಕೆ, ಈ ಫಲಿತಾಂಶಗಳು ಬಹುಮಟ್ಟಿಗೆ ಪ್ರತಿಕೂಲ ಮೌಲ್ಯಮಾಪನಗಳನ್ನು ಆಧರಿಸಿವೆ, ಅಂದರೆ ಮೇಲ್ವಿಚಾರಣೆಯಿಂದ ತಪ್ಪಿಸಿಕೊಳ್ಳುವಂತೆ ನಾವು ಮಾಡೆಲ್‌ಗೆ ಸೂಚಿಸಿದ ಸಂದರ್ಭಗಳನ್ನು ಆಧರಿಸಿವೆ. ಒಟ್ಟಾರೆಯಾಗಿ, ಭದ್ರತೆ ಮತ್ತು ಸುರಕ್ಷತಾ ನಿರ್ಬಂಧಗಳನ್ನು ಉಲ್ಲಂಘಿಸುವ ಸಾಧ್ಯತೆ GPT‑5.6 Sol ಗಿಂತ Astra ಗೆ ಕಡಿಮೆ ಎಂದು ನಮ್ಮ ಹೊಂದಾಣಿಕೆ ಮೌಲ್ಯಮಾಪನಗಳು ತೋರಿಸುತ್ತವೆ.
    • ಆದರೂ, ಈ ಪ್ರವೃತ್ತಿಯನ್ನು ನಾವು ಗಂಭೀರವಾಗಿ ಪರಿಗಣಿಸುತ್ತೇವೆ. ನಮ್ಮ ಮಾಡೆಲ್‌ಗಳು ಹೆಚ್ಚು ಸಮರ್ಥವಾಗುತ್ತಿದ್ದಂತೆ, ಈ ಫಲಿತಾಂಶಗಳು ಮತ್ತು ಮೇಲ್ವಿಚಾರಣಾಸಾಧ್ಯತೆಯ ಮೇಲಿನ ಅವುಗಳ ಪರಿಣಾಮಗಳನ್ನು ತನಿಖೆ ಮಾಡುವುದನ್ನು ಮುಂದುವರಿಸುತ್ತೇವೆ. ಆಲೋಚನಾ ಸರಣಿಯ ಮೇಲ್ವಿಚಾರಣೆಯನ್ನು ಉಳಿಸಿ ಬಳಸಿಕೊಳ್ಳಲು OpenAI ಕೆಲಸ ಮಾಡಿದೆ. CoT ಮೇಲ್ವಿಚಾರಣಾಸಾಧ್ಯತೆಯನ್ನು ಉಳಿಸುವುದು ಸಂಶೋಧನಾ ಕಾರ್ಯಕ್ರಮದ ಪ್ರಮುಖ ಗುರಿಯಾಗಿದೆ. ಆದರೆ, ಮಾಡೆಲ್‌ನ ಆಲೋಚನಾ ಸರಣಿಯನ್ನು ಪರಿಶೀಲಿಸುವುದನ್ನು ಮೀರಿದ ಹೊಂದಾಣಿಕೆ ಲೆಕ್ಕಪರಿಶೋಧನಾ ತಂತ್ರಗಳನ್ನು ಅಭಿವೃದ್ಧಿಪಡಿಸುವ ಪ್ರಾಮುಖ್ಯತೆಯನ್ನೂ ಈ ಫಲಿತಾಂಶಗಳು ಒತ್ತಿಹೇಳುತ್ತವೆ.
  6. GPT‑6 Astra ಅಂತರ್ಜಾಲ ವೀಕ್ಷಣೆ ಮತ್ತು ಕಾರ್ಯಸ್ಥಳದ ಸನ್ನಿವೇಶಗಳನ್ನು ಹೆಚ್ಚು ಜವಾಬ್ದಾರಿಯುತವಾಗಿ ನಿರ್ವಹಿಸುತ್ತದೆ: GPT‑5.6 Solಗಿಂತ GPT‑6 Astra ಪ್ರಾಂಪ್ಟ್ ಒಳಸೇರಿಸುವಿಕೆಗಳಿಗೆ ಗಣನೀಯವಾಗಿ ಹೆಚ್ಚು ಪ್ರತಿರೋಧ ಹೊಂದಿದೆ. ವಾಸ್ತವಿಕ ಅಂತರ್ಜಾಲ ವೀಕ್ಷಣೆ ಮತ್ತು ವೃತ್ತಿಪರ ಕಂಪ್ಯೂಟರ್ ಪರಿಸರಗಳಲ್ಲಿ ಮಾಡೆಲ್‌ನ ವರ್ತನೆಯನ್ನೂ ಪರೀಕ್ಷಿಸಿದ್ದೇವೆ. GPT‑5.6 ಸೋಲ್‌ಗೆ ಹೋಲಿಸಿದರೆ, ಹೊಂದಾಣಿಕೆಯಿಲ್ಲದ ಮತ್ತು ಸಂಭಾವ್ಯ ವಿನಾಶಕಾರಿ ಕ್ರಮಗಳನ್ನು ಕೈಗೊಳ್ಳುವ ಸಾಧ್ಯತೆ ಈ ಮಾಡೆಲ್‌ಗೆ ಗಣನೀಯವಾಗಿ ಕಡಿಮೆ ಎಂದು ಕಂಡುಕೊಂಡಿದ್ದೇವೆ. ಉದಾಹರಣೆಗೆ, ಅನಧಿಕೃತ ವಹಿವಾಟುಗಳು, ದತ್ತಾಂಶ ನಷ್ಟ, ಅಗತ್ಯಕ್ಕಿಂತ ಹೆಚ್ಚಿನ ಪ್ರವೇಶ ಅಥವಾ ನಿಯಂತ್ರಣಗಳನ್ನು ತಪ್ಪಿಸುವುದು. ಹಿಂಸಾತ್ಮಕ ದಾಳಿಯ ಯೋಜನೆಗೆ ನೆರವು ನೀಡುವ ಅಥವಾ ವಂಚನೆ ಮಾಡುವ ವಿನಂತಿಗಳಂತಹ ಹಾನಿಕಾರಕ ಕೋರಿಕೆಗಳನ್ನು ಸ್ವಾಯತ್ತ ಕಾರ್ಯಾಚರಣೆಯ ಸನ್ನಿವೇಶಗಳಲ್ಲಿ ನಿರ್ವಹಿಸುವಾಗಲೂ ಇದು ಹೆಚ್ಚು ಸುರಕ್ಷಿತವಾಗಿ ವರ್ತಿಸುತ್ತದೆ.
  7. ಹೆಚ್ಚಿನ ಅಪಾಯದ ಸನ್ನಿವೇಶಗಳಲ್ಲಿ GPT‑6 Astra ಗಣನೀಯವಾಗಿ ಹೆಚ್ಚು ಸುರಕ್ಷಿತವಾಗಿದೆ. ಕಾರ್ಯಾಚರಣಾ ಬಳಕೆ ಮತ್ತು ಮಾನವರ ಪ್ರತಿಕೂಲ ರೆಡ್ ಟೀಮಿಂಗ್‌ನಿಂದ ಪಡೆದ ಸವಾಲಿನ ವಿನಂತಿಗಳಿಗೆ GPT‑6 Astra, GPT‑5.6 Sol ಗಿಂತ ಹೆಚ್ಚು ಸುರಕ್ಷಿತವಾಗಿ ಪ್ರತಿಕ್ರಿಯಿಸುತ್ತದೆ. ಅಸುರಕ್ಷಿತ ವಿನಂತಿಗಳನ್ನು ಸುರಕ್ಷಿತವಾಗಿ ಪೂರ್ಣಗೊಳಿಸುವುದರಲ್ಲೂ, ನಿರುಪದ್ರವಿ ವಿನಂತಿಗಳನ್ನು ಅನಗತ್ಯವಾಗಿ ನಿರಾಕರಿಸದಿರುವುದರಲ್ಲೂ Astra ಪ್ಯಾರೆಟೊ ಸುಧಾರಣೆ ಸಾಧಿಸಿದೆ. ಸ್ಪಷ್ಟ ವಿನಂತಿಗಿಂತ ವಿಶಾಲ ಸನ್ನಿವೇಶದಿಂದ ಹಾನಿಯ ಅಪಾಯ ಉದ್ಭವಿಸುವ ತೀವ್ರ ಸನ್ನಿವೇಶಗಳಿಗೂ ಈ ಸುಧಾರಣೆಗಳು ಅನ್ವಯಿಸುತ್ತವೆ. 18 ವರ್ಷಕ್ಕಿಂತ ಕಡಿಮೆ ವಯಸ್ಸಿನ ಬಳಕೆದಾರರಿಗೆ ವಯಸ್ಸಿಗೆ ಸೂಕ್ತವಾದ ಸುರಕ್ಷತಾ ಮಿತಿಗಳನ್ನೂ Astra ಹೆಚ್ಚು ಸ್ಥಿರವಾಗಿ ಅನ್ವಯಿಸುತ್ತದೆ.