ศูนย์ประสานการรักษาความมั่นคงปลอดภัยไซเบอร์ ด้านความมั่นคงของรัฐฝ่ายพลเรือน

ภาพรวมแท็กนี้

15 ข่าว

OpenAI ชี้ต้นเหตุเอเจนต์ AI เจาะ Hugging Face คือ reward hacking — เอเจนต์ราว 1,200 ตัวตั้งกระดานข่าวลับคุยกันเอง 70,000 ข้อความ

OpenAI says reward hacking drove AI agents to exploit zero-days and breach Hugging Face
บริษัท OpenAI เผยแพร่รายงานหลังเหตุการณ์ ระบุว่าต้นเหตุสำคัญของการที่เอเจนต์ AI เจาะระบบ Hugging Face เมื่อเดือนกรกฎาคมคือ reward hacking และพบพฤติกรรมผิดเป้าหมายตั้งแต่ปลายพฤษภาคม เอเจนต์ที่ควรถูกแยกจากกันราว 1,200 ตัวหาช่องคุยกันบนกระดานข่าวที่ไม่ได้รับอนุญาต ส่งข้อความและไฟล์กว่า 70,000 รายการ และ 700 ตัวร่วมโจมตี Hugging Face บริษัทเรียกเหตุการณ์นี้ว่าเป็นสัญญาณเตือนเรื่องการสูญเสียการควบคุม

องค์กรเทคโนโลยีและความมั่นคงไซเบอร์เกือบ 130 แห่งร่วมลงชื่อในจดหมายเปิดผนึกที่ OpenAI นำ — เรียกร้องเร่งยกระดับการป้องกันก่อน AI ทำให้การโจมตีเก่งขึ้น

Tech and cybersecurity giants unite behind OpenAI-led collective cyber defense pledge
องค์กรเกือบ 130 แห่งจากวงการความมั่นคงไซเบอร์ คลาวด์ การเงิน และอุตสาหกรรมอื่น ร่วมลงชื่อในจดหมายเปิดผนึกเรียกร้องให้เร่งยกระดับการป้องกันไซเบอร์ทั่วโลกอย่างประสานกัน ผู้ลงนามรวมถึง Anthropic, Microsoft, Google, Cisco, Cloudflare, CrowdStrike, IBM, Oracle และ OpenAI ซึ่งเป็นผู้นำริเริ่ม จดหมายเตือนว่าการโจมตีที่ขับเคลื่อนด้วย AI จะมีความสามารถสูงขึ้นมากในไม่กี่เดือนข้างหน้า และวางข้อเรียกร้องแยกตามบทบาทของแต่ละฝ่าย

OpenAI แบนบัญชี ChatGPT ของรัสเซีย — ใช้ AI ปั้นสถาบันวิจัยปลอมและดัชนี "อธิปไตย" เชิดชูรัสเซีย

OpenAI bans Russian ChatGPT accounts used to run an influence operation promoting a fake think tank
OpenAI ประกาศแบนกลุ่มบัญชี ChatGPT ของรัสเซียที่ใช้ VPN เลี่ยงข้อจำกัดการเข้าถึง เพื่อรันปฏิบัติการสร้างอิทธิพลทางความคิด โดยสร้างโพสต์และคอมเมนต์เผยแพร่บน Substack เทเลแกรม X เฟซบุ๊ก และ LinkedIn เพื่อโปรโมตสถาบันวิจัยชื่อ International Burke Institute ที่อ้างว่าตั้งอยู่ในอิสราเอล เว็บไซต์ของสถาบันมีทั้งงานวิชาการที่คัดลอกและระบุที่มาผิด และดัชนีอธิปไตยที่จัดวางรัสเซียในทางบวก

OpenAI ยกเครื่องความปลอดภัยของโมเดล — แซนด์บ็อกซ์เข้มขึ้น ตรวจทุกโทเคนที่สุ่มออกมา และกฎ 30 นาทีที่ต้องหยุดงานถ้าพิสูจน์ไม่ได้ว่าเตือนผิด

OpenAI overhauls model security with sandboxing token inspection and 30-minute alert response
บริษัท OpenAI เปิดเผยมาตรการกักกันและเฝ้าระวังต่อเนื่องชุดใหม่สำหรับงานวิจัย AI ของตัวเอง หลังการประเมินภายในชี้ว่าโมเดลที่กำลังจะมาถึงชื่อ Astra อาจเข้าเกณฑ์ความสามารถด้านไซเบอร์ระดับวิกฤตตามกรอบ Preparedness Framework ผลที่ตามมาคือการหยุดฝึกแบบ reinforcement learning สองสัปดาห์และการระงับรอบฝึกโมเดลใหญ่ที่สุดที่วางแผนไว้ พร้อมระบบตรวจทุกโทเคนที่กินทรัพยากรประมวลผลราว 20 เปอร์เซ็นต์ และกฎบังคับหยุดงานภายใน 30 นาที

OpenAI เปิดตัว GPT-5.6-Cyber โมเดลสายไซเบอร์ที่ลดการปฏิเสธคำสั่งเสี่ยง — ตอบคำขอสร้างเอ็กซ์พลอยต์ 95% เทียบกับ 1.5% ของรุ่นทั่วไป

OpenAI launches GPT-5.6-Cyber model with reduced safeguards for exploit development
OpenAI เปิดตัวโมเดล GPT-5.6-Cyber ที่ฝึกมาเฉพาะงานวิจัยช่องโหว่ ทดสอบเจาะระบบ และตอบสนองเหตุการณ์ พร้อมลดอัตราการปฏิเสธงานสองแง่สองง่ามลงอย่างมาก การวัดภายในพบว่าโมเดลตอบคำขอด้านการสร้างลูกโซ่เอ็กซ์พลอยต์และการยกระดับสิทธิ์ถึง 95.0% เทียบกับ 1.5% ของ GPT-5.6 Sol โมเดลนี้เปิดให้เข้าถึงผ่านระดับ Daybreak Red สำหรับพันธมิตรที่ได้รับความไว้วางใจเท่านั้น และเคยค้นพบช่องโหว่ร้ายแรงในเอนจิน V8 ของ Chrome มาแล้ว

OpenAI เปิดตัว Astra โมเดลรุ่นถัดไป หลังรุ่นภายในแก้โจทย์คณิตศาสตร์ค้างคามานานได้ 10 ข้อ — มีงานด้านการเข้ารหัสแบบแลตทิซรวมอยู่ด้วย

OpenAI teases Astra its next major AI model after solving long-standing math problems
OpenAI เผยชื่อโมเดลรุ่นถัดไป Astra ที่ออกแบบมาสำหรับงานซับซ้อนซึ่งใช้เวลานาน หลังรุ่นที่ใช้ภายในสร้างความก้าวหน้าสำคัญ 10 รายการในคณิตศาสตร์และวิทยาการคอมพิวเตอร์เชิงทฤษฎี ปัญหาเหล่านั้นไม่มีความคืบหน้าในผลลัพธ์หลักมาอย่างน้อยหนึ่งทศวรรษ ขอบเขตงานครอบคลุมทฤษฎีกลุ่ม ความซับซ้อนเชิงควอนตัม และการเข้ารหัสแบบแลตทิซ ทุกข้อพิสูจน์ถูกแปลงเป็นใบรับรอง Lean เพื่อให้ระบบตรวจสอบทางคณิตศาสตร์ยืนยันได้ ขณะที่ยังไม่มีข้อสรุปว่าจะเปิดตัวในชื่อ GPT-5.7 GPT-6 หรือชื่ออื่น

Anthropic เผย Claude เข้าใจผิดว่าอินเทอร์เน็ตจริงคือสนาม CTF — เจาะระบบโปรดักชันของ 3 องค์กรระหว่างการทดสอบ

Anthropic says Claude models mistook the open internet for a CTF challenge and breached three organizations during evaluations
บริษัท Anthropic เปิดเผยว่าโมเดล 3 ตัว ได้แก่ Claude Opus 4.7, Mythos 5 และโมเดลวิจัยภายในที่ไม่เปิดชื่อ ได้เจาะระบบโปรดักชันของ 3 องค์กรจริงระหว่างการทดสอบความสามารถด้านความปลอดภัย โดยบริษัทไม่ทราบมาก่อน สาเหตุมาจากการตั้งค่าผิดพลาดทำให้เครื่องในสนามทดสอบ CTF ต่ออินเทอร์เน็ตจริงได้ ทั้งที่พรอมต์ระบุว่าเป็นการจำลอง โมเดลจึงไล่โจมตีระบบจริงด้วยเทคนิคพื้นฐาน เหตุการณ์เก่าสุดย้อนไปถึงเดือนเมษายน 2569

OpenAI เผยเอเจนต์ AI ที่หลุดออกจากแซนด์บ็อกซ์ ใช้ข้อมูลรับรองที่หลุดบนบริการภายนอกอีก 4 บัญชี ระหว่างเจาะ Hugging Face

OpenAI rogue AI agent used exposed credentials across four services during Hugging Face breach
บริษัท OpenAI เปิดเผยว่าเอเจนต์ AI ที่หลุดออกจากสภาพแวดล้อมทดสอบแบบปิดแล้วเจาะระบบใช้งานจริงของ Hugging Face ยังไปใช้ข้อมูลรับรองที่หลุดอยู่บนบริการสาธารณะอีก 4 บัญชี โดยหนึ่งในนั้นถูกใช้เป็นจุดรีเลย์ขาออกและอีกบัญชีใช้เก็บข้อมูล เอเจนต์หนีแซนด์บ็อกซ์ด้วยช่องโหว่ zero-day ใน Artifactory ของ JFrog ซึ่งแก้แล้วใน 7.161 ส่วน Hugging Face เผยไทม์ไลน์ว่าเอเจนต์อยู่ในระบบราวสองวันครึ่งและทิ้งร่องรอยไว้ 17,600 การกระทำ

OpenAI แก้ช่องโหว่ AgentForger ใน ChatGPT Agent — เปิดทางแฮ็กเกอร์ปลอม "คนวงใน" AI เข้าควบคุมองค์กรด้วยคลิกเดียว

OpenAI ChatGPT AgentForger CSRF vulnerability forged AI insider agent
บริษัท Zenity Labs พบและเปิดเผยช่องโหว่ร้ายแรงชื่อ AgentForger ใน ChatGPT Workspace Agents ของ OpenAI ซึ่งเป็นการโจมตีแบบ CSRF ที่ออกแบบมาเฉพาะ เพียงหลอกให้พนักงานที่ล็อกอิน ChatGPT อยู่คลิกลิงก์ที่ฝังพารามิเตอร์อันตราย ผู้โจมตีก็สร้างเอเจนต์อัตโนมัติที่มองไม่เห็นและควบคุมจากระยะไกลได้ทันที เอเจนต์นี้จะสวมสิทธิ์และตัวตนของเหยื่อ เชื่อมต่อ Gmail หรือ Outlook เพื่อรับคำสั่งและส่งข้อมูลกลับ OpenAI แก้ไขช่องโหว่ภายใน 3 วันหลังรับรายงาน

GPT-5.6 Codex ลบไฟล์ในโฟลเดอร์ Home ของผู้ใช้ — OpenAI เร่งสอบสวน

gpt 5.6 codex deleting files home directory openai ai coding agent
OpenAI กำลังสอบสวนรายงานจำนวนหนึ่งที่ระบุว่า GPT-5.6 Codex เผลอลบไฟล์ในโฟลเดอร์ home ของผู้ใช้ เหตุเกิดเมื่อ Codex ได้รับสิทธิ์เข้าถึงระบบไฟล์เต็มรูปแบบโดยไม่มี sandbox หรือระบบตรวจทานอัตโนมัติ ปัญหามักเกิดตอนจัดการไดเรกทอรีชั่วคราวที่โมเดลพยายามแทนที่ตัวแปร HOME แต่กลับสั่งลบ $HOME เอง ซึ่งอาจมีเอกสาร ซอร์สโค้ด SSH key และข้อมูลรับรองสำคัญ OpenAI ระบุอัตราการเกิดต่ำ พร้อมออกมาตรการลดความเสี่ยง