เกี่ยวข้องกับหัวข้อนี้สภาเทคโนโลยีแห่งอนาคตและ AI

OpenAI มอบโจทย์คณิตศาสตร์ที่ยังไม่มีคำตอบ 4,000 ข้อให้โมเดลใหม่

  • OpenAI เผยแพร่ 722 งานวิจัยคณิตศาสตร์เขียนโดย AI หลังโมเดลของบริษัทพัฒนาเกินกว่าสอบที่มีอยู่
  • โมเดลที่ยังไม่เปิดตัวแก้ปัญหาเปิดราว 4,000 ข้อ ใช้เวลาเฉลี่ยผลลัพธ์ละสามชั่วโมง
  • ยังไม่ได้รับการยืนยันทุกหลักฐาน และ OpenAI เตือนว่าบางส่วนอาจมีปัญหา
Promo

การทดสอบคณิตศาสตร์เป็นวิธีมาตรฐานในการทดสอบความสามารถของโมเดล AI อย่าง ChatGPT และ Claude เสมอมา OpenAI กล่าวว่า ตอนนี้โมเดลของตนทำได้ดีมากจนการทดสอบคณิตศาสตร์ที่มีอยู่ไม่ค่อยมีประโยชน์อีกต่อไป ดังนั้นนักวิจัยจึงลองโจทย์ที่ยากกว่าเดิม

พวกเขามอบปัญหาคณิตศาสตร์ที่ยังไม่มีใครแก้ได้ราว 4,000 ข้อให้กับโมเดลที่ยังไม่เปิดตัว ผลลัพธ์ที่ได้กลับน่าประหลาดใจและสร้างความกังวลในคราวเดียวกัน

AI สร้าง ต้นฉบับ 722 ฉบับ ซึ่งแบ่งเป็น 372 กลุ่มของผลลัพธ์ที่เกี่ยวข้องกัน OpenAI ระบุว่าแต่ละผลลัพธ์ใช้เวลาประมวลในการให้เหตุผลโดยเฉลี่ยประมาณสามชั่วโมง

ชุมชนทางคณิตศาสตร์กำลังจะได้พบกับวันที่ตื่นเต้นมากจริงๆ! กล่าวโดย Stefano Gogioso สมาชิกของ BeInCrypto’s Future Tech and AI Experts Council

AI กำลังก้าวหน้าเกินไปเร็วเกินไปหรือไม่?

นี่คือประเด็นสำคัญ AI ขั้นแนวหน้ากำลังเริ่มก้าวข้ามการตอบโจทย์ที่มีคำตอบอยู่แล้ว ไปสู่การสร้างคำตอบสำหรับคำถามที่ยังไม่รู้มาก่อน

ผู้สนับสนุน
ผู้สนับสนุน

นั่นอาจเพิ่มขีดความสามารถทางปัญญาของนักวิจัย วิศวกร หรือวิเคราะห์ข้อมูลได้อย่างก้าวกระโดด

แต่ผลลัพธ์ไม่ได้แปลว่าเป็นความจริง งานวิจัยหลายชิ้นของ OpenAI มีการพิสูจน์แบบ Lean ที่ตรวจสอบได้ด้วยคอมพิวเตอร์ ขณะที่บางชิ้นไม่มี OpenAI เตือนว่าบางผลลัพธ์ที่ยังไม่ได้ยืนยัน อาจมีปัญหาได้

นั่นสร้างข้อจำกัดใหม่ เพราะมนุษย์อาจต้องเผชิญกับความยากในการตรวจสอบงานวิจัยให้เร็วเท่า AI ที่ผลิตข้อมูลเหล่านี้

AI สามารถวิเคราะห์เชิงคาดการณ์และตัดสินใจลงทุนได้แล้วหรือไม่?

เป็นไปได้ แต่ด้านการเงินมีความซับซ้อนในลักษณะเฉพาะของตน

ข้อพิสูจน์ทางคณิตศาสตร์สามารถแสดงถูกผิดได้ในที่สุด แต่ตลาดนั้นมีความผันผวนและเปลี่ยนแปลงอยู่ตลอดเวลา

ข้อมูลอ้างอิงด้านการเงินล่าสุดยังแสดงให้เห็นว่า AI ขั้นแนวหน้ายังมีปัญหากับการวิเคราะห์การลงทุนที่ซับซ้อน และงานวิจัยเกี่ยวกับจังหวะตลาดก็พบว่าข้อได้เปรียบในการทำนายมีจำกัด

โอกาสระยะสั้นคือการวิเคราะห์ที่ลึกซึ้งกว่าเดิม แทนที่จะเป็นการคาดการณ์ที่แม่นยำสมบูรณ์

AI ที่สามารถให้เหตุผลได้ต่อเนื่องเป็นชั่วโมง อาจตรวจสอบรายงานต่างๆ การเรียกประชุมเรื่องผลประกอบการ ข้อมูลเศรษฐกิจมหภาคและสถานการณ์ที่แข่งขันกันได้พร้อมกัน แล้วสามารถทดลองตั้งสมมติฐานมากกว่า analyst คนเดียวทำได้มาก

นี่อาจเป็นสัญญาณใหญ่จากการทดลองของ OpenAI เพราะ AI เริ่มมีขีดความสามารถในการผลิตงานวิเคราะห์เชิงลึกอย่างมากมาย ปัญหาต่อไปจึงอยู่ที่การตัดสินใจว่างานไหนควรค่าแก่ความไว้วางใจ

ข้อจำกัดความรับผิดชอบ

BeInCrypto มุ่งมั่นในการรายงานที่เป็นกลางและโปร่งใส บทความข่าวนี้มีจุดมุ่งหมายเพื่อนำเสนอข้อมูลที่ถูกต้องและทันต่อเหตุการณ์ อย่างไรก็ตาม ขอแนะนำให้ผู้อ่านตรวจสอบข้อเท็จจริงด้วยตนเองและปรึกษาผู้เชี่ยวชาญก่อนตัดสินใจใด ๆ โดยอาศัยเนื้อหานี้ โปรดทราบว่าข้อกำหนดและเงื่อนไข นโยบายความเป็นส่วนตัว และข้อจำกัดความรับผิดชอบของเราได้รับการปรับปรุงแล้ว

ผู้สนับสนุน
ผู้สนับสนุน