Artificial Intelligence▲
Olas เปิดตัวโมเดล AI ขนาดเล็กที่ทำผลงานได้เทียบเท่า GPT-4.1 ในการทดสอบการพยากรณ์
Olas เปิดตัวโมเดล AI ใหม่เมื่อวันอังคาร ซึ่งฝึกด้วยข้อมูลการพยากรณ์จากตลาดทำนายผลมากกว่า 200,000 รายการ และทำผลงานได้เทียบเท่า GPT-4.1 ของ OpenAI ในการทดสอบความสามารถในการพยากรณ์เหตุการณ์ในโลกจริง โดย Olas-Predict-R1-14B มีความแม่นยำ 75.8% จากการทดสอบกับตลาด 2,628 แห่งที่ไม่เคยเห็นมาก่อน เทียบกับ 75.4% ของ GPT-4.1 และ 71.4% ของโมเดล DeepSeek ต้นทาง ตามเอกสารการวัดผลที่แชร์ให้กับ Benzinga
Olas ซึ่งพัฒนาเอเจนต์ AI อัตโนมัติที่ค้นคว้าและซื้อขายในตลาดทำนายผล ได้ฝึกโมเดลนี้ด้วยข้อมูลการพยากรณ์ 214,529 รายการจากตลาดที่ปิดผลแล้ว 5,116 แห่ง และการปรับละเอียดช่วยปรับปรุงคะแนน Brier ของโมเดลได้ราว 20% เดวิด มินาร์ช ประธานเจ้าหน้าที่บริหารของ Valory และสมาชิกผู้ก่อตั้งของ Olas กล่าวกับ Benzinga ว่าผลลัพธ์นี้บ่งชี้ว่าโมเดล AI เฉพาะทางที่มีต้นทุนต่ำกว่ากำลังสร้างแรงกดดันทางเศรษฐกิจที่เพิ่มขึ้นต่อระบบเอนกประสงค์ขั้นสูงที่สุดของอุตสาหกรรม และกล่าวว่าโมเดลระดับแนวหน้าอาจจำเป็นต้องหา ตลาดใหม่ เพื่อรักษาอัตราการเติบโต
Olas ระบุว่าโมเดลของบริษัทสามารถทำงานบน GPU เพียงตัวเดียว และน้ำหนักของโมเดลเปิดเผยต่อสาธารณะ ทำให้นักพัฒนาสามารถรันโมเดลได้เองแทนที่จะจ่ายเงินให้ผู้ให้บริการ AI แบบปิดสำหรับการพยากรณ์แต่ละครั้ง ในการทดลองแยกต่างหากที่ Benzinga ร้องขอ Olas-Predict ให้โอกาส 70% ที่ Nvidia จะจบปี 2026 ในฐานะบริษัทที่มีมูลค่าตลาดใหญ่ที่สุดในโลก ขณะที่เทรดเดอร์ใน Polymarket ปัจจุบันให้น้ำหนัก Nvidia ที่ 78%
About megatrends
Artificial Intelligence › Closed / Frontier Labs ▼Competition
Artificial Intelligence › Open-Weight Model Developers ▲Technology
Artificial Intelligence › Agentic AI & Autonomous Workflows Technology
OLAS · Technology · Positive Olas unveiled Olas-Predict-R1-14B, a small AI model matching GPT-4.1 in forecasting accuracy and runnable on a single GPU.
Valory · Technology · Positive Valory CEO David Minarsch is a founding member of Olas, whose new forecasting model was unveiled and benchmarked.
OpenAI · Competition · Negative Olas's cheaper specialized model matched GPT-4.1 and its CEO said such models pressure advanced general-purpose systems like OpenAI's.
DeepSeek · · Neutral DeepSeek's underlying model is cited only as the 71.4% baseline that Olas fine-tuned and surpassed.