Claude Haiku 5.5 เปิดตัวแล้ว! ราคาถูกลง 90%

chaincatcherchaincatcher

เพิ่งเปิดตัว Claude Haiku 5.5 จาก Anthropic ราคาเพียง 1 ใน 10 ของ Haiku 4.5 รุ่นก่อนหน้า และ 1 ใน 20 ของ Sonnet 5.5 เทียบเท่าราคา GPT-6 Luna ของ OpenAI

ในตารางเบนช์มาร์กอย่างเป็นทางการ Luna แพ้ทั้งหกหมวดหมู่ โดยหลายหมวดมีคะแนนใกล้เคียงกับ Sonnet

คะแนน OSWorld สำหรับการควบคุมคอมพิวเตอร์พุ่งจาก 15.7% ในรุ่นก่อนหน้าเป็น 72.4% ห่างจาก Sonnet 5.5 เพียง 11.5 จุดเปอร์เซ็นต์

Terminal-Bench 4.0 สำหรับการเขียนโปรแกรมเทอร์มินัลได้ 39.2% เพิ่มขึ้นจากศูนย์ในรุ่นก่อนหน้า

GDPval-AA สำหรับงานความรู้ได้ 1620 คะแนน มากกว่าสองเท่าของรุ่นก่อนหน้า

ข้อสอบ "Final Exam for Humanity" HLE แบบไม่ใช้เครื่องมือ เพิ่มจาก 10.2% เป็น 45.9%

ประหยัดได้แค่ไหน

ราคาอยู่ที่ 0.10 ดอลลาร์ต่อล้านโทเคนสำหรับอินพุต และ 0.50 ดอลลาร์สำหรับเอาต์พุต ซึ่งเป็นราคาสำหรับพรอมต์ต่ำกว่า 100,000 โทเคน หากเกิน 100,000 โทเคน คิดเป็น 0.50 ดอลลาร์สำหรับอินพุต และ 2.50 ดอลลาร์สำหรับเอาต์พุต

การอ่านแคชคิด 0.01 ดอลลาร์ต่อล้านโทเคน และการประมวลผลแบบแบตช์มีส่วนลดเพิ่มอีก 50%

ตามการคำนวณอย่างเป็นทางการ งานเดียวกันโดยเฉลี่ยถูกกว่า Haiku 4.5 ประมาณ 75% ทำให้เรียกใช้ได้มากขึ้นประมาณสี่เท่าด้วยงบประมาณเท่าเดิม

การประหยัดไม่ถึง 90% เพราะคำขอที่เกิน 100,000 โทเคนมีราคาเพียงครึ่งเดียว แต่โชคดีที่ประมาณ 90% ของคำขอใน Haiku รุ่นก่อนหน้าอยู่ต่ำกว่า 100,000 โทเคน นอกจากนี้ tokenizer ใหม่จะเพิ่มจำนวนโทเคนสำหรับข้อความเดียวกันประมาณ 30%

เมื่อเทียบกับ GPT-6 Luna ราคาอินพุต เอาต์พุต และแคชสำหรับต่ำกว่า 100,000 โทเคนเท่ากันทุกประการ

เมื่อจัดการกับบริบทที่ยาว Luna ถูกกว่า โดยขึ้นราคาเฉพาะเมื่อเกินประมาณ 270,000 โทเคน และคิด 0.20 ดอลลาร์สำหรับอินพุต และ 0.75 ดอลลาร์สำหรับเอาต์พุต

การอ่านแคชของ Sonnet 5.5 ก็ลดลงครึ่งหนึ่งตั้งแต่วันนี้ จาก 0.20 ดอลลาร์ต่อล้านโทเคนเป็น 0.10 ดอลลาร์ โดยการคำนวณอย่างเป็นทางการระบุว่างานเอเจนต์ส่วนใหญ่จะถูกลงประมาณ 20%

แพ็กเกจแม็กซ์และทีมจะเริ่มให้เครดิตเอพีไอรายเดือนตั้งแต่สัปดาห์นี้ โดยแม็กซ์ 5x ให้ 100 ดอลลาร์ แม็กซ์ 20x ให้ 200 ดอลลาร์ และทีมสูงสุด 500 ดอลลาร์ ใช้ร่วมกันทั้งทีม ใช้ได้กับทุกรุ่นบน Claude Platform

คะแนนสูงกว่า Luna แต่ยังตามหลัง Sonnet ในการเขียนโปรแกรมซับซ้อน

Haiku รุ่นนี้มีความก้าวหน้าอย่างมากเมื่อเทียบกับรุ่นก่อนหน้า

คะแนน OSWorld สำหรับการควบคุมคอมพิวเตอร์พุ่งจาก 15.7% ในรุ่นก่อนหน้าเป็น 72.4% ห่างจาก Sonnet 5.5 เพียง 11.5 จุดเปอร์เซ็นต์

Terminal-Bench 4.0 สำหรับการเขียนโปรแกรมเทอร์มินัลได้ 39.2% เพิ่มขึ้นจากศูนย์ในรุ่นก่อนหน้า

GDPval-AA สำหรับงานความรู้ได้ 1620 คะแนน มากกว่าสองเท่าของรุ่นก่อนหน้า

ข้อสอบ "Final Exam for Humanity" HLE แบบไม่ใช้เครื่องมือ เพิ่มจาก 10.2% เป็น 45.9%

การควบคุมคอมพิวเตอร์เป็นด้านที่พัฒนามากที่สุดในครั้งนี้ โดย Luna ในราคาเดียวกันได้เพียง 48.9% ขณะที่ Haiku 5.5 ทำได้ดีกว่า 23.5 จุดเปอร์เซ็นต์

เมื่อพิจารณาต้นทุน ความแตกต่างยิ่งชัดเจนขึ้น โดยทำคะแนนเกิน Luna สูงสุดเมื่อตั้งเป็นโหมด Medium แต่มีค่าใช้จ่ายน้อยกว่า

ในงานความรู้ คะแนน 1620 ของ Haiku 5.5 สูงกว่า 1437 ของ Luna แต่ยังตามหลัง 1840 ของ Sonnet 5.5 อยู่เล็กน้อย แม้แต่การตั้งค่า Medium เริ่มต้นก็ได้ 1277

ในการให้คะแนนโครงการระยะยาวบน AA-Briefcase เพิ่มจาก 614 คะแนนในรุ่นก่อนหน้าเป็น 1578 คะแนน ขณะที่ Luna ได้ 1336

ในการให้เหตุผลและการอ่านภาพ เมื่อ HLE ใช้เครื่องมือค้นหาและโค้ด Haiku 5.5 ได้ 57.4% ขณะที่ Sonnet 5.5 ได้ 64.5% ในการอ่านแผนภูมิมืออาชีพ Chartography เพิ่มจาก 6.4% ในรุ่นก่อนหน้าเป็น 46.4% ขณะที่ Luna ได้ 29.1% และ Sonnet 5.5 ได้ 61.6%

ช่องว่างที่ใหญ่ที่สุดกับ Sonnet คือการเขียนโปรแกรม บน Terminal-Bench 4.0 คะแนน 39.2% มากกว่าสองเท่าของ Luna (16.4%) แต่ Sonnet 5.5 ได้ 70.6%

บน FrontierCode ได้ 46.4% เอาชนะ Luna ที่ 42.4% แต่ยังตามหลังคะแนนสูงสุดของ Sonnet 5.5 ที่ 52.1% เกือบ 6 คะแนน

ทางการยังระบุว่าการเขียนโปรแกรมเอเจนต์ที่ซับซ้อนยังควรใช้ Sonnet 5.5 และ Opus 5.5

เหมาะกับงานอะไร

ตำแหน่งทางการของ Haiku 5.5 คือสำหรับงานขนาดใหญ่ รวดเร็ว และคุ้มค่า เช่น การเขียนสรุป การบีบอัดบริบท การสืบค้นฐานข้อมูล และการจัดหมวดหมู่

นอกจากนี้ยังเป็นโมเดล Claude ที่เร็วที่สุดในปัจจุบัน ช้ากว่า Opus เพียงเล็กน้อยเมื่อตั้งเป็นโหมดเร็ว (ซึ่งแพงมาก!) เหมาะสำหรับบริการลูกค้าแบบเรียลไทม์และการทำงานบนเบราว์เซอร์

ทางการยังให้ข้อเสนอแนะจากบริษัทแอปพลิเคชัน AI ชั้นนำหลายแห่งระหว่างการทดสอบภายใน

อาซานะพบว่าความล่าช้าในการทำงานเสร็จลดลงกว่า 30% เมื่อเทียบกับโมเดลปัจจุบัน ขณะที่บ็อกซ์วัดความล่าช้าได้ประมาณครึ่งหนึ่งของ Haiku 4.5

การใช้งานหลักอีกอย่างคือเป็นซับเอเจนต์สำหรับ Opus หรือ Sonnet โดยโมเดลใหญ่แยกงานและตัดสินใจ ส่วน Haiku เป็นผู้ดำเนินการ

เดวินฟิวชันของค็อกนิชันใช้ Opus 5.5 เป็นโมเดลหลักและ Haiku 5.5 เป็นผู้ช่วย รักษาคะแนนระดับสูงสุดที่ 66.2 พร้อมลดต้นทุนและความล่าช้า

บริษัท AI ด้านการเงินโรโกใช้โมเดลใหญ่สร้างพีพีที โดย Haiku 5.5 เจาะลึกรายงานเท็นเคเพื่อดึงข้อมูลรายได้ตามกลุ่มธุรกิจ

บัญชีนักพัฒนา Claude ให้เดโม โดยภารกิจคือออกแบบที่วางไข่โดยใช้ของใช้ในบ้านหลายอย่าง เป้าหมายคือปล่อยจากความสูง 32 เมตรโดยไม่แตก

Opus 5.5 ทำเสร็จใน 3 นาที 37 วินาที ลอง 25 วิธี ค่าใช้จ่าย 0.47 ดอลลาร์ ขณะที่ใช้ซับเอเจนต์ Haiku 5.5 จำนวน 10 ตัว ใช้เวลาเพียง 58 วินาที ลอง 86 วิธี ค่าใช้จ่าย 0.14 ดอลลาร์

คู่มือการใช้งาน Haiku 5.5

Haiku 5.5 พร้อมใช้งานแล้วบนไคลเอนต์ Claude, Claude Code และแพลตฟอร์มอย่าง AWS, Google Cloud, Microsoft Azure, Cursor, OpenRouter เป็นต้น รหัสโมเดลคือ claude-haiku-5-5 มีบริบท 1 ล้านโทเคน และเอาต์พุตสูงสุด 128,000 โทเคนต่อคำขอ

เป็น Haiku รุ่นแรกที่ปรับระดับการคิดได้ มีห้าระดับตั้งแต่ Low ถึง Max และเอพีไอตั้งค่าเริ่มต้นเป็น Medium

เอสดีเคของ Python และ TypeScript ยังเพิ่มการควบคุมคอมพิวเตอร์และการทำงานบนเบราว์เซอร์ ซึ่งขณะนี้อยู่ในช่วงเบต้า

เมื่อย้ายจาก Haiku 4.5 โทเคนของข้อความเดียวกันจะเพิ่มขึ้นประมาณ 30% และต้องคำนวณ max_tokens และประมาณการค่าใช้จ่ายใหม่

budgettokens ถูกแทนที่ด้วยการคิดแบบปรับตัวและระดับ Effort ส่วน temperature, topp และ top_k ต้องลบออก และการตอบกลับแบบ pre-filled ใช้ไม่ได้อีกต่อไป ข้อกำหนดรูปแบบเปลี่ยนเป็นสตรักเจอร์เอาต์พุต

การควบคุมคอมพิวเตอร์ต้องเปลี่ยนไปใช้ชุดเครื่องมือใหม่ computertoolset20260801 และยังไม่รองรับไพรออริตีเทียร์

หากเห็นว่ายุ่งยาก สามารถรันคำสั่งใน Claude Code:

ให้มันแก้ไขตัวเอง

แน่นอน สำหรับผู้ที่ไม่ใช่นักพัฒนา ตอนนี้สามารถสนทนากับ Haiku 5.5 ได้โดยตรงในไคลเอนต์!

สำหรับคำถามง่าย ๆ ไม่จำเป็นต้องรบกวนเฟเบิล, Opus หรือ Sonnet Haiku 5.5 ให้คำตอบที่แม่นยำได้แม้ใช้ความเข้มข้นในการอนุมานต่ำ แทนที่เครื่องมือค้นหาได้อย่างสมบูรณ์แบบ

ไปลองใช้กันเลย!

อ้างอิง:

https://www.anthropic.com/claude-haiku-5-5

เนื้อหานี้จัดทำขึ้นโดยมีวัตถุประสงค์เพื่อแจ้งข้อมูลและให้ความรู้เท่านั้น และไม่ถือว่าเป็นคำแนะนำด้านการลงทุนที่เกี่ยวข้องกับ BTCC แต่อย่างใด BTCC ใช้ความพยายามอย่างเต็มที่ แต่ไม่สามารถรับประกันความจริงแท้ ความถูกต้อง หรือความเป็นต้นฉบับของเนื้อหาข้างต้นได้

แนะนำ

Anthropic เดินหน้าสู่การเข้าตลาดหลักทรัพย์: รายงานเร่งทำ IPO มูลค่า 2 ล้านล้านดอลลาร์ก่อนวันขอบคุณพระเจ้า จัดงานวันนักลงทุน 14 ตุลาคมนักลงทุน YZi Labs: สามโอกาสธุรกิจจากการแปลงหุ้นเป็นโทเคนฤดูอัลต์คอยน์ยังไม่เริ่มอย่างเป็นทางการ รอบนี้อาจขับเคลื่อนด้วยมูลค่าการใช้งานจริงซื้อเหรียญมีม แถม "หุ้นสหรัฐฯ"? "Niu Lai" เปลี่ยนโทเคนหุ้นให้กลายเป็นแอร์ดรอปแห่ชอร์ตพันธบัตรสหรัฐฯ แค่ข้อมูลแย่ตัวเดียวก็จุดชนวนชอร์ตสควีซได้