เจาะลึกภายในแพลตฟอร์ม

เจาะลึก Olano Cortex: ระบบ AI ที่ใช้งานจริงพัฒนาตัวเองอย่างไร

Most AI deployments are at their best on launch day and quietly decay from there. Olano systems are built to run the other way: Olano Cortex - the improvement layer of the platform - turns each day's real work into concrete improvements: Fully Autonomous out of the box, every change logged and reversible, and rewriting an agent's own instructions waits for your approval whichever mode you choose. Here's how that engine actually works.

ทำไมการนำ AI ไปใช้ส่วนใหญ่จึงหยุดนิ่ง

ระบบ AI ถูกตั้งค่าตามภาพนิ่งของธุรกิจคุณ ณ ตอนนั้น ทั้งสินค้าวันนี้ นโยบายวันนี้ และวิธีพูดจาแบบวันนี้ ธุรกิจเดินหน้าต่อ แต่การตั้งค่าไม่ได้เดินตาม คำตอบจึงเริ่มล้าสมัย ประโยคเดิม ๆ ที่อ่านแล้วขัดหูก็วนซ้ำไม่รู้จบ และงานที่ระบบน่าจะรับไปทำได้ ก็ยังต้องทำมืออยู่ต่อไป เพราะไม่มีใครกันเวลาไว้นั่งลงปรับมันเลย

ในเครื่องมือส่วนใหญ่ «การพัฒนา» จึงหมายถึงการที่คนต้องสังเกตเห็นปัญหา จำมันไว้ แล้วหาเวลาสักบ่ายหนึ่งมาแก้พรอมป์ต บ่ายวันนั้นแทบไม่เคยมาถึง ผลลัพธ์คือกราฟที่คุ้นเคย น่าประทับใจในสัปดาห์แรก พอทนได้ในเดือนที่สาม และถูกทิ้งอย่างเงียบ ๆ ในเดือนที่หก

นี่แหละคือความล้มเหลวจำเพาะที่ Olano Cortex มีอยู่เพื่อป้องกัน

Cortex คืออะไร

ทุกงานของ Olano ทำงานอยู่บนแพลตฟอร์มเดียวกัน คือ Olano Core ซึ่งเป็นรันไทม์แบบหลายเอเจนต์ที่ประสานทั้งเอเจนต์ เครื่องมือ ความจำ ช่องทาง และด่านความปลอดภัย และ Olano Cortex ซึ่งเป็นเครื่องยนต์การรู้คิดที่วางซ้อนอยู่บนนั้น หน้าที่ของ Cortex แคบและไม่ธรรมดา ตามตารางที่คุณกำหนด มันจะศึกษางานที่เอเจนต์ของคุณทำจริง แล้วเปลี่ยนสิ่งที่พบให้เป็นการเปลี่ยนแปลงที่คุณกำกับได้

The critical design decision is in that last clause. Cortex is not a system rewriting itself in the dark. It is an improvement pipeline you govern, and you choose how much of it runs unattended. Out of the box it is อัตโนมัติเต็มรูปแบบ: new skills, distilled memory, sharper procedures and tidy-ups apply on their own, each one snapshotted, logged and reversible. Rewriting an agent's own instructions waits for a human in either mode, and so does anything sent outside your deployment or anything that cannot be undone. Prefer to sign off first? Switch Fully Autonomous off and every change queues for approval - the same approval-first architecture that governs การตอบกลับลูกค้าที่ส่งออกภายนอก เพียงแต่นำมาใช้กับวิวัฒนาการของตัวระบบเอง

ห้าวงจร

Cortex ทำงานเป็นวงจรที่วนซ้ำ โดยแต่ละวงจรมีหน้าที่ของตัวเอง:

  • การทบทวน Cortex จะย้อนอ่านบทสนทนาล่าสุด แล้วกลั่นสิ่งที่สำคัญลงในความจำระยะยาว ทั้งการตัดสินใจที่เกิดขึ้น ความชอบที่แสดงออกมา และข้อเท็จจริงที่ควรเก็บไว้ นี่คือเหตุผลว่าทำไม เอเจนต์ Olano จึงจดจำธุรกิจของคุณได้ ไม่ใช่แค่เก็บบันทึกบทสนทนาไว้เฉย ๆ
  • การเรียนรู้ เมื่องานเดิมวนกลับมาเรื่อย ๆ เช่น รายงานเดิมที่ประกอบด้วยวิธีเดิม หรือคำถามเดิมที่จัดการด้วยขั้นตอนเดิม Cortex จะร่างมันขึ้นเป็นสกิลที่นำกลับมาใช้ซ้ำได้ คือขั้นตอนที่เขียนไว้เป็นลายลักษณ์อักษร แล้วเอเจนต์ก็ทำซ้ำแบบเดิมทุกครั้ง
  • การสร้างสรรค์ Cortex ระดมความคิดและทำต้นแบบไอเดียที่ทีมยังไม่ได้ร้องขอ เช่น เวิร์กโฟลว์ที่ควรทำอัตโนมัติ หรือมุมมองที่น่าลองสำรวจ ต้นแบบเหล่านี้เป็นข้อเสนอ ไม่ใช่การนำไปใช้จริง
  • การปรับปรุง Cortex เสนอคำสั่งที่คมขึ้นให้ตัวเอเจนต์เอง เช่น ขัดเกลาถ้อยคำที่เคยทำให้เข้าใจผิด หรือเติมข้อควรระวังที่บทสนทนากับลูกค้าชี้ให้เห็นว่ายังขาดอยู่
  • การจัดระเบียบ ความจำที่มีแต่โตขึ้นเรื่อย ๆ สุดท้ายก็กลายเป็นสัญญาณรบกวน Cortex ดูแลมันเหมือนดูแลสวน คือตัดสิ่งที่ล้าสมัยทิ้ง รวบรายการซ้ำเข้าด้วยกัน และรักษาความรู้ที่เอเจนต์พึ่งพาให้สดใหม่อยู่เสมอ

จังหวะที่คุณควบคุมเอง

Cortex จะทำสิ่งเหล่านี้แข็งขันแค่ไหน เป็นค่าที่ตั้งได้ ไม่ใช่พฤติกรรมตายตัว ค่าจังหวะสำเร็จรูปมี ผ่อนคลาย, สมดุล และ เข้มข้น ซึ่งกำหนดว่าจะทบทวน เรียนรู้ และเสนอมากน้อยแค่ไหน อีกทั้งการรันแบบให้เหตุผลเชิงลึกยังมีเพดานงบประมาณรายวัน ซ้อนอยู่บนการควบคุมค่าใช้จ่ายแบบเข้มที่ครอบทั้งระบบอีกชั้น วงจรพัฒนาที่ทะเยอทะยานจึงไม่มีทางกลายเป็นบิลที่คุมไม่อยู่

พัฒนาตัวเองโดยไม่ทำลายตัวเอง

ระบบที่แก้ไขตัวเองจะยอมรับได้ก็ต่อเมื่อมันทำร้ายคุณไม่ได้ระหว่างที่ทำแบบนั้น มาตรการป้องกันของ Cortex เป็นเรื่องเชิงโครงสร้าง ไม่ใช่คำสัญญา

  • Rewriting an agent's instructions waits for a human, in either mode. Cortex proposes; a human disposes. Nothing rewrites who an agent is or how it is told to behave until someone on your side signs off - even with Fully Autonomous on. The same hold covers anything sent outside your deployment and anything that cannot be undone. Skills, memory and lossless tidying - a new procedure, a deduplicated memory, two identical skills merged - apply directly under Fully Autonomous, because a click on every one of those would train your team to approve without reading, which is the worst thing that can happen to the queue that does matter. Switch it off and those queue too.
  • What Cortex applies itself is snapshotted, with one-click undo. A scheduled pass that tidies memory, consolidates the workspace or merges skills runs behind a snapshot, and if it turns out to be wrong in practice, rolling it back is a single action - not an archaeology project. A proposal that was approved lands in a plain-text file you can read and edit, with a revision history showing what it said before.
  • ทุกการกระทำถูกบันทึกไว้ในล็อกตรวจสอบ คุณตอบได้เสมอว่า «อะไรเปลี่ยนไป เมื่อไร และใครอนุมัติ» ด้วยร่องรอยตรวจสอบที่แก้ไขไม่ได้ชุดเดียวกับที่ครอบคลุมทุกอย่างที่เอเจนต์ของคุณทำ
  • สิ่งที่ปรับปรุงอ่านเข้าใจได้ด้วยคน Cortex ไม่ได้ไปเทรนค่าน้ำหนักของโมเดลใหม่ แต่ทำงานอยู่สูงขึ้นมาอีกชั้น คือกับความจำ สกิล และคำสั่งที่เขียนไว้เป็นภาษาคนธรรมดา นั่นแหละที่ทำให้ทั้งวงจรตรวจสอบได้ เพราะทีมของคุณอ่านสิ่งที่ถูกขอให้อนุมัติได้จริง ๆ

หนึ่งสัปดาห์กับ Cortex หน้าตาเป็นอย่างไร

เอเจนต์ทำงานจริงของแต่ละวันบนช่องทางของคุณCortex ทบทวนงานเหล่านั้นตามจังหวะที่คุณตั้งไว้คำสั่งที่คมขึ้นจะเข้าคิวเป็นข้อเสนอให้ทีมของคุณทีมของคุณตรวจแล้วอนุมัติ หรือปฏิเสธNew skills, memory and tidying apply directly, each change snapshottedอะไรที่พลาด ก็ย้อนกลับได้ในคลิกเดียว

ในทางปฏิบัติ การทบต้นนี้เงียบแต่ไม่เคยหยุด คำถามที่หน้าร้านของคุณตอบพลาดเมื่อวันอังคาร พอวันพุธก็กลายเป็นข้อเสนอแก้คำสั่ง รายงานที่เอเจนต์ฝ่ายปฏิบัติการของคุณประกอบด้วยมือสามสัปดาห์ติดกลับมาเป็นทักษะที่ร่างไว้แล้ว รายละเอียดราคาที่ลูกค้าทักท้วงไปอยู่ในความจำระยะยาวก่อนที่ลูกค้ารายถัดไปจะถาม ไม่มีข้อไหนเลยที่ต้องให้ทีมของคุณจำ จัดตาราง หรือลงมือเขียน มีแค่ดูว่า Cortex เสนออะไร และชำเลืองดูว่ามันเก็บกวาดอะไรไปบ้าง

นั่นแหละคือความต่างในทางปฏิบัติ ระหว่างการซื้อเครื่องมือ AI กับการวางระบบที่มีคนดูแลและพัฒนาต่อ อย่างแรกดีได้เท่ากับวันที่ตั้งค่าเสร็จ ส่วนอย่างหลังถูกวัดกับเดือนก่อน และถูกคาดหวังให้ดีกว่าเดิม นี่ยังเป็นส่วนใหญ่ของสิ่งที่งาน Olano แบบดูแลเต็มรูปแบบเข้าไปจัดการด้วย เราคอยดูข้อเสนอ ตัวชี้วัด จังหวะการทำงาน และ ผลงานในแต่ละวัน ที่สิ่งเหล่านั้นควรจะทำให้ดีขึ้น

อ่านเพิ่มเติม

ตอนอื่น ๆ ของซีรีส์ «เจาะลึกแพลตฟอร์ม» และที่มาของสถาปัตยกรรมการอนุมัตินี้

คำถามที่พบบ่อย

Cortex เปลี่ยนระบบของฉันได้โดยไม่ต้องขออนุมัติจากฉันไหม

It depends on what is being changed, and the split is deliberate. Out of the box Cortex runs Fully Autonomous: new skills, distilled memory, sharper procedures and lossless tidying apply on their own, each one logged and reversible. Three things wait for a human whatever that switch says: rewriting an agent's own instructions - who it is and how it is told to behave - sending anything outside your deployment, and anything that cannot be undone. Those queue as proposals with Approve and Reject buttons; a deployment owner can lift that hold for a specific agent, and it is never lifted by default. Prefer to sign off on everything? Switch Fully Autonomous off, for one agent or the whole deployment, and every change queues instead. Every action Cortex takes is audit-logged either way.

Cortex ทำงานบ่อยแค่ไหน

ตามตารางเวลาที่คุณควบคุมเอง ค่าจังหวะสำเร็จรูปอย่างผ่อนคลาย สมดุล และเข้มข้น จะกำหนดว่า Cortex ทบทวน เรียนรู้ และเสนอการปรับปรุงอย่างแข็งขันแค่ไหน อีกทั้งการรันแบบให้เหตุผลเชิงลึกยังมีเพดานงบประมาณรายวัน จังหวะที่ทะเยอทะยานกว่าจึงไม่มีทางกลายเป็นบิลที่คุมไม่อยู่

Cortex เอาข้อมูลของฉันไปเทรนโมเดล AI ใหม่หรือเปล่า

ไม่ Cortex ไม่ได้เทรนค่าน้ำหนักของโมเดลใหม่ แต่ปรับปรุงระบบที่ชั้นสูงขึ้นมาอีกขั้น คือในความจำ สกิลที่ใช้ซ้ำได้ และคำสั่งของตัวเอเจนต์เอง ทั้งหมดนี้เป็นสิ่งที่คนอ่านได้ ทีมของคุณจึงตรวจดู อนุมัติ ย้อนกลับ และตรวจสอบย้อนหลังได้ นั่นแหละคือเหตุผลว่าทำไมวงจรการพัฒนานี้จึงกำกับดูแลได้

ค่าใช้จ่ายในการรัน Cortex เท่าไร

Cortex ทำงานอยู่ภายใต้การควบคุมค่าใช้จ่ายแบบเข้มชุดเดียวกับส่วนอื่นของระบบคุณ ซึ่งตกลงกันไว้ล่วงหน้า และการรันแบบให้เหตุผลเชิงลึกยังมีเพดานรายวันเพิ่มอีกชั้น ค่าจังหวะที่คุณเลือก ไม่ว่าจะผ่อนคลาย สมดุล หรือเข้มข้น คือคันโยกหลักว่ามันจะคิดมากแค่ไหน

วางระบบที่เดือนหน้าดีกว่าเดือนนี้

จองการปรึกษา แล้วเราจะทำแผนเวิร์กโฟลว์ที่มีมูลค่าสูงสุดของคุณ เสนอราคาแบบตายตัว และลงมือสร้างก็ต่อเมื่อคุณอนุมัติ โดยมี Cortex คอยพัฒนามันตั้งแต่สัปดาห์แรก

ปรึกษาโปรเจกต์