韩国有家公司,最近在AI芯片圈搞出了动静。Rebellions这名字听着就带着股不服输的劲儿,2020年才成立,现在估值已经破10亿美元了。更关键的是,他们拉上了Arm和HBM内存的供应商,准备在推理芯片这条赛道上跟英伟达较较劲。

这事儿有意思就有意思在,人家压根没想着去跟英伟达抢训练芯片的生意。训练市场那边AMD、英伟达这些老炮儿把着道,初创公司想挤进去基本没戏。Rebellions掉头扎进了推理芯片领域,现在看来,这步棋走得挺妙。

从金融科技到AI芯片的转身

说起来,这家公司一开始的想法跟AI芯片八竿子打不着。2020年刚成立那会儿,团队瞄准的是高频交易用的加速芯片。首席执行官朴成铉在摩根士丹利待过,对金融科技那套门道门清。韩国科学技术院的本科加麻省理工学院双硕士,在英特尔、三星移动、SpaceX都干过活,履历亮得晃眼。

但市场这东西变化快,他们很快发现AI推理这块蛋糕更大。手机、汽车、云端服务,但凡AI应用要落地,都得靠推理芯片。于是船头一转,直接改了方向。首席技术官吴镇旭也不是省油的灯,首尔国立大学本科,KAIST高级学位,还在微软研究院搞过芯片架构。这配置,难怪能在短时间内折腾出名堂。

融资节奏也挺能说明问题。2020年和2022年两轮下来拿了6100万美元,去年B轮KTCorp领投,连沙特阿美的风投都进场了。最狠的是C轮,Arm直接领投,三星风投、和硕联合创投也跟着加码。这朋友圈一看就知道,人家是冲着高端市场去的。

CGRA架构到底有啥门道

技术路线上,Rebellions没走寻常路。传统GPU架构他们没碰,搞了个叫CGRA的东西——粗粒度可配置阵列。听着拗口,其实就是能根据AI推理任务自动切换计算模式的架构。

打个比方,就像变形金刚似的,遇到预填充阶段切一种形态,解码阶段又变另一种。比那些固定架构的芯片灵活多了,效率也高。他们的RebelSingle芯片用了三星4纳米工艺,64个神经网络核心,还配了HBM3E内存控制器。去年11月刚完成录制,现在正送样给客户测试呢。

还有个更狠的RebelQuad,把四个Single芯片用三星的中介层技术拼一块,FP16精度下能跑到1petaflops,功耗600瓦。跟英伟达的H200比,FP16和FP8性能高了3.4%,每瓦性能多20.7%。虽然跟最新的B200还有差距,但带宽和功耗需求更低,性价比摆在那儿。AMD的MI325X在每瓦性能上差不多水平,但Rebellions的内存带宽需求更小,散热要求没那么苛刻。

软件生态和市场打法

做芯片光硬件厉害不够,软件生态得跟上。Rebellions走的是开源路线,基于PyTorch搞了套技术栈,用了Triton推理引擎和vLLM开源库。他们自己开发的RBLNCCL集体通信库,能跟Ray分布式推理框架对接,跑在RedHat平台上。对于想自己搭AI推理系统的企业来说,这套工具链挺实用。

市场策略也看得出精明。他们主攻亚洲、非洲、中东这些地区的自主AI中心和新云平台。这些地方对美国出口管制比较敏感,Rebellions的芯片不受限制,这算是个不小的卖点。产品形态上目前只做PCI-Express卡,没上OAM插槽,不过客户有需求也能改,灵活性拉满。

未来计划也挺清晰,下一步要用三星2纳米工艺搞混合平台,性能还能往上提。不过挑战也不少,英伟达、AMD这些巨头不会坐着看,怎么保持技术优势、扩大市场份额,都是摆在眼前的问题。

结语

说实话,AI芯片这个市场变化太快了。今天的优势明天可能就不是优势了,现在行业都在盯着混合专家模型的发展,推理芯片的需求会不会变天还真不好说。Rebellions能在短短几年内成为韩国首家AI芯片独角兽,靠的是独特的CGRA架构、Arm和HBM供应商的支持,还有精准的市场定位。

但技术优势能不能转化成市场优势,最后还得看客户验证的结果。芯片这东西,再花哨的参数也得靠实际应用说话。不过话说回来,有新玩家挑战英伟达的地位总归是好事,市场竞争激烈了,技术进步才快,企业选择也多。这匹黑马能跑多远,咱们继续看着就是了。