Treble z Islandii zebrało 18 mln dolarów na platformę symulacji głosu AI, testującą modele i sprzęt dla Amazon i Logitech.

Źródło zdjęcia: TechCrunch
Islandzki startup Treble, tworzący platformę do symulacji dźwięku i głosu, zebrał 18 milionów dolarów w rozszerzonej rundzie finansowania. Jak podaje TechCrunch, firma chce zająć centralne miejsce w błyskawicznie rozwijającej się branży voice AI, dostarczając infrastrukturę testową dla producentów modeli, sprzętu konsumenckiego i robotyki.
Głosowa sztuczna inteligencja od lat rozwija się na bazie nagrań i danych zbieranych z internetu. Treble proponuje inne podejście – wykorzystanie precyzyjnej symulacji fizycznej do generowania danych dźwiękowych. Jak wyjaśnił współzałożyciel Finnur Pind w rozmowie z TechCrunch, „audio AI to w zasadzie problem danych, i właśnie tu leżą największe możliwości rozwoju kolejnej generacji modeli i sprzętu. Do dziś prawie cała sztuczna inteligencja związana z dźwiękiem powstawała z nagrań i danych zeskrobanych z internetu. Wierzymy, że precyzyjna symulacja fizyczna może być alternatywnym sposobem tworzenia danych dla dźwięku”.
Platforma Treble służy nie tylko do generowania danych syntetycznych na potrzeby usuwania szumów, poprawy jakości mowy czy trenowania modeli, ale również do oceny modeli głosowych w różnorodnych warunkach – firma przekazuje te informacje twórcom laboratoriów AI jako feedback do dalszego rozwoju.
Drugim kluczowym obszarem działalności Treble jest projektowanie i testowanie sprzętu z perspektywy dźwięku. Firma współpracuje z producentami słuchawek i głośników, tworząc wirtualne prototypy, które pokazują, jak dane urządzenie może brzmieć jeszcze przed produkcją fizycznego egzemplarza. Platforma pozwala też sprawdzić, jak głośnik smart, w zależności od swojego położenia w pomieszczeniu, rozpoznaje wypowiadane komendy.
Ostatnio Treble rozszerzyło swoją działalność o symulacyjne testowanie okularów smart glasses i innych urządzeń AI, które coraz częściej wykorzystują głos jako główny interfejs interakcji. Pind zdradził, że szczególnie interesuje go nadchodząca generacja urządzeń, które mogą oferować funkcje „nadludzkiego słuchu”.
„Naprawdę jestem podekscytowany kolejną generacją takich urządzeń jak słuchawki i okulary smart, które mogą umożliwić [funkcję] nadludzkiego słuchu. To obszar, w którym można naprawdę lepiej słyszeć w trudnych warunkach akustycznych. Może jesteś w restauracji i chcesz słyszeć tylko osoby w zasięgu dwóch metrów, albo jesteś na seminarium i chcesz wyciszyć osoby wokół siebie” – powiedział Pind.
Treble deklaruje, że chce zwiększyć zaangażowanie w sektorze fizycznej AI, obejmującym robotykę, motoryzację i firmy produkujące drony, umożliwiając im rozwój funkcji opartych na dźwięku poprzez testowanie i symulację.
Francois Ruether, wiceprezes Paladin Capital Group, podkreślił w rozmowie z TechCrunch, że platforma Treble wyróżnia się zdolnością do symulowania różnych modeli i urządzeń, a jej znaczenie będzie rosło wraz z ekspansją firmy na nowe obszary. „Nasza teza brzmi: w miarę jak coraz więcej produktów zależy od rozumienia dźwięku, ta infrastruktura staje się coraz cenniejsza w obszarach voice AI, wearables, robotyki i fizycznej AI. Klienci zachowują własność swoich modeli, produktów i procesów rozwoju, jednocześnie korzystając ze wspólnej bazy w postaci natywnej infrastruktury akustycznej opartej na symulacji” – powiedział Ruether.
Inwestycja w Treble wpisuje się w szerszy trend napływu kapitału do sektora voice AI, obejmującego automatyzację obsługi klienta, notatniki spotkań i inteligentne okulary AI, gdzie głos staje się głównym sposobem interakcji z technologią.

CATL i Tencent inwestują w rundę Deepseek wartą do 15 mld dolarów. Chiński startup AI planuje debiut giełdowy na początku 2027 roku.

Microsoft i Hugging Face udostępnili ThinkingBox — benchmark oceniający agentów AI na podstawie stanu bazy danych, nie treści odpowiedzi.

Profesor MIT Cathy Wu wykorzystuje uczenie ze wzmocnieniem, by projektować lepsze systemy transportowe, po latach porażek osiągając 30-krotny wzrost efektywności treningu.