苏风拎着大包小包回到家,把东西往沙发上一扔,整个人直接瘫了进去。
他靠在沙发上歇了会儿,掏出手机翻了翻。
屏幕上有几条消息,最上面是赵明远发来的。
“苏总,注册材料我这边已经提交了,特拉华州那边效率很高,大概一周左右能下来。
办公室我看了几处,曼哈顿中城有个共享办公空间,环境不错,前期够用了。
另外招聘的事我也在推进,量化研究员和交易员各发了几份Offer,等你下次来美利坚的时候应该就能见着了。”
苏风回了一条:“辛苦了,资金这周内到位。”
赵明远秒回:“收到。”
苏风靠在沙发上,脑子里过了一遍接下来的时间线。
三月份中旬国家集训队报到,六月份IMO,中间还有几个月的时间。
除了这些杂七杂八的事,还有两件更大的事在等着他。
第一件事是2016年3月,AlphaGO对战李世石。
这场人机大战会把整个人工智能行业彻底点燃,资本、人才、关注度会像潮水一样涌进来。
当然这都是后话。
眼下最重要的,是先把TranSfOrmer的专利和论文搞定。
TranSfOrmer这东西,说复杂也复杂,说简单也简单。
核心就那几个东西,自注意力机制、多头注意力、位置编码、残差连接、层归一化。
难的不是原理,难的是在2016年这个时间节点,全世界没有人想到可以这么干。
现在的自然语言处理圈子,还是RNN和LSTM的天下。
序列模型嘛,一个字一个字地处理,就跟人说话似的,一个词接一个词往下顺。
这思路听着合理,但有个致命的毛病,太慢了。
你不能并行计算,后面的字得等前面的字算完才能开始。
而且长句子跑到后面,前面的信息就丢得差不多了,跟金鱼一样记忆力只有七秒。
但是自注意力机制不一样。
苏风现在要做的先申请专利,再写一个简单TranSfOrmer框架,以及最后发表论文。
先说专利,这是最关键的一点。
前世,谷歌2017年6月才把TranSfOrmer论文丢上arXiv。
他们的专利更是拖到2019年才在美国授权,而且写得窄,只保护原版编码器-解码器那一整套架构。
结果呢?
后来OpenAI搞GPT,只用解码器,直接绕过去了。
BERT只用编码器也绕过去了。
谷歌手握这么个核弹级别的专利,最后愣是没收上几个钱。
说白了,谷歌那帮研究员都是学术脑,先发论文再补专利,顺序搞反了。
论文一公开,很多保护点就被废掉了。
当然更重要的是,2017年这会儿,连谷歌自己都没意识到这玩意儿以后能变成万亿级大模型的地基,只当它是一个做机器翻译的新网络。
苏风不一样。
他知道这套架构将来会变成什么。
知道GPT、BERT、T5、LLaMA,所有这些叫得上名字的大模型,全他妈是TranSfOrmer的儿子孙子。
知道以后全世界每一家搞AI的公司,都离不开这个架构。
所以他得先把专利摁死。
以后,全世界只要是家AI公司就得给苏风上供,乖乖交钱。
当然苏风也不会收太多,要不然这些大公司也会急眼。
现在距离谷歌搞出TranSfOrmer还有一年多。
苏风还不及。
现在真正着急的是另一
(本章未完,请点击下一页继续阅读)