更多

    LLM

    商湯日日新有 4.0 新版本 辦公小浣熊分析數據一問即答

    商湯科技宣布「日日新 SenseNova」推出 4.0 新版本。官方指其知識更全面、推理能力更高,而且生成能力更強,同時支持跨模態互換。其中,該公司更基於新發布的商量大語言模型 Function call & Assistants API 開發了數據分析工具「辦公小浣熊」。

    商湯開源大型語言模型 InternLM2 一次可讀 30 萬中文字

    商湯科技( SenseTime )發布新一代大型語言模型 InternLM2 (書生·浦語 2.0),並繼續開源提供免費商用授權。 InternLM2 包含 7B 及 20B 兩種參數規格及基座、對話等版本,支援 20 萬 tokens 的上下文,能夠一次過接受及處理約 30 萬中文字。

    微軟 GitHub 開源 DeepSpeed Chat 簡化訓練類似 ChatGPT 千億級模型

    訓練 GPT 般大型語言模型的時間和資金成本極高,並非一般人和企業可負擔。微軟在 GitHub 開源 DeepSpeed Chat,將千億級大型模型的訓練成本和花費時間驟降 15 倍。以 1,750 億參數模型為例,在 Azure 上 64x NVIDIA A100 GPU 可在 20 小時完成訓練,花費約 5,120 美元。

    呼籲暫停 AI 開發卻大手購入 GPU Elon Musk 據報在 Twitter 成立部門發展 LLM

    早前 Elon Musk 聯同其他科技界名人,一同聯署呼籲發展 AI 的科企應暫停開發 6 個月,商議如何規範 AI 開發。不過這位前首富似乎另有一份劇本。據 Business Insider 報道,Elon Musk 在控制 Twitter 的 X Corp 成立了個 AI 開發專案部門,並且大手購入約 10,000 張 GPU,準備發展大型語言模型。

    乘 AIGC 熱潮再出擊 Facebook 發表 LLaMA 大語言模型

    Facebook 前年改名 Meta 發展元宇宙事業,投入大量資金還未見成果。但近日科技界轉軚,紛紛投資到人工智能生成內容 AIGC,Meta 也要展示他們也在那方面的能力,發表具備 650 億個參數的大語言模型 LLaMA。

    最新文章

    亞馬遜加碼共 40 億美元投資 Anthropic 重注 Claude 模型反攻 OpenAI

    開發大型語言模型的 AI 創業公司,證明生成式 AI 能力愈來愈強大,吸引更多科技公司的資金落注。亞馬遜一如承諾合共向 Anthropic 投資 40 億美元,支持開發 Claude 模型,加強兩者的合作關係。據報亞馬遜以估值 180 億美元入股 Anthropic,難怪在投資聲明強調只是小股東。