跳至内容
chenpaopao

chenpaopao

研究方向:语音识别 语音大模型 职业追求:AI改变世界,语音服务世界

  • 关于我:

人生很长,不必急着给自己答案。且行且思,在岁月里辨认内心,在取舍中靠近想成为的人。愿走过的路有所积累,写下的文字自有回响。

近期文章

  • Qwen-Audio-3.0-ASR:用 MoE、上下文与指令控制把 ASR 推向真实工业场景
  • dLLM-ASR:更快的扩散式大语言模型语音识别框架
  • RSI – [Recursive Self-Improvement]
  • Jev 深度解析:面向结构化决策的 System One 模型、原理、优势与工程实践

归档

分类

本网站用于记录人工智能相关论文学习记录,如有文章雷同,敬请见谅。

AI 文本生成图片工具汇总

1、https://openai.com/dall-e-2/

2、 https://imagen.research.google/

3、https://github.com/alembics/disco-diffusion

试玩: https://colab.research.google.com/github/alembics/disco-diffusion/blob/main/Disco_Diffusion.ipynb

4、https://github.com/jina-ai/discoart

5、https://replicate.com/nightmareai/disco-diffusion(API)

6、https://midjourney.gitbook.io/docs/(app)

7、https://www.midjourney.com/showcase/

7、https://blog.tiamat.ai/about/

相关文章:

  1. BLEU—机器翻译评价方法
  2. Deep Tutorials for PyTorch
  3. GAN系列之 CycleGAN
  4. Depthwise卷积与Pointwise卷积
发布于 2022年9月6日2022年9月6日作者 chenpaopao分类 人工智能、机器学习

发表评论 取消回复

您的电子邮箱地址不会被公开。 必填项已用*标注

文章导航

上一篇 上篇文章: python 爬取网站图片
下一篇 下篇文章: 医学分割评价指标
自豪地采用WordPress

京公网安备 11010802040332号

京ICP备2022026248号