统计、机器学习与编程知识的原创博客

从阿里专家内部交流纪要看国内AI模型发展现状

本文主要描述了阿里眼中国内各家企业的大模型水平以及一些硬件算力的判断，同时结合部分其它信息整理。里面涉及到当前国内各大企业模型水平判断（如百度文心一言、华为盘古等）以及算力储备信息。

2023/04/24 22:44:34 阅读 2873

大模型/显卡/算力

MySQL调优之SQL语句优化

SQL语句优化

2016-04-05 11:08:23 阅读 2895

mysqlsql语句

一个基于Python的机器学习项目——各种Kaggle比赛的解决方案

2019/11/03 12:02:16 阅读 2905

Tensorflow和PyTorch是深度学习最流行的两个框架，二者都有坚定的支持者。一般认为由于Google的支持，TensorFlow的社区支持比较好，在工业应用广泛。但是尽管有keras加持，但易用性方面依然被认为不如PyTorch。而后者最早由Facebook人工智能团队开发。由于其易用性，被认为在科学研究中有广泛使用。那么，最近几年二者发展如何，是否实际还如之前的观点一样，这里AssemblyAI的一个作者做了一些对比。

2021/12/15 19:54:20 阅读 2916

pytorch/tensorflow

OpenAI第二代DALL·E发布，可以使用自然语言创造和编辑图片的模型

今天，时隔一年后，OpenAI发布了第二代的DALL·E模型。相比较第一代的模型，DALL·E 2，以4倍的分辨率生成更真实和准确的图像。

2022/04/06 23:25:38 阅读 2919

OpenAI/语言模型

pandas的一些使用技巧

pandas的使用

2019/03/27 21:16:54 阅读 2922

pandas/Python

基于java的网络爬虫框架(实现京东数据的爬取，并将插入数据库)

基于java的网络爬虫框架

2016-09-09 08:32:12 阅读 2923

java/网络爬虫

隐马尔科夫模型及其在NLP中的应用指南

隐马尔可夫模型（HMM）是一种统计模型，也用于机器学习。它可以用来描述取决于内部因素的可观察事件的演变，而这些因素是无法直接观察到的。这是一类概率图形模型，允许我们从一组观察到的变量中预测一串未知的变量。在这篇文章中，我们将详细讨论隐马尔可夫模型。我们将了解它可以使用的背景，我们也将讨论它的不同应用。我们还将讨论HMM在PoS标签中的使用和python的实现。文章中所涉及的主要内容如下。

2021/10/17 15:53:45 阅读 2927

HMM/机器学习/隐马尔科夫模型

计算机视觉领域的六大任务简介

计算机视觉与自然语言处理是近几年人工智能领域进步最快以及应用最为成熟的两个方向。计算机视觉里面任务涉及面广，有很多细分领域，本文将对计算机视觉领域中比较常见的六种任务进行总结并同时展示以下相关任务的一些成绩。

2021/11/21 21:29:20 阅读 2928

CV/计算机视觉

“GPT”的模型太多无法选择？让大模型帮你选择大模型！浙江大学发布HuggingGPT！

随着ChatGPT的火爆以及MetaAI开源了LLaMA，各家公司好像一夜之间都有了各种ChatGPT模型的研发实力。而针对不同任务和应用构建的LLM更是层出不穷。那么，如何选择合适的模型完成特定的任务，甚至是使用多个模型完成一个复杂的任务似乎仍然很困难。为此，浙江大学与微软亚洲研究院联合发布了一个大模型写作系统HuggingGPT，可以根据输入的任务帮我们选择合适的大模型解决！

2023/04/24 22:46:06 阅读 2937

HuggingGPT/LLM

eclispe常见错误及其解决方案

eclipse创建导入项目的时候经常会发生各种错误。本篇博客将讲述常见的错误及其解决方案。

2017/10/18 15:15:00 阅读 2939

eclipse/maven/编程

指标函数（Metrics Function）和损失函数（Loss Function）的区别是什么？

指标（metrics）和损失函数（loss function）在深度学习和机器学习里面非常常见，很多时候他们的公式都似乎是一样的，在编写程序的时候，二者的区别好像也不是很大。那为什么还会有这两种不同的概念出现呢？本文将简单介绍一下二者的区别和应用。

2022/07/05 19:14:02 阅读 2951

指标函数/损失函数/深度学习

网络爬虫中的模拟登陆获取数据（实例教学）

网络爬虫中的模拟登陆获取数据

2016-09-09 08:30:35 阅读 2960

java/模拟登陆/网络爬虫

国产开源中文大语言模型再添重磅玩家：清华大学NLP实验室发布开源可商用大语言模型CPM-Bee

5月27日，OpenBMB发布了一个最高有100亿参数规模的开源大语言模型CPM-BEE，OpenBMB是清华大学NLP实验室联合智源研究院成立的一个开源组织。该模型针对高质量中文数据集做了训练优化，支持中英文。根据官方的测试结果，其英文测试水平约等于LLaMA-13B，中文评测结果优秀。

2023/05/31 23:07:40 阅读 2965

CPM-Bee/中文大模型/国产大模型/大语言模型

计算广告入门基础

2018/09/19 23:09:36 阅读 2969

如何让开源大模型支持ChatGPT的Code Interpreter能力：基于LangChain的开源项目Code Interpreter API

ChatGPT的Code Interpreter插件让ChatGPT突破了大语言模型本身只能做文本处理的限制，使其可以通过生成并执行Python代码来实现强大的数据分析、图片生成、视频数据处理等操作，大大拓展了ChatGPT的实用范围和价值。在此前的文章中，我们已经分析了Code Interpreter插件的官方实现。而今天，LangChain的官方博客也推出了一种类似的开源方案，让开源模型也可以实现ChatGPT的Code Interperter插件。我们简要描述一下这个方案。

2023/07/18 00:32:47 阅读 2969

ChatGPT/CodeInterpreter

python中Scrapy的安装详细过程

2016-09-18 08:34:00 阅读 2975

python/网络爬虫

帮助你提升知识和技能的17个数据科学项目（都是可以免费获取的）

数据科学项目为我们提供了很好的机会提升我们的技能和知识。这篇博客提供了17个数据科学的项目，都是可以免费获取的项目，大家可以通过这些诶项目学习数据科学相关知识。

2017/11/07 16:33:37 阅读 2975

数据/数据学习/数据科学

大数据环境下的处理系统与数据分析

随着互联网的高速发展,人类进入了一个信息爆炸的时代，每个人的生活都充满了结构化和非结构化的数据。另外，随着以博客、社交网络、基于位置的服务LBS为代表的新型信息发布方式的不断涌现，以及云计算、物联网技术的兴起，数据正以前所未有的速度在不断地增长和积累，数据已经渗透到当今每一个行业和业务职能领域成为重要的产生因素，以数据为驱动的大数据时代已经不可避免地到来。本文主要围绕大数据特征、处理系统、以及大数据分析来阐述大数据环境下的数据分析在思想、流程、方法等方面的转变，以及围绕此主题而出现的相关关键技术与方法。

2018/09/29 16:31:27 阅读 2982

大数据

主题模型聚类匹配2018TKDE阅读笔记（Topic Models for Unsupervised Cluster Matching）

主题模型聚类匹配

2018/04/24 16:48:57 阅读 2994

主题模型聚类匹配

Java中自增操作i++与++i的区别

在Java中，自增是一种非常常见的操作，在自增中，有两种写法，一种是前缀自增（++i），一种是后缀自增（i++)。这里主要简单介绍两种自增的差别。

2019/09/07 15:17:28 阅读 3007

java/编程

《Effective Java 第三版》笔记之一创建静态工厂方法而不是使用构造器

本文是Effective Java第三版笔记的第一个之创建静态工厂方法而不是使用构造器

2018/09/14 23:06:36 阅读 3009

effectivejava/java

Eclipse安装SVN插件

使用SVN进行项目的版本管理是非常流行的操作，这篇博客将描述Eclipse安装SVN的方法。

2017/09/01 15:48:48 阅读 3023

eclipse/svn/编程